Нативное приложение macOS для работы с ChromaDB без терминала: установка и обновление движка, подключение к локальной базе данных или серверу, просмотр и редактирование ее содержимого, а также выполнение встраиваний через локальную LM Studio.
Статья: https://habr.com/ru/articles/1074938/
#ChromaDBManager #ChromaDB #RAG #MacOS #MCP #LMStudio #Hermes #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
В Audio.cpp теперь 62 семейства моделей и 85+ вариантов моделей. И их количество продолжает расти!
Самое заметное изменение для пользователей — это новый интерфейс Arena. Теперь вместо того, чтобы тестировать одну модель за раз, вы можете использовать один общий входной файл и поставить в очередь несколько локальных моделей или вариантов GGUF, а затем сравнить сгенерированные результаты. Это удобно, если нужно выбрать одну из моделей, не тратя время на написание множества скриптов.
Добавлено в версии 0.7:
- TTS / Озвучивание: FireRedTTS3, MagpieTTS, PersonaPlex, F5-TTS / Хабиби, Генератор голоса МОССА, Доттс Правка
- ASR / понимание речи: FireRedAudio, IBM Granite Speech 5.0 TurboCTC, функция принудительного выравнивания MMS
- Преобразование голоса: MeanVC2
- Генерация музыки / аудио: MiniMax Music 3, MiDashengLM-Gen, ControlFoley (экспериментальный), варианты ACE-Step 1.5 XL
- Аудиоинструменты: AudioSR
(Работает на: Windows CPU, Windows Vulkan, Windows CUDA 12.4, Windows CUDA 13.3, Ubuntu x64 CPU, Ubuntu x64 Vulkan, macOS arm64 Metal, macOS x64 CPU.)
(Обсуждение и Подробнее)
#audiocpp #audio #AiAudio #Supertonic #TTS #MOSSTTS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 BigMoeOnEdge - Запускайте модели MoE, размер которых превышает объем вашей оперативной памяти. MoE размером с Frontier на телефоне с 12 ГБ памяти, только на процессоре, без потерь, на стандартной версии llama.cpp
🔗 https://github.com/Helldez/BigMoeOnEdge
⬇️ Скачать: https://github.com/Helldez/BigMoeOnEdge/releases/latest
(Обсуждение) - Qwen 3.6 35B Q4, 7–8 токенов в секунду на телефоне Android с 12 ГБ памяти (и рекорд — 397B на мобильном устройстве).
- Qwen3.8-Flash-Next: 125B параметров, ~82 ГБ на диске, на телефоне с 12 ГБ памяти. 2,03 ток/с !
#BigMoeOnEdge #Android #Windows #MacOS #Linux #llamacpp #LocalAi #AiLocal
Модель Mixture-of-Experts состоит из множества небольших «экспертов», и в каждом сгенерированном токене используются лишь некоторые из них. BigMoeOnEdge делает это буквально: он держит под рукой небольшую часть модели, которая всегда нужна, и считывает только тех экспертов, которые запрашивает каждый токен, прямо из флэш-памяти в момент, когда они нужны. Остальная часть модели остается на диске. Именно это позволяет модели, размер которой в несколько раз превышает объем оперативной памяти, генерировать текст на обычном телефоне без потерь: результат идентичен байтам при работе с той же моделью в оперативной памяти.
Он создан на основе публичного API llama.cpp, а не как форк. Все форматы квантования, токенизаторы и шаблоны чатов, которые поддерживает llama.cpp, работают «из коробки», потому что эту часть выполняет сам llama.cpp: MXFP4 и Q4_K_M проходят через один и тот же код. Поддержка новой архитектуры MoE — это одна строка в реестре, а обновление llama.cpp после выхода новой версии — это обычное обновление подмодуля.
DeepSeek V4 Flash 0731 — самая большая модель, которую удалось запустить таким образом. Она генерируется на телефоне с 12 ГБ оперативной памяти, с потоковой передачей данных с флеш-накопителя в виде трех файлов фрагментов, поставляемых Hugging Face, без этапа слияния и без использования ПК.
(На широком видео: Слева направо: gpt-oss-120b (~60 ГБ), Qwen3-30B-A3B (18,5 ГБ), Gemma-4-26B-A4B (17 ГБ), записано в демонстрационном приложении на телефоне с 12 ГБ памяти, в реальном времени, без ускорения.)
(Обсуждение) - Qwen 3.6 35B Q4, 7–8 токенов в секунду на телефоне Android с 12 ГБ памяти (и рекорд — 397B на мобильном устройстве).
- Qwen3.8-Flash-Next: 125B параметров, ~82 ГБ на диске, на телефоне с 12 ГБ памяти. 2,03 ток/с !
#BigMoeOnEdge #Android #Windows #MacOS #Linux #llamacpp #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
💬 ToshLLM — локальный ИИ именно для Intel Mac + AMD GPU.
Запускайте современные открытые модели на уже имеющемся у вас Mac с процессором Intel. Собственное ускорение Metal, без облачных технологий и платы за токены.
(Последние версии Jan.ai и Atomic.chat перестали поддерживать Mac Intel и теперь они только для Apple Silicon (M1-M6), но MSTY еще работает на Intel!)
В разделе "Аудио" есть #Транскрибация моделью #Whisper и есть разделы "Изображение" и "Видео"!
🔗 https://toshllm.com
🔗 https://github.com/engeldlgado/toshllm
⬇️ Скачать: https://github.com/engeldlgado/toshllm/releases/latest
#ToshLLM #MacIntel #Intel #IntelMac #AMD #MacOS #LocalAi #AiLocal #СтавитьВсем
Запускайте современные открытые модели на уже имеющемся у вас Mac с процессором Intel. Собственное ускорение Metal, без облачных технологий и платы за токены.
(Последние версии Jan.ai и Atomic.chat перестали поддерживать Mac Intel и теперь они только для Apple Silicon (M1-M6), но MSTY еще работает на Intel!)
Большинство локальных инструментов для больших языковых моделей в macOS ориентированы только на Apple Silicon. Компьютеры Intel Mac с дискретными графическими процессорами AMD, в том числе сборки Hackintosh, отстают: стандартные движки выдают поврежденный результат на дискретных графических процессорах AMD и считывают веса моделей через PCIe с гораздо меньшей скоростью, чем возможно.
✔️ ToshLLM решает эту проблему. Он объединяет llama.cpp встроенные исправления для AMD и оборачивает их в усовершенствованное родное приложение SwiftUI — так что карта, подобная RX 6700 XT, превращается из непригодной в действительно быструю.
👉 Первый запуск (Gatekeeper): релизы еще не заверены Apple Developer ID, поэтому macOS блокирует первое открытие. Перейдите в «Системные настройки» → «Конфиденциальность и безопасность» и нажмите «Открыть в любом случае», либо выполните команду:
xattr -dr com.apple.quarantine /Applications/ToshLLM.app
В разделе "Аудио" есть #Транскрибация моделью #Whisper и есть разделы "Изображение" и "Видео"!
#ToshLLM #MacIntel #Intel #IntelMac #AMD #MacOS #LocalAi #AiLocal #СтавитьВсем
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
LifeOS — это персональный органайзер, с которым вы в основном и общаетесь. Вы произносите что-то вслух, Whisper (или любая другая модель преобразования речи в текст) локально транскрибирует это, локальная языковая модель читает текст, и он становится задачей, событием, записью в дневнике, расходом, взвешиванием или приемом пищи. Модель предлагает варианты, но никогда их не записывает. Приложение проверяет каждый вариант, и в каждой карточке приводятся слова, из которых она была создана. Преимущество в том, что ничего не покидает пределы вашего устройства.
(Обсуждение)
#LifeOS #ASR #AiVoice #Диктовка #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
В отличие от традиционных инструментов ИИ, которые зависят от удаленных облачных API, Agro переносит весь механизм логического вывода, планирование контекста, выполнение инструментов агента и рендеринг AIGC непосредственно на ваше физическое устройство. Благодаря нативной среде выполнения Google LiteRT-LM на C++ и бэкендам аппаратного ускорения (Apple Metal, WebGPU Dawn, DirectX, Vulkan, OpenCL), Agro гарантирует 100% конфиденциальность данных и сверхплавный и быстрый процесс генерации.
🌟 Основные преимущества:
🔒 100 % локальное и автономное использование: все диалоги, исторические записи и логические выводы хранятся исключительно на вашем устройстве — никакие данные не отправляются в облако.
⚡️ Собственное аппаратное ускорение: низкоуровневое управление памятью и оптимизация графического процессора, адаптированная для графических процессоров настольных компьютеров, Apple Neural Engine / Metal и мобильных графических процессоров.
🧩 Автономный цикл работы агента и экосистема инструментов: встроенный структурированный цикл вызова инструментов, поддерживающий локальное выполнение JavaScript, веб-поиск в реальном времени и анализ содержимого URL.
🎨 Мультимодальная структурированная генерация: помимо обычного текста, позволяет синтезировать и отображать на устройстве в режиме реального времени векторную графику SVG, 8-битный чиптюн и анимацию Lottie.
#Android Agro-1.2.2.apk
#macOS Arm64 Agro-1.2.2-macos-aarch64.dmg - если карантин, то в Терминале:
sudo xattr -d com.apple.quarantine /Applications/Agro.app#Windows X86_64 Agro-1.2.2-windows-x86_64.exe
(Обсуждение)
P,S, Очень простое для начинающих! Выбор Gemma4-4B или любая LiteRT на диске! Помнит историю чата как "знания"!
#Agro #Linux #iOS #iPhone #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
благодаря llama.cpp — очень большие модели MoE на 64-гигабайтном Mac
Форк llama.cpp для запуска моделей MoE намного большего размера, чем доступная оперативная память с потоковой передачей их экспертов с SSD по запросу, оптимизированный специально для Apple Silicon.
Целевое оборудование: M1 Max, 64 ГБ, ~400 ГБ/с. Все, кроме экспертов, остается в оперативной памяти; эксперты хранятся в ограниченном кэше, который заполняется по запросу и с помощью одноуровневой предварительной выборки. Таким образом, полезный размер контрольной точки определяется пропускной способностью диска, а не оперативной памятью — модель 284B размером 107 ГиБ работает на компьютере с 64 ГБ оперативной памяти со скоростью, которая действительно пригодна для агентного кодирования.
(Обсуждение)
#llamacpp #Qwen38FlashNext #MacOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 BayesChat - Privacy-first, AI Chat Workspace, BYOK, MCP tool & Chat Presets
🔗 https://bayeschat.xyz
⬇️ https://apps.apple.com/us/app/bayeschat-ai-chat-byok-mcp/id6777948055
Для #MacOS скоро!
#BayesChat #iOS #iPhone #iPad #BYOK #MCP #API
(Конфиденциальность, AI-чат, BYOK, инструмент MCP и предустановки чата!)
Поддержка нескольких провайдеров: Подключение к любой модели через API, совместимые с OpenAI / Anthropic, включая локальные модели
Предустановки чата: Сохраните приглашение, модель, параметр и инструмент в качестве предустановок для повторного использования. Переключайтесь между ними одним касанием, чтобы повысить эффективность рабочего процесса
Поддержка протокола MCP: интеграция MCP для вызова сторонних инструментов
Точная настройка параметров: формируйте каждый ответ с помощью точных и гибких элементов управления
Прямая трансляция: рендеринг анимации пишущей машинки в реальном времени с формулами LaTeX и разметкой
Настраиваемые темы и цвета: выберите тему и цвета по своему вкусу
Для #MacOS скоро!
Вы переходите от одной задачи к другой, и для каждой из них нужна своя подсказка, своя настройка. Особенно на телефоне. В итоге вам приходится снова и снова все перенастраивать.
Знакомая ситуация? Это утомительно!
Поэтому автор решил просто все исправить.
BayesChat позволяет сохранить подсказку, модель, параметры и инструменты в виде одного пресета. Чтобы переключиться между задачами, достаточно одного нажатия.
Больше не нужно каждый раз начинать с нуля.
И, конечно же, он полностью поддерживает локальные языковые модели (Пост)
#BayesChat #iOS #iPhone #iPad #BYOK #MCP #API
Please open Telegram to view this post
VIEW IN TELEGRAM
WeMM-Embedding — это семейство универсальных мультимодальных моделей встраивания, разработанных командой WeChat Vision. Они обеспечивают унифицированное представление текста, изображений, видео, визуальных документов и смешанных мультимодальных входных данных, демонстрируя высочайшую производительность в различных тестах, охватывающих разные задачи и области.
WeMM-Embedding-9B — это универсальная мультимодальная модель встраивания, созданная на основе Qwen3.5. Она принимает текст, изображения, видео, визуальные документы и смешанные мультимодальные входные данные и возвращает 4096-мерное нормализованное по L2 встраивание.
Аудиовход не поддерживается.
(Обсуждение)
#Embedding #WeMMEmbedding #Qwen35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
Везде (во всех вкладках) настроек надо выбрать локальную модель и скачать ее!
Для #Транскрибация очень быстрая #Parakeet
Для исправления, чата и ... есть большой выбор локальных моделей! (Смотри скриншоты)
#MacOS чит М: OpenWhispr-1.9.2-arm64.dmg
Чип Intel: OpenWhispr-1.9.2.dmg
#Windows OpenWhispr-Setup-1.9.2.exe
#OpenWhispr #Whisper #Linux #Диктовка #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM