Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
📱 BigMoeOnEdge - Запускайте модели MoE, размер которых превышает объем вашей оперативной памяти. MoE размером с Frontier на телефоне с 12 ГБ памяти, только на процессоре, без потерь, на стандартной версии llama.cpp
Модель Mixture-of-Experts состоит из множества небольших «экспертов», и в каждом сгенерированном токене используются лишь некоторые из них. BigMoeOnEdge делает это буквально: он держит под рукой небольшую часть модели, которая всегда нужна, и считывает только тех экспертов, которые запрашивает каждый токен, прямо из флэш-памяти в момент, когда они нужны. Остальная часть модели остается на диске. Именно это позволяет модели, размер которой в несколько раз превышает объем оперативной памяти, генерировать текст на обычном телефоне без потерь: результат идентичен байтам при работе с той же моделью в оперативной памяти.
Он создан на основе публичного API llama.cpp, а не как форк. Все форматы квантования, токенизаторы и шаблоны чатов, которые поддерживает llama.cpp, работают «из коробки», потому что эту часть выполняет сам llama.cpp: MXFP4 и Q4_K_M проходят через один и тот же код. Поддержка новой архитектуры MoE — это одна строка в реестре, а обновление llama.cpp после выхода новой версии — это обычное обновление подмодуля.
DeepSeek V4 Flash 0731 — самая большая модель, которую удалось запустить таким образом. Она генерируется на телефоне с 12 ГБ оперативной памяти, с потоковой передачей данных с флеш-накопителя в виде трех файлов фрагментов, поставляемых Hugging Face, без этапа слияния и без использования ПК.
(На широком видео: Слева направо: gpt-oss-120b (~60 ГБ), Qwen3-30B-A3B (18,5 ГБ), Gemma-4-26B-A4B (17 ГБ), записано в демонстрационном приложении на телефоне с 12 ГБ памяти, в реальном времени, без ускорения.)

🔗 https://github.com/Helldez/BigMoeOnEdge
⬇️Скачать: https://github.com/Helldez/BigMoeOnEdge/releases/latest
(Обсуждение) - Qwen 3.6 35B Q4, 7–8 токенов в секунду на телефоне Android с 12 ГБ памяти (и рекорд — 397B на мобильном устройстве).
- Qwen3.8-Flash-Next: 125B параметров, ~82 ГБ на диске, на телефоне с 12 ГБ памяти. 2,03 ток/с !
#BigMoeOnEdge #Android #Windows #MacOS #Linux #llamacpp #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1
💬 ToshLLMлокальный ИИ именно для Intel Mac + AMD GPU.

Запускайте современные открытые модели на уже имеющемся у вас Mac с процессором Intel. Собственное ускорение Metal, без облачных технологий и платы за токены.
(Последние версии Jan.ai и Atomic.chat перестали поддерживать Mac Intel и теперь они только для Apple Silicon (M1-M6), но MSTY еще работает на Intel!)
Большинство локальных инструментов для больших языковых моделей в macOS ориентированы только на Apple Silicon. Компьютеры Intel Mac с дискретными графическими процессорами AMD, в том числе сборки Hackintosh, отстают: стандартные движки выдают поврежденный результат на дискретных графических процессорах AMD и считывают веса моделей через PCIe с гораздо меньшей скоростью, чем возможно.

✔️ ToshLLM решает эту проблему. Он объединяет llama.cpp встроенные исправления для AMD и оборачивает их в усовершенствованное родное приложение SwiftUI — так что карта, подобная RX 6700 XT, превращается из непригодной в действительно быструю.

👉 Первый запуск (Gatekeeper): релизы еще не заверены Apple Developer ID, поэтому macOS блокирует первое открытие. Перейдите в «Системные настройки» → «Конфиденциальность и безопасность» и нажмите «Открыть в любом случае», либо выполните команду:
xattr -dr com.apple.quarantine /Applications/ToshLLM.app

В разделе "Аудио" есть #Транскрибация моделью #Whisper и есть разделы "Изображение" и "Видео"!
🔗 https://toshllm.com
🔗 https://github.com/engeldlgado/toshllm
⬇️Скачать: https://github.com/engeldlgado/toshllm/releases/latest
#ToshLLM #MacIntel #Intel #IntelMac #AMD #MacOS #LocalAi #AiLocal #СтавитьВсем
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
🎙 LifeOS - Персональный органайзер, с которым вы разговариваете. Скажите: «Поход в спортзал в понедельник, среду и пятницу в три часа, и напомни мне завтра позвонить стоматологу», — и языковая модель, работающая на вашем собственном оборудовании, превратит…
🤖 Вышла версия 0.3.0 LifeOS! Полностью работоспособна на 12 ГБ видеопамяти.

LifeOS — это персональный органайзер, с которым вы в основном и общаетесь. Вы произносите что-то вслух, Whisper (или любая другая модель преобразования речи в текст) локально транскрибирует это, локальная языковая модель читает текст, и он становится задачей, событием, записью в дневнике, расходом, взвешиванием или приемом пищи. Модель предлагает варианты, но никогда их не записывает. Приложение проверяет каждый вариант, и в каждой карточке приводятся слова, из которых она была создана. Преимущество в том, что ничего не покидает пределы вашего устройства.

⬇️Скачать LifeOS v0.3.0 для Windows (от 30.08.2026)
(Обсуждение)
#LifeOS #ASR #AiVoice #Диктовка #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤖 Agro - — это мультиплатформенное (Android, iOS, macOS, Windows, Linux) локальное приложение с большой языковой моделью (LLM) и автономным чат-агентом на базе устройства.

В отличие от традиционных инструментов ИИ, которые зависят от удаленных облачных API, Agro переносит весь механизм логического вывода, планирование контекста, выполнение инструментов агента и рендеринг AIGC непосредственно на ваше физическое устройство. Благодаря нативной среде выполнения Google LiteRT-LM на C++ и бэкендам аппаратного ускорения (Apple Metal, WebGPU Dawn, DirectX, Vulkan, OpenCL), Agro гарантирует 100% конфиденциальность данных и сверхплавный и быстрый процесс генерации.

🌟 Основные преимущества:
🔒 100 % локальное и автономное использование: все диалоги, исторические записи и логические выводы хранятся исключительно на вашем устройстве — никакие данные не отправляются в облако.
⚡️ Собственное аппаратное ускорение: низкоуровневое управление памятью и оптимизация графического процессора, адаптированная для графических процессоров настольных компьютеров, Apple Neural Engine / Metal и мобильных графических процессоров.
🧩 Автономный цикл работы агента и экосистема инструментов: встроенный структурированный цикл вызова инструментов, поддерживающий локальное выполнение JavaScript, веб-поиск в реальном времени и анализ содержимого URL.
🎨 Мультимодальная структурированная генерация: помимо обычного текста, позволяет синтезировать и отображать на устройстве в режиме реального времени векторную графику SVG, 8-битный чиптюн и анимацию Lottie.

🔗 https://github.com/Onion99/Agro
Скачать https://github.com/Onion99/Agro/releases
#Android Agro-1.2.2.apk
#macOS Arm64 Agro-1.2.2-macos-aarch64.dmg - если карантин, то в Терминале: sudo xattr -d com.apple.quarantine /Applications/Agro.app
#Windows X86_64 Agro-1.2.2-windows-x86_64.exe
(Обсуждение)
P,S, Очень простое для начинающих! Выбор Gemma4-4B или любая LiteRT на диске! Помнит историю чата как "знания"!
#Agro #Linux #iOS #iPhone #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1
⚡️ Qwen3.8-Flash-Next оптимизирован для компьютеров Mac
благодаря llama.cpp — очень большие модели MoE на 64-гигабайтном Mac
Форк llama.cpp для запуска моделей MoE намного большего размера, чем доступная оперативная память с потоковой передачей их экспертов с SSD по запросу, оптимизированный специально для Apple Silicon.
Целевое оборудованиеM1 Max, 64 ГБ, ~400 ГБ/с. Все, кроме экспертов, остается в оперативной памяти; эксперты хранятся в ограниченном кэше, который заполняется по запросу и с помощью одноуровневой предварительной выборки. Таким образом, полезный размер контрольной точки определяется пропускной способностью диска, а не оперативной памятью — модель 284B размером 107 ГиБ работает на компьютере с 64 ГБ оперативной памяти со скоростью, которая действительно пригодна для агентного кодирования.

🔗 https://github.com/mihailescu2m/llama.cpp
(Обсуждение)
#llamacpp #Qwen38FlashNext #MacOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 BayesChat - Privacy-first, AI Chat Workspace, BYOK, MCP tool & Chat Presets

(Конфиденциальность, AI-чат, BYOK, инструмент MCP и предустановки чата!)
Поддержка нескольких провайдеров: Подключение к любой модели через API, совместимые с OpenAI / Anthropic, включая локальные модели
Предустановки чата: Сохраните приглашение, модель, параметр и инструмент в качестве предустановок для повторного использования. Переключайтесь между ними одним касанием, чтобы повысить эффективность рабочего процесса
Поддержка протокола MCP: интеграция MCP для вызова сторонних инструментов
Точная настройка параметров: формируйте каждый ответ с помощью точных и гибких элементов управления
Прямая трансляция: рендеринг анимации пишущей машинки в реальном времени с формулами LaTeX и разметкой
Настраиваемые темы и цвета: выберите тему и цвета по своему вкусу

🔗 https://bayeschat.xyz
⬇️ https://apps.apple.com/us/app/bayeschat-ai-chat-byok-mcp/id6777948055
Для #MacOS скоро!
Вы переходите от одной задачи к другой, и для каждой из них нужна своя подсказка, своя настройка. Особенно на телефоне. В итоге вам приходится снова и снова все перенастраивать.
Знакомая ситуация? Это утомительно!
Поэтому автор решил просто все исправить.
BayesChat позволяет сохранить подсказку, модель, параметры и инструменты в виде одного пресета. Чтобы переключиться между задачами, достаточно одного нажатия.
Больше не нужно каждый раз начинать с нуля.
И, конечно же, он полностью поддерживает локальные языковые модели (Пост)

#BayesChat #iOS #iPhone #iPad #BYOK #MCP #API
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: WeMM-Embedding 9B/4B/2B от Tencent

WeMM-Embedding — это семейство универсальных мультимодальных моделей встраивания, разработанных командой WeChat Vision. Они обеспечивают унифицированное представление текста, изображений, видео, визуальных документов и смешанных мультимодальных входных данных, демонстрируя высочайшую производительность в различных тестах, охватывающих разные задачи и области.

WeMM-Embedding-9B — это универсальная мультимодальная модель встраивания, созданная на основе Qwen3.5. Она принимает текст, изображения, видео, визуальные документы и смешанные мультимодальные входные данные и возвращает 4096-мерное нормализованное по L2 встраивание.
Аудиовход не поддерживается.

🔗 https://huggingface.co/tencent/WeMM-Embedding-9B
🔗 https://huggingface.co/tencent/WeMM-Embedding-4B
🔗 https://huggingface.co/tencent/WeMM-Embedding-2B
🔗 https://github.com/Tencent/WeMM-Embedding
🔗 https://github.com/Tencent/WeMM-Embedding/blob/main/assets/WeMM_Embedding_tech_report.pdf
(Обсуждение)
#Embedding #WeMMEmbedding #Qwen35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
🎙 OpenWhispr - Ваш голос в 3 раза быстрее, чем клавиатура. Голосовой помощник с открытым исходным кодом. Конфиденциальность по умолчанию. Пишите быстрее в любом приложении. Бесплатно, если локально. Подписка — если хочешь облачную обработку. Можно подключить…
⬇️ Обновление: OpenWhispr 1.9.2 (29.08.2026)
Везде (во всех вкладках) настроек надо выбрать локальную модель и скачать ее!
Для #Транскрибация очень быстрая #Parakeet
Для исправления, чата и ... есть большой выбор локальных моделей! (Смотри скриншоты)
🔗 https://github.com/OpenWhispr/openwhispr/releases/tag/v1.9.2
#MacOS чит М: OpenWhispr-1.9.2-arm64.dmg
Чип Intel: OpenWhispr-1.9.2.dmg
#Windows OpenWhispr-Setup-1.9.2.exe
🎞 Подробно о установке и настройке: https://youtu.be/6TXOs0_ejhQ или на RuTube.
#OpenWhispr #Whisper #Linux #Диктовка #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
💬 Vellium - Настольное приложение для общения с ИИ и ролевыми играми. Характеристики: - Чат с ветвлением, редактированием/удалением, перегенерации и многопользовательскими автоповоротами. - Инструменты для ролевой игры: блоки подсказок, примечания автора…
🔈 Vellium v1.1.0 — голос в реальном времени, локальные STT / TTS и многое другое!

Vellium — это настольное приложение с открытым исходным кодом, ориентированное на локальное использование, для общения с ИИ, ролевых игр и написания больших текстов.
Последние обновления в основном направлены на упрощение использования локальных голосовых и модельных настроек.
Режим реального времени теперь поддерживает микрофонный ввод, локальное распознавание речи или распознавание речи, совместимое с Whisper, потоковую передачу текста в речь, вложения, контекст экрана и обычные инструменты чата — и все это в одном голосовом интерфейсе.
Локальную голосовую модель можно установить и настроить прямо в приложении. Whisper Large v3 Turbo Q5_0 доступен для распознавания, а TeraTTSv2 обеспечивает воспроизведение на английском и русском языках в режиме реального времени. Процесс преобразования текста в речь остается активным между ответами, что позволяет избежать полной перезагрузки модели при каждом ответе.
Также была упрощена настройка llama.cpp. Vellium может обнаруживать существующие llama-server установки, модели GGUF и запущенные локальные конечные точки, а затем настраивать их как управляемый бэкенд.
Было внесено множество мелких исправлений: более надежная потоковая передача TTS, более безопасное извлечение архива во время выполнения, улучшенное обнаружение конечных точек, улучшенная обработка тайм-аутов, поддержка системных сертификатов и упрощенная навигация по настройкам.
Чаты, персонажи, книги знаний, писательские проекты и коллекции знаний хранятся локально в SQLite.
Vellium работает на macOS, Windows и Linux и поддерживает API, совместимые с OpenAI, OpenRouter, LM Studio, Ollama и KoboldCpp.

🔗 https://github.com/tg-prplx/vellium
(Обсуждение)
Ранее было: https://t.me/Ai2Local/230
#Vellium #MacOS #Windows #Linux #ChatRP #RP #Whisper #TTS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🎨 Private Diffusion - Local Art - Изображение Локально

Оно использует как нейронный движок, так и графический процессор (а также ядра NAX на M5 и A19 Pro) для логического вывода.
Приложение пока в разработке, но уже поддерживает около 10 моделей, включая Krea 2 Turbo и Kroma, Z-Image-Turbo.
Модели меньшего размера также работают на iPhone и iPad.
Ссылка на TestFlight для тех, кто хочет попробовать.
🔗 https://testflight.apple.com/join/DQwfQsEg
(Из обсуждения)
#PrivateDiffusion #LocalArt #AiArt #Zimage #Flux2 #Krea2 #ERNIEimage #iPhone #iPad #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM