Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
📱 OfflineGPT - Локальный ИИ на устройстве Android и iOS

New: Gemma 4 (LiteRT-LM) on-device
- Text, image, audio + web tool
🔍 Ключевые особенности:
Полностью офлайн – Работает без Wi-Fi, мобильного интернета или сигнала. Идеально для путешествий, полетов или удаленной работы.
Продвинутая локальная обработка – Эффективное форматирование запросов, потоковая передача токенов и умное контекстное окно для долгих, связных диалогов.
Приватность по умолчанию – Ничего не отправляется и не хранится за пределами вашего устройства. Никакого отслеживания, никакого облака.
Отличная контекстная память – OfflineGPT помнит имена, темы и связи на протяжении долгих чатов. Благодаря скользящим окнам, кэшированию и повторному использованию токенов, он дает логичные и связные ответы, недоступные другим офлайн ИИ.
Оптимизирован для логики, а не скорости – Работает немного медленнее, чем другие ИИ-приложения, но обеспечивает большую ясность и глубину рассуждений.
Pro-версия (единовременная покупка) – Открывает функции памяти, пользовательские запросы и более глубокую персонализацию.
Легкий и эффективный – Занимает всего около 30 МБ и оптимизирован для работы на смартфонах Android среднего класса.
Без рекламы. Совсем. – Чистое общение без отвлекающих факторов.
🔒 Без облака. Без задержек. Без лишнего. Просто умный офлайн ИИ.

🔗 https://codealp.ch/offline-gpt
⬇️ Android https://play.google.com/store/apps/details?id=com.offlinegpt.app
⬇️ iPhone: https://apps.apple.com/us/app/offline-ai-studio/id6761210483
#OfflineGPT #App #iOS #iPhone #Android #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
📖 AugmentedQuill - Веб-интерфейс для создания прозы с помощью ИИ

Помощник по написанию текстов на основе ИИ с поддержкой структуры повествования + чат-бот + подсказки в виде изображений.
Вы — автор, и вы за рулем: ваша история — это ваша история, а ИИ— ваш творческий партнер (от помощника в мозговых штурмах до «литературного негра»), который поддерживает вашу точку зрения и выбор.

Что умеет AugmentedQuill:
Создание историй на основе проектов (рассказ, роман, серия)
Многоглавная и многокнижная структура
Помощник по написанию текстов на основе искусственного интеллекта и чат (локальный API-ключ / конечные точки, совместимые с OpenAI)
Пользовательские шаблоны подсказок (редактор, писатель, чат-боты)
Справочник (персонажи, сцены, предыстория, предметы и т. д.)
Метаданные изображений + оптимизация генерации подсказок для изображений
Конфигурация на основе шаблонов JSON и переопределений в среде
Автоматическое сохранение артефактов проекта в data/projects

🔗 https://github.com/StableLlamaAI/AugmentedQuill
⬇️ Скачать: Windows: AugmentedQuill.Setup.0.9.1.exe и Linux
(Обсуждение)
#AugmentedQuill #Windows #Linux #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Хорошая статья для новичков: Топ локальных нейросетей ︎2026: подборка ИИ для запуска из дома https://habr.com/ru/companies/bothub/articles/1028906/
👍2
Модель: Talkie — LLM знающая до 1930

Представляем «говорящую» модель 13B, созданную в 1930 году!
talkie-1930-13b-base - Это языковая модель 13b, обученная на текстах на английском языке, написанных до 1931 года.

talkie-1930-13b-it - Модель была доработана с использованием нового набора данных, составленного на основе справочных материалов, изданных до 1931 года, в том числе руководств по этикету, написанию писем, энциклопедий и сборников стихов. Кроме того, для улучшения способности следовать инструкциям модель прошла обучение с подкреплением в режиме онлайн.

Также предоставляем «современную» базовую модель talkie-web-13b-base с той же архитектурой и вычислительными мощностями, что и у talkie-1930, но обученную на FineWeb, чтобы можно было проводить контролируемое сравнение современных и старых моделей.

Есть такой жанр, тренировка LLM на исторических данных. В этот раз 13B модель натренировали на 260 миллиардах токенов до 1930 года включительно, что делает это наибольшим подобным экспериментом. Дата выбрана неслучайно — всё что написано до 1930 года, в США является общественным достоянием.

Летом команда собирается выпустить модель на уровне GPT-3. Кстати к созданию этой модели приложил руку Alec Radford, который натренировал самую первую GPT.

💬 Чат: Поговорить с прошлым (есть очередь, может быть проще скачать себе)
Блогпост
🔗 https://github.com/talkie-lm/talkie
Веса: https://huggingface.co/collections/talkie-lm/talkie-13b
Статья: https://habr.com/ru/companies/kodik/news/1028908/
(Обсуждение)
#Talkie #Talkie13b #talkie1930 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🤖 OpenMNK - Компьютерный агент. Вы говорите, он работает.

Терминальные команды, редактирование документов, управление браузером, управление знаниями — и все это в диалоговом режиме.
- голосовой ввод одним нажатием клавиши
- модели OSS, совместимые с любым провайдером, поддерживающим OpenAI
- крошечная кодовая база и полный контроль, никаких случайных ослаблений и газлайтинга
- строка запроса / текстовый редактор, для редактирования в котором не нужно 10 минут жать на клавиши со стрелками

🔗 https://openmnk.com
🔗 https://github.com/Emericen/openmnk
(Обсуждение и пример с удалением приложения)
#OpenMNK #MacOS #AgentAi #AiAgent #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📺 Интересное применение TurboQuant для поиска и рекомендации фильмов прямо на устройстве!

TurboQuant — это новый революционный алгоритм квантования от Google Research, который применяет случайное вращение к многомерным векторам для устранения выбросов, обеспечивая экстремально низкое сжатие с практически нулевой потерей точности.

Несмотря на то, что эта технология сейчас набирает популярность благодаря уменьшению размера кэша LLM KV, разработчик хотел посмотреть, как она справляется с семантическим поиском на устройстве!

Он интегрировал ее в демонстрационную версию рекомендаций на стороне клиента (CineMatch), чтобы она работала исключительно на устройстве.

Вот как движок управляет архитектурой:

- 6-кратное сжатие: TurboQuant применяет случайное вращение и 3-битное скалярное квантование, чтобы уменьшить размерность 384-мерных векторных представлений Float32 с 1536 байт до 249 байт.

- Микропосылки: благодаря такой плотности весь векторизованный индекс фильмов мгновенно отправляется клиенту в виде небольшого JSON-файла размером ~12 КБ.

- Выполнение SIMD в WASM: мы даже не распаковываем данные во время выполнения. Браузер вычисляет скалярное произведение непосредственно для сжатых векторов с помощью SIMD в WebAssembly.

- Сопоставление без джиттера: косинусное сходство Top-K выполняется примерно за 13 мс, что значительно ниже порогового значения в 16 мс, обеспечивающего безупречную частоту кадров в 60 кадров в секунду без обращения к серверу.

Внедрение передовых алгоритмов квантования непосредственно в браузер открывает огромный потенциал для создания искусственного интеллекта с нулевыми вычислительными затратами, ориентированного на конфиденциальность.

🔗 https://h3manth.com/ai/cinematch/
(Обсуждение)
#TurboQuant #CineMatch #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Nemotron-3-Nano-Omni-30B-A3B-Reasoning

Audio-Image/vids-Text -> Text
NVIDIA Nemotron 3 Nano Omni — это мультимодальная большая языковая модель, которая объединяет в себе функции понимания видео, аудио, изображений и текста для поддержки корпоративных рабочих процессов, связанных с вопросами и ответами, обобщением, расшифровкой и анализом документов. Она расширяет возможности семейства Nemotron Nano за счет интегрированных функций понимания видео и речи, графического пользовательского интерфейса (GUI), оптического распознавания символов (OCR) и расшифровки речи, что позволяет осуществлять комплексную обработку разнообразного корпоративного контента, такого как записи совещаний, материалы по управлению и оценке, обучающие видео и сложные бизнес-документы.
Эта модель была усовершенствована с использованием Qwen3-VL-30B-A3B-Instruct, Qwen3.5-122B-A10B, Qwen3.5-397B-A17B, Qwen2.5-VL-72B-Instruct и gpt-oss-120b.
Дата выпуска: 28.04.2026

Формат (ы) ввода:
- Видео: mp4, до 2 минут. Для видео с разрешением 1080p частота дискретизации составляет до 1 кадра в секунду / 128 кадров. Для видео с более низким разрешением, например 720p, может использоваться более высокая частота дискретизации, например 2 кадра в секунду / 256 кадров.
- Аудио: wav, mp3 (до 1 часа), частота дискретизации 8 кГц и выше
- Изображение: красный, зеленый, синий (RGB) (jpeg, png)
- Текст: строка

Original BF 16 https://huggingface.co/nvidia/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF16
GGUF: https://huggingface.co/unsloth/NVIDIA-Nemotron-3-Nano-Omni-30B-A3B-Reasoning-GGUF
(Обсуждение)
#Nemotron #Omni #Nemotron3NanoOmni #OCR #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модели: Laguna XS.2 и Laguna M.1

Ориентированны на агентное кодирование.
- Laguna M.1 - модель с 225 миллиардами параметров (из них 23 миллиарда активных)
- Laguna XS.2, с открытыми весами. 33 миллиарда параметров, из них 3 миллиарда активных.
Обе модели можно использовать бесплатно в течение ограниченного времени через API и на OpenRouter.

Чтобы было удобнее работать с этими моделями, запустили два предварительных продукта:
- пул, наш агент для написания кода на основе терминала, и
- Shimmer, облачный инструмент для разработки веб-приложений, API и клиентских интерфейсов с использованием наших моделей.

Пост:🔗 https://poolside.ai/blog/introducing-laguna-xs2-m1
🔗 https://huggingface.co/poolside/Laguna-XS.2
(Обсуждение)
#Laguna #LagunaXS2 #LagunaM1 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🎙 Говорун - Голосовой ввод на русском языке в любом приложении — нейросеть прямо в телефоне, без интернета!

Голосовой ввод на русском языке для Android. Работает прямо на телефоне — без интернета, без аккаунтов, без облака. Звук никуда не отправляется.
В основе: GigaAM v3 — модель распознавания речи от Сбера!

В RuStore https://www.rustore.ru/catalog/app/com.govorun.lite
⬇️ Говорун 1.0.8 govorun-lite-1.0.8.apk
Проект: https://github.com/amidexe/govorun-lite
#govorun #Говорун #Диктовка #STT #App #Android #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 QClaw — локальный ИИ-агент с интеграцией в мессенджеры от Tencent

QClaw — делай меньше. Живи больше.
Tencent выпустили QClaw — персональный ИИ-агент, который работает локально на устройстве и управляется через WhatsApp, Telegram, Discord или Slack. Настройка занимает три минуты, бета-версия бесплатная.

Построен на базе OpenClaw. Можно отправить команду типа «забронируй столик на пятницу» или «найди счёт в папке загрузок» — агент выполнит задачу на устройстве и пришлёт уведомление по готовности.

Есть движок долгосрочной памяти: запоминает привычки, расписание и предпочтения. Чем больше используешь, тем точнее работает.
Для #macOS (Apple Silicon и Intel) #Windows

🔗 https://qclawsg.qq.com
#QClaw #AgentAi #AiAgent #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🌎 Gemma4 — ИИ-ассистент, который работает прямо в браузере

Расширение для Chrome с локальной моделью Gemma4 умеет искать по истории браузера, делать саммари страниц, управлять вкладками и подсвечивать элементы на сайтах. Главное: все данные остаются на твоём устройстве — никуда не передаются.
Проект построен на базе Transformers.js и моделей Gemma 4 E2B и all-MiniLM-L6-v2.

💾 Проект с открытым кодом. Разработчик выложил подробный разбор того, как он это собрал — если интересны технические детали, стоит почитать.

🌎 Расширение: https://chromewebstore.google.com/detail/transformersjs-gemma-4-br/dhaknnnkcdkjhcclchmnfdhddoehoool
🔗 https://github.com/nico-martin/gemma4-browser-extension
🔗 https://huggingface.co/blog/transformersjs-chrome-extension
Статья: https://habr.com/ru/news/1029332/
#Gemma4 #Gemma4E2B #WebGPU #AgentAi #AiAgent #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Модель: Mistral Medium 3.5 128B

Это мультимодальная dense модель на 128B, с контекстом на 256k.
Mistral Medium 3.5 пришел на смену своим предшественникам Mistral Medium 3.1 и Magistral в Le Chat. Он также заменил Devstral 2 в агенте для написания кода Vibe. В частности, новая унифицированная модель обеспечивает более высокую производительность при выполнении задач по инструкциям, логическому мышлению и написанию кода по сравнению с предыдущими моделями.

Усилия по обработке данных настраиваются для каждого запроса, поэтому одна и та же модель может быстро ответить в чате или выполнить сложную агентскую задачу. Обучили кодировщик изображений с нуля, чтобы он мог работать с изображениями разных размеров и соотношений сторон.
Обходит прошлые модели Mistral, но не дотягивает до самых больших открытых моделей.

Mistral Medium 3.5 обладает следующими возможностями:
- Режим рассуждений: переключение между быстрым режимом мгновенного ответа и режимом рассуждений, повышающим производительность за счет вычислений во время тестирования по запросу.
- Видение: анализирует изображения и предоставляет информацию на основе визуального контента в дополнение к текстовому.
- Многоязычность: поддержка десятков языков, включая английский, французский, испанский, немецкий, итальянский, португальский, нидерландский, китайский, японский, корейский и арабский.
- Системные подсказки: строгое соблюдение и поддержка системных подсказок.
- Agentic: лучшие в своем классе агентские возможности с собственным вызовом функций и выводом в формате JSON.
- Большое контекстное окно: поддерживает контекстное окно размером 256 КБ.

Модель единственная в своей весовой категории, все конкуренты в разы больше, так что для локального деплоя может быть неплохим вариантом. Для того чтобы модель не вела себя совсем как черепашка, опубликовали ещё и голову для спекулятивного декодинга.

Цена за API этой модели $1.5/$7.5 за миллион токенов, так что смысла юзать в облаке особо нет.

Веса https://huggingface.co/mistralai/Mistral-Medium-3.5-128B
Блогпост
Квант: Q4_K_M весит: 78.4 GB для ориентира!
(Обсуждение и еще)
#Mistral #MistralMedium #MistralMedium35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Семейство моделей IBM Granite 4.1 (3B/8B/30B)

В релиз вошли небольшие языковые модели (small language models, SLM), а также модели Granite для распознавания речи, изображений, эмбеддингов и Guardian. Цель состоит в том, чтобы разработчики могли легко использовать эти модели в реальных системах искусственного интеллекта корпоративного уровня. Несмотря на свой размер, эти модели очень эффективны.

Granite 4.1 демонстрирует впечатляющие результаты в работе с языковыми моделями при вызове инструментов и выполнении инструкций, высочайшую точность транскрипции для речевых моделей Granite, возможности обнаружения вредоносных действий с помощью Granite Guardian и высокие показатели в рейтингах для Granite Vision при извлечении данных из таблиц и диаграмм.

Поддерживаемые языки: английский, немецкий, испанский, французский, японский, португальский, арабский, чешский, итальянский, корейский, нидерландский и китайский.

Коллекция: https://huggingface.co/ibm-granite/collections
Granite-4.1-3B https://huggingface.co/ibm-granite/granite-4.1-3b
Granite-4.1-8B https://huggingface.co/ibm-granite/granite-4.1-8b
Granite-4.1-30B https://huggingface.co/ibm-granite/granite-4.1-30b
Пост: https://research.ibm.com/blog/granite-4-1-ai-foundation-models
Общий рейтинг: https://artificialanalysis.ai
(Обсуждение и еще и еще)
#Granite #IBMGranite #IBMGranite41 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM