📱 OfflineGPT - Локальный ИИ на устройстве Android и iOS
• New: Gemma 4 (LiteRT-LM) on-device
- Text, image, audio + web tool
🔗 https://codealp.ch/offline-gpt
⬇️ Android https://play.google.com/store/apps/details?id=com.offlinegpt.app
⬇️ iPhone: https://apps.apple.com/us/app/offline-ai-studio/id6761210483
#OfflineGPT #App #iOS #iPhone #Android #LocalAi #AiLocal
• New: Gemma 4 (LiteRT-LM) on-device
- Text, image, audio + web tool
🔍 Ключевые особенности:
✅ Полностью офлайн – Работает без Wi-Fi, мобильного интернета или сигнала. Идеально для путешествий, полетов или удаленной работы.
✅ Продвинутая локальная обработка – Эффективное форматирование запросов, потоковая передача токенов и умное контекстное окно для долгих, связных диалогов.
✅ Приватность по умолчанию – Ничего не отправляется и не хранится за пределами вашего устройства. Никакого отслеживания, никакого облака.
✅ Отличная контекстная память – OfflineGPT помнит имена, темы и связи на протяжении долгих чатов. Благодаря скользящим окнам, кэшированию и повторному использованию токенов, он дает логичные и связные ответы, недоступные другим офлайн ИИ.
✅ Оптимизирован для логики, а не скорости – Работает немного медленнее, чем другие ИИ-приложения, но обеспечивает большую ясность и глубину рассуждений.
✅ Pro-версия (единовременная покупка) – Открывает функции памяти, пользовательские запросы и более глубокую персонализацию.
✅ Легкий и эффективный – Занимает всего около 30 МБ и оптимизирован для работы на смартфонах Android среднего класса.
✅ Без рекламы. Совсем. – Чистое общение без отвлекающих факторов.
🔒 Без облака. Без задержек. Без лишнего. Просто умный офлайн ИИ.
#OfflineGPT #App #iOS #iPhone #Android #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Помощник по написанию текстов на основе ИИ с поддержкой структуры повествования + чат-бот + подсказки в виде изображений.
Вы — автор, и вы за рулем: ваша история — это ваша история, а ИИ— ваш творческий партнер (от помощника в мозговых штурмах до «литературного негра»), который поддерживает вашу точку зрения и выбор.
✨ Что умеет AugmentedQuill:
Создание историй на основе проектов (рассказ, роман, серия)
Многоглавная и многокнижная структура
Помощник по написанию текстов на основе искусственного интеллекта и чат (локальный API-ключ / конечные точки, совместимые с OpenAI)
Пользовательские шаблоны подсказок (редактор, писатель, чат-боты)
Справочник (персонажи, сцены, предыстория, предметы и т. д.)
Метаданные изображений + оптимизация генерации подсказок для изображений
Конфигурация на основе шаблонов JSON и переопределений в среде
Автоматическое сохранение артефактов проекта в data/projects
(Обсуждение)
#AugmentedQuill #Windows #Linux #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Хорошая статья для новичков: Топ локальных нейросетей ︎2026: подборка ИИ для запуска из дома https://habr.com/ru/companies/bothub/articles/1028906/
👍2
Представляем «говорящую» модель 13B, созданную в 1930 году!
talkie-1930-13b-base - Это языковая модель 13b, обученная на текстах на английском языке, написанных до 1931 года.
talkie-1930-13b-it - Модель была доработана с использованием нового набора данных, составленного на основе справочных материалов, изданных до 1931 года, в том числе руководств по этикету, написанию писем, энциклопедий и сборников стихов. Кроме того, для улучшения способности следовать инструкциям модель прошла обучение с подкреплением в режиме онлайн.
Также предоставляем «современную» базовую модель talkie-web-13b-base с той же архитектурой и вычислительными мощностями, что и у talkie-1930, но обученную на FineWeb, чтобы можно было проводить контролируемое сравнение современных и старых моделей.
Есть такой жанр, тренировка LLM на исторических данных. В этот раз 13B модель натренировали на 260 миллиардах токенов до 1930 года включительно, что делает это наибольшим подобным экспериментом. Дата выбрана неслучайно — всё что написано до 1930 года, в США является общественным достоянием.
Летом команда собирается выпустить модель на уровне GPT-3. Кстати к созданию этой модели приложил руку Alec Radford, который натренировал самую первую GPT.
Блогпост
Веса: https://huggingface.co/collections/talkie-lm/talkie-13b
Статья: https://habr.com/ru/companies/kodik/news/1028908/
(Обсуждение)
#Talkie #Talkie13b #talkie1930 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Терминальные команды, редактирование документов, управление браузером, управление знаниями — и все это в диалоговом режиме.
- голосовой ввод одним нажатием клавиши
- модели OSS, совместимые с любым провайдером, поддерживающим OpenAI
- крошечная кодовая база и полный контроль, никаких случайных ослаблений и газлайтинга
- строка запроса / текстовый редактор, для редактирования в котором не нужно 10 минут жать на клавиши со стрелками
(Обсуждение и пример с удалением приложения)
#OpenMNK #MacOS #AgentAi #AiAgent #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
TurboQuant — это новый революционный алгоритм квантования от Google Research, который применяет случайное вращение к многомерным векторам для устранения выбросов, обеспечивая экстремально низкое сжатие с практически нулевой потерей точности.
Несмотря на то, что эта технология сейчас набирает популярность благодаря уменьшению размера кэша LLM KV, разработчик хотел посмотреть, как она справляется с семантическим поиском на устройстве!
Он интегрировал ее в демонстрационную версию рекомендаций на стороне клиента (CineMatch), чтобы она работала исключительно на устройстве.
Вот как движок управляет архитектурой:
- 6-кратное сжатие: TurboQuant применяет случайное вращение и 3-битное скалярное квантование, чтобы уменьшить размерность 384-мерных векторных представлений Float32 с 1536 байт до 249 байт.
- Микропосылки: благодаря такой плотности весь векторизованный индекс фильмов мгновенно отправляется клиенту в виде небольшого JSON-файла размером ~12 КБ.
- Выполнение SIMD в WASM: мы даже не распаковываем данные во время выполнения. Браузер вычисляет скалярное произведение непосредственно для сжатых векторов с помощью SIMD в WebAssembly.
- Сопоставление без джиттера: косинусное сходство Top-K выполняется примерно за 13 мс, что значительно ниже порогового значения в 16 мс, обеспечивающего безупречную частоту кадров в 60 кадров в секунду без обращения к серверу.
Внедрение передовых алгоритмов квантования непосредственно в браузер открывает огромный потенциал для создания искусственного интеллекта с нулевыми вычислительными затратами, ориентированного на конфиденциальность.
(Обсуждение)
#TurboQuant #CineMatch #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Audio-Image/vids-Text -> Text
NVIDIA Nemotron 3 Nano Omni — это мультимодальная большая языковая модель, которая объединяет в себе функции понимания видео, аудио, изображений и текста для поддержки корпоративных рабочих процессов, связанных с вопросами и ответами, обобщением, расшифровкой и анализом документов. Она расширяет возможности семейства Nemotron Nano за счет интегрированных функций понимания видео и речи, графического пользовательского интерфейса (GUI), оптического распознавания символов (OCR) и расшифровки речи, что позволяет осуществлять комплексную обработку разнообразного корпоративного контента, такого как записи совещаний, материалы по управлению и оценке, обучающие видео и сложные бизнес-документы.
Эта модель была усовершенствована с использованием Qwen3-VL-30B-A3B-Instruct, Qwen3.5-122B-A10B, Qwen3.5-397B-A17B, Qwen2.5-VL-72B-Instruct и gpt-oss-120b.
Дата выпуска: 28.04.2026
Формат (ы) ввода:
- Видео: mp4, до 2 минут. Для видео с разрешением 1080p частота дискретизации составляет до 1 кадра в секунду / 128 кадров. Для видео с более низким разрешением, например 720p, может использоваться более высокая частота дискретизации, например 2 кадра в секунду / 256 кадров.
- Аудио: wav, mp3 (до 1 часа), частота дискретизации 8 кГц и выше
- Изображение: красный, зеленый, синий (RGB) (jpeg, png)
- Текст: строка
Original BF 16 https://huggingface.co/nvidia/Nemotron-3-Nano-Omni-30B-A3B-Reasoning-BF16
GGUF: https://huggingface.co/unsloth/NVIDIA-Nemotron-3-Nano-Omni-30B-A3B-Reasoning-GGUF
(Обсуждение)
#Nemotron #Omni #Nemotron3NanoOmni #OCR #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Reddit
From the LocalLLaMA community on Reddit: Nemotron-3-Nano-Omni-30B-A3B-Reasoning, New model?
Explore this post and more from the LocalLLaMA community
Ориентированны на агентное кодирование.
- Laguna M.1 - модель с 225 миллиардами параметров (из них 23 миллиарда активных)
- Laguna XS.2, с открытыми весами. 33 миллиарда параметров, из них 3 миллиарда активных.
Обе модели можно использовать бесплатно в течение ограниченного времени через API и на OpenRouter.
Чтобы было удобнее работать с этими моделями, запустили два предварительных продукта:
- пул, наш агент для написания кода на основе терминала, и
- Shimmer, облачный инструмент для разработки веб-приложений, API и клиентских интерфейсов с использованием наших моделей.
Пост:
(Обсуждение)
#Laguna #LagunaXS2 #LagunaM1 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Голосовой ввод на русском языке для Android. Работает прямо на телефоне — без интернета, без аккаунтов, без облака. Звук никуда не отправляется.
В основе: GigaAM v3 — модель распознавания речи от Сбера!
В RuStore https://www.rustore.ru/catalog/app/com.govorun.lite
Проект: https://github.com/amidexe/govorun-lite
#govorun #Говорун #Диктовка #STT #App #Android #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 QClaw — локальный ИИ-агент с интеграцией в мессенджеры от Tencent
QClaw — делай меньше. Живи больше.
🔗 https://qclawsg.qq.com
#QClaw #AgentAi #AiAgent #LocalAi #AiLocal
QClaw — делай меньше. Живи больше.
Tencent выпустили QClaw — персональный ИИ-агент, который работает локально на устройстве и управляется через WhatsApp, Telegram, Discord или Slack. Настройка занимает три минуты, бета-версия бесплатная.
Построен на базе OpenClaw. Можно отправить команду типа «забронируй столик на пятницу» или «найди счёт в папке загрузок» — агент выполнит задачу на устройстве и пришлёт уведомление по готовности.
Есть движок долгосрочной памяти: запоминает привычки, расписание и предпочтения. Чем больше используешь, тем точнее работает.
Для #macOS (Apple Silicon и Intel) #Windows
#QClaw #AgentAi #AiAgent #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🌎 Gemma4 — ИИ-ассистент, который работает прямо в браузере
Расширение для Chrome с локальной моделью Gemma4 умеет искать по истории браузера, делать саммари страниц, управлять вкладками и подсвечивать элементы на сайтах. Главное: все данные остаются на твоём устройстве — никуда не передаются.
Проект построен на базе Transformers.js и моделей Gemma 4 E2B и all-MiniLM-L6-v2.
💾 Проект с открытым кодом. Разработчик выложил подробный разбор того, как он это собрал — если интересны технические детали, стоит почитать.
🌎 Расширение: https://chromewebstore.google.com/detail/transformersjs-gemma-4-br/dhaknnnkcdkjhcclchmnfdhddoehoool
🔗 https://github.com/nico-martin/gemma4-browser-extension
🔗 https://huggingface.co/blog/transformersjs-chrome-extension
Статья: https://habr.com/ru/news/1029332/
#Gemma4 #Gemma4E2B #WebGPU #AgentAi #AiAgent #LocalAi #AiLocal
Расширение для Chrome с локальной моделью Gemma4 умеет искать по истории браузера, делать саммари страниц, управлять вкладками и подсвечивать элементы на сайтах. Главное: все данные остаются на твоём устройстве — никуда не передаются.
Проект построен на базе Transformers.js и моделей Gemma 4 E2B и all-MiniLM-L6-v2.
💾 Проект с открытым кодом. Разработчик выложил подробный разбор того, как он это собрал — если интересны технические детали, стоит почитать.
🌎 Расширение: https://chromewebstore.google.com/detail/transformersjs-gemma-4-br/dhaknnnkcdkjhcclchmnfdhddoehoool
Статья: https://habr.com/ru/news/1029332/
#Gemma4 #Gemma4E2B #WebGPU #AgentAi #AiAgent #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Это мультимодальная dense модель на 128B, с контекстом на 256k.
Mistral Medium 3.5 пришел на смену своим предшественникам Mistral Medium 3.1 и Magistral в Le Chat. Он также заменил Devstral 2 в агенте для написания кода Vibe. В частности, новая унифицированная модель обеспечивает более высокую производительность при выполнении задач по инструкциям, логическому мышлению и написанию кода по сравнению с предыдущими моделями.
Усилия по обработке данных настраиваются для каждого запроса, поэтому одна и та же модель может быстро ответить в чате или выполнить сложную агентскую задачу. Обучили кодировщик изображений с нуля, чтобы он мог работать с изображениями разных размеров и соотношений сторон.
Обходит прошлые модели Mistral, но не дотягивает до самых больших открытых моделей.
Mistral Medium 3.5 обладает следующими возможностями:
- Режим рассуждений: переключение между быстрым режимом мгновенного ответа и режимом рассуждений, повышающим производительность за счет вычислений во время тестирования по запросу.
- Видение: анализирует изображения и предоставляет информацию на основе визуального контента в дополнение к текстовому.
- Многоязычность: поддержка десятков языков, включая английский, французский, испанский, немецкий, итальянский, португальский, нидерландский, китайский, японский, корейский и арабский.
- Системные подсказки: строгое соблюдение и поддержка системных подсказок.
- Agentic: лучшие в своем классе агентские возможности с собственным вызовом функций и выводом в формате JSON.
- Большое контекстное окно: поддерживает контекстное окно размером 256 КБ.
Модель единственная в своей весовой категории, все конкуренты в разы больше, так что для локального деплоя может быть неплохим вариантом. Для того чтобы модель не вела себя совсем как черепашка, опубликовали ещё и голову для спекулятивного декодинга.
Цена за API этой модели $1.5/$7.5 за миллион токенов, так что смысла юзать в облаке особо нет.
Веса https://huggingface.co/mistralai/Mistral-Medium-3.5-128B
Блогпост
Квант: Q4_K_M весит: 78.4 GB для ориентира!
(Обсуждение и еще)
#Mistral #MistralMedium #MistralMedium35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
В релиз вошли небольшие языковые модели (small language models, SLM), а также модели Granite для распознавания речи, изображений, эмбеддингов и Guardian. Цель состоит в том, чтобы разработчики могли легко использовать эти модели в реальных системах искусственного интеллекта корпоративного уровня. Несмотря на свой размер, эти модели очень эффективны.
Granite 4.1 демонстрирует впечатляющие результаты в работе с языковыми моделями при вызове инструментов и выполнении инструкций, высочайшую точность транскрипции для речевых моделей Granite, возможности обнаружения вредоносных действий с помощью Granite Guardian и высокие показатели в рейтингах для Granite Vision при извлечении данных из таблиц и диаграмм.
Поддерживаемые языки: английский, немецкий, испанский, французский, японский, португальский, арабский, чешский, итальянский, корейский, нидерландский и китайский.
Коллекция: https://huggingface.co/ibm-granite/collections
Granite-4.1-3B https://huggingface.co/ibm-granite/granite-4.1-3b
Granite-4.1-8B https://huggingface.co/ibm-granite/granite-4.1-8b
Granite-4.1-30B https://huggingface.co/ibm-granite/granite-4.1-30b
Пост: https://research.ibm.com/blog/granite-4-1-ai-foundation-models
Общий рейтинг: https://artificialanalysis.ai
(Обсуждение и еще и еще)
#Granite #IBMGranite #IBMGranite41 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM