Голосовой ввод на русском языке для Android. Работает прямо на телефоне — без интернета, без аккаунтов, без облака. Звук никуда не отправляется.
В основе: GigaAM v3 — модель распознавания речи от Сбера!
В RuStore https://www.rustore.ru/catalog/app/com.govorun.lite
Проект: https://github.com/amidexe/govorun-lite
#govorun #Говорун #Диктовка #STT #App #Android #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 QClaw — локальный ИИ-агент с интеграцией в мессенджеры от Tencent
QClaw — делай меньше. Живи больше.
🔗 https://qclawsg.qq.com
#QClaw #AgentAi #AiAgent #LocalAi #AiLocal
QClaw — делай меньше. Живи больше.
Tencent выпустили QClaw — персональный ИИ-агент, который работает локально на устройстве и управляется через WhatsApp, Telegram, Discord или Slack. Настройка занимает три минуты, бета-версия бесплатная.
Построен на базе OpenClaw. Можно отправить команду типа «забронируй столик на пятницу» или «найди счёт в папке загрузок» — агент выполнит задачу на устройстве и пришлёт уведомление по готовности.
Есть движок долгосрочной памяти: запоминает привычки, расписание и предпочтения. Чем больше используешь, тем точнее работает.
Для #macOS (Apple Silicon и Intel) #Windows
#QClaw #AgentAi #AiAgent #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🌎 Gemma4 — ИИ-ассистент, который работает прямо в браузере
Расширение для Chrome с локальной моделью Gemma4 умеет искать по истории браузера, делать саммари страниц, управлять вкладками и подсвечивать элементы на сайтах. Главное: все данные остаются на твоём устройстве — никуда не передаются.
Проект построен на базе Transformers.js и моделей Gemma 4 E2B и all-MiniLM-L6-v2.
💾 Проект с открытым кодом. Разработчик выложил подробный разбор того, как он это собрал — если интересны технические детали, стоит почитать.
🌎 Расширение: https://chromewebstore.google.com/detail/transformersjs-gemma-4-br/dhaknnnkcdkjhcclchmnfdhddoehoool
🔗 https://github.com/nico-martin/gemma4-browser-extension
🔗 https://huggingface.co/blog/transformersjs-chrome-extension
Статья: https://habr.com/ru/news/1029332/
#Gemma4 #Gemma4E2B #WebGPU #AgentAi #AiAgent #LocalAi #AiLocal
Расширение для Chrome с локальной моделью Gemma4 умеет искать по истории браузера, делать саммари страниц, управлять вкладками и подсвечивать элементы на сайтах. Главное: все данные остаются на твоём устройстве — никуда не передаются.
Проект построен на базе Transformers.js и моделей Gemma 4 E2B и all-MiniLM-L6-v2.
💾 Проект с открытым кодом. Разработчик выложил подробный разбор того, как он это собрал — если интересны технические детали, стоит почитать.
🌎 Расширение: https://chromewebstore.google.com/detail/transformersjs-gemma-4-br/dhaknnnkcdkjhcclchmnfdhddoehoool
Статья: https://habr.com/ru/news/1029332/
#Gemma4 #Gemma4E2B #WebGPU #AgentAi #AiAgent #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Это мультимодальная dense модель на 128B, с контекстом на 256k.
Mistral Medium 3.5 пришел на смену своим предшественникам Mistral Medium 3.1 и Magistral в Le Chat. Он также заменил Devstral 2 в агенте для написания кода Vibe. В частности, новая унифицированная модель обеспечивает более высокую производительность при выполнении задач по инструкциям, логическому мышлению и написанию кода по сравнению с предыдущими моделями.
Усилия по обработке данных настраиваются для каждого запроса, поэтому одна и та же модель может быстро ответить в чате или выполнить сложную агентскую задачу. Обучили кодировщик изображений с нуля, чтобы он мог работать с изображениями разных размеров и соотношений сторон.
Обходит прошлые модели Mistral, но не дотягивает до самых больших открытых моделей.
Mistral Medium 3.5 обладает следующими возможностями:
- Режим рассуждений: переключение между быстрым режимом мгновенного ответа и режимом рассуждений, повышающим производительность за счет вычислений во время тестирования по запросу.
- Видение: анализирует изображения и предоставляет информацию на основе визуального контента в дополнение к текстовому.
- Многоязычность: поддержка десятков языков, включая английский, французский, испанский, немецкий, итальянский, португальский, нидерландский, китайский, японский, корейский и арабский.
- Системные подсказки: строгое соблюдение и поддержка системных подсказок.
- Agentic: лучшие в своем классе агентские возможности с собственным вызовом функций и выводом в формате JSON.
- Большое контекстное окно: поддерживает контекстное окно размером 256 КБ.
Модель единственная в своей весовой категории, все конкуренты в разы больше, так что для локального деплоя может быть неплохим вариантом. Для того чтобы модель не вела себя совсем как черепашка, опубликовали ещё и голову для спекулятивного декодинга.
Цена за API этой модели $1.5/$7.5 за миллион токенов, так что смысла юзать в облаке особо нет.
Веса https://huggingface.co/mistralai/Mistral-Medium-3.5-128B
Блогпост
Квант: Q4_K_M весит: 78.4 GB для ориентира!
(Обсуждение и еще)
#Mistral #MistralMedium #MistralMedium35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
В релиз вошли небольшие языковые модели (small language models, SLM), а также модели Granite для распознавания речи, изображений, эмбеддингов и Guardian. Цель состоит в том, чтобы разработчики могли легко использовать эти модели в реальных системах искусственного интеллекта корпоративного уровня. Несмотря на свой размер, эти модели очень эффективны.
Granite 4.1 демонстрирует впечатляющие результаты в работе с языковыми моделями при вызове инструментов и выполнении инструкций, высочайшую точность транскрипции для речевых моделей Granite, возможности обнаружения вредоносных действий с помощью Granite Guardian и высокие показатели в рейтингах для Granite Vision при извлечении данных из таблиц и диаграмм.
Поддерживаемые языки: английский, немецкий, испанский, французский, японский, португальский, арабский, чешский, итальянский, корейский, нидерландский и китайский.
Коллекция: https://huggingface.co/ibm-granite/collections
Granite-4.1-3B https://huggingface.co/ibm-granite/granite-4.1-3b
Granite-4.1-8B https://huggingface.co/ibm-granite/granite-4.1-8b
Granite-4.1-30B https://huggingface.co/ibm-granite/granite-4.1-30b
Пост: https://research.ibm.com/blog/granite-4-1-ai-foundation-models
Общий рейтинг: https://artificialanalysis.ai
(Обсуждение и еще и еще)
#Granite #IBMGranite #IBMGranite41 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Chirp работает локально, генерирует естественную речь и сохраняет аудиофайлы на вашем компьютере. Поддерживает Kokoro и Qwen3-TTS
Chirp упрощает процесс: введите текст, сгенерируйте его локально, а затем воспроизведите или экспортируйте результат, не выходя из приложения.
Основные функции:
- Преобразование текста в речь в автономном режиме после загрузки модели
- Поддержка Kokoro и Qwen3-TTS
- Клонирование голоса с эталонным WAV
- 12 поддерживаемых языков
- Предварительный просмотр аудио после генерации
- Поддержка macOS, Windows и Linux
- Поддержка GPU для Nvidia, AMD и Intel
- CLI для генерации WAV-файлов
- Локальный HTTP API с документами Swagger
- Готовый агент / инструкции по навыкам и каталог голосовых настроек
Идея состоит в том, чтобы создать что-то вроде локального настольного приложения в стиле ElevenLabs, но полностью автономного и с открытым исходным кодом.
👉 И еще с таким же названием: https://www.chirptype.com - только уже для #Диктовка #STT
(Обсуждение)
#Chirp #chirptype #Kokoro #Qwen3TTS #TTS #macOS #Windows #Linux #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Пост про: «Qwen3.5-21B-Claude-4.6-Opus-Heretic-Uncensored»: что на самом деле внутри файнтюна с громким именем https://habr.com/ru/articles/1032324/
Brain_Box_1.0.apk
31.6 MB
📱 BrainBox — личный ИИ-ассистент.
1. Локальный запуск GGUF-языковых моделей без интернета. Пользователь загружает модель на устройство и общается с ней через чат-интерфейс. Поддерживается гибридный RAG (BM25 + Embedding Reranking), vision (изображения в чат через mtmd), загрузка документов в контекст. Всё работает офлайн, данные не покидают устройство.
2. Поддерживает работу через внешние LLM API вместо локальной модели. Все провайдеры используют OpenAI-совместимый формат /v1/chat/completions.
Поддержка «персонажей» — можно настроить ассистентов под конкретные задачи.
Vision только с локальными моделями.
RAG и документы работают и локально и с API.
Источник: 4PDA
#BrainBox #Android #LocalAi #AiLocal
1. Локальный запуск GGUF-языковых моделей без интернета. Пользователь загружает модель на устройство и общается с ней через чат-интерфейс. Поддерживается гибридный RAG (BM25 + Embedding Reranking), vision (изображения в чат через mtmd), загрузка документов в контекст. Всё работает офлайн, данные не покидают устройство.
2. Поддерживает работу через внешние LLM API вместо локальной модели. Все провайдеры используют OpenAI-совместимый формат /v1/chat/completions.
Поддержка «персонажей» — можно настроить ассистентов под конкретные задачи.
Vision только с локальными моделями.
RAG и документы работают и локально и с API.
Источник: 4PDA
#BrainBox #Android #LocalAi #AiLocal
👍2
Tencent выпустили в опенсорс короля ИИ-переводчиков — модель на базе AngelSlim превосходит по точности Google Translate и работает локально на смартфоне.
• Поддерживает 33 языка, включая русский и английский.
• Переводит тексты даже без интернета.
• Запускается локально на устройстве.
• Весит всего 440 МБ благодаря тулкиту AngelSlim для сжатия модели без потери качества. (Hy-MT1.5-1.8B-2bit (574MB) и Hy-MT1.5-1.8B-1.25bit (440MB))
• На #Android можно поставить APK-файл демки в один клик.
📣 GGUF:https://huggingface.co/AngelSlim/Hy-MT1.5-1.8B-1.25bit-GGUF
📱 Android Demo: https://huggingface.co/AngelSlim/Hy-MT1.5-1.8B-2bit-GGUF/resolve/main/Hy-MT-demo.apk?download=true
#AngelSlim #HyMT #Translate #Перевод #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Он умеет делать каверы, генерить треки по референсу, настраивать голос и лирику и даже бустить качество трека.
🎵 Идеальная альтернатива Suno с открытым исходным кодом — профессиональный пользовательский интерфейс для создания музыки с помощью искусственного интеллекта ACE-Step 1.5. Бесплатно, локально, без ограничений. Хватит платить за Suno!
В готовой композиции можно изменить отдельные элементы и сгенерить для нее визуал.
Весит всего ~4 ГБ, работает локально, без лимитов и подписок!
Еще было:
https://t.me/Ai2Local/369
https://t.me/Ai2Local/560
https://t.me/Ai2Local/611
https://t.me/Ai2Local/621
#ACEStep15 #ACEStep #Suno #AiMusic #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Jarvis — ассистент, который работает полностью на твоём компьютере. Запоминает историю разговоров, группирует их по темам и распознаёт голос.
💬 Умеет искать информацию, генерировать тексты и интегрируется с сотнями сервисов — от умного дома до рабочих инструментов. Все данные остаются локально, интернет не требуется.
100% приватный голосовой помощник с ИИ, который живет на вашем компьютере (работает в автономном режиме). Общайтесь с ним так, как будто Джарвис — третий человек в комнате, и получайте ответы в диалоговом режиме. Он все запоминает, знает ваше местоположение и время, может проверять веб-страницы, управлять Chrome, отслеживать питание и многое другое с поддержкой неограниченного количества MCP / инструментов без потери контекста.
Для #macOS #Windows #Linux
#Jarvis #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Новая модель ZAYA1-8B появилась несколько дней назад и сразу привлекла внимание. При 760 миллионах активных параметров (8.4B всего) она показывает результаты, сопоставимые с моделями в десятки раз крупнее: AIME 2026 — 89,1%, HMMT — 71,6%. Для сравнения: обходит Mistral-Small-4 со 119 миллиардами параметров.
(Превосходит гораздо более крупные модели с открытым исходным кодом по некоторым показателям в области математики и кодирования.)
Это первая крупная модель-смесь экспертов, обученная целиком на видеокартах AMD. Архитектура сжимает кэш ключ-значение в 8 раз, использует маршрутизатор на многослойном перцептроне и обучаемое масштабирование остатков. Рассуждения встроены на этапе предобучения — модель агрегирует варианты через Markovian RSA.
Доступна под лицензией Apache 2.0, веса выложены на HuggingFace, есть бесплатный сервер на Zyphra Cloud.
Отчет: https://arxiv.org/abs/2605.05365
#ZAYA18B #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1