Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
📥 GitHub превратился в магазин опенсорс приложений.

Ставить, искать и обновлять проги теперь можно в пару кликов:
🟡 В привычной для всех ленте показаны тренды и популярные репозитории;
🟡 Обновления для уже установленных приложений подтягиваются сами;
🟡 Перед установкой проект можно изучить;
🟡 Работает на Android, Windows, macOS и Linux.

➡️ Ставим: https://github-store.org
🔗 https://github.com/OpenHub-Store/GitHub-Store
Версия 1.6.2 тут.
#GitHub #GitHubStore #APP #Android #Windows #macOS #Linux
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Mistral Small 4

Mistral выпустила универсальную ИИ-модель Mistral Small 4
🔗 https://mistral.ai/news/mistral-small-4
Ключевые архитектурные особенности:
- Смешанная модель экспертов (Mixture of Experts, MoE): 128 экспертов, по 4 активных на каждый токен, что обеспечивает эффективное масштабирование и специализацию.

- 119 миллиардов параметров, по 6 миллиардов активных параметров на каждый токен (8 миллиардов, включая встраиваемые и выходные слои).

- Окно контекста 256 тысяч, поддерживающее взаимодействие с длинными текстами и анализ документов.

- Настраиваемая сложность логического вывода: переключение между быстрыми ответами с низкой задержкой и глубокими выводами, требующими больших вычислительных ресурсов.

- Встроенная мультимодальность: поддерживает ввод как текста, так и изображений, что открывает возможности для самых разных сценариев использования — от анализа документов до визуального анализа.

Модель: https://huggingface.co/collections/mistralai/mistral-small-4
(Статья)
=======
💡 Версия без цензуры: Mistral-Small-4-119B-2603-heretic
🔗 https://huggingface.co/darkc0de/Mistral-Small-4-119B-2603-heretic
(Обсуждение)
#MistralSmall4 #heretic #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 Inferencer - Private AI Studio

Inferencer позволяет запускать, размещать и глубоко контролировать последние модели SOTA AI (OSS, DeepSeek, Qwen, Kimi, GLM, MiniMax и другие) с вашего собственного компьютера или телефона. Никакие данные не отправляются в облако для обработки - сохраняя вашу полную конфиденциальность.
Усовершенствованные элементы управления выводом дают вам полный контроль над их точностью и результатами.
Модели:
Начните с раздела моделей, где вы можете скачать последние модели непосредственно из Hugging Face.
Сервер:
Используйте функцию сервера для подключения к Inferencer, запущенному на вашем Mac, для запуска еще более крупных моделей по сети.
Чаты:
Выберите модель для взаимодействия в верхней строке меню и напишите подсказку для начала. В любой момент вы можете переключаться между моделями и продолжать чат, чтобы увидеть, что еще они могут обнаружить. Вы также можете выборочно удалять прошлые сообщения, чтобы модель была сфокусированной и меньше рассеянной.
Элементы управления чатом:
Контролируйте параметры вывода, включая системную подсказку для управления тем, как модель реагирует, температуру для контроля точности ответа и многое другое.
Энтропия и проверка токенов:
Выберите инспекторов, чтобы заглянуть во внутреннюю работу каждого выводимого слова и увидеть уровни достоверности модели и альтернативные варианты. Управление откликом:
Используйте функцию ответа управления для управления выводом, генерируемым моделью. Например, пропуск преамбулы или направление модели на вывод в структурированном html. Настройки включают родительский контроль, политику автоматического удаления и многое другое.
Конфиденциальность:
Для максимальной конфиденциальности вся обработка ИИ происходит в автономном режиме и на вашем устройстве по умолчанию. Базовые подписки (бесплатные): Большинство функций разблокированы бесплатно, включая неограниченное количество чатов и подключение к вашему Mac. Профессиональный:
Обновление для более продвинутой проверки токенов и контроля отклика.

⬇️ https://apps.apple.com/cv/app/inferencer-private-ai-studio/id6749861443
🔗 https://apps.apple.com/us/app/inferencer-private-ai-studio/id6749861443
#Inferencer #MacOS #iPhone #iPad #App #SoftAI #AiSoft #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Обновленные плагины для LM Studio уже доступны.
Веб-исследование Plug'n'Play, полностью локально!

- DuckDuckGo Переработанная версия https://lmstudio.ai/vadimfedenko/duck-duck-go-reworked
Переработанный плагин DuckDuckGo.

- visit-website-reworked https://lmstudio.ai/vadimfedenko/visit-website-reworked
Переработанный плагин с функцией прокси, который позволяет языковым моделям «посещать» веб-сайты, предоставляя им ссылки, URL-адреса изображений и текстовое содержимое любой веб-страницы.
Автору нравится использовать его с Qwen 3.5 27B в качестве замены Perplexity!
Кстати, в LM Studio с Qwen постоянно происходил сбой при вызовах инструментов. Автор исправил это, создав собственный шаблон Jinja Prompt. С тех пор все работает идеально. Даже версия 9b отлично подходит для исследований. Он выложил шаблон Jinja на Pastebin, если кому-то понадобится...

(Обсуждение)
#LMStudio #DuckDuckGo #LocalAi #AiLocal
👍2
🎙 Whisper -Распознавание речи на основе Whisper

Распознавание речи происходит полностью в автономном режиме.
При первом запуске необходимо загрузить модели Whisper с Hugging Face. Это единственное использование разрешения на доступ в Интернет.

В приложении Whisper также может переводить все поддерживаемые языки на английский.

Как получить максимальную отдачу от Whisper:
- Удерживайте кнопку нажатой во время разговора
- Сделайте небольшой перерыв перед началом работы
- Говорите четко, громко и в умеренном темпе
- Обратите внимание на ограничение в 30 секунд на запись

🔗 https://f-droid.org/de/packages/org.woheller69.whisper/
⬇️ Версия 3.6 (36) Добавлен 01.02.2026 г.
(Обсуждение)
===========
🎙 Еще: Phone Whisper: голосовая диктовка для Android с локальным Whisper (без облачных технологий)
Это плавающая кнопка для голосового ввода, которая работает поверх любого приложения. Нажмите, чтобы записать, нажмите еще раз, чтобы расшифровать, — текст будет вставлен в выделенное поле.
Также поддерживается дополнительная постобработка (удаление знаков препинания, форматирование, командный режим для использования в терминале).

🔗 https://github.com/kafkasl/phone-whisper
⬇️ Скачать .APK
(Обсуждение)
Аналоги по тегу: #Диктовка
#Whisper #App #Android #Транскрибация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Модель: 🔈 LuxTTS — быстрый синтез речи с клонированием голоса

Модель выдаёт аудио в 48 кГц вместо стандартных для TTS 24 кГц. Звучит чище, детальнее — особенно заметно на голосовых нюансах.

Работает на 1 ГБ видеопамяти. Можно запустить даже на слабой видеокарте или в бесплатном Colab.

Доступны готовые варианты для быстрого старта: демо на Hugging Face, Colab-ноутбук и установка через Pinokio.

🔗 https://github.com/ysharma3501/LuxTTS
и https://huggingface.co/YatharthS/LuxTTS
и https://huggingface.co/spaces/YatharthS/LuxTTS
или https://colab.research.google.com/drive/1cDaxtbSDLRmu6tRV_781Of_GSjHSo1Cu?usp=sharing
или https://pinokio.co/item.html?uri=https%3A%2F%2Fgithub.com%2FTeletambe%2FLuxTTS&parent_frame=https://yandex.ru/
#LuxTTS #TTS #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: GigaChat 3.1 на 702B-A36B и 10B-A1.8B

💡 Сбер обновил ГигаЧат для всех пользователей — теперь ИИ-помощник работает на базе флагманской модели GigaChat 3.1 Ultra.

Ассистент научился искать информацию в сети прямо во время диалога, а также получил долгосрочную память — теперь ИИ-помощник запоминает все важные для пользователя факты и использует их в диалогах.

⚡️ Самое интересное в релизе — компактная GigaChat-3.1-Lightning. При 1,8 млрд активных параметров модель выдает качество уровня GPT-4o, заявляют разработчики. Открытые модели уже могут быть не только маленькими, быстрыми и дешевыми, но еще и умными.

По цифрам: Ultra обходит DeepSeek-V3-0324 и Qwen3-235B в математике и reasoning. Lightning — на бенчах сравним с сопоставимыми по размеру Qwen, а на аренах уровень GPT-4o.
Обучающие данные:
Базовый обучающий корпус GigaChat 3 охватывает 10 языков и включает в себя книги, научные материалы, наборы данных с кодом и математические наборы данных. Все данные проходят дедупликацию, языковую фильтрацию и автоматическую проверку качества с использованием эвристических методов и классификаторов.

Синтетические данные по-прежнему играют важную роль в обеспечении качества. В более широком обучающем корпусе мы использовали около 5,5 триллионов синтетических токенов, в том числе:
- данные о вопросах и ответах, сгенерированные на основе исходных текстов,
- обратные цепочки подсказок для генерации структурированных данных,
- заметки, созданные с помощью модели и встроенные в тексты,
- миллионы синтетических задач с решениями по математике и программированию в стиле олимпиад,
- синтетические тесты для задач, связанных с написанием кода и логическими рассуждениями.

Код и веса новинок выложили на HuggingFace.
Протестировать обновление можно бесплатно на сайте.
А в статье на Хабре команда рассказала, как именно их обучали.
💡 Подробно: https://t.me/gigadev_channel/65

⬇️GGUF: https://huggingface.co/ai-sage/GigaChat3.1-10B-A1.8B-GGUF
и https://huggingface.co/ai-sage/GigaChat3.1-702B-A36B-GGUF
💬 (Обсуждение)
================
🤖 Tool calling для GigaChat 3.1 в open-source инструментах https://t.me/gigadev_channel/67 - от разработчиков!
#GigaChat31 #GigaChat #GGUF #aisage #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️Невероятно! Смогли запустить 400B Qwen 3.5 на iPhone 17 Pro

Веса стримятся с диска, так что скорость всего полтокена в секунду. Но инференс код навайбкодили и модель не супер агрессивно квантизировали, так что тут можно ускорить как минимум в несколько раз.
(Обычно такая модель занимает под 400 Гб. и для ее запуска надо как минимум Mac Studio 512Gb, а тут всего iPhone 17 Pro!)
#iPhone #Qwen35 #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 Airi — ИИ-компаньон с голосом и аватаром в стиле VTuber

На GitHub выложили открытый проект Airiлокальный ИИ-ассистент с анимированным аватаром и голосовым общением. Работает на вашем компьютере, подключается к разным языковым моделям через API или Ollama.

Что умеет:
• Общается голосом через ElevenLabs
• Поддерживает большинство провайдеров LLM, включая локальные модели
• Играет в Minecraft и Factorio
• Интегрируется с Discord и Telegram
Запоминает контекст диалогов

Проект заточен под персонализированное общение — модель запоминает переписку и подстраивается под стиль взаимодействия.
🔗 https://github.com/moeru-ai/airi
#Airi #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: 📄 dots.mocr — OCR-модель, которая превращает графику в SVG

Новая модель на 3 млрд параметров умеет не только распознавать текст с изображений и документов, но и конвертировать структурированные элементы в SVG-код. Работает с диаграммами, UI-макетами и научными графиками.

Доступны две версии: базовая для OCR и специализированная для генерации SVG. Есть демо для быстрого тестирования.

🔗 https://github.com/rednote-hilab/dots.mocr
Модель: https://huggingface.co/rednote-hilab/dots.mocr
и https://huggingface.co/rednote-hilab/dots.mocr-svg
🔗 https://dotsocr.xiaohongshu.com
#dotsmocr #OCR #SVG #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: MolmoWeb 4B / 8B

MolmoWeb - это семейство полностью открытых мультимодальных веб-агентов. Агенты MolmoWeb достигают самых современных результатов, превосходящих аналогичные модели с открытым весом, такие как Fara-7B, UI-Tars-1.5-7B и Holo1-7B.
MolmoWeb-8B также превосходит агенты set-of-marks (SoM), построенные на гораздо более крупных моделях closed frontier, таких как GPT-4o. Кроме того, авторы продемонстрировали стабильный прирост результатов за счет масштабирования времени тестирования с помощью параллельного развертывания с отбором лучших из N вариантов, достигнув показателей 94,7 % и 60,5 % pass@4 (по сравнению с 78,2 % и 35,3 % pass@1) на WebVoyager и Online-Mind2Web соответственно.

MolmoWeb-4B основан на архитектуре Molmo2, в которой в качестве системы технического зрения используются Qwen3-8B и SigLIP 2.

Узнайте больше о семействе MolmoWeb из анонса в блоге и технического отчета.

💬 Демо: https://molmoweb.allen.ai
🔗 https://huggingface.co/allenai/MolmoWeb-8B
🔗 https://huggingface.co/allenai/MolmoWeb-8B-Native
🔗 https://huggingface.co/allenai/MolmoWeb-4B
🔗 https://huggingface.co/allenai/MolmoWeb-4B-Native
(Обсуждение)
#MolmoWeb #MolmoWeb4B #MolmoWeb8B #Molmo2 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Qwen3.5‑4B‑Neo и Qwen3.5‑9B‑Neo

Две новые доработанные версии Qwen3.5 «Neo» ориентированы на быстрое и эффективное принятие решений!

👉 Qwen3.5‑4B‑Neo
Оптимизированная для логического вывода доработка Qwen3.5‑4B. Основное внимание уделяется эффективной последовательности рассуждений: более коротким внутренним цепочкам рассуждений, снижению стоимости токенов и повышению точности.
🔗 https://huggingface.co/Jackrong/Qwen3.5-4B-Neo

👉 Qwen3.5‑9B‑Neo
Более крупный вариант, доработанный на основе Qwen3.5‑9B.
🔗 https://huggingface.co/Jackrong/Qwen3.5-9B-Neo

Версии GGUF также доступны в коллекции здесь: https://huggingface.co/collections/Jackrong/qwen35-neo
(Обсуждение)
#Qwen354BNeo #Qwen359BNeo #GGUF #Qwen35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1
📱 InferrLM - Локальный ИИ на iOS и Android

InferrLM - это мобильное приложение, которое переносит LLMs и SLMs непосредственно на ваше устройство Android и iOS и позволяет вашему устройству действовать как локальный сервер. Также поддерживаются облачные модели, такие как Claude, Gemini и ChatGPT. Вложения файлов с RAG также хорошо поддерживаются для локальных моделей. В InferrLM теперь есть поддержка MLX.

🔗 https://www.inferrlm.app
Проект: https://github.com/sbhjt-gr/InferrLM
📱 Android: InferrLM: On-device AI https://play.google.com/store/apps/details?id=com.gorai.ragionare
iOS: https://apps.apple.com/us/app/inferrlm/id6754396856
(Обсуждение)

Все аналоги для Android https://t.me/Ai2Local/22
Все аналоги для iPhone https://t.me/Ai2Local/21
#InferrLM #Android #iOS #iPhone #App #LLM #RAG #MLX #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM