Local Ai
443 subscribers
894 photos
249 videos
4 files
810 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
Local Ai
💬 Vellium - Настольное приложение для общения с ИИ и ролевыми играми. Характеристики: - Чат с ветвлением, редактированием/удалением, перегенерации и многопользовательскими автоповоротами. - Инструменты для ролевой игры: блоки подсказок, примечания автора…
⬇️ Обновление Vellium до v1.1.2 (18.09.26)
https://github.com/tg-prplx/vellium/releases/tag/v1.1.2

Vellium
- это локальный настольный инструмент для общения с ИИ, ролевых игр, голосовых разговоров и написания больших текстов.
Что включает в себя Vellium:
- Чат и ролевая игра: разветвленные временные линии, редактирование сообщений, несколько персонажей, личины, лоребуки, авторские заметки, состояние сцены, блоки подсказок, перевод, вложения, экспорт и управляемые автоматические ходы.
- Контекст с учетом рассуждений: поля рассуждений провайдера и <think> трассировки могут отображаться, ограничиваться, сохраняться и при необходимости возвращаться в модель в качестве контекста. Рассуждения в ролевой игре — это отдельный режим симуляции подсказок.
- Голосовой чат и аватары Inochi2D: микрофонный вход, STT-совместимость с Whisper, потоковая TTS, синхронизация губ/эмоций на основе параметров для .inp/.inx кукол, управление моделями и ролевыми играми, вложения, контекст экрана и инструменты чата в режиме Live.
- Написание: проекты, главы, сцены, Character Forge, аннотации, действия по переписыванию и расширению, контекст RAG, импорт DOCX и экспорт DOCX/Markdown.
- Персонажи и данные о мире: импорт/редактирование карточек персонажей, ручной порядок персонажей, участие нескольких персонажей, LoreBooks и импорт информации о мире.
- Знания и RAG: коллекции, ограниченная загрузка, эмбеддинги, опциональное изменение рейтинга и явные привязки для чата и письма.
- Провайдеры: API, совместимые с OpenAI, KoboldCpp, пользовательские адаптеры конечных точек, резервные модели, маршрутизация моделей для конкретных заданий и политика параметров API.
- Инструменты и расширения: вызовы инструментов MCP, структурированные результаты обработки изображений, локальные плагины, темы, виджеты, настраиваемые поля инспектора и виджеты на рабочем столе.
- Локальный контроль: сохранение данных в SQLite, полный локальный режим, проверка URL-адресов провайдеров, плагины с ограниченным доступом и отдельные средства защиты для мощных устаревших инструментов рабочего пространства.

Интерфейс переведен на английский, русский, китайский и японский языки.

#Vellium #MacOS #Windows #Linux #ChatRP #RP #Whisper #TTS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
📱 Inferencer - Private AI Studio Inferencer позволяет запускать, размещать и глубоко контролировать последние модели SOTA AI (OSS, DeepSeek, Qwen, Kimi, GLM, MiniMax и другие) с вашего собственного компьютера или телефона. Никакие данные не отправляются…
📺 Inferencer - Private AI Studio активно обновляется!
В этом обновлении:
+ Anthropic API and Claude Code support, including cache optimisations + Thinking limit improvements and enforcer option (disabled by default)
+ Thinking limits for Server API
+ OpenCode support for Server API date override + Missed tool call detection (enabled by default)
+ HTML/JS validator tool + File tool improvements
+ Cache re-use improvements
+ Vision cache support and tool call improvements for DeepSeek V4.1
+ Bug fixes and performance improvements

Also, in case you missed the last updates:
+ Support for DeepSeek V4.1, GLM-5.3, GLM-5.3-Flash, Qwen3.8-Flash + File Attachments including support for Code, PDF, Word, and ePub + Multiprocessing engine for inferencing multiple models at the same time + Multi-computer clustering for inferencing larger models + MTP and DSpark Speculative Decoding for DeepSeek V4, Gemma4, and Qwen3.6 (up to 2x faster)
+ Persistent prompt caching (enable in Settings - up to ~99x faster for cache hits)
+ MCP Server support including arc-1 SAP, Playwright, MindsDB, Microsoft Learn, and DeepWiki

⬇️ https://apps.apple.com/ru/app/inferencer-private-ai-studio/id6749861443
#Inferencer #MacOS #iPhone #iPad #App #SoftAI #AiSoft #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Inco Splash — механизм логического вывода с открытым исходным кодом, созданный на основе модели и процессора Apple.

Скорость декодирования в 3 раза выше, чем у Ollama, в 2 раза выше, чем у oMLX, и почти в 4 раза выше, когда агент разветвляется на субагентов.
Qwen3.8-27B со скоростью 144 ток/ с на MacBook Pro M5 Max!

Требования: M3 или новее, macOS 26.4+, 36 ГБ
Начните работу с помощью одной команды:
brew install incoai/tap/splash
splash serve --model incoai/Qwen3.8-27B-Splash

Вот и вся настройка. Укажите на него своего агента, он работает с Claude Code, OpenCode, Codex или Hermes

Предпочитаете приложение?
Также доступно в LM Studio
Получите последнюю версию LM Studio Bionic: https://lmstudio.ai

Настройки> Среда выполнения, загрузите Splash, затем загрузите модель. Тот же движок внутри приложения для работы локального агента на вашем Mac.
🔗 https://github.com/incoai/splash
📖 Статья: https://inco.ai/blog/splash/
(Обсуждение)
#IncoSplash #Splash #LMStudioBionic #LMStudio #MacOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1
📖 Пост про: Qwen3.8-Flash-Next (95,5 Гб.) на 64-Гб. Mac со скоростью ~ 27 ток /с!

Это работает, потому что маршрутизируемые эксперты хранятся на SSD и считываются только тогда, когда к ним обращается токен.
модельhttps://huggingface.co/nitinpanj/qwen38-flash-next-v3
форкhttps://github.com/npanj/llama.cpp
Это не будет работать на стандартной версии llama.cpp. В основной ветке есть архитектура, но нет флага экспертной потоковой обработки, поэтому программа просто пытается загрузить все 95,5 ГиБ и падает.
Скорость на M5 Pro (64 ГБ):
- обработка подсказок ~367 токенов в секунду
- генерация, черновик включен ~27,6 токенов в секунду
- генерация, черновик выключен 18–18,6 токенов в секунду
- при 29 тысячах контекстов, использование реального чата ~20,6 токенов в секунду!

Подробнее и Обсуждение: https://www.reddit.com/r/LocalLLaMA/comments/1wk14il/qwen38flashnext_955_gib_on_a_64gb_mac_at_27_toks/
#Qwen38FlashNext #MacOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📺 MiniMax Code теперь с открытым исходным кодом.
Агент для написания кода в терминале с помощью MiniMax, ваших собственных моделей и инструментов, не связанных с кодом.

Что входит в пакет:
- Терминальный пользовательский интерфейс
- Безголовый интерфейс командной строки
- Поддержка протокола агент-клиент
- BYOK и пользовательские провайдеры
- API, совместимые с OpenAI и Anthropic
- Режим планирования и возобновляемые сеансы
- Субагенты, MCP, плагины и навыки
- Редактирование кода, выполнение команд и проверка тестов

Лицензия по умолчанию для исходного кода — MIT. Исходный код включает в себя терминальный пользовательский интерфейс, CLI без графического интерфейса и ACP, но не включает настольное приложение.

🔗 https://github.com/MiniMax-AI/minimax-code
⬇️ https://agent.minimax.io/download
(Обсуждение)
#MiniMaxCode #MiniMax #Windows #MacOS
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: WeVisDoc от Tencent — парсер документов в Markdown

Модель превращает страницу 📄 в структурированный текст с LaTeX-формулами и HTML-таблицами. Основа — дообученный Qwen3-VL, доступны версии 2B и 4B параметров.

На вход подаёшь PNG, JPEG или WebP, на выходе получаешь чистый Markdown. По бенчмаркам WeVisDoc лидирует среди сквозных парсеров документов. Запускается через vLLM с OpenAI-совместимым API или локально через Transformers.
🔗 https://tencent.github.io/WeVisDoc/
🔗 https://github.com/Tencent/WeVisDoc
🔗 https://huggingface.co/collections/tencent/wevisdoc
Демо: https://huggingface.co/spaces/hugging-apps/wevisdoc-4b-demo
#WeVisDoc #Qwen3VL #OCR #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: AliceAI-T5-35B-A0.6B-Base - Alice AI Search модель быстрых ответов Алисы на Поиске
AliceAI-T5 — базовая языковая модель с архитектурой encoder-decoder и разреженными MoE-слоями: 34,35 млрд уникальных параметров, 512 экспертов в каждом MoE-слое, из которых для каждого токена выбираются 8.
Подробно про эту модель можно прочитать в статье на Хабре.
🔗 https://huggingface.co/yandex/AliceAI-T5-35B-A0.6B
#AliceAIT535BA06BBase #AliceAIT5 #AliceAISearch #AliceAI #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM