Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
MDST Engine: запускайте модели GGUF в браузере с помощью WebGPU/WASM для 100% локального логического вывода.

Теперь для запуска моделей вам не понадобится дополнительное программное обеспечение — только современный браузер (Chrome, Safari и Edge).

Сейчас MDST работает на Qwen 3, Ministral 3, LFM 2.5 и Gemma 3 в любом квантовании GGUF.

Подробную информацию о исследовании GGUF и планах на будущее, а также о текущей общедоступной таблице лидеров WebGPU и раннем доступе можно найти по ссылке:
https://mdst.app/blog/mdst_engine_run_gguf_models_in_your_browser
(Обсуждение поста Автора) специальный код приглашения, чтобы пропустить очередь: localllama_Epyz6cF
#MDST #Engine #MDSTEngine #GGUF #WebGPU #WASM #AiLocal #LocalAi
🔈 Голосовая ИИ-студия MimikaStudio

Десктопное приложение для работы с голосом — от клонирования до озвучки длинных текстов.

🎙 Что внутри:
· Клонирование голоса по 3 секундам записи
· Генерация речи
· Создание аудиокниг и озвучка объёмных материалов
· 23 языка, включая русский
· Версии для macOS, Windows и веб


Главное — локальный запуск. Можно скачать бесплатные модели (Qwen3-TTS, Chatterbox, Kokoro) и работать без облака. Данные остаются на вашем компьютере, минимальные требования — 8 Гб ОЗУ.

Подходит для подкастов, обучающих материалов и любого контента, где нужен синтез речи.
23 Языка! (Английский, немецкий, испанский, французский, итальянский, японский, корейский, португальский, Русский, китайский, арабский, датский, хинди, голландский, норвежский, польский, шведский, турецкий, филиппинский, малайский, суахили, иврит, финский.

🔗 https://boltzmannentropy.github.io/mimikastudio.github.io
Проект: https://github.com/BoltzmannEntropy/MimikaStudio
(Статья) (Обсуждение поста Автора)
#TTS #MimikaStudio #AiLocal #LocalAi #MacOS
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Ovis2.6-30B-A3B — немного лучше, чем Qwen3-VL-30B-A3B!

Значительно улучшены такие аспекты, как понимание длинных контекстов и изображений с высоким разрешением, визуальное мышление с активным анализом изображений и понимание документов с большим объемом информации.
👉 Улучшенная обработка длинных последовательностей и изображений с высоким разрешением
Ovis2.6 расширяет контекстное окно до 64 000 токенов и поддерживает разрешение изображений до 2880×2880, что значительно повышает его способность обрабатывать визуальные данные с высоким разрешением и большим объемом информации. Эти улучшения особенно эффективны при ответах на вопросы по длинным текстам, когда модель должна собрать и синтезировать подсказки, разбросанные по нескольким страницам, чтобы дать правильный ответ.

👉 Думайте с помощью образа
Мы представляем возможность "Думай с помощью образа", которая превращает видение из пассивного источника информации в активное когнитивное рабочее пространство. Во время рассуждений модель может активно использовать визуальные инструменты (например, обрезку и поворот) для повторного изучения и анализа областей изображения в рамках своей цепочки размышлений, что позволяет проводить многооборотные саморефлексивные рассуждения на основе визуальных данных для повышения точности решения сложных задач.

👉 Расширенные возможности оптического распознавания символов, работы с документами и диаграммами
Продолжая уделять особое внимание задачам, связанным с обработкой визуальной информации, мы усовершенствовали возможности модели в области оптического распознавания символов (OCR), понимания документов и анализа графиков и диаграмм. Ovis2.6 не только точно извлекает структурированную информацию из визуальных данных, но и анализирует извлеченные данные.

🔗 https://huggingface.co/AIDC-AI/Ovis2.6-30B-A3B
(Обсуждение)
#Ovis2630BA3B #Ovis26 #Ovis #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
💡 GPT-OSS (20B) работает на 100 % локально в вашем браузере на WebGPU

Демоверсию, демонстрирующая GPT-OSS (20B), которая на 100 % работает локально в браузере на WebGPU с использованием Transformers.js v4 и ONNX Runtime Web.

Ссылки:
- Демонстрация (+ исходный код): https://huggingface.co/spaces/webml-community/GPT-OSS-WebGPU - тут скачается модель и потом чат с ней!
- Оптимизированная модель ONNX: https://huggingface.co/onnx-community/gpt-oss-20b-ONNX
(Обсуждение поста Автора)
#WebGPU #GPTOSS20B #GPTOSS #AiModel #ModelAi #LocalAi #AiLocal
🎙 🔈 Izwi - Локальная система аудиовывода для преобразования текста в речь, автоматического распознавания речи и аудиочатов.

Новое настольное приложение для локального аудиовывода!
Он включает в себя:
- преобразование текста в речь (TTS),
- автоматическое распознавание речи (ASR),
- поддержка моделей для чатов и аудиочатов,
- управление жизненным циклом модели (загрузка, выгрузка),
- рабочий процесс с использованием интерфейса командной строки (izwi) с веб-интерфейсом и интерфейсом для настольных компьютеров.

Альфа-версии установщиков доступны для:
- macOS (.dmg)
- Windows (.exe)
- Linux (.deb) плюс пакеты для терминала для каждой платформы.
🔗 https://github.com/agentem-ai/izwi
(Обсуждение поста Автора)
#Izwi #TTS #ASR #macOS #Windows #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📲 Служба Автоответчика HAL - Полностью локальный телефонный скринер с искусственным интеллектом. Отвечает на звонки в стиле HAL 9000, собирает информацию о звонящем, записывает разговоры и отправляет push-уведомления с кратким описанием и полной расшифровкой.

Никакого облачного ИИ. Никаких поминутных платежей. Работает исключительно на вашем оборудовании с использованием локальной большой языковой модели, локального преобразования речи в текст и локального преобразования текста в речь с клонированием голоса.
🔗 https://github.com/ninjahuttjr/hal-answering-service
(Обсуждение и Подробнее)
#halanswering #HAL #Автоответчик #AiАвтоответчик #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🎬 Warlock-Studio восстанавливает видео и фото до исходного качества

Нейросети в инструменте разбирают испорченные видео и картинки попиксельно. Работает с отдельными кадрами и целыми роликами.

💡 Можно настроить разрешение, FPS, кодеки и формат вывода. Обрабатывает даже большие файлы за минуту — всё локально, без передачи данных на сервер!

Запускается на слабом железе. Проект регулярно обновляется — разработчики добавляют новые функции.
🔗 https://github.com/Ivan-Ayub97/Warlock-Studio
#AiVideo #WarlockStudio #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
🔈 Izwi - Локальная система аудиовывода для преобразования текста в речь (TTS), автоматического распознавания речи и голосового искусственного интеллекта.

Izwi — это аудиоплатформа на основе ИИ, ориентированная на конфиденциальность и работающая исключительно на вашем компьютере. Никаких облачных сервисов, никаких API-ключей, никаких данных, покидающих ваше устройство.
Основные возможности:
- Голосовой режим — голосовые разговоры с ИИ в режиме реального времени
- Преобразование текста в речь — генерация естественной речи на основе текста
- Распознавание речи — преобразование аудио в текст с высокой точностью
- Определение дикторов — определение и разделение нескольких дикторов
- Клонирование голоса — клонирование любого голоса на основе короткого аудиофрагмента
- Создание голоса — создание собственных голосов на основе текстовых описаний
- Принудительное выравнивание — выравнивание аудио и текста на уровне слов
- Чат — текстовые диалоги с ИИ

🔗 https://izwiai.com
https://github.com/agentem-ai/izwi
⬇️ Скачать: https://github.com/agentem-ai/izwi/releases
(Обсуждение) (Пост про Izwi v0.1.0-alpha-12)
#Izwi #TTS #MacOS #Windows #Linux #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🌐 Liquid LFM2-VL 450M (Q4_0) работает в браузере через WebGPU (локальный вывод)

ИИ на устройстве для любой платформы.
Запускайте большие языковые модели, преобразуйте речь в текст и текст в речь локально — конфиденциально, без подключения к интернету и быстро.

Liquid LFM2-VL 450M (Q4_0) работает локально в браузере с использованием WebGPU (бета-версия RunAnywhere Web SDK). При наличии поддержки используется ускорение WebGPU, а при ее отсутствии — резервный вариант WASM.

💬 Чат: https://runanywhere-web-demo.vercel.app/
Проект: https://github.com/RunanywhereAI/runanywhere-sdks - тут наглядно показана работа на мобильном браузере и более интересно!
(Обсуждение)
#WebGPU #WASM #LiquidLFM2VL #runanywhere #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🎲 openClaw-Desktop - Настольная платформа с ИИ для неигровых персонажей!

Нативное настольное приложение сИИ для общения, работы с документами и игр!
Подключайтесь к любому шлюзу с ИИ.
Редактируйте документы с помощью ИИ.
Играйте в более чем 14 игр против ИИ.
Одно приложение для всех рабочих процессов.
Текущие возможности:
🧠 Работает с локальными или удаленными шлюзами больших языковых моделей
🎭 Режим взаимодействия с неигровыми персонажами с использованием директив [face:], [act:]
🔌 Архитектура с несколькими шлюзами (переключение моделей/сессий)
📄 Рабочая область Forge (OCR + редактирование с помощью агента)
🎮 Встроенный игровой хаб с искусственным интеллектом
🤖 Эксперименты с игровым процессом «Агент против агента»

Характеристики:
Чат — многошлюзовой чат с искусственным интеллектом, потоковой передачей, загрузкой файлов, переключением моделей и историей сессий.

Forge — открывайте и редактируйте файлы Excel, Word, PDF, PowerPoint, HWP, Markdown и JSON. Агенты с искусственным интеллектом могут совместно редактировать документы в режиме реального времени с помощью рабочих процессов утверждения.

Игры — более 14 встроенных игр (шахматы, покер, Go-Stop, Janggi, 3D-пазлы и другие). Играйте против встроенных агентов с искусственным интеллектом или больших языковых моделей, подключенных через шлюз.

Режим NPC — диалоги с персонажами, в которых учитываются их эмоциональное состояние, действия, динамический фон и мимика аватара.

Мультишлюз — одновременное подключение к нескольким шлюзам openClaw. Аутентификация на уровне устройства по протоколу Ed25519 с автоматическим переподключением.

🔗 https://github.com/stormixus/openClaw-Desktop
Скачать: https://github.com/stormixus/openClaw-Desktop/releases/tag/v0.1.3
(Обсуждение)
#openClawDesktop #openClaw #MacOS #Windows #Linux #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
1
This media is not supported in your browser
VIEW IN TELEGRAM
🔍 Recall Lite (локальный разум)
Локальный семантический поиск по файлам, потому что обычный поиск по файлам не учитывает контекст.
Он сканирует ваши файлы, локально генерирует эмбеддинги, сохраняет векторы и выполняет поиск по косинусному сходству. Никакого облака, никаких API-ключей, никакой телеметрии. Все остается на вашем компьютере.
Что он делает:
Локальный семантический поиск. Вы вводите запрос, а он находит файлы. Работает в системном трее, никогда не отвлекается.

- индексирует более 50 типов файлов (pdf, изображения, код, конфигурации, markdown, csv, журналы, dotfiles, что угодно)
- РАСПОЗНАВАНИЕ изображений с помощью встроенного в Windows движка. нулевая установка
- считывает EXIF из фотографий -> камера, объектив, диафрагма, ISO, фокусное расстояние, координаты gps
- преобразуйте геокоды GPS в реальные названия городов. Так что да, вы можете искать «фотографии из Стамбула», и это работает
- даты из EXIF преобразуются в понятные человеку слова — названия дней, месяцев, время суток, времена года на английском и турецком языках. найдите "летнее утро" и найдите июльскую фотографию
- гибридный поиск: векторное сходство + полнотекстовый + JINA cross-encoder reranker
- расширение запроса удаляет стоп-слова (EN + TR), генерирует варианты ключевых слов
- интеллектуальное разбиение на блоки -> разбивает rust на fn/struct, python на def/class, markdown на заголовки, yaml на ключи верхнего уровня. размеры блоков настраиваются в соответствии с форматом
- семантические контейнеры -> изолировать работу / личное / исследование. у каждого есть своя таблица базы данных. удалить один, без остатка
- параллельная извлечение файлов с помощью rayon --> все ядра вашего процессора работают одновременно
- поддержка i18n --> файлы локали в формате JSON, автоматическое определение языка системы. Добавьте файл json, чтобы указать свой язык

(Обсуждение)
🔗 https://github.com/illegal-instruction-co/recall-lite
#RecallLite #Windows #AiSearch #AiFind #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
🎙 Voicebox — клонируй любой голос за две секунды

Voicebox - локальная нейросеть для клонирования голоса. Работает офлайн, без подписок и ограничений — по сути, бесплатная альтернатива ElevenLabs.
Клонирование голоса с открытым исходным кодом на основе Qwen3-TTS. Создавайте естественную речь на основе текста с практически идеальной имитацией голоса.

Принцип простой: загрузил короткий кусок аудио — получил клон голоса. Дальше можно генерировать речь из текста, собирать диалоги из нескольких голосов, озвучивать видео или презентации.

Что умеет:
• Клонирует голос по короткому сэмплу
• Генерирует речь из текста любым клоном
• Собирает разговоры и подкасты из нескольких голосов
• Записывает и расшифровывает аудио

Всё работает локально — проекты и озвучки хранятся на твоём ПК.
🔗 https://voicebox.sh
https://github.com/jamiepine/voicebox
#Qwen3TTS #TTS #Voicebox #MacOS #Windows #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
Модель: 🎙 MOSS-TTS Family — открытые модели для синтеза речи и звуков

Команда OpenMOSS выпустила семейство мультиязычных моделей для генерации голоса. Раньше от них были транскрибатор и видеогенератор, теперь — полноценный набор инструментов для работы со звуком.

Что умеют модели:
💬 Генерируют длинную речь без потери качества
💬 Клонируют голос по образцу
💬 Создают выразительные диалоги с несколькими говорящими
💬 Проектируют голос по текстовому описанию — без аудиопримеров
💬 Работают в реальном времени
💬 Генерируют звуковые эффекты по текстовому запросу

Есть студия для экспериментов, но вход только через китайский номер телефона. Демо можно посмотреть на Hugging Face и официальном сайте.

🔗 https://mosi.cn/models/moss-tts - Тут много примеров!
https://github.com/OpenMOSS/MOSS-TTS
https://huggingface.co/collections/OpenMOSS-Team/moss-tts
https://huggingface.co/spaces/OpenMOSS-Team/MOSS-TTSD-v1.0
https://studio.mosi.cn/voice-synthesis?mode=double
#MOSSTTS #MOSS #TTS #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 ValeDesk - Универсальный почти локальный, но в конечном счете разумный помощник.
Настольный ИИ-помощник с поддержкой локальных моделей!
Основные возможности:
Планирование задач — визуальная панель задач с отслеживанием прогресса, сохраняемая для каждого сеанса
Запланированные задачи — создание напоминаний и повторяющихся задач с автоматическим выполнением
OpenAI SDK — полный контроль над API, совместимость с любой конечной точкой, совместимой с OpenAI
Локальные модели — поддержка vLLM, Ollama, LM Studio
Кодовые песочницы — выполнение кода на JavaScript (виртуальная машина Node.js) и Python (системный подпроцесс)
Поддержка документов — извлечение текста из PDF и DOCX (в комплекте, работает «из коробки»)
Веб-поиск — интеграция Tavily и Z.AI для поиска в интернете
Парсинг Telegram — отображение каналов t.me с реакциями, просмотрами и автоматической прокруткой старых постов
Безопасность — песочница для безопасных операций с файлами
Кроссплатформенность — Windows, macOS, Linux с соответствующими командами оболочки
(Пост Автора)
(Опыт тестирования автором)

🔗 https://github.com/vakovalskii/ValeDesk
#ValeDesk #AiAgent #AgentAi #MacOS #Windows #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: INTELLECT-3.1 на основе GLM 4.5 Air.
INTELLECT-3.1 — это модель логического вывода на основе смеси экспертов с 106 миллиардами (A12B) параметров, созданная в результате дальнейшего обучения INTELLECT-3 с дополнительным обучением с подкреплением в области математики, программирования, разработки программного обеспечения и агентных задач.
INTELLECT-3 — это модель Mixture-of-Experts с 106 миллиардами параметров, обученная с использованием SFT и RL на основе базовой модели GLM 4.5 Air. Она демонстрирует высочайшую для своего размера производительность в тестах на математику, программирование, естественные науки и логическое мышление.

🔗 Чат: https://chat.primeintellect.ai
Блог: https://www.primeintellect.ai/blog/intellect-3
Модель: https://huggingface.co/PrimeIntellect/INTELLECT-3.1
Рабочий квант: https://huggingface.co/noctrex/INTELLECT-3.1-MXFP4_MOE-GGUF (MXFP4_MOE=67.4 GB)
#INTELLECT31 #INTELLECT3 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
🔈 Izwi - Локальная система аудиовывода для преобразования текста в речь (TTS), автоматического распознавания речи и голосового искусственного интеллекта. Izwi — это аудиоплатформа на основе ИИ, ориентированная на конфиденциальность и работающая исключительно…
🔈 Выпущена версия Izwi v0.1.0-alpha-12 (более быстрая система автоматического распознавания речи + более интеллектуальная система синтеза речи)
Нового:
- Полноформатная система автоматического распознавания речи с автоматическим разбиением на фрагменты и сшиванием с перекрытием
- Более быстрая потоковая передача системы автоматического распознавания речи и меньше ненужного перекодирования при загрузке
- Поддержка MLX Parakeet
- Новые варианты 4-битных моделей (Parakeet, LFM2.5, чат Qwen3, принудительное выравнивание)
- Улучшения в системе преобразования речи в текст: ограничения на основе модели + адаптивные тайм-ауты
- Более удобный интерфейс управления моделями (Мои модели + модальное окно выбора модели)

Документы: https://izwiai.com
(Обсуждение)
#Izwi #TTS #MacOS #Windows #Linux #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
👏1
This media is not supported in your browser
VIEW IN TELEGRAM
📱 Локальное приложение для преобразования речи в текст для iOS (альтернатива Wispr Flow)

Внутри модели: Parakeet V3 (200Mb), Whisper Large V3 Turbo (800Mb), Apple Speech.
Есть режимы: Заметки, Митинг, Клавиатура.
Есть свои Сокращения, Словарь, ИИ постОбработка, ...
Есть приложения для iOS, MacOS и Android.

Ссылка на тестовый режим:
https://testflight.apple.com/join/e5pcxwyq

Автор с радостью предоставит приложение бесплатно тем, кто оставит полезный отзыв о тестовом режиме. (ТУТ)

Еще есть приложение для MacOS с локальной обработкой. При желании пользователи могут синхронизировать свои сниппеты и словарь с помощью личного аккаунта iCloud.
#VoiceReader #Parakeet #Whisper #iPhone #App #Транскрибация #AiLocal #LocalAi