Local Ai
444 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
Local Ai
Jan https://jan.ai — новый опенсорсный конкурент Perplexity, который работает полностью локально и запускается даже на слабых ПК. Их собственная модель Jan основана на Qwen3-4B и дообучена для сложных рассуждений и интернет-поиска. В бенчмарке SimpleQA…
⚡️Обновление: Jan v0.7.8: интеграция с OpenClaw, Jan CLI и автоматическое управление контекстом (от 11 марта 2026 года)

⚠️ Подключайтесь к Telegram и WhatsApp с помощью простой настройки!

Подробнее
: https://www.jan.ai/changelog/2026-03-11-jan-openclaw-cli-context

Версия Jan с встроенным Google TurboQuant для тех, у кого мало ОЗУ: https://t.me/Ai2Local/482

#Jan #JanAi #App #Windows #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
AnythingLLM.com локальный ИИ на ПК и Смартфон Клиент: есть и десктоп (Windos, Linux, macOS (Intel & Arm M)) и веб-клиент (docker) и для Android (ниже). Для браузера Chrome есть расширение: AnythingLLM Browser Companion Для скачивания на ПК нужен VPN!…
Обновление: AnythingLLM до v1.11.1

Наконец-то: Главная страница AnythingLLM была полностью переработана, чтобы стать более современной и удобной для пользователей. Теперь вы можете начать общение сразу после запуска приложения.

Подробнее: https://github.com/Mintplex-Labs/anything-llm/releases/tag/v1.11.1
#AnythingLLM #LocalAi #AiLocal #App #Windows #MacOS
Please open Telegram to view this post
VIEW IN TELEGRAM
🤖 SoyLM - Альтернатива NotebookLM на базе Nemotron.

Расшифровка YouTube, рендеринг Playwright JS, FTS5 RAG, поиск DDG, потоковая передача SSE.

Инструмент RAG для локального поиска с использованием Nemotron-Nano-9B-v2-Japanese через vLLM. (без использования облачного API)
Что он делает:
Загружайте документы, URL-адреса или видео с YouTube в качестве источников. SoyLM анализирует их с помощью локальной языковой модели, сохраняет структурированные сводки в SQLite и позволяет общаться с вашими источниками с помощью RAG (FTS5 + BM25) и дополнительного веб-поиска (DuckDuckGo).

🔗 https://github.com/soy-tuber/SoyLM
(Обсуждение)
#SoyLM #NotebookLM #Nemotron #RAG #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 Echovo - Local TTS & Voice Cloning

Echovo (App Store, платное 6 Euro) — единственное мобильное приложение, где Qwen3-TTS работает нативно и полностью on-device (через MLX + Neural Engine на iPhone A17 Pro и выше). Никакого облака, модель скачивается в приложение (~2 ГБ), клонирует голос с 3 секунд аудио.
Echovo - Лучший TTS и клонирование голоса Echovo обеспечивает совое современные преобразования текста в речь прямо на ваш iPhone, на базе Qwen3-TTS, полностью работающий на устройстве с ускорением кремния Apple. Ваше сообщение никогда не покидает ваш телефон.
Два мощных режима
- **Text-to-Speech**: Введите или вставьте любой текст и создайте естественную, выразительную речь. Выберите один из нескольких динамиков, настройте параметры качества и управляйте стиль речи с помощью пользовательских инструкций.
- **Voice Clone**: Запишите короткий аудиоклип или загрузите справочный файл, и Echovo сгенерирует речь, соответствующую характеристикам голоса. Клонировать любой голос за считанные секунды.
💬 11 языков! Создавайте речь на английском, китайском, японском, корейском, немецком, французском, испанском, русском, португальском, итальянском языках — или позвольте автоматическому обнаружению справиться с этим за вас.
👉 Полностью приватно
Вся обработка происходит на вашем устройстве с использованием фреймворка Apple MLX. Никакие аудиоданные, текст и голосовые образцы никогда не отправляются на внешние серверы. Ваши разговоры остаются вашими.
👉 Основные функции:
- Вывод ИИ на устройстве
- Интернет не требуется после загрузки модели
- Два варианта модели: Base (TTS + голосовое клонирование) и CustomVoice (управление стилем на основе инструкций)
- Показатели производительности в режиме реального времени: RTF, время синтеза, использование памяти, количество токенов и тепловое состояние
- Регулируемые предустановки качества: Fast, Balanced и High - История генерации со встроенным воспроизведением аудио
- Запись справочного звука напрямую или импорт из файлов
- Сохранение и управление эталонной аудиобиблиотекой для быстрого повторного использования
- Темная и светлая тема с элегантным, минимальным интерфейсом
- Обмен сгенерированными аудиофайлами
👉 Как это работает:
1. Скачайте модель (~1,9 ГБ каждая, один раз)
2. Введите текст и нажмите «Сгенерировать»
3. Прослушайте, поделитесь или сохраните результат
👉 Требования:
- iPhone с Apple Silicon (A17 Pro или более поздней версии рекомендуется для лучшей производительности)
- ~2 ГБ бесплатного хранилища на модель

⬇️ https://apps.apple.com/ru/app/echovo-tts-voice-cloning/id6758773035
#Echovo #Qwen3TTS #TTS #iPhone #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🎙 HITOKU - Помощник по голосовому набору текста в локальной строке меню Mac

Приложении для Mac, которое работает в строке меню и позволяет записывать голосовые заметки. ИИ, работающий исключительно локально. Оптимизировано для Apple Silicon.
Создали его, потому что большинство инструментов для диктовки и написания текстов с помощью ИИ были слишком громоздкими для быстрого набора текста, а нужно было что-то быстрое, приватное и простое в использовании, чтобы записывать свои мысли в любое текстовое поле.
Основная идея заключается в том, что вы можете просто говорить как обычно и запрашивать нужный черновик, вместо того чтобы переключаться между режимами или заранее выбирать, что вы пишете: электронное письмо, заметки или что-то еще.

🔗 https://hitoku.me
(Обсуждение)
Аналоги по тегу: #Диктовка
#HITOKU #MacOS #ASR #STT #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
🔈 OpenReader — это программа для чтения документов с преобразованием текста в речь с открытым исходным кодом, созданная на базе Next. js для EPUB, PDF, TXT, MD и DOCX с функцией синхронного воспроизведения.
🎯 Мультипровайдерская система преобразования текста в речь с конечными точками, совместимыми с OpenAI (OpenAI, DeepInfra, Kokoro, KittenTTS-FastAPI, Orpheus, пользовательские).
📖 Воспроизведение с чтением вслух для PDF/EPUB с озвучиванием с учетом структуры предложения.
⏱️ Выделение послов с помощью дополнительных whisper.cpp временных меток.
🛜 Синхронизация + импорт из библиотеки для переноса документов между устройствами и из папок на сервере.
🗂 Гибкое хранилище со встроенным файловым хранилищем SeaweedFS или внешними бэкендами, совместимыми с S3.
🎧 Экспорт аудиокниг в m4b/mp3 с возможностью возобновления чтения по главам.
🐳 Возможность самостоятельного хостинга с помощью Docker, опциональной аутентификации и автоматической миграции при запуске.

🔗 https://github.com/richardr1126/openreader
#OpenReader #TTS #EPUB
Please open Telegram to view this post
VIEW IN TELEGRAM
📸 Local Diffusion - Запустите SD1.x/2.x/3.x, SDXL и FLUX.1 на своем Android для генерации изображений
Local Diffusion — это приложение на Flutter, которое переносит модели Diffusion на Android с помощью потрясающего stable-diffusion.cpp

📱 По-настоящему локальный вывод: генерируйте изображения прямо на своем Android-устройстве.

🚀 Широкая совместимость с моделями:
Поддерживает широкий спектр архитектур: SD1.x, SD2.x, SDXL, SD3/SD3.5, Flux/Flux-schnell, SD-Turbo, SDXL-Turbo и другие.

⬇️ Загружайте модели напрямую из популярных источников, таких как Hugging Face и Civitai.

⚡️ Квантование на лету: автоматическое квантование полноточных моделей при загрузке для экономии памяти и потенциального повышения скорости. Поддерживаемые форматы: q8_0, q6_k, q5_0, q5_1, q5_1k, q4_0, q4_1, q4_k, q3_k, q2_k.

Скорость на флагмане: 10–30 сек
Плюсы: Самый мощный, ControlNet, LoRA, полностью локально!
🔗 https://github.com/rmatif/Local-Diffusion
Скачать v0.3 (.APK)

Альтернативы:
- Local Dream - Только SD 1.5 (но с NPU-ускорением) - Лучшая скорость на Snapdragon!
- Off Grid - Улучшенные SDXL-варианты (DreamShaper, Absolute Reality и т.д.) - 5–10 сек (с NPU) - Удобный UI, + LLM в одном приложении, 100% оффлайн!

#LocalDiffusion #App #Android #StableDiffusion #SDXL #SD #Flux #AiImage #text2image #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
1
📸 Local Dream - - Запустите SD1.5 на своем Android для генерации изображений

Запускайте Stable Diffusion на устройствах Android с ускорением на базе процессора Snapdragon NPU. Также поддерживается вывод на центральном и графическом процессорах.
С NPU-ускорением! - Лучшая скорость на Snapdragon!
Android Stable Diffusion с ускорением на базе процессора Snapdragon NPU Также поддерживает логический вывод на центральном и графическом процессорах!

Особенности:
🎨 txt2img — создавайте изображения на основе текстовых описаний
🖼 img2img — преобразуйте существующие изображения
🎭 inpaint — перерисовывайте выбранные области изображений
- пользовательские модели — импортируйте собственные модели SD1.5 для центрального процессора (в приложении) или нейронного процессора (следуйте руководству по конвертации). Вы можете получить несколько предварительно преобразованных моделей от xororz/sd-qnn или Mr-J-369
- поддержка LoRA — поддержка добавления весов LoRA в пользовательские модели для процессора при импорте.
- веса подсказок — выделение определенных слов в подсказках. Например, (masterpiece:1.5). Тот же формат, что и Automatic1111
- эмбеддинги — поддержка пользовательских эмбеддингов, таких как EasyNegative. Требуется формат SafeTensor. Преобразуйте pt в safetensors с помощью этого
- апскейлеров — 4-кратное увеличение с помощью realesrgan_x4plus_anime_6b и 4x-UltraSharpV2_Lite

📱 https://play.google.com/store/apps/details?id=io.github.xororz.localdream (отфильтровано по NSFW)
🔗 https://github.com/xororz/local-dream
(Скачать .APK без цензуры)

Альтернативы:
- Local Diffusion https://t.me/Ai2Local/363
- Off Grid - Улучшенные SDXL-варианты (DreamShaper, Absolute Reality и т.д.) - 5–10 сек (с NPU) - Удобный UI, + LLM в одном приложении, 100% оффлайн!

#LocalDream #App #Android #StableDiffusion #NPU #LoRA #AiImage #text2image #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
🎶 Tencent выпустил LeVo 2 — открытый генератор музыки на 4B параметров

Модель генерирует треки до 4,5 минут, работает с текстом и аудио, ошибается в передаче слов песен в 8,55% случаев — это лучше многих коммерческих решений.

Что умеет: создаёт музыку по текстовому описанию или аудиофрагменту, выдаёт отдельно вокал и инструменталы или вместе, запускается на GPU с 10 ГБ VRAM.

Есть быстрая версия — генерация за минуту.
Обновился плагин для ComfyUI.

Интересно сравнить с AceStep 1.5.

🔗 https://levo-demo.github.io/levo_v2_demo/
🔗 https://github.com/tencent-ailab/songgeneration?tab=readme-ov-file
🔗 https://huggingface.co/lglg666/SongGeneration-v2-large
🔗 https://huggingface.co/spaces/tencent/SongGeneration
🔗 https://github.com/smthemex/ComfyUI_SongGeneration
#LeVo2 #Suno #AiMusic #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🦥 Unsloth Studio - крутая альтернатива LM Studio!

Unsloth представила Unsloth Studio — open-source веб-интерфейс для запуска, обучения и экспорта моделей локально. Публичный запуск состоялся сейчас, хотя сам проект разрабатывался около года.

Это даёт простой единый инструмент вместо набора утилит: можно запускать GGUF и safetensors, собирать датасеты из файлов, дообучать модели и сравнивать их между собой. Есть поддержка text, vision, audio, TTS и embedding, а также экспорт в нужные форматы.

Обзор основных функций Unsloth Studio.
- Запускайте модели локально на Mac, Windows и Linux
- Обучайте более 500 моделей в 2 раза быстрее с уменьшением объема видеопамяти на 70%.
- Поддерживает GGUF, визуальные, звуковые и встраиваемые модели
- Сравнивайте и сражайтесь с моделями бок о бок
- Вызов инструмента для самовосстановления и веб-поиск
- Автоматическое создание наборов данных из PDF, CSV и DOCX
- Выполнение кода позволяет LLMs тестировать код для получения более точных выходных данных
- Экспортировать модели в GGUF, Safetensors и другие!
- Настройка параметров автоматического вывода (temp, top-p и т.д.) + редактирование шаблонов чатов

Обучение работает на NVIDIA GPU, на CPU и Mac доступен в основном режим чата, поддержка MLX, AMD и Intel заявлена позже.
GitHub: https://github.com/unslothai/unsloth
Блог + все, что нужно знать: https://unsloth.ai/docs/new/studio
(Обсуждение-1, Обсуждение-2)
#Unsloth #UnslothStudio #LLM #OpenSource #LocalAI #AI #AiLocal #MachineLearning #GGUF
Модель: Drummer's Skyfall 31B v4.1, Valkyrie 49B v2.1, Anubis 70B v1.2 и Anubis Mini 8B v1! — корабли нового поколения для ваших новых приключений!

Если вы не следили за сообществом Beaver, то могли пропустить эти четыре тихих релиза.

🔗 Skyfall 31B v4.1 - https://huggingface.co/TheDrummer/Skyfall-31B-v4.1

🔗 Valkyrie 49B v2.1 - https://huggingface.co/TheDrummer/Valkyrie-49B-v2.1

🔗 Anubis 70B v1.2 - https://huggingface.co/TheDrummer/Anubis-70B-v1.2

🔗 Anubis Mini 8B v1 - https://huggingface.co/TheDrummer/Anubis-Mini-8B-v1 (Llama 3.3 8B tune)

Это значительные улучшения по сравнению с предыдущими версиями, и они звучат так же, как другие модели поколения 4.0 (например, Cydonia 24B 4.3, Rocinante X 12B v1, если вам нравятся эти модели).
(Обсуждение)
#Beaver #Drummer #Skyfall31B #Valkyrie49B #Anubis70B #AnubisMini8B #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
🔈 LoopMaker — музыкальный генератор на основе ИИ для Mac (офлайн, безлимитный) LoopMaker - это нативное приложение для macOS, использующее современную музыкальную модель с ИИ. Опишите, что вы хотите, и LoopMaker создаст это локально, конфиденциально, за считанные…
This media is not supported in your browser
VIEW IN TELEGRAM
🎶 [Обновление] Качество звука в LoopMaker значительно улучшилось с момента этого поста. Сравнение в режиме реального времени.

Уже было о LoopMaker — нативном приложении для Mac, которое генерирует музыку локально на устройстве с помощью фреймворка Apple MLX. Вот что изменилось с тех пор.
Что улучшилось:
Самое большое изменение — переход на ACE-Step 1.5, новейшую музыкальную модель с открытым исходным кодом от ACE Studio. Эта модель по результатам тестирования на SongEval показала результаты между Suno v4.5 и v5, что является огромным скачком по сравнению с тем, на каком уровне находилась генерация локальной музыки еще месяц назад.

Конкретные улучшения качества:
- Разделение инструментов стало намного чище. Треки больше не звучат размыто или сжато
- Значительно улучшилась четкость и естественность вокала. Все еще не на уровне Suno v5, но теперь действительно приятно слушать
- Бас стал более плотным. 808-е и низкие частоты звучат как надо
- Высокочастотные детали (хай-хэты, тарелки, обертоны струнных) звучат более реалистично
- Структура песни на более длинных сессиях стала более целостной. Меньше случайных отклонений

Чем отличается архитектура новой модели:

В ACE-Step 1.5 используется гибридный подход, который отделяет планирование от рендеринга:

1) Языковая модель (на основе Qwen, 0,6–4 млрд параметров) отвечает за планирование песни с помощью метода Chain-of-Thought. Она принимает текстовое описание и создает полный план: темп, тональность, аранжировку, текст, стилистические характеристики.

2) Diffusion Transformer отвечает за синтез звука на основе этого шаблона

Такое разделение означает, что DiT не пытается одновременно понять ваш запрос и сгенерировать звук. Каждый компонент фокусируется на том, что у него получается лучше всего. Аналогичным образом разделение кодировщика текста и декодировщика изображений повысило качество SD-изображений.

Модель также использует внутреннее обучение с подкреплением для выравнивания, а не внешние модели вознаграждения. Без предвзятости в пользу RLHF. Это помогает обеспечить единообразие подсказок на более чем 50 языках.

Технические детали, которые важны для этого сабреддита:
- Модель работает через Apple MLX + графический процессор через Metal
- Требуется менее 8 ГБ памяти. Работает на базе M1/M2 с 16 ГБ памяти
- В модели реализована поддержка тонкой настройки LoRA (пока не в приложении, но в планах)
- Лицензия MIT, обучение на лицензионных и бесплатных данных

Над чем еще нужно поработать:
- Скорость генерации на MLX ниже, чем на CUDA. Минуты, а не секунды. Компромисс ради нативного интерфейса Mac
- Согласованность вокала может варьироваться в зависимости от поколения. Чувствительность к начальным данным по-прежнему высока (проблема «гача»)
- В приложении пока нет обучения с учителем. Если вы хотите провести тонкую настройку, вам нужно будет запустить необработанную модель через Python
- Некоторые жанры (особенно китайский рэп) проигрывают по сравнению с другими

🔗 https://3422223166764.gumroad.com/l/loopmaker
(Обсуждение)
#LoopMaker #ACEStep15 #ACEStep #Suno #AiMusic #AiSong #AiAudio #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Holotron-12B — высокопроизводительную модель для эпохи компьютерных агентов

Это высокопроизводительная мультимодальная модель с открытым исходным кодом, разработанная совместно с NVIDIA специально для эпохи компьютерных агентов. (По производительности не уступает Holo2/Qwen, но в два раза превосходит их по пропускной способности)
Holotron-12B, обученная на основе открытой модели NVIDIA Nemotron-Nano-2 VL на собственной смеси данных H Company, является результатом тесного сотрудничества исследовательских лабораторий в разработке нового типа модели, оптимизированной в первую очередь для масштабирования и производительности в производственных условиях.

Почему создали Holotron-12B?:
Большинство современных мультимодальных моделей оптимизированы в первую очередь для статического зрения или выполнения инструкций. Однако у Holotron-12B, как и у модели Holo2, другая цель: служить в качестве модели принятия решений для компьютерных агентов, которые должны эффективно воспринимать, анализировать и действовать в интерактивных средах.

При разработке Holotron-12B стремились создать модель, которая могла бы эффективно масштабироваться в производственной среде, обрабатывая длинные контексты с несколькими изображениями, и при этом показывать хорошие результаты в тестах.

🤗Hugging Face: https://huggingface.co/Hcompany/Holotron-12B

📖Подробное техническое описание: https://hcompany.ai/holotron-12b
Пост: https://x.com/hcompany_ai/status/2033851052714320083
(Обсуждение)
#Holotron12B #NVIDIA #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🎬 Переводчик в реальном времени — локальный ИИ-переводчик

Локальный инструмент для перевода в режиме реального времени с использованием ИИ и плавающим интерфейсом на базе Whisper и Qwen.
Realtime Interpreter — это полностью локальный инструмент для синхронного перевода с использованием искусственного интеллекта. Он может прослушивать системный звук или микрофонный ввод в режиме реального времени, использовать Whisper для распознавания речи, а затем задействовать локальную большую языковую модель (например, Qwen) для потокового перевода и, наконец, отображать двуязычные субтитры в независимом плавающем окне, которое всегда находится поверх других окон.

Ключевые особенности:
🏠 Полностью локальное приложение: не требует подключения к интернету, что обеспечивает конфиденциальность и исключает утечку данных.
⚡️ Перевод в режиме реального времени с низкой задержкой: от распознавания речи до перевода обычно проходит 2–4 секунды.
🪟 Независимое плавающее окно Always-On-Top: Субтитры с переводом отображаются поверх всех остальных окон, не мешая вашей работе (иногда оно может вести себя нестабильно, но просто перезапустите его, если оно исчезнет 🫠).
🌍 Поддержка 29 языков: от китайского до венгерского, включая большинство основных языков мира.
🎭 Оптимизация для конкретных сценариев: вводите подсказки для конкретных областей (например, «Нейронаука Массачусетского технологического института», «Корейские дорамы», «Непринужденный чат») для оптимизации качества перевода.
🔄 Горячая перезагрузка во время работы: переключайте языки, сценарии и источники аудиовхода на лету, без перезапуска.

🔗 https://github.com/GlitchyBlep/Realtime-AI-Translator
(Обсуждение)
#RealtimeInterpreter #Interpreter #Whisper #AiПеревод #Перевод #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🎙 Offline Voice Input - Локальная транскрибация!

Голосовой ввод в автономном режиме обеспечивает профессиональный уровень преобразования речи в текст, работая полностью на вашем устройстве. Пишете ли вы электронные письма, делаете заметки или общаетесь в чате, ваши голосовые данные никогда не покидают ваш телефон.
Характеристики:
- Автономная транскрипция: использует модели глубокого обучения (Parakeet TDT) для полной расшифровки речи на устройстве.
- Поддерживаемые языки: болгарский, хорватский, чешский, датский, нидерландский, английский, эстонский, финский, французский, немецкий, греческий, венгерский, итальянский, латышский, литовский, мальтийский, польский, португальский, румынский, словацкий, словенский, испанский, шведский, русский, украинский
- Клавиатура с голосовым вводом Используйте свой голос для ввода текста.
- Субтитры в реальном времени: субтитры для любого аудио/видео, воспроизводимого на вашем устройстве.
- Конфиденциальность превыше всего: аудиоданные не покидают ваше устройство.

📱 https://play.google.com/store/apps/details?id=dev.notune.transcribe
⬇️ Скачать .APK v0.1.14
Проект: https://github.com/notune/android_transcribe_app

Еще есть: parakeet_transcribe https://github.com/RastislavKish/parakeet_transcribe
Многоязычная транскрипция аудио в текст с помощью Parakeet TDT (Восторг тут)
Аналоги по тегу: #Диктовка
#OfflineVoiceInput #transcribe #App #Android #Parakeet #транскрибация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM