Local Ai
✨ Jan https://jan.ai — новый опенсорсный конкурент Perplexity, который работает полностью локально и запускается даже на слабых ПК. Их собственная модель Jan основана на Qwen3-4B и дообучена для сложных рассуждений и интернет-поиска. В бенчмарке SimpleQA…
Подробнее: https://www.jan.ai/changelog/2026-03-11-jan-openclaw-cli-context
#Jan #JanAi #App #Windows #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
✨ AnythingLLM.com локальный ИИ на ПК и Смартфон Клиент: есть и десктоп (Windos, Linux, macOS (Intel & Arm M)) и веб-клиент (docker) и для Android (ниже). Для браузера Chrome есть расширение: AnythingLLM Browser Companion Для скачивания на ПК нужен VPN!…
Наконец-то: Главная страница AnythingLLM была полностью переработана, чтобы стать более современной и удобной для пользователей. Теперь вы можете начать общение сразу после запуска приложения.
Подробнее: https://github.com/Mintplex-Labs/anything-llm/releases/tag/v1.11.1
#AnythingLLM #LocalAi #AiLocal #App #Windows #MacOS
Please open Telegram to view this post
VIEW IN TELEGRAM
Расшифровка YouTube, рендеринг Playwright JS, FTS5 RAG, поиск DDG, потоковая передача SSE.
Инструмент RAG для локального поиска с использованием Nemotron-Nano-9B-v2-Japanese через vLLM. (без использования облачного API)
Что он делает:
Загружайте документы, URL-адреса или видео с YouTube в качестве источников. SoyLM анализирует их с помощью локальной языковой модели, сохраняет структурированные сводки в SQLite и позволяет общаться с вашими источниками с помощью RAG (FTS5 + BM25) и дополнительного веб-поиска (DuckDuckGo).
(Обсуждение)
#SoyLM #NotebookLM #Nemotron #RAG #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 Echovo - Local TTS & Voice Cloning
Echovo (App Store, платное 6 Euro) — единственное мобильное приложение, где Qwen3-TTS работает нативно и полностью on-device (через MLX + Neural Engine на iPhone A17 Pro и выше). Никакого облака, модель скачивается в приложение (~2 ГБ), клонирует голос с 3 секунд аудио.
⬇️ https://apps.apple.com/ru/app/echovo-tts-voice-cloning/id6758773035
#Echovo #Qwen3TTS #TTS #iPhone #AiLocal #LocalAi
Echovo (App Store, платное 6 Euro) — единственное мобильное приложение, где Qwen3-TTS работает нативно и полностью on-device (через MLX + Neural Engine на iPhone A17 Pro и выше). Никакого облака, модель скачивается в приложение (~2 ГБ), клонирует голос с 3 секунд аудио.
Echovo - Лучший TTS и клонирование голоса Echovo обеспечивает совое современные преобразования текста в речь прямо на ваш iPhone, на базе Qwen3-TTS, полностью работающий на устройстве с ускорением кремния Apple. Ваше сообщение никогда не покидает ваш телефон.
Два мощных режима
- **Text-to-Speech**: Введите или вставьте любой текст и создайте естественную, выразительную речь. Выберите один из нескольких динамиков, настройте параметры качества и управляйте стиль речи с помощью пользовательских инструкций.
- **Voice Clone**: Запишите короткий аудиоклип или загрузите справочный файл, и Echovo сгенерирует речь, соответствующую характеристикам голоса. Клонировать любой голос за считанные секунды.💬 11 языков! Создавайте речь на английском, китайском, японском, корейском, немецком, французском, испанском, русском, португальском, итальянском языках — или позвольте автоматическому обнаружению справиться с этим за вас.
👉 Полностью приватно
Вся обработка происходит на вашем устройстве с использованием фреймворка Apple MLX. Никакие аудиоданные, текст и голосовые образцы никогда не отправляются на внешние серверы. Ваши разговоры остаются вашими.
👉 Основные функции:
- Вывод ИИ на устройстве
- Интернет не требуется после загрузки модели
- Два варианта модели: Base (TTS + голосовое клонирование) и CustomVoice (управление стилем на основе инструкций)
- Показатели производительности в режиме реального времени: RTF, время синтеза, использование памяти, количество токенов и тепловое состояние
- Регулируемые предустановки качества: Fast, Balanced и High - История генерации со встроенным воспроизведением аудио
- Запись справочного звука напрямую или импорт из файлов
- Сохранение и управление эталонной аудиобиблиотекой для быстрого повторного использования
- Темная и светлая тема с элегантным, минимальным интерфейсом
- Обмен сгенерированными аудиофайлами
👉 Как это работает:
1. Скачайте модель (~1,9 ГБ каждая, один раз)
2. Введите текст и нажмите «Сгенерировать»
3. Прослушайте, поделитесь или сохраните результат
👉 Требования:
- iPhone с Apple Silicon (A17 Pro или более поздней версии рекомендуется для лучшей производительности)
- ~2 ГБ бесплатного хранилища на модель
#Echovo #Qwen3TTS #TTS #iPhone #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Приложении для Mac, которое работает в строке меню и позволяет записывать голосовые заметки. ИИ, работающий исключительно локально. Оптимизировано для Apple Silicon.
Создали его, потому что большинство инструментов для диктовки и написания текстов с помощью ИИ были слишком громоздкими для быстрого набора текста, а нужно было что-то быстрое, приватное и простое в использовании, чтобы записывать свои мысли в любое текстовое поле.
Основная идея заключается в том, что вы можете просто говорить как обычно и запрашивать нужный черновик, вместо того чтобы переключаться между режимами или заранее выбирать, что вы пишете: электронное письмо, заметки или что-то еще.
(Обсуждение)
Аналоги по тегу: #Диктовка
#HITOKU #MacOS #ASR #STT #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
🎯 Мультипровайдерская система преобразования текста в речь с конечными точками, совместимыми с OpenAI (OpenAI, DeepInfra, Kokoro, KittenTTS-FastAPI, Orpheus, пользовательские).
📖 Воспроизведение с чтением вслух для PDF/EPUB с озвучиванием с учетом структуры предложения.
⏱️ Выделение послов с помощью дополнительных whisper.cpp временных меток.
🛜 Синхронизация + импорт из библиотеки для переноса документов между устройствами и из папок на сервере.
🗂 Гибкое хранилище со встроенным файловым хранилищем SeaweedFS или внешними бэкендами, совместимыми с S3.
🎧 Экспорт аудиокниг в m4b/mp3 с возможностью возобновления чтения по главам.
🐳 Возможность самостоятельного хостинга с помощью Docker, опциональной аутентификации и автоматической миграции при запуске.
#OpenReader #TTS #EPUB
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - richardr1126/openreader: An open-source read-along document reader server with high-quality TTS options, synchronized…
An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD. - richardr1126/openreader
Local Diffusion — это приложение на Flutter, которое переносит модели Diffusion на Android с помощью потрясающего stable-diffusion.cpp
📱 По-настоящему локальный вывод: генерируйте изображения прямо на своем Android-устройстве.
🚀 Широкая совместимость с моделями:
Поддерживает широкий спектр архитектур: SD1.x, SD2.x, SDXL, SD3/SD3.5, Flux/Flux-schnell, SD-Turbo, SDXL-Turbo и другие.⬇️ Загружайте модели напрямую из популярных источников, таких как Hugging Face и Civitai.
⚡️ Квантование на лету: автоматическое квантование полноточных моделей при загрузке для экономии памяти и потенциального повышения скорости. Поддерживаемые форматы: q8_0, q6_k, q5_0, q5_1, q5_1k, q4_0, q4_1, q4_k, q3_k, q2_k.
Скорость на флагмане: 10–30 сек
Плюсы: Самый мощный, ControlNet, LoRA, полностью локально!
Скачать v0.3 (.APK)
Альтернативы:
- Local Dream - Только SD 1.5 (но с NPU-ускорением) - Лучшая скорость на Snapdragon!
- Off Grid - Улучшенные SDXL-варианты (DreamShaper, Absolute Reality и т.д.) - 5–10 сек (с NPU) - Удобный UI, + LLM в одном приложении, 100% оффлайн!
#LocalDiffusion #App #Android #StableDiffusion #SDXL #SD #Flux #AiImage #text2image #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - rmatif/Local-Diffusion: Run SD1.x/2.x/3.x, SDXL, and FLUX.1 on your phone device
Run SD1.x/2.x/3.x, SDXL, and FLUX.1 on your phone device - rmatif/Local-Diffusion
❤1
Запускайте Stable Diffusion на устройствах Android с ускорением на базе процессора Snapdragon NPU. Также поддерживается вывод на центральном и графическом процессорах.
С NPU-ускорением! - Лучшая скорость на Snapdragon!
Android Stable Diffusion с ускорением на базе процессора Snapdragon NPU Также поддерживает логический вывод на центральном и графическом процессорах!
✨ Особенности:
🎨 txt2img — создавайте изображения на основе текстовых описаний
🖼 img2img — преобразуйте существующие изображения
🎭 inpaint — перерисовывайте выбранные области изображений
- пользовательские модели — импортируйте собственные модели SD1.5 для центрального процессора (в приложении) или нейронного процессора (следуйте руководству по конвертации). Вы можете получить несколько предварительно преобразованных моделей от xororz/sd-qnn или Mr-J-369
- поддержка LoRA — поддержка добавления весов LoRA в пользовательские модели для процессора при импорте.
- веса подсказок — выделение определенных слов в подсказках. Например, (masterpiece:1.5). Тот же формат, что и Automatic1111
- эмбеддинги — поддержка пользовательских эмбеддингов, таких как EasyNegative. Требуется формат SafeTensor. Преобразуйте pt в safetensors с помощью этого
- апскейлеров — 4-кратное увеличение с помощью realesrgan_x4plus_anime_6b и 4x-UltraSharpV2_Lite
📱 https://play.google.com/store/apps/details?id=io.github.xororz.localdream (отфильтровано по NSFW)
(Скачать .APK без цензуры)
Альтернативы:
- Local Diffusion https://t.me/Ai2Local/363
- Off Grid - Улучшенные SDXL-варианты (DreamShaper, Absolute Reality и т.д.) - 5–10 сек (с NPU) - Удобный UI, + LLM в одном приложении, 100% оффлайн!
#LocalDream #App #Android #StableDiffusion #NPU #LoRA #AiImage #text2image #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель генерирует треки до 4,5 минут, работает с текстом и аудио, ошибается в передаче слов песен в 8,55% случаев — это лучше многих коммерческих решений.
Что умеет: создаёт музыку по текстовому описанию или аудиофрагменту, выдаёт отдельно вокал и инструменталы или вместе, запускается на GPU с 10 ГБ VRAM.
Есть быстрая версия — генерация за минуту.
Обновился плагин для ComfyUI.
Интересно сравнить с AceStep 1.5.
🔗 https://levo-demo.github.io/levo_v2_demo/
#LeVo2 #Suno #AiMusic #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🦥 Unsloth Studio - крутая альтернатива LM Studio!
Unsloth представила Unsloth Studio — open-source веб-интерфейс для запуска, обучения и экспорта моделей локально. Публичный запуск состоялся сейчас, хотя сам проект разрабатывался около года.
Это даёт простой единый инструмент вместо набора утилит: можно запускать GGUF и safetensors, собирать датасеты из файлов, дообучать модели и сравнивать их между собой. Есть поддержка text, vision, audio, TTS и embedding, а также экспорт в нужные форматы.
Обзор основных функций Unsloth Studio.
- Запускайте модели локально на Mac, Windows и Linux
- Обучайте более 500 моделей в 2 раза быстрее с уменьшением объема видеопамяти на 70%.
- Поддерживает GGUF, визуальные, звуковые и встраиваемые модели
- Сравнивайте и сражайтесь с моделями бок о бок
- Вызов инструмента для самовосстановления и веб-поиск
- Автоматическое создание наборов данных из PDF, CSV и DOCX
- Выполнение кода позволяет LLMs тестировать код для получения более точных выходных данных
- Экспортировать модели в GGUF, Safetensors и другие!
- Настройка параметров автоматического вывода (temp, top-p и т.д.) + редактирование шаблонов чатов
Обучение работает на NVIDIA GPU, на CPU и Mac доступен в основном режим чата, поддержка MLX, AMD и Intel заявлена позже.
GitHub: https://github.com/unslothai/unsloth
Блог + все, что нужно знать: https://unsloth.ai/docs/new/studio
(Обсуждение-1, Обсуждение-2)
#Unsloth #UnslothStudio #LLM #OpenSource #LocalAI #AI #AiLocal #MachineLearning #GGUF
Unsloth представила Unsloth Studio — open-source веб-интерфейс для запуска, обучения и экспорта моделей локально. Публичный запуск состоялся сейчас, хотя сам проект разрабатывался около года.
Это даёт простой единый инструмент вместо набора утилит: можно запускать GGUF и safetensors, собирать датасеты из файлов, дообучать модели и сравнивать их между собой. Есть поддержка text, vision, audio, TTS и embedding, а также экспорт в нужные форматы.
Обзор основных функций Unsloth Studio.
- Запускайте модели локально на Mac, Windows и Linux
- Обучайте более 500 моделей в 2 раза быстрее с уменьшением объема видеопамяти на 70%.
- Поддерживает GGUF, визуальные, звуковые и встраиваемые модели
- Сравнивайте и сражайтесь с моделями бок о бок
- Вызов инструмента для самовосстановления и веб-поиск
- Автоматическое создание наборов данных из PDF, CSV и DOCX
- Выполнение кода позволяет LLMs тестировать код для получения более точных выходных данных
- Экспортировать модели в GGUF, Safetensors и другие!
- Настройка параметров автоматического вывода (temp, top-p и т.д.) + редактирование шаблонов чатов
Обучение работает на NVIDIA GPU, на CPU и Mac доступен в основном режим чата, поддержка MLX, AMD и Intel заявлена позже.
GitHub: https://github.com/unslothai/unsloth
Блог + все, что нужно знать: https://unsloth.ai/docs/new/studio
(Обсуждение-1, Обсуждение-2)
#Unsloth #UnslothStudio #LLM #OpenSource #LocalAI #AI #AiLocal #MachineLearning #GGUF
Если вы не следили за сообществом Beaver, то могли пропустить эти четыре тихих релиза.
Это значительные улучшения по сравнению с предыдущими версиями, и они звучат так же, как другие модели поколения 4.0 (например, Cydonia 24B 4.3, Rocinante X 12B v1, если вам нравятся эти модели).
(Обсуждение)
#Beaver #Drummer #Skyfall31B #Valkyrie49B #Anubis70B #AnubisMini8B #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
This media is not supported in your browser
VIEW IN TELEGRAM
Уже было о LoopMaker — нативном приложении для Mac, которое генерирует музыку локально на устройстве с помощью фреймворка Apple MLX. Вот что изменилось с тех пор.
Что улучшилось:
Самое большое изменение — переход на ACE-Step 1.5, новейшую музыкальную модель с открытым исходным кодом от ACE Studio. Эта модель по результатам тестирования на SongEval показала результаты между Suno v4.5 и v5, что является огромным скачком по сравнению с тем, на каком уровне находилась генерация локальной музыки еще месяц назад.
Конкретные улучшения качества:
- Разделение инструментов стало намного чище. Треки больше не звучат размыто или сжато
- Значительно улучшилась четкость и естественность вокала. Все еще не на уровне Suno v5, но теперь действительно приятно слушать
- Бас стал более плотным. 808-е и низкие частоты звучат как надо
- Высокочастотные детали (хай-хэты, тарелки, обертоны струнных) звучат более реалистично
- Структура песни на более длинных сессиях стала более целостной. Меньше случайных отклонений
Чем отличается архитектура новой модели:
В ACE-Step 1.5 используется гибридный подход, который отделяет планирование от рендеринга:
1) Языковая модель (на основе Qwen, 0,6–4 млрд параметров) отвечает за планирование песни с помощью метода Chain-of-Thought. Она принимает текстовое описание и создает полный план: темп, тональность, аранжировку, текст, стилистические характеристики.
2) Diffusion Transformer отвечает за синтез звука на основе этого шаблона
Такое разделение означает, что DiT не пытается одновременно понять ваш запрос и сгенерировать звук. Каждый компонент фокусируется на том, что у него получается лучше всего. Аналогичным образом разделение кодировщика текста и декодировщика изображений повысило качество SD-изображений.
Модель также использует внутреннее обучение с подкреплением для выравнивания, а не внешние модели вознаграждения. Без предвзятости в пользу RLHF. Это помогает обеспечить единообразие подсказок на более чем 50 языках.
Технические детали, которые важны для этого сабреддита:
- Модель работает через Apple MLX + графический процессор через Metal
- Требуется менее 8 ГБ памяти. Работает на базе M1/M2 с 16 ГБ памяти
- В модели реализована поддержка тонкой настройки LoRA (пока не в приложении, но в планах)
- Лицензия MIT, обучение на лицензионных и бесплатных данных
Над чем еще нужно поработать:
- Скорость генерации на MLX ниже, чем на CUDA. Минуты, а не секунды. Компромисс ради нативного интерфейса Mac
- Согласованность вокала может варьироваться в зависимости от поколения. Чувствительность к начальным данным по-прежнему высока (проблема «гача»)
- В приложении пока нет обучения с учителем. Если вы хотите провести тонкую настройку, вам нужно будет запустить необработанную модель через Python
- Некоторые жанры (особенно китайский рэп) проигрывают по сравнению с другими
(Обсуждение)
#LoopMaker #ACEStep15 #ACEStep #Suno #AiMusic #AiSong #AiAudio #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Это высокопроизводительная мультимодальная модель с открытым исходным кодом, разработанная совместно с NVIDIA специально для эпохи компьютерных агентов. (По производительности не уступает Holo2/Qwen, но в два раза превосходит их по пропускной способности)
Holotron-12B, обученная на основе открытой модели NVIDIA Nemotron-Nano-2 VL на собственной смеси данных H Company, является результатом тесного сотрудничества исследовательских лабораторий в разработке нового типа модели, оптимизированной в первую очередь для масштабирования и производительности в производственных условиях.
Почему создали Holotron-12B?:
Большинство современных мультимодальных моделей оптимизированы в первую очередь для статического зрения или выполнения инструкций. Однако у Holotron-12B, как и у модели Holo2, другая цель: служить в качестве модели принятия решений для компьютерных агентов, которые должны эффективно воспринимать, анализировать и действовать в интерактивных средах.
При разработке Holotron-12B стремились создать модель, которая могла бы эффективно масштабироваться в производственной среде, обрабатывая длинные контексты с несколькими изображениями, и при этом показывать хорошие результаты в тестах.
🤗Hugging Face: https://huggingface.co/Hcompany/Holotron-12B
📖Подробное техническое описание: https://hcompany.ai/holotron-12b
Пост: https://x.com/hcompany_ai/status/2033851052714320083
(Обсуждение)
#Holotron12B #NVIDIA #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🎬 Переводчик в реальном времени — локальный ИИ-переводчик
Локальный инструмент для перевода в режиме реального времени с использованием ИИ и плавающим интерфейсом на базе Whisper и Qwen.
🔗 https://github.com/GlitchyBlep/Realtime-AI-Translator
(Обсуждение)
#RealtimeInterpreter #Interpreter #Whisper #AiПеревод #Перевод #LocalAi #AiLocal
Локальный инструмент для перевода в режиме реального времени с использованием ИИ и плавающим интерфейсом на базе Whisper и Qwen.
Realtime Interpreter — это полностью локальный инструмент для синхронного перевода с использованием искусственного интеллекта. Он может прослушивать системный звук или микрофонный ввод в режиме реального времени, использовать Whisper для распознавания речи, а затем задействовать локальную большую языковую модель (например, Qwen) для потокового перевода и, наконец, отображать двуязычные субтитры в независимом плавающем окне, которое всегда находится поверх других окон.
Ключевые особенности:
🏠 Полностью локальное приложение: не требует подключения к интернету, что обеспечивает конфиденциальность и исключает утечку данных.
⚡️ Перевод в режиме реального времени с низкой задержкой: от распознавания речи до перевода обычно проходит 2–4 секунды.
🪟 Независимое плавающее окно Always-On-Top: Субтитры с переводом отображаются поверх всех остальных окон, не мешая вашей работе (иногда оно может вести себя нестабильно, но просто перезапустите его, если оно исчезнет 🫠).
🌍 Поддержка 29 языков: от китайского до венгерского, включая большинство основных языков мира.
🎭 Оптимизация для конкретных сценариев: вводите подсказки для конкретных областей (например, «Нейронаука Массачусетского технологического института», «Корейские дорамы», «Непринужденный чат») для оптимизации качества перевода.
🔄 Горячая перезагрузка во время работы: переключайте языки, сценарии и источники аудиовхода на лету, без перезапуска.
(Обсуждение)
#RealtimeInterpreter #Interpreter #Whisper #AiПеревод #Перевод #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Голосовой ввод в автономном режиме обеспечивает профессиональный уровень преобразования речи в текст, работая полностью на вашем устройстве. Пишете ли вы электронные письма, делаете заметки или общаетесь в чате, ваши голосовые данные никогда не покидают ваш телефон.
Характеристики:
- Автономная транскрипция: использует модели глубокого обучения (Parakeet TDT) для полной расшифровки речи на устройстве.
- Поддерживаемые языки: болгарский, хорватский, чешский, датский, нидерландский, английский, эстонский, финский, французский, немецкий, греческий, венгерский, итальянский, латышский, литовский, мальтийский, польский, португальский, румынский, словацкий, словенский, испанский, шведский, русский, украинский
- Клавиатура с голосовым вводом Используйте свой голос для ввода текста.
- Субтитры в реальном времени: субтитры для любого аудио/видео, воспроизводимого на вашем устройстве.
- Конфиденциальность превыше всего: аудиоданные не покидают ваше устройство.
📱 https://play.google.com/store/apps/details?id=dev.notune.transcribe
Проект: https://github.com/notune/android_transcribe_app
✅ Еще есть: parakeet_transcribe https://github.com/RastislavKish/parakeet_transcribe
Многоязычная транскрипция аудио в текст с помощью Parakeet TDT (Восторг тут)
Аналоги по тегу: #Диктовка
#OfflineVoiceInput #transcribe #App #Android #Parakeet #транскрибация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM