Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
ℹ️ STEP3-VL-10B — это облегчённая базовая модель с открытым исходным кодом, призванная изменить представление о компромиссе между компактностью и эффективностью и передовым мультимодальным интеллектом. Несмотря на компактные 10B параметров, STEP3-VL-10B отлично справляется с визуальным восприятием, сложными рассуждениями и ориентированностью на человека.
Она стабильно превосходит модели размером до 10 млрд параметров и конкурирует или превосходит значительно более крупные модели с открытыми весами (в 10–20 раз больше по размеру), такие как GLM-4.6V (106B-A12B), Qwen3-VL-Thinking (235B-A22B), а также флагманские проприетарные модели, такие как Gemini 2.5 Pro и Seed-1.5-VL.
Результаты показывают, что STEP3-VL-10B — это самая мощная модель с открытым исходным кодом в классе параметров 10B.
Модель: https://huggingface.co/stepfun-ai/Step3-VL-10B
Демо: https://huggingface.co/spaces/stepfun-ai/Step3-VL-10B - отлично отвечает на русском!
Обсуждение на Reddit.
#StepfunAi #Step3VL10B #LocalAi #AiLocal #ModelAi #AiModel
Please open Telegram to view this post
VIEW IN TELEGRAM
🥱1
💡 YaGUFF - Конвертер GGUF с графическим интерфейсом, полностью основанный на llama.cpp.
https://github.com/usrname0/YaGGUF
Обсуждение.
#YaGGUF #GGUF #llama #LocalAi #AiLocal #ModelAi #AiModel
👍1
⚡️ V6rge AI Suite - Универсальная автономная ИИ-студия
Не требует программирования. Без облачных технологий. На 100 % локально.

V6rge — это единое приложение, которое предоставляет вам возможности полноценной исследовательской лаборатории в области ИИ. Установите, нажмите и создавайте. (Flux, Music, Agent)
Что он делает :
- Локальный режим: агент, который может управлять вашим ПК, отдавая ему команды .
- Генерация изображений: Flux.1 и Qwen-Image (без подписок, только ваш графический процессор).
- Музыка: генерирует треки с помощью MusicGen.
- Видео: поддержка HunyuanVideo.
- Удаление вокала


Возможности ⚡️
💻 Агент ОС: управляет вашим ПК. Просто введите "Упорядочить папку загрузок" или "Найти все PDF-файлы" и наблюдайте за происходящим.
🎨 Генератор изображений: создавайте изображения студийного качества (доступно несколько флагманских моделей).
🎬 Генератор видео: создавайте видео из текста.
🧊 3D-модели: превращайте любое изображение в 3D-объект за считанные секунды.
🗣 Голос и аудио: Клонируйте голоса и создавайте музыку.
🛠 Инструменты: Повышение качества до 4K, удаление фона, разделение вокала.

Проект: https://github.com/Dedsec-b/v6rge-releases-/
Скачать v0.1.5 - Для Windows / Linux
Обсуждение на Reddit.
#V6rge #AISuite #Flux #AiAgent #LocalAi #AiLocal #SoftAi #AiSoft #Windows
👍2
🔍 Решения для локальных глубоких исследований:

1) https://gptr.dev
https://github.com/assafelovic/gpt-researcher

2) https://deerflow.tech
https://github.com/bytedance/deer-flow

3) https://github.com/Alibaba-NLP/DeepResearch - Tongyi DeepResearch

4) https://github.com/stanford-oval/storm - STORM

5) https://github.com/ItzCrazyKns/Perplexica - Perplexica

6) https://github.com/MiroMindAI/MiroFlow

7) https://github.com/murtaza-nasir/maestro

8) https://github.com/sentient-agi/ROMA

9) https://blog.langchain.com/deep-agents /

10) https://github.com/miurla/morphic

11) https://github.com/edoigtrd/ubiquite

12) https://github.com/SalesforceAIResearch/enterprise-deep-research

13) https://github.com/ruc-datalab/DeepAnalyze

14) https://github.com/RUC-NLPIR/DeepAgent

15) https://github.com/vamplabAI/sgr-deep-research

16) https://github.com/AstroPilot-AI/Denario

17) https://github.com/CMBAgents/cmbagent

18) https://github.com/sagar-n/deepagents/tree/v3.0.0/deep-research-agents-v3

19) https://github.com/anilsharmay/full-stack-local-deep-research-agent

20) https://github.com/microsoft/autogen

21) https://github.com/huggingface/smolagents/tree/main/examples/open_deep_research

22) https://github.com/rupeshs/verity - Verity — это поисковая система на основе искусственного интеллекта в стиле Perplexity, которая работает полностью локально на компьютерах с ИИ. Она сочетает в себе поиск на основе SearXNG, извлечение данных и локальные рассуждения на основе больших языковых моделей для генерации обоснованных, проверяемых ответов без использования облачных сервисов.(Обсуждение)

Обсуждение на Reddit.
#DeepResearchAgent #DeepResearch #AiAgent #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🤖 Cowork-Local-LLM

🤖 Настольный ИИ-помощник с поддержкой локальной модели — агент, совместимый с OpenAI SDK, с системой памяти, файловыми операциями, веб-поиском и современным пользовательским интерфейсом. Поддерживает vLLM, Ollama, Qwen, Llama и другие.
(На локальной модели: Qwen3-30b)
Сандбокска для исполнения кода пока что нет...

Проект: https://github.com/vakovalskii/Cowork-Local-LLM

MacOS: https://github.com/vakovalskii/Cowork-Local-LLM/releases/download/v0.0.3/Agent.Cowork-0.0.3-arm64.dmg

Windows: https://github.com/vakovalskii/Cowork-Local-LLM/releases/download/v0.0.4/Agent.Cowork.0.0.3.exe

Кому такое полезно?
Тем кто не любит или боится кодовых IDE и не понимает CLI (попробовать точно стоит очень хорошие UI паттеры заложили ребята (и китайцы скопировали) на старте в Cowork)
(Автор)
#AgentCowork #CoworkLocalLLM #Cowork #LocalAi #AiLocal #SoftAi #AiSoft #Windows #MacOS
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🔈 Модель: CosyVoice 3 от Alibaba— TTS-модель с клонированием голоса за 3 секунды!

⚡️ Модель вышла в опенсорс с коммерческой лицензией. При скромных 0,5 млрд параметров обходит по качеству более тяжёлых конкурентов.

Что умеет:
• Работает с 9 языками: русский, английский, китайский, японский, корейский, немецкий, испанский, французский и итальянский

• Клонирует голос по 3 секундам аудио — воспроизводит тембр, акцент, скорость речи, ударения и даже речевые особенности

• Поддержка инструкций: поддерживает различные инструкции, такие как языки, диалекты, эмоции, скорость, громкость и т. д.

• Распознаёт эмоции и дефекты речи: чавканье, шипение, картавость, всхлипы

• Генерирует в реальном времени с задержкой около 150 мс

• Позволяет вручную корректировать произношение отдельных слов — удобно для сложных терминов

• Доступна для коммерческого использования в любых проектах

🔗 Демо: https://funaudiollm.github.io/cosyvoice3/
https://huggingface.co/FunAudioLLM/Fun-CosyVoice3-0.5B-2512
Квант: BF16 занимает всего 1,29 ГБ!
Есть Форк CosyVoice_for_MacOs → https://github.com/v3ucn/CosyVoice_for_MacOs
Самый простой и удобный способ в 2026 году на macOS:

1) Установи Miniconda (или Anaconda), если ещё нет
https://docs.conda.io/en/latest/miniconda.html
2) Создай среду и установи зависимости:
conda create -n cosy3 python=3.10 -y
conda activate cosy3

# Важно: используй pip с зеркалом, если в РФ/Европе медленно без VPN
pip install -r https://raw.githubusercontent.com/FunAudioLLM/CosyVoice/main/requirements.txt -i https://mirrors.aliyuan.com/pypi/simple/

# Если sox не находится — ставим через brew
brew install sox

3) Скачай модель (самый быстрый способ через huggingface-cli)
# Установи hf-hub если ещё нет
pip install huggingface_hub[cli]

huggingface-cli download FunAudioLLM/Fun-CosyVoice3-0.5B-2512 --local-dir pretrained_models/Fun-CosyVoice3-0.5B
huggingface-cli download FunAudioLLM/CosyVoice-ttsfrd --local-dir pretrained_models/CosyVoice-ttsfrd

4) Запусти WebUI (самый удобный интерфейс)
git clone --recursive https://github.com/FunAudioLLM/CosyVoice.git
cd CosyVoice

# Если submodule не скачался — выполняй
git submodule update --init --recursive

# Сам запуск
python webui.py --port 8501 --model_dir pretrained_models/Fun-CosyVoice3-0.5B
Открой в браузере http://127.0.0.1:8501
Там будет интерфейс похожий на XTTS / Piper / StyleTTS — вводишь текст, выбираешь режим (zero-shot, instruct, cross-lingual), грузишь референсный аудио-файл (3–10 сек голоса) и генерируешь.

#TTS #CosyVoice3 #MacOS #LocalAi #AiLocal #ModelAi #AiModel #AiVoice
Please open Telegram to view this post
VIEW IN TELEGRAM
🔈 Bantr: локальное безлимитное преобразование текста в речь TTS для Apple Silicon

Bantr - Приложение для преобразования текста в речь с естественным звучанием, которое работает исключительно на вашем Mac.

🤖 Более 150 естественных, выразительных голосов
🔒 Работает исключительно на вашем Mac (без облачного хранилища)
🆓 Не требует входа в систему, не расходует квоту
💸 Не требует подписки (единовременная покупка, бесплатные обновления в будущем)
⚡️ Быстрое локальное создание с использованием платформы Apple MLX
Вот что будет дальше:
🧬 Клонируйте пользовательские голоса и эмоции, используя небольшой пример
📄 Загружайте документы (pdf, epub, docx и т.д.)
🎙 Генерируйте диалоги с несколькими дикторами.
Поддержка дополнительных языков
Улучшено управление проектами
И многое другое из ваших отзывов

Полностью локальное, без облака, использует современные модели (включая XTTS-подобные). Пишут, что качество очень хорошее, работает на M-чипах мгновенно!
Демо: https://www.youtube.com/watch?v=HqcXhWqLrS0
Поддерживается: macOS 15 и выше с Apple Silicon (M1, M2, M3, M4, M5...).
Цена: 60$ единоразово!
https://getbantr.com
#TTS #Bantr #SoftAI #AiSoft #MacOS #LocalAi #AiLocal #AiVoice
Please open Telegram to view this post
VIEW IN TELEGRAM
🔈 TTS-WebUI - Веб-интерфейс для создания аудио!

TTS WebUI — это бесплатный веб-интерфейс на основе gradio для преобразования текста в речь (TTS), создания аудио и музыки.
Этот веб-интерфейс позволяет генерировать аудио из текста с помощью более чем 30 моделей ИИ, включая Bark, MusicGen, Tortoise и многие другие.

Единый веб-интерфейс Gradio + React с расширениями для ACE-Step, Kimi Audio, Piper TTS, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, Stable Audio, MMS, StyleTTS2, MAGNet, AudioGen, MusicGen, Tortoise, RVC, Vocos, Demucs, SeamlessM4T и Bark!
(Текущий размер базовой установки составляет около 10,7 ГБ. Для каждой модели потребуется дополнительно 2–8 ГБ свободного места.)

🔗 https://ttswebui.com
Демо: https://www.youtube.com/watch?v=SSmxO-ccCXE
Проект: https://github.com/rsxdalv/TTS-WebUI
#TTSWebUI #TTS #WebUI #AiVoice #LocalAi #AiLocal #Windows
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
⬇️ GPU Poor LLM Arena - Рейтинг "маленьких" моделей

Если у вас нет топового ПК, это не повод не использовать LLM

GPU-Poor LLM Gladiator Arena - это LMарена для маленьких моделей.

Проект вырос из простой идеи: стало много реально сильных tiny/compact моделей и захотелось сделать понятную площадку, где их можно сравнивать. Плюс это playground для их теста.

Чтобы быстро попробовать:
Зайдите в Space - вкладка Battle Arena - введите промпт - “Generate Responses” - проголосуйте. А потом загляните в лидерборды и сравните динамику...

🔗 https://huggingface.co/spaces/k-mktr/gpu-poor-llm-arena
#lmArena #poorllmArena #gpupoorllmarena #LocalAi #AiLocal #ModelAi #AiModel #huggingface
Please open Telegram to view this post
VIEW IN TELEGRAM
🔍 AI Model Tracker - Отслеживание моделей ИИ

Инструмент для отслеживания моделей ИИ, подходящих для локального использования (т. е. с объёмом видеопамяти менее 24 ГБ) в Hugging Space и Modelscope.

AI Model Tracker — это настольное приложение, которое запускается в один клик и автоматически находит и систематизирует модели ИИ в интернете. Оно решает проблему «разброса моделей», когда модели разбросаны повсюду, а вы не знаете, какие у вас есть, какие новые и какие будут работать на вашем оборудовании.
Ключевые особенности:
- Автоматическое обнаружение - Scraps Hugging Face, ModelScope (китайские модели) и многое другое для новых моделей с искусственным интеллектом
- С учетом аппаратного обеспечения - Ориентирован на модели, работающие с видеопамятью объемом менее 24 ГБ (большинство потребительских графических процессоров).
- Красивая панель управления - веб-интерфейс для просмотра, фильтрации и поиска моделей
- Отслеживание китайских моделей - Особое внимание Qwen, DeepSeek и другим китайским моделям
- Оценки размера - Приблизительные оценки в ГБ, чтобы вы знали размеры загрузок
- Метаданные GGUF - извлекает подробную информацию о квантовании GGUF
- Автозапуск - автоматически открывает браузер при запуске
- Еженедельные обзоры - Автоматические отчеты о новых моделях.

https://github.com/nigelp/ai-model-tracker
Обсуждение.
#AIModelTracker #LocalAi #AiLocal #ModelAi #AiModel #huggingface
Please open Telegram to view this post
VIEW IN TELEGRAM
💡 vLLM-MLX - vLLM для Apple Silicon

Вывод, аналогичный vLLM, для Apple Silicon — обработка текста, изображений, видео и аудио с ускорением на графическом процессоре Mac.

Сервер, совместимый с OpenAI, для Apple Silicon. Запуск языковых моделей (LLama, Qwen-VL, LLaVA) с непрерывной пакетной обработкой, вызовом инструментов MCP и мультимодальной поддержкой. Собственный бэкенд MLX, более 400 токенов в секунду.
Характеристики:
- Мультимодальный — текст, изображения, видео и аудио на одной платформе
- Собственное ускорение с помощью графического процессора на Apple Silicon (M1, M2, M3, M4)
- Собственные голоса для преобразования текста в речь — испанский, французский, китайский, японский и ещё 5 языков
- Совместимость с OpenAI API — прямая замена клиента OpenAI
- Вызов инструментов MCP — интеграция внешних инструментов через протокол контекста модели
- Пейджинговый кэш KV — эффективное с точки зрения памяти кэширование с общим префиксом
- Непрерывная пакетная обработка — высокая пропускная способность для нескольких пользователей, работающих одновременно.

Максимальная производительность на M4:
- Llama-3.2-1B-4bit → 464 ток/с
- Qwen3-0.6B → 402 ток/с
- Whisper STT → 197x в реальном времени
Работает со стандартным OpenAI Python SDK - просто укажите его на localhost.
🔗 https://github.com/waybarrios/vllm-mlx
Обсуждение.
#vLLMMLX #vLLM #MLX #MacOS #LocalAi #AiLocal
🛠 Dyad - Гибкий, локальный, с открытым исходным кодом
конструктор приложений с ИИ

Бесплатное приложение для создания ИИ с открытым исходным кодом - альтернатива v0, Lovable и Bolt!

Что оно может делать:
- Создание приложения с помощью перетаскивания элементов интерфейса
- Запуск локально на вашем компьютере
- Отсутствие необходимости подписки
- Полный контроль над вашим кодом

Любая модель ИИ, включая бесплатные версии!
Вы не привязаны к одному поставщику или модели. Используйте собственные ключи API с такими топовыми моделями, как Gemini 3, GPT-5 от OpenAI, Claude Sonnet 4.5 и другими.
У вас мощный компьютер? С помощью Dyad можно легко запускать модели локально с помощью Ollama для обеспечения полной конфиденциальности данных.
Идеально подходит для: Быстрого прототипирования без привязки к поставщику

Для: macOS (Apple Silicon), #macOS (Intel), #Windows
🔗 https://www.dyad.sh/
#Dyad #SoftAI #AiSoft #LocalAi #AiLocal
👍1