Она стабильно превосходит модели размером до 10 млрд параметров и конкурирует или превосходит значительно более крупные модели с открытыми весами (в 10–20 раз больше по размеру), такие как GLM-4.6V (106B-A12B), Qwen3-VL-Thinking (235B-A22B), а также флагманские проприетарные модели, такие как Gemini 2.5 Pro и Seed-1.5-VL.
Результаты показывают, что STEP3-VL-10B — это самая мощная модель с открытым исходным кодом в классе параметров 10B.
Модель: https://huggingface.co/stepfun-ai/Step3-VL-10B
Демо: https://huggingface.co/spaces/stepfun-ai/Step3-VL-10B - отлично отвечает на русском!
Обсуждение на Reddit.
#StepfunAi #Step3VL10B #LocalAi #AiLocal #ModelAi #AiModel
Please open Telegram to view this post
VIEW IN TELEGRAM
🥱1
💡 YaGUFF - Конвертер GGUF с графическим интерфейсом, полностью основанный на llama.cpp.
https://github.com/usrname0/YaGGUF
Обсуждение.
#YaGGUF #GGUF #llama #LocalAi #AiLocal #ModelAi #AiModel
https://github.com/usrname0/YaGGUF
Обсуждение.
#YaGGUF #GGUF #llama #LocalAi #AiLocal #ModelAi #AiModel
👍1
⚡️ V6rge AI Suite - Универсальная автономная ИИ-студия
Не требует программирования. Без облачных технологий. На 100 % локально.
V6rge — это единое приложение, которое предоставляет вам возможности полноценной исследовательской лаборатории в области ИИ. Установите, нажмите и создавайте. (Flux, Music, Agent)
Проект: https://github.com/Dedsec-b/v6rge-releases-/
Скачать v0.1.5 - Для Windows / Linux
Обсуждение на Reddit.
#V6rge #AISuite #Flux #AiAgent #LocalAi #AiLocal #SoftAi #AiSoft #Windows
Не требует программирования. Без облачных технологий. На 100 % локально.
V6rge — это единое приложение, которое предоставляет вам возможности полноценной исследовательской лаборатории в области ИИ. Установите, нажмите и создавайте. (Flux, Music, Agent)
Что он делает :
- Локальный режим: агент, который может управлять вашим ПК, отдавая ему команды .
- Генерация изображений: Flux.1 и Qwen-Image (без подписок, только ваш графический процессор).
- Музыка: генерирует треки с помощью MusicGen.
- Видео: поддержка HunyuanVideo.
- Удаление вокала
Возможности ⚡️
💻 Агент ОС: управляет вашим ПК. Просто введите "Упорядочить папку загрузок" или "Найти все PDF-файлы" и наблюдайте за происходящим.
🎨 Генератор изображений: создавайте изображения студийного качества (доступно несколько флагманских моделей).
🎬 Генератор видео: создавайте видео из текста.
🧊 3D-модели: превращайте любое изображение в 3D-объект за считанные секунды.
🗣 Голос и аудио: Клонируйте голоса и создавайте музыку.
🛠 Инструменты: Повышение качества до 4K, удаление фона, разделение вокала.
Проект: https://github.com/Dedsec-b/v6rge-releases-/
Скачать v0.1.5 - Для Windows / Linux
Обсуждение на Reddit.
#V6rge #AISuite #Flux #AiAgent #LocalAi #AiLocal #SoftAi #AiSoft #Windows
👍2
1) https://gptr.dev
https://github.com/assafelovic/gpt-researcher
2) https://deerflow.tech
https://github.com/bytedance/deer-flow
3) https://github.com/Alibaba-NLP/DeepResearch - Tongyi DeepResearch
4) https://github.com/stanford-oval/storm - STORM
5) https://github.com/ItzCrazyKns/Perplexica - Perplexica
6) https://github.com/MiroMindAI/MiroFlow
7) https://github.com/murtaza-nasir/maestro
8) https://github.com/sentient-agi/ROMA
9) https://blog.langchain.com/deep-agents /
10) https://github.com/miurla/morphic
11) https://github.com/edoigtrd/ubiquite
12) https://github.com/SalesforceAIResearch/enterprise-deep-research
13) https://github.com/ruc-datalab/DeepAnalyze
14) https://github.com/RUC-NLPIR/DeepAgent
15) https://github.com/vamplabAI/sgr-deep-research
16) https://github.com/AstroPilot-AI/Denario
17) https://github.com/CMBAgents/cmbagent
18) https://github.com/sagar-n/deepagents/tree/v3.0.0/deep-research-agents-v3
19) https://github.com/anilsharmay/full-stack-local-deep-research-agent
20) https://github.com/microsoft/autogen
21) https://github.com/huggingface/smolagents/tree/main/examples/open_deep_research
22) https://github.com/rupeshs/verity - Verity — это поисковая система на основе искусственного интеллекта в стиле Perplexity, которая работает полностью локально на компьютерах с ИИ. Она сочетает в себе поиск на основе SearXNG, извлечение данных и локальные рассуждения на основе больших языковых моделей для генерации обоснованных, проверяемых ответов без использования облачных сервисов.(Обсуждение)
Обсуждение на Reddit.
#DeepResearchAgent #DeepResearch #AiAgent #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
GPT Researcher
GPT Researcher - Autonomous AI Research Agent
GPT Researcher is an open-source autonomous AI research agent that produces deep, multi-source research reports with inline citations. #1 on Carnegie Mellon's DeepResearchGym benchmark.
🤖 Настольный ИИ-помощник с поддержкой локальной модели — агент, совместимый с OpenAI SDK, с системой памяти, файловыми операциями, веб-поиском и современным пользовательским интерфейсом. Поддерживает vLLM, Ollama, Qwen, Llama и другие.
(На локальной модели: Qwen3-30b)
Сандбокска для исполнения кода пока что нет...
Проект: https://github.com/vakovalskii/Cowork-Local-LLM
MacOS: https://github.com/vakovalskii/Cowork-Local-LLM/releases/download/v0.0.3/Agent.Cowork-0.0.3-arm64.dmg
Windows: https://github.com/vakovalskii/Cowork-Local-LLM/releases/download/v0.0.4/Agent.Cowork.0.0.3.exe
Кому такое полезно?
Тем кто не любит или боится кодовых IDE и не понимает CLI (попробовать точно стоит очень хорошие UI паттеры заложили ребята (и китайцы скопировали) на старте в Cowork)
(Автор)
#AgentCowork #CoworkLocalLLM #Cowork #LocalAi #AiLocal #SoftAi #AiSoft #Windows #MacOS
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ Модель вышла в опенсорс с коммерческой лицензией. При скромных 0,5 млрд параметров обходит по качеству более тяжёлых конкурентов.
Что умеет:
• Работает с 9 языками: русский, английский, китайский, японский, корейский, немецкий, испанский, французский и итальянский
• Клонирует голос по 3 секундам аудио — воспроизводит тембр, акцент, скорость речи, ударения и даже речевые особенности
• Поддержка инструкций: поддерживает различные инструкции, такие как языки, диалекты, эмоции, скорость, громкость и т. д.
• Распознаёт эмоции и дефекты речи: чавканье, шипение, картавость, всхлипы
• Генерирует в реальном времени с задержкой около 150 мс
• Позволяет вручную корректировать произношение отдельных слов — удобно для сложных терминов
• Доступна для коммерческого использования в любых проектах
🔗 Демо: https://funaudiollm.github.io/cosyvoice3/
https://huggingface.co/FunAudioLLM/Fun-CosyVoice3-0.5B-2512
Квант: BF16 занимает всего 1,29 ГБ!
Есть Форк CosyVoice_for_MacOs → https://github.com/v3ucn/CosyVoice_for_MacOs
Самый простой и удобный способ в 2026 году на macOS:
1) Установи Miniconda (или Anaconda), если ещё нет
https://docs.conda.io/en/latest/miniconda.html
2) Создай среду и установи зависимости:
conda create -n cosy3 python=3.10 -y
conda activate cosy3
# Важно: используй pip с зеркалом, если в РФ/Европе медленно без VPN
pip install -r https://raw.githubusercontent.com/FunAudioLLM/CosyVoice/main/requirements.txt -i https://mirrors.aliyuan.com/pypi/simple/
# Если sox не находится — ставим через brew
brew install sox
3) Скачай модель (самый быстрый способ через huggingface-cli)
# Установи hf-hub если ещё нет
pip install huggingface_hub[cli]
huggingface-cli download FunAudioLLM/Fun-CosyVoice3-0.5B-2512 --local-dir pretrained_models/Fun-CosyVoice3-0.5B
huggingface-cli download FunAudioLLM/CosyVoice-ttsfrd --local-dir pretrained_models/CosyVoice-ttsfrd
4) Запусти WebUI (самый удобный интерфейс)
git clone --recursive https://github.com/FunAudioLLM/CosyVoice.git
cd CosyVoice
# Если submodule не скачался — выполняй
git submodule update --init --recursive
# Сам запуск
python webui.py --port 8501 --model_dir pretrained_models/Fun-CosyVoice3-0.5B
Открой в браузере http://127.0.0.1:8501
Там будет интерфейс похожий на XTTS / Piper / StyleTTS — вводишь текст, выбираешь режим (zero-shot, instruct, cross-lingual), грузишь референсный аудио-файл (3–10 сек голоса) и генерируешь.
#TTS #CosyVoice3 #MacOS #LocalAi #AiLocal #ModelAi #AiModel #AiVoice
Please open Telegram to view this post
VIEW IN TELEGRAM
Bantr - Приложение для преобразования текста в речь с естественным звучанием, которое работает исключительно на вашем Mac.
🤖 Более 150 естественных, выразительных голосов
🔒 Работает исключительно на вашем Mac (без облачного хранилища)
🆓 Не требует входа в систему, не расходует квоту
💸 Не требует подписки (единовременная покупка, бесплатные обновления в будущем)
⚡️ Быстрое локальное создание с использованием платформы Apple MLX
Вот что будет дальше:
🧬 Клонируйте пользовательские голоса и эмоции, используя небольшой пример
📄 Загружайте документы (pdf, epub, docx и т.д.)
🎙 Генерируйте диалоги с несколькими дикторами.
✅ Поддержка дополнительных языков
✅ Улучшено управление проектами
✅ И многое другое из ваших отзывов
Полностью локальное, без облака, использует современные модели (включая XTTS-подобные). Пишут, что качество очень хорошее, работает на M-чипах мгновенно!
Демо: https://www.youtube.com/watch?v=HqcXhWqLrS0
Поддерживается: macOS 15 и выше с Apple Silicon (M1, M2, M3, M4, M5...).
Цена: 60$ единоразово!
https://getbantr.com
#TTS #Bantr #SoftAI #AiSoft #MacOS #LocalAi #AiLocal #AiVoice
Please open Telegram to view this post
VIEW IN TELEGRAM
Gumroad
Bantr: Private, Unlimited Text-to-Speech for Apple Silicon
Compatibility: Apple Silicon Macs (M1 and newer) running macOS 15 or later.Most text-to-speech tools run on the cloud - limiting your usage with subscriptions, training corporate models with your d...
TTS WebUI — это бесплатный веб-интерфейс на основе gradio для преобразования текста в речь (TTS), создания аудио и музыки.
Этот веб-интерфейс позволяет генерировать аудио из текста с помощью более чем 30 моделей ИИ, включая Bark, MusicGen, Tortoise и многие другие.
Единый веб-интерфейс Gradio + React с расширениями для ACE-Step, Kimi Audio, Piper TTS, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, Stable Audio, MMS, StyleTTS2, MAGNet, AudioGen, MusicGen, Tortoise, RVC, Vocos, Demucs, SeamlessM4T и Bark!
(Текущий размер базовой установки составляет около 10,7 ГБ. Для каждой модели потребуется дополнительно 2–8 ГБ свободного места.)
🔗 https://ttswebui.com
Демо: https://www.youtube.com/watch?v=SSmxO-ccCXE
Проект: https://github.com/rsxdalv/TTS-WebUI
#TTSWebUI #TTS #WebUI #AiVoice #LocalAi #AiLocal #Windows
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Если у вас нет топового ПК, это не повод не использовать LLM
GPU-Poor LLM Gladiator Arena - это LMарена для маленьких моделей.
Проект вырос из простой идеи: стало много реально сильных tiny/compact моделей и захотелось сделать понятную площадку, где их можно сравнивать. Плюс это playground для их теста.
Чтобы быстро попробовать:
Зайдите в Space - вкладка Battle Arena - введите промпт - “Generate Responses” - проголосуйте. А потом загляните в лидерборды и сравните динамику...
🔗 https://huggingface.co/spaces/k-mktr/gpu-poor-llm-arena
#lmArena #poorllmArena #gpupoorllmarena #LocalAi #AiLocal #ModelAi #AiModel #huggingface
Please open Telegram to view this post
VIEW IN TELEGRAM
Инструмент для отслеживания моделей ИИ, подходящих для локального использования (т. е. с объёмом видеопамяти менее 24 ГБ) в Hugging Space и Modelscope.
AI Model Tracker — это настольное приложение, которое запускается в один клик и автоматически находит и систематизирует модели ИИ в интернете. Оно решает проблему «разброса моделей», когда модели разбросаны повсюду, а вы не знаете, какие у вас есть, какие новые и какие будут работать на вашем оборудовании.
✨ Ключевые особенности:
- Автоматическое обнаружение - Scraps Hugging Face, ModelScope (китайские модели) и многое другое для новых моделей с искусственным интеллектом
- С учетом аппаратного обеспечения - Ориентирован на модели, работающие с видеопамятью объемом менее 24 ГБ (большинство потребительских графических процессоров).
- Красивая панель управления - веб-интерфейс для просмотра, фильтрации и поиска моделей
- Отслеживание китайских моделей - Особое внимание Qwen, DeepSeek и другим китайским моделям
- Оценки размера - Приблизительные оценки в ГБ, чтобы вы знали размеры загрузок
- Метаданные GGUF - извлекает подробную информацию о квантовании GGUF
- Автозапуск - автоматически открывает браузер при запуске
- Еженедельные обзоры - Автоматические отчеты о новых моделях.
https://github.com/nigelp/ai-model-tracker
Обсуждение.
#AIModelTracker #LocalAi #AiLocal #ModelAi #AiModel #huggingface
Please open Telegram to view this post
VIEW IN TELEGRAM
💡 vLLM-MLX - vLLM для Apple Silicon
Вывод, аналогичный vLLM, для Apple Silicon — обработка текста, изображений, видео и аудио с ускорением на графическом процессоре Mac.
Сервер, совместимый с OpenAI, для Apple Silicon. Запуск языковых моделей (LLama, Qwen-VL, LLaVA) с непрерывной пакетной обработкой, вызовом инструментов MCP и мультимодальной поддержкой. Собственный бэкенд MLX, более 400 токенов в секунду.
Максимальная производительность на M4:
- Llama-3.2-1B-4bit → 464 ток/с
- Qwen3-0.6B → 402 ток/с
- Whisper STT → 197x в реальном времени
Работает со стандартным OpenAI Python SDK - просто укажите его на localhost.
🔗 https://github.com/waybarrios/vllm-mlx
Обсуждение.
#vLLMMLX #vLLM #MLX #MacOS #LocalAi #AiLocal
Вывод, аналогичный vLLM, для Apple Silicon — обработка текста, изображений, видео и аудио с ускорением на графическом процессоре Mac.
Сервер, совместимый с OpenAI, для Apple Silicon. Запуск языковых моделей (LLama, Qwen-VL, LLaVA) с непрерывной пакетной обработкой, вызовом инструментов MCP и мультимодальной поддержкой. Собственный бэкенд MLX, более 400 токенов в секунду.
Характеристики:
- Мультимодальный — текст, изображения, видео и аудио на одной платформе
- Собственное ускорение с помощью графического процессора на Apple Silicon (M1, M2, M3, M4)
- Собственные голоса для преобразования текста в речь — испанский, французский, китайский, японский и ещё 5 языков
- Совместимость с OpenAI API — прямая замена клиента OpenAI
- Вызов инструментов MCP — интеграция внешних инструментов через протокол контекста модели
- Пейджинговый кэш KV — эффективное с точки зрения памяти кэширование с общим префиксом
- Непрерывная пакетная обработка — высокая пропускная способность для нескольких пользователей, работающих одновременно.
Максимальная производительность на M4:
- Llama-3.2-1B-4bit → 464 ток/с
- Qwen3-0.6B → 402 ток/с
- Whisper STT → 197x в реальном времени
Работает со стандартным OpenAI Python SDK - просто укажите его на localhost.
🔗 https://github.com/waybarrios/vllm-mlx
Обсуждение.
#vLLMMLX #vLLM #MLX #MacOS #LocalAi #AiLocal
GitHub
GitHub - waybarrios/vllm-mlx: High-performance OpenAI and Anthropic compatible LLM inference server for Apple Silicon. Native MLX…
High-performance OpenAI and Anthropic compatible LLM inference server for Apple Silicon. Native MLX, continuous batching, multimodal models, MCP tool calling, and Claude Code support. - waybarrios/...
🛠 Dyad - Гибкий, локальный, с открытым исходным кодом
конструктор приложений с ИИ
Бесплатное приложение для создания ИИ с открытым исходным кодом - альтернатива v0, Lovable и Bolt!
Что оно может делать:
- Создание приложения с помощью перетаскивания элементов интерфейса
- Запуск локально на вашем компьютере
- Отсутствие необходимости подписки
- Полный контроль над вашим кодом
Любая модель ИИ, включая бесплатные версии!
Вы не привязаны к одному поставщику или модели. Используйте собственные ключи API с такими топовыми моделями, как Gemini 3, GPT-5 от OpenAI, Claude Sonnet 4.5 и другими.
У вас мощный компьютер? С помощью Dyad можно легко запускать модели локально с помощью Ollama для обеспечения полной конфиденциальности данных.
Для: macOS (Apple Silicon), #macOS (Intel), #Windows
🔗 https://www.dyad.sh/
#Dyad #SoftAI #AiSoft #LocalAi #AiLocal
конструктор приложений с ИИ
Бесплатное приложение для создания ИИ с открытым исходным кодом - альтернатива v0, Lovable и Bolt!
Что оно может делать:
- Создание приложения с помощью перетаскивания элементов интерфейса
- Запуск локально на вашем компьютере
- Отсутствие необходимости подписки
- Полный контроль над вашим кодом
Любая модель ИИ, включая бесплатные версии!
Вы не привязаны к одному поставщику или модели. Используйте собственные ключи API с такими топовыми моделями, как Gemini 3, GPT-5 от OpenAI, Claude Sonnet 4.5 и другими.
У вас мощный компьютер? С помощью Dyad можно легко запускать модели локально с помощью Ollama для обеспечения полной конфиденциальности данных.
Идеально подходит для: Быстрого прототипирования без привязки к поставщику
Для: macOS (Apple Silicon), #macOS (Intel), #Windows
🔗 https://www.dyad.sh/
#Dyad #SoftAI #AiSoft #LocalAi #AiLocal
👍1