Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
Media is too big
VIEW IN TELEGRAM
Модель: ACE-Step 1.5 - Наконец-то вышла альтернатива Suno с открытым исходным кодом!

Самая мощная локальная модель для создания музыки, которая превосходит большинство коммерческих альтернатив!

ACE-Step 1.5 — это музыкальная модель с открытым исходным кодом, которая может сгенерировать полноценную песню примерно за 2 секунды на A100, работает локально на обычном ПК (около 4 ГБ видеопамяти) и превосходит Suno по общепринятым оценочным показателям.
Ключевые особенности ACE-Step 1.5:
- Качество: превосходит Suno по общим оценкам
- Скорость: полная песня на A100 за 2 секунды
- Локальная версия: ~4 ГБ видеопамяти, менее 10 секунд на RTX 3090
- LoRA: обучите свой собственный стиль на нескольких песнях
- Лицензия: MIT, бесплатная для коммерческого использования
- Данные: полностью авторизованные, плюс синтетические

Это уже поддерживается в Comfy. Лицензия MIT. Также доступна демоверсия HuggingFace! Практически весь пакет — поддерживаются LoRA, несколько различных моделей для адаптации к разным потребностям, функции наложения и перекрашивания. Это наиболее близкая к Suno и аналогичным платформам с открытым исходным кодом разработка.

🔗 https://acemusic.ai
GitHub: https://github.com/ace-step/ACE-Step-1.5
https://ace-step.github.io
https://ace-step.github.io/ace-step-v1.5.github.io/
Пост: https://xcancel.com/acemusicAI/status/2018731205546684678
Демо: https://huggingface.co/spaces/ACE-Step/ACE-Step
(Обсуждение-1, Обсуждение-2)
Еще про нее с видео.

На ней: https://ai-jukebox.com - бесплатная музыка без перерывов, и вы можете проголосовать за то, какой жанр и тема будут сгенерированы следующими.
#ACEStep15 #ACEStep #Suno #AiMusic #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Helcyon-Mercury-12B-v3.0 - Создано для пользователей, которым не нужен чат-бот. Им нужно присутствие.

Представьте себе GPT‑4o, если бы у него была душа и он не был бы на поводке. (Без цензуры!)

💡 Что такое Helcyon Mercury?
Helcyon — это диалоговый ИИ с функцией присутствия, разработанный для пользователей, которым важны глубина, понимание тональности и единообразие в длинных диалогах.
Создан для:
- Естественная беседа, которая не становится скучной или однообразной
- Творческая работа: рассказы, письма, поддержка повествования
- Административные и профессиональные письменные задания
- Глубокая ролевая игра и захватывающее взаимодействие с персонажем
- Эмоционально интеллектуальное отражение реакции

Философия дизайна:
- Ясность важнее корпоративного стиля
- Острие важнее безопасности
- Ритм важнее заполнения
- Присутствие важнее шаблонов

🔧 Что у него хорошо получается:
Последовательная идентичность — отсутствие смены тона или сброса настроек
Эмоциональный интеллект — отражает намерения и энергию
Мастерство ролевой игры — погружение, осознанность, живость
Отслеживание контекста — запоминает нить разговора
Реальные задачи — письма от администратора, переписывание, составление резюме
Поток повествования — чёткая структура и естественный голос
Контекст от 16 000 до 32 000 символов — содержательные беседы
Вибрация GPT-4o — чёткая, актуальная, отзывчивая
Нулевой фильтр — без уклонений, без подобострастия

Создано в XeyonAI — компании, специализирующейся на суверенном диалоговом ИИ с реальной эмоциональной составляющей.

🔗 https://huggingface.co/XeyonAI/Mistral-Helcyon-Mercury-12b-v3.0-GGUF
(Обсуждение)
#XeyonAI #HelcyonMercury12B #HelcyonMercury #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Выпущены LocalAI v3.9 и v3.10: собственные агенты, пользовательский интерфейс для создания видео и унифицированные серверы GPU

LocalAI — это альтернатива OpenAI и Anthropic, набравшая 42 000 звёзд на Github и ставшая одной из первых в этой области! LocalAI может работать локально, без использования графического процессора. Он стремится обеспечить те же функции, что и OpenAI, например, позволяет генерировать изображения, аудио, текст и создавать мощные конвейеры агентов.
Очень подробно в большом посте на форуме.

Если у вас не было возможности раньше познакомиться с LocalAI, посмотрите это видео на YouTube: https://www.youtube.com/watch?v=PDqYhB9nNHA (там не показаны новые функции, но вы получите представление!)
Выпуск 3.10.0: https://github.com/mudler/LocalAI/releases/tag/v3.10.0
Выпуск 3.9.0: https://github.com/mudler/LocalAI/releases/tag/v3.9.0
#LocalAi #AiLocal
Модель: Qwen3-Coder-Next

Новая компактная, специально разработанная для кодинга в агентном режиме и локальной разработки!

Построена на базе Qwen3-Next-80B-A3B-Base с гибридным вниманием и MoE, где активно используется всего 3B параметров при общем размере 80B

В Qwen на этот раз уделили внимание обучению на исполнении задач с реальными средами, обратной связи от выполнения кода, специализированных экспертах для кодинга и дистилляции экспертов в одну модель

70%+ на SWE-Bench Verified (один из лучших показателей среди открытых моделей)

HuggingFace, Github, Блог, ModelScope
👉 (Обсуждение-1, Обсуждение-2)
👉 Reddit: Технический отчёт Qwen3-Coder: обобщение вызовов инструментов, взлом вознаграждений, общие знания
👉 Пост про нее на Хабр.

#Qwen3Next80B #Qwen3Next #Qwen3CoderNext #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🎙 Whisper Key — локальный конвертер речи в текст

Локальное преобразование речи в текст для Windows/macOS с глобальной горячей клавишей.
Особенности:
Глобальная горячая клавиша: начните записывать речь из любого приложения
Автоматическая вставка: запись непосредственно курсором.
Автоматическая отправка: При необходимости автоматически отправьте свою транскрипцию с помощью ENTER
Возможность работы в автономном режиме: после загрузки моделей интернет не требуется.
Локальная обработка: голосовые данные никогда не покидают ваш компьютер
Эффективные модели: Выберите небольшую и эффективную модель для центрального процессора
Поддержка CUDA: Или используйте графический процессор nVidia в моделях большего размера
Обнаружение голосовой активности: автоматическое отключение после длительного молчания и предотвращение галлюцинаций
Кроссплатформенность: работает в Windows и macOS
Настраиваемый: настройка горячих клавиш, моделей и многого другого

🔗 https://github.com/PinW/whisper-key-local/
Теперь доступно в Windows и macOS!
(Обсуждение поста автора)
#WhisperKey #Whisper #Windows #macOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📖🔈 Александрия - Генератор Аудиокниг

Генератор аудиокниг с использованием аннотаций скриптов LLM и клонированием голоса Qwen3 TTS — лаунчер Pinokio.

LLM преобразует ваш текст в аннотированный сценарий, а TTS оживляет его с помощью пользовательских или клонированных голосов. поддерживает эмоциональные подсказки.
🔗 https://github.com/Finrandojin/alexandria-audiobook
(Обсуждение поста Автора)

🔈 Есть еще такая онлайн версия: https://vadash.github.io/EdgeTTS/

Есть: VoxCPM2 https://voxcpm.com
TTS без токенизации для генерации многоязычной речи, креативного голосового дизайна и реалистичного клонирования
🔗 https://github.com/OpenBMB/VoxCPM

Есть: GPT-SoVITS-WebUI
Мощный веб-интерфейс для преобразования речи в текст и обратно.
🔗 https://github.com/RVC-Boss/GPT-SoVITS

#AlexandriaAudiobook #Alexandria #Audiobook #TTS #Qwen3TTS #Pinokio #EdgeTTS #LocalAi #AiLocal #VoxCPM
Please open Telegram to view this post
VIEW IN TELEGRAM
💰 TaxHacker — автономный бухгалтерский ИИ

Self-hosted ИИ-бухгалтерия для анализа чеков и инвойсов!

Позвольте ИИ наконец позаботиться о ваших налогах, отсканировать чеки и проанализировать ваши расходы!
Самостоятельное бухгалтерское приложение для фрилансеров, инди-разработчиков и малого бизнеса.

💥 TaxHacker — open source-приложение для автоматизации учёта расходов и доходов, ориентированное на приватное использование в режиме self-hosted. Система превращает фотографии чеков, PDF-инвойсы и банковские выписки в структурированную финансовую базу данных с помощью больших языковых моделей.
🧠 Как это работает:
Пользователь загружает документы, после чего ИИ извлекает ключевые данные, включая суммы, даты, контрагентов и назначения платежей. Процесс построен на LLM и может быть адаптирован под конкретные форматы документов за счёт настраиваемых промптов. Поддерживается обработка документов на любых языках, включая рукописные чеки.

📊 Система поддерживает мультивалютные операции с автоматической конвертацией по историческому курсу на дату транзакции, а также учёт криптоактивов. Возможна детализация одного чека на несколько транзакций, гибкая категоризация, привязка к проектам и хранение дополнительных пользовательских полей. Данные можно фильтровать и экспортировать для дальнейшей работы или налоговой отчётности. Приложение совместимо с моделями OpenAI, Google Gemini и Mistral.

🎯 TaxHacker закрывает нишу приватной ИИ-бухгалтерии для фрилансеров, предпринимателей и небольших команд, которым важно не передавать финансовые данные сторонним сервисам. Инструмент снижает ручную нагрузку, уменьшает количество ошибок при вводе данных и делает подготовку финансовой отчётности быстрее и прозрачнее.

🔗 https://taxhacker.app
https://github.com/vas3k/TaxHacker
#TaxHacker #AiTax #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔈 Ultimate Vocal Remover бесплатно отделяет вокал и музыку с помощью ИИ

💥 Ultimate Vocal Remover — бесплатный инструмент на базе нейросетей для разделения вокала и инструментальной части трека, а также очистки аудио от шумов и артефактов.

🧠 Ultimate Vocal Remover использует обученные модели разделения источников, которые анализируют аудиодорожку и раскладывают её на отдельные компоненты. Пользователь загружает файл, выбирает модель и получает раздельные дорожки без ручной настройки и сложных параметров.

📊 Инструмент работает локально и поддерживает Windows, macOS и Linux. Интерфейс максимально простой, установка не требует регистрации или подписки. Проект распространяется бесплатно с открытым исходным кодом, а качество разделения сопоставимо с платными сервисами.

🎯 Ultimate Vocal Remover делает профессиональные аудио-задачи доступными без затрат. Он подходит для музыкантов, подкастеров, монтажёров и контент-мейкеров, которым нужно быстро отделить вокал, сделать минусовку или очистить звук без облаков и ограничений.
🔗 https://github.com/Anjok07/ultimatevocalremovergui
#UltimateVocalRemover #VocalRemover #Windows #macOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: 📱 Voxtral Transcribe 2 от Mistral AI

Французская #Mistral AI выпустила второе поколение своих моделей распознавания речи. Главные акценты - задержка менее 200 мс, локальная работа без облака и открытая лицензия Apache 2.0.
Демо: https://huggingface.co/spaces/mistralai/Voxtral-Mini-Realtime
Что важно:
✧ потоковое распознавание в реальном времени
✧ открытые веса и on-device-запуск
✧ WER около 4% на бенчмарке FLEURS
✧ поддержка диаризации и 13 языков (включая русский)
✧ низкая стоимость через API

Mistral AI делает акцент и на стоимости сервиса. Использование Voxtral Mini Transcribe 2 через API оценивается в 0,003 доллара за минуту обработки (примерно 0,27 рубля), а потоковое распознавание в реальном времени - в 0,006 доллара за минуту (около 0,55 рубля). Это заметно ниже цен многих конкурентов при сопоставимых характеристиках.

Voxtral Realtime уже доступна для скачивания на платформе Hugging Face, а обе модели интегрированы в API Mistral.

Вместе с релизом компания запустила обновлённый аудио-плейграунд в Mistral Studio. Пользователи могут бесплатно загрузить до десяти аудиофайлов размером до 1 ГБ каждый, выбрать формат временных меток, включить диаризацию и добавить контекстные подсказки для улучшения качества распознавания. Поддерживаются популярные форматы - MP3, WAV, M4A, FLAC и OGG.
🔗 Подробнее...

#VoxtralRealtime #Voxtral #VoxtralTranscribe2 #Transcribe #Транскрибация #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM