Media is too big
VIEW IN TELEGRAM
Самая мощная локальная модель для создания музыки, которая превосходит большинство коммерческих альтернатив!
ACE-Step 1.5 — это музыкальная модель с открытым исходным кодом, которая может сгенерировать полноценную песню примерно за 2 секунды на A100, работает локально на обычном ПК (около 4 ГБ видеопамяти) и превосходит Suno по общепринятым оценочным показателям.
Ключевые особенности ACE-Step 1.5:
- Качество: превосходит Suno по общим оценкам
- Скорость: полная песня на A100 за 2 секунды
- Локальная версия: ~4 ГБ видеопамяти, менее 10 секунд на RTX 3090
- LoRA: обучите свой собственный стиль на нескольких песнях
- Лицензия: MIT, бесплатная для коммерческого использования
- Данные: полностью авторизованные, плюс синтетические
Это уже поддерживается в Comfy. Лицензия MIT. Также доступна демоверсия HuggingFace! Практически весь пакет — поддерживаются LoRA, несколько различных моделей для адаптации к разным потребностям, функции наложения и перекрашивания. Это наиболее близкая к Suno и аналогичным платформам с открытым исходным кодом разработка.
GitHub: https://github.com/ace-step/ACE-Step-1.5
https://ace-step.github.io
https://ace-step.github.io/ace-step-v1.5.github.io/
Пост: https://xcancel.com/acemusicAI/status/2018731205546684678
Демо: https://huggingface.co/spaces/ACE-Step/ACE-Step
(Обсуждение-1, Обсуждение-2)
Еще про нее с видео.
На ней: https://ai-jukebox.com - бесплатная музыка без перерывов, и вы можете проголосовать за то, какой жанр и тема будут сгенерированы следующими.
#ACEStep15 #ACEStep #Suno #AiMusic #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Представьте себе GPT‑4o, если бы у него была душа и он не был бы на поводке. (Без цензуры!)
💡 Что такое Helcyon Mercury?
Helcyon — это диалоговый ИИ с функцией присутствия, разработанный для пользователей, которым важны глубина, понимание тональности и единообразие в длинных диалогах.
Создан для:
- Естественная беседа, которая не становится скучной или однообразной
- Творческая работа: рассказы, письма, поддержка повествования
- Административные и профессиональные письменные задания
- Глубокая ролевая игра и захватывающее взаимодействие с персонажем
- Эмоционально интеллектуальное отражение реакции
Философия дизайна:
- Ясность важнее корпоративного стиля
- Острие важнее безопасности
- Ритм важнее заполнения
- Присутствие важнее шаблонов
🔧 Что у него хорошо получается:
✅ Последовательная идентичность — отсутствие смены тона или сброса настроек
✅ Эмоциональный интеллект — отражает намерения и энергию
✅ Мастерство ролевой игры — погружение, осознанность, живость
✅ Отслеживание контекста — запоминает нить разговора
✅ Реальные задачи — письма от администратора, переписывание, составление резюме
✅ Поток повествования — чёткая структура и естественный голос
✅ Контекст от 16 000 до 32 000 символов — содержательные беседы
✅ Вибрация GPT-4o — чёткая, актуальная, отзывчивая
✅ Нулевой фильтр — без уклонений, без подобострастия
Создано в XeyonAI — компании, специализирующейся на суверенном диалоговом ИИ с реальной эмоциональной составляющей.
(Обсуждение)
#XeyonAI #HelcyonMercury12B #HelcyonMercury #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
huggingface.co
XeyonAI/Mistral-Helcyon-Mercury-12b-v3.0-GGUF · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
✨ Выпущены LocalAI v3.9 и v3.10: собственные агенты, пользовательский интерфейс для создания видео и унифицированные серверы GPU
LocalAI — это альтернатива OpenAI и Anthropic, набравшая 42 000 звёзд на Github и ставшая одной из первых в этой области! LocalAI может работать локально, без использования графического процессора. Он стремится обеспечить те же функции, что и OpenAI, например, позволяет генерировать изображения, аудио, текст и создавать мощные конвейеры агентов.
Очень подробно в большом посте на форуме.
Если у вас не было возможности раньше познакомиться с LocalAI, посмотрите это видео на YouTube: https://www.youtube.com/watch?v=PDqYhB9nNHA (там не показаны новые функции, но вы получите представление!)
Выпуск 3.10.0: https://github.com/mudler/LocalAI/releases/tag/v3.10.0
Выпуск 3.9.0: https://github.com/mudler/LocalAI/releases/tag/v3.9.0
#LocalAi #AiLocal
LocalAI — это альтернатива OpenAI и Anthropic, набравшая 42 000 звёзд на Github и ставшая одной из первых в этой области! LocalAI может работать локально, без использования графического процессора. Он стремится обеспечить те же функции, что и OpenAI, например, позволяет генерировать изображения, аудио, текст и создавать мощные конвейеры агентов.
Очень подробно в большом посте на форуме.
Если у вас не было возможности раньше познакомиться с LocalAI, посмотрите это видео на YouTube: https://www.youtube.com/watch?v=PDqYhB9nNHA (там не показаны новые функции, но вы получите представление!)
Выпуск 3.10.0: https://github.com/mudler/LocalAI/releases/tag/v3.10.0
Выпуск 3.9.0: https://github.com/mudler/LocalAI/releases/tag/v3.9.0
#LocalAi #AiLocal
Новая компактная, специально разработанная для кодинга в агентном режиме и локальной разработки!
Построена на базе Qwen3-Next-80B-A3B-Base с гибридным вниманием и MoE, где активно используется всего 3B параметров при общем размере 80B
В Qwen на этот раз уделили внимание обучению на исполнении задач с реальными средами, обратной связи от выполнения кода, специализированных экспертах для кодинга и дистилляции экспертов в одну модель
70%+ на SWE-Bench Verified (один из лучших показателей среди открытых моделей)
HuggingFace, Github, Блог, ModelScope
👉 Reddit: Технический отчёт Qwen3-Coder: обобщение вызовов инструментов, взлом вознаграждений, общие знания
👉 Пост про нее на Хабр.
#Qwen3Next80B #Qwen3Next #Qwen3CoderNext #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Локальное преобразование речи в текст для Windows/macOS с глобальной горячей клавишей.
✨ Особенности:
Глобальная горячая клавиша: начните записывать речь из любого приложения
Автоматическая вставка: запись непосредственно курсором.
Автоматическая отправка: При необходимости автоматически отправьте свою транскрипцию с помощью ENTER
Возможность работы в автономном режиме: после загрузки моделей интернет не требуется.
Локальная обработка: голосовые данные никогда не покидают ваш компьютер
Эффективные модели: Выберите небольшую и эффективную модель для центрального процессора
Поддержка CUDA: Или используйте графический процессор nVidia в моделях большего размера
Обнаружение голосовой активности: автоматическое отключение после длительного молчания и предотвращение галлюцинаций
Кроссплатформенность: работает в Windows и macOS
Настраиваемый: настройка горячих клавиш, моделей и многого другого
Теперь доступно в Windows и macOS!
(Обсуждение поста автора)
#WhisperKey #Whisper #Windows #macOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - PinW/whisper-key-local: Global hotkeys to record speech and transcribe directly to your cursor
Global hotkeys to record speech and transcribe directly to your cursor - PinW/whisper-key-local
Генератор аудиокниг с использованием аннотаций скриптов LLM и клонированием голоса Qwen3 TTS — лаунчер Pinokio.
LLM преобразует ваш текст в аннотированный сценарий, а TTS оживляет его с помощью пользовательских или клонированных голосов. поддерживает эмоциональные подсказки.
(Обсуждение поста Автора)
Есть: VoxCPM2 https://voxcpm.com
TTS без токенизации для генерации многоязычной речи, креативного голосового дизайна и реалистичного клонирования
Есть: GPT-SoVITS-WebUI
Мощный веб-интерфейс для преобразования речи в текст и обратно.
#AlexandriaAudiobook #Alexandria #Audiobook #TTS #Qwen3TTS #Pinokio #EdgeTTS #LocalAi #AiLocal #VoxCPM
Please open Telegram to view this post
VIEW IN TELEGRAM
Self-hosted ИИ-бухгалтерия для анализа чеков и инвойсов!
Позвольте ИИ наконец позаботиться о ваших налогах, отсканировать чеки и проанализировать ваши расходы!
Самостоятельное бухгалтерское приложение для фрилансеров, инди-разработчиков и малого бизнеса.
💥 TaxHacker — open source-приложение для автоматизации учёта расходов и доходов, ориентированное на приватное использование в режиме self-hosted. Система превращает фотографии чеков, PDF-инвойсы и банковские выписки в структурированную финансовую базу данных с помощью больших языковых моделей.
🧠 Как это работает:
Пользователь загружает документы, после чего ИИ извлекает ключевые данные, включая суммы, даты, контрагентов и назначения платежей. Процесс построен на LLM и может быть адаптирован под конкретные форматы документов за счёт настраиваемых промптов. Поддерживается обработка документов на любых языках, включая рукописные чеки.
📊 Система поддерживает мультивалютные операции с автоматической конвертацией по историческому курсу на дату транзакции, а также учёт криптоактивов. Возможна детализация одного чека на несколько транзакций, гибкая категоризация, привязка к проектам и хранение дополнительных пользовательских полей. Данные можно фильтровать и экспортировать для дальнейшей работы или налоговой отчётности. Приложение совместимо с моделями OpenAI, Google Gemini и Mistral.
🎯 TaxHacker закрывает нишу приватной ИИ-бухгалтерии для фрилансеров, предпринимателей и небольших команд, которым важно не передавать финансовые данные сторонним сервисам. Инструмент снижает ручную нагрузку, уменьшает количество ошибок при вводе данных и делает подготовку финансовой отчётности быстрее и прозрачнее.
https://github.com/vas3k/TaxHacker
#TaxHacker #AiTax #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
💥 Ultimate Vocal Remover — бесплатный инструмент на базе нейросетей для разделения вокала и инструментальной части трека, а также очистки аудио от шумов и артефактов.
🧠 Ultimate Vocal Remover использует обученные модели разделения источников, которые анализируют аудиодорожку и раскладывают её на отдельные компоненты. Пользователь загружает файл, выбирает модель и получает раздельные дорожки без ручной настройки и сложных параметров.
📊 Инструмент работает локально и поддерживает Windows, macOS и Linux. Интерфейс максимально простой, установка не требует регистрации или подписки. Проект распространяется бесплатно с открытым исходным кодом, а качество разделения сопоставимо с платными сервисами.
🎯 Ultimate Vocal Remover делает профессиональные аудио-задачи доступными без затрат. Он подходит для музыкантов, подкастеров, монтажёров и контент-мейкеров, которым нужно быстро отделить вокал, сделать минусовку или очистить звук без облаков и ограничений.
🔗 https://github.com/Anjok07/ultimatevocalremovergui
#UltimateVocalRemover #VocalRemover #Windows #macOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Французская #Mistral AI выпустила второе поколение своих моделей распознавания речи. Главные акценты - задержка менее 200 мс, локальная работа без облака и открытая лицензия Apache 2.0.
Демо: https://huggingface.co/spaces/mistralai/Voxtral-Mini-Realtime
Что важно:
✧ потоковое распознавание в реальном времени
✧ открытые веса и on-device-запуск
✧ WER около 4% на бенчмарке FLEURS
✧ поддержка диаризации и 13 языков (включая русский)
✧ низкая стоимость через API
Mistral AI делает акцент и на стоимости сервиса. Использование Voxtral Mini Transcribe 2 через API оценивается в 0,003 доллара за минуту обработки (примерно 0,27 рубля), а потоковое распознавание в реальном времени - в 0,006 доллара за минуту (около 0,55 рубля). Это заметно ниже цен многих конкурентов при сопоставимых характеристиках.
Voxtral Realtime уже доступна для скачивания на платформе Hugging Face, а обе модели интегрированы в API Mistral.
Вместе с релизом компания запустила обновлённый аудио-плейграунд в Mistral Studio. Пользователи могут бесплатно загрузить до десяти аудиофайлов размером до 1 ГБ каждый, выбрать формат временных меток, включить диаризацию и добавить контекстные подсказки для улучшения качества распознавания. Поддерживаются популярные форматы - MP3, WAV, M4A, FLAC и OGG.🔗 Подробнее...
#VoxtralRealtime #Voxtral #VoxtralTranscribe2 #Transcribe #Транскрибация #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM