✨ Выпущены LocalAI v3.9 и v3.10: собственные агенты, пользовательский интерфейс для создания видео и унифицированные серверы GPU
LocalAI — это альтернатива OpenAI и Anthropic, набравшая 42 000 звёзд на Github и ставшая одной из первых в этой области! LocalAI может работать локально, без использования графического процессора. Он стремится обеспечить те же функции, что и OpenAI, например, позволяет генерировать изображения, аудио, текст и создавать мощные конвейеры агентов.
Очень подробно в большом посте на форуме.
Если у вас не было возможности раньше познакомиться с LocalAI, посмотрите это видео на YouTube: https://www.youtube.com/watch?v=PDqYhB9nNHA (там не показаны новые функции, но вы получите представление!)
Выпуск 3.10.0: https://github.com/mudler/LocalAI/releases/tag/v3.10.0
Выпуск 3.9.0: https://github.com/mudler/LocalAI/releases/tag/v3.9.0
#LocalAi #AiLocal
LocalAI — это альтернатива OpenAI и Anthropic, набравшая 42 000 звёзд на Github и ставшая одной из первых в этой области! LocalAI может работать локально, без использования графического процессора. Он стремится обеспечить те же функции, что и OpenAI, например, позволяет генерировать изображения, аудио, текст и создавать мощные конвейеры агентов.
Очень подробно в большом посте на форуме.
Если у вас не было возможности раньше познакомиться с LocalAI, посмотрите это видео на YouTube: https://www.youtube.com/watch?v=PDqYhB9nNHA (там не показаны новые функции, но вы получите представление!)
Выпуск 3.10.0: https://github.com/mudler/LocalAI/releases/tag/v3.10.0
Выпуск 3.9.0: https://github.com/mudler/LocalAI/releases/tag/v3.9.0
#LocalAi #AiLocal
Новая компактная, специально разработанная для кодинга в агентном режиме и локальной разработки!
Построена на базе Qwen3-Next-80B-A3B-Base с гибридным вниманием и MoE, где активно используется всего 3B параметров при общем размере 80B
В Qwen на этот раз уделили внимание обучению на исполнении задач с реальными средами, обратной связи от выполнения кода, специализированных экспертах для кодинга и дистилляции экспертов в одну модель
70%+ на SWE-Bench Verified (один из лучших показателей среди открытых моделей)
HuggingFace, Github, Блог, ModelScope
👉 Reddit: Технический отчёт Qwen3-Coder: обобщение вызовов инструментов, взлом вознаграждений, общие знания
👉 Пост про нее на Хабр.
#Qwen3Next80B #Qwen3Next #Qwen3CoderNext #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Локальное преобразование речи в текст для Windows/macOS с глобальной горячей клавишей.
✨ Особенности:
Глобальная горячая клавиша: начните записывать речь из любого приложения
Автоматическая вставка: запись непосредственно курсором.
Автоматическая отправка: При необходимости автоматически отправьте свою транскрипцию с помощью ENTER
Возможность работы в автономном режиме: после загрузки моделей интернет не требуется.
Локальная обработка: голосовые данные никогда не покидают ваш компьютер
Эффективные модели: Выберите небольшую и эффективную модель для центрального процессора
Поддержка CUDA: Или используйте графический процессор nVidia в моделях большего размера
Обнаружение голосовой активности: автоматическое отключение после длительного молчания и предотвращение галлюцинаций
Кроссплатформенность: работает в Windows и macOS
Настраиваемый: настройка горячих клавиш, моделей и многого другого
Теперь доступно в Windows и macOS!
(Обсуждение поста автора)
#WhisperKey #Whisper #Windows #macOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - PinW/whisper-key-local: Global hotkeys to record speech and transcribe directly to your cursor
Global hotkeys to record speech and transcribe directly to your cursor - PinW/whisper-key-local
Генератор аудиокниг с использованием аннотаций скриптов LLM и клонированием голоса Qwen3 TTS — лаунчер Pinokio.
LLM преобразует ваш текст в аннотированный сценарий, а TTS оживляет его с помощью пользовательских или клонированных голосов. поддерживает эмоциональные подсказки.
(Обсуждение поста Автора)
Есть: VoxCPM2 https://voxcpm.com
TTS без токенизации для генерации многоязычной речи, креативного голосового дизайна и реалистичного клонирования
Есть: GPT-SoVITS-WebUI
Мощный веб-интерфейс для преобразования речи в текст и обратно.
#AlexandriaAudiobook #Alexandria #Audiobook #TTS #Qwen3TTS #Pinokio #EdgeTTS #LocalAi #AiLocal #VoxCPM
Please open Telegram to view this post
VIEW IN TELEGRAM
Self-hosted ИИ-бухгалтерия для анализа чеков и инвойсов!
Позвольте ИИ наконец позаботиться о ваших налогах, отсканировать чеки и проанализировать ваши расходы!
Самостоятельное бухгалтерское приложение для фрилансеров, инди-разработчиков и малого бизнеса.
💥 TaxHacker — open source-приложение для автоматизации учёта расходов и доходов, ориентированное на приватное использование в режиме self-hosted. Система превращает фотографии чеков, PDF-инвойсы и банковские выписки в структурированную финансовую базу данных с помощью больших языковых моделей.
🧠 Как это работает:
Пользователь загружает документы, после чего ИИ извлекает ключевые данные, включая суммы, даты, контрагентов и назначения платежей. Процесс построен на LLM и может быть адаптирован под конкретные форматы документов за счёт настраиваемых промптов. Поддерживается обработка документов на любых языках, включая рукописные чеки.
📊 Система поддерживает мультивалютные операции с автоматической конвертацией по историческому курсу на дату транзакции, а также учёт криптоактивов. Возможна детализация одного чека на несколько транзакций, гибкая категоризация, привязка к проектам и хранение дополнительных пользовательских полей. Данные можно фильтровать и экспортировать для дальнейшей работы или налоговой отчётности. Приложение совместимо с моделями OpenAI, Google Gemini и Mistral.
🎯 TaxHacker закрывает нишу приватной ИИ-бухгалтерии для фрилансеров, предпринимателей и небольших команд, которым важно не передавать финансовые данные сторонним сервисам. Инструмент снижает ручную нагрузку, уменьшает количество ошибок при вводе данных и делает подготовку финансовой отчётности быстрее и прозрачнее.
https://github.com/vas3k/TaxHacker
#TaxHacker #AiTax #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
💥 Ultimate Vocal Remover — бесплатный инструмент на базе нейросетей для разделения вокала и инструментальной части трека, а также очистки аудио от шумов и артефактов.
🧠 Ultimate Vocal Remover использует обученные модели разделения источников, которые анализируют аудиодорожку и раскладывают её на отдельные компоненты. Пользователь загружает файл, выбирает модель и получает раздельные дорожки без ручной настройки и сложных параметров.
📊 Инструмент работает локально и поддерживает Windows, macOS и Linux. Интерфейс максимально простой, установка не требует регистрации или подписки. Проект распространяется бесплатно с открытым исходным кодом, а качество разделения сопоставимо с платными сервисами.
🎯 Ultimate Vocal Remover делает профессиональные аудио-задачи доступными без затрат. Он подходит для музыкантов, подкастеров, монтажёров и контент-мейкеров, которым нужно быстро отделить вокал, сделать минусовку или очистить звук без облаков и ограничений.
🔗 https://github.com/Anjok07/ultimatevocalremovergui
#UltimateVocalRemover #VocalRemover #Windows #macOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Французская #Mistral AI выпустила второе поколение своих моделей распознавания речи. Главные акценты - задержка менее 200 мс, локальная работа без облака и открытая лицензия Apache 2.0.
Демо: https://huggingface.co/spaces/mistralai/Voxtral-Mini-Realtime
Что важно:
✧ потоковое распознавание в реальном времени
✧ открытые веса и on-device-запуск
✧ WER около 4% на бенчмарке FLEURS
✧ поддержка диаризации и 13 языков (включая русский)
✧ низкая стоимость через API
Mistral AI делает акцент и на стоимости сервиса. Использование Voxtral Mini Transcribe 2 через API оценивается в 0,003 доллара за минуту обработки (примерно 0,27 рубля), а потоковое распознавание в реальном времени - в 0,006 доллара за минуту (около 0,55 рубля). Это заметно ниже цен многих конкурентов при сопоставимых характеристиках.
Voxtral Realtime уже доступна для скачивания на платформе Hugging Face, а обе модели интегрированы в API Mistral.
Вместе с релизом компания запустила обновлённый аудио-плейграунд в Mistral Studio. Пользователи могут бесплатно загрузить до десяти аудиофайлов размером до 1 ГБ каждый, выбрать формат временных меток, включить диаризацию и добавить контекстные подсказки для улучшения качества распознавания. Поддерживаются популярные форматы - MP3, WAV, M4A, FLAC и OGG.🔗 Подробнее...
#VoxtralRealtime #Voxtral #VoxtralTranscribe2 #Transcribe #Транскрибация #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
💥 Полностью опенсорсный и локальный NotebookLM — в HyperBookLM достаточно загрузить URL-ссылку, PDF или текст,
а дальше можно:
• Задавать вопросы по содержанию;
• Получать удобные конспекты;
• Создавать наглядные майнд-мапы;
• Превращать в презентации;
• Генерировать аудио-выжимки.
Всё это — локально и 100% с открытым кодом.
Он похож на Google NotebookLM, но с ключевым отличием: активные веб-агенты, которые умеют работать с живым интернетом.
🔗 https://github.com/hyperbrowserai/hyperbooklm
#HyperBookLM #NotebookLM #LocalAi #AiLocal
а дальше можно:
• Задавать вопросы по содержанию;
• Получать удобные конспекты;
• Создавать наглядные майнд-мапы;
• Превращать в презентации;
• Генерировать аудио-выжимки.
Всё это — локально и 100% с открытым кодом.
Он похож на Google NotebookLM, но с ключевым отличием: активные веб-агенты, которые умеют работать с живым интернетом.
🧩 HyperbookLM — рабочее пространство для исследований и обучения, куда можно добавлять:
— URL-страницы
— PDF-документы
— текстовые файлы
ИИ позволяет задавать вопросы сразу по всем источникам, строить сводки и визуализации.
⚙️ Ключевые возможности:
— интеллектуальный поиск по материалам
— веб-агенты, анализирующие сайты
— автоматическое создание mind map
— экспорт в презентации
— аудио-саммари для прослушивания
🚀 Чем лучше аналогов:
— полностью open-source
— не привязан к Google
— работает с живым вебом
— не ограничен одним ИИ-вендором
🔗 https://github.com/hyperbrowserai/hyperbooklm
#HyperBookLM #NotebookLM #LocalAi #AiLocal
This media is not supported in your browser
VIEW IN TELEGRAM
🔊 Вышла мощнейшая нейронка для улучшения качества звука в несколько раз — NovaSR превращает аудио с частотой 16 кГц в супер-чёткое 48 кГц.
Работает как магия — обрабатывает 3600 секунд звука за одну (!) секунду. Сама модель — крошечная, весит всего 52 КБ, что меньше 5-секундного аудио-файла.
🔗 GitHub лежит тут, а демка доступна здесь.
#NovaSR #AiAudio #LocalAi #AiLocal
Работает как магия — обрабатывает 3600 секунд звука за одну (!) секунду. Сама модель — крошечная, весит всего 52 КБ, что меньше 5-секундного аудио-файла.
#NovaSR #AiAudio #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM