Local Ai
Vellium — это настольное приложение с открытым исходным кодом, ориентированное на локальное использование, для общения с ИИ, ролевых игр и написания больших текстов.
Последние обновления в основном направлены на упрощение использования локальных голосовых и модельных настроек.
Режим реального времени теперь поддерживает микрофонный ввод, локальное распознавание речи или распознавание речи, совместимое с Whisper, потоковую передачу текста в речь, вложения, контекст экрана и обычные инструменты чата — и все это в одном голосовом интерфейсе.
Локальную голосовую модель можно установить и настроить прямо в приложении. Whisper Large v3 Turbo Q5_0 доступен для распознавания, а TeraTTSv2 обеспечивает воспроизведение на английском и русском языках в режиме реального времени. Процесс преобразования текста в речь остается активным между ответами, что позволяет избежать полной перезагрузки модели при каждом ответе.
Также была упрощена настройка llama.cpp. Vellium может обнаруживать существующие llama-server установки, модели GGUF и запущенные локальные конечные точки, а затем настраивать их как управляемый бэкенд.
Было внесено множество мелких исправлений: более надежная потоковая передача TTS, более безопасное извлечение архива во время выполнения, улучшенное обнаружение конечных точек, улучшенная обработка тайм-аутов, поддержка системных сертификатов и упрощенная навигация по настройкам.
Чаты, персонажи, книги знаний, писательские проекты и коллекции знаний хранятся локально в SQLite.
Vellium работает на macOS, Windows и Linux и поддерживает API, совместимые с OpenAI, OpenRouter, LM Studio, Ollama и KoboldCpp.
(Обсуждение)
Ранее было: https://t.me/Ai2Local/230
#Vellium #MacOS #Windows #Linux #ChatRP #RP #Whisper #TTS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🎨 Private Diffusion - Local Art - Изображение Локально
Оно использует как нейронный движок, так и графический процессор (а также ядра NAX на M5 и A19 Pro) для логического вывода.
Приложение пока в разработке, но уже поддерживает около 10 моделей, включая Krea 2 Turbo и Kroma, Z-Image-Turbo.
Модели меньшего размера также работают на iPhone и iPad.
Ссылка на TestFlight для тех, кто хочет попробовать.
🔗 https://testflight.apple.com/join/DQwfQsEg
(Из обсуждения)
#PrivateDiffusion #LocalArt #AiArt #Zimage #Flux2 #Krea2 #ERNIEimage #iPhone #iPad #MacOS #AiLocal #LocalAi
Оно использует как нейронный движок, так и графический процессор (а также ядра NAX на M5 и A19 Pro) для логического вывода.
Приложение пока в разработке, но уже поддерживает около 10 моделей, включая Krea 2 Turbo и Kroma, Z-Image-Turbo.
Модели меньшего размера также работают на iPhone и iPad.
Ссылка на TestFlight для тех, кто хочет попробовать.
(Из обсуждения)
#PrivateDiffusion #LocalArt #AiArt #Zimage #Flux2 #Krea2 #ERNIEimage #iPhone #iPad #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Собственный вывод MiniMax-H3 на языке C для NVIDIA CUDA в Linux и Metal на Apple Silicon. Преобразование текста в видео/аудио, обработка первого/последнего кадра и упорядоченные ссылки на изображения/видео/аудио Ref2VA работают без сбоев на обоих бэкендах.
#MiniMaxH3 #MiniMax #H3 #h3cStudio #AiVideo #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Выберите свой компьютер, укажите, для чего вам нужна модель, и система выдаст подходящие варианты.
(Обсуждение)
#llmpicker #AiModel #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
MOSS-Transcribe-Diarize Pro — более мощная модель с более высокой общей производительностью, доступная на онлайн-платформе.
MOSS-Transcribe-Diarize 0.9B поддерживает более 50 языков.
MOSS-Transcribe-Diarize — это наше флагманское семейство моделей, позволяющее за один проход преобразовывать реальные аудиозаписи в структурированные расшифровки с указанием говорящего. Вместо того чтобы объединять отдельные системы автоматического распознавания речи и диаризации, эти модели совместно выполняют транскрипцию речи и диаризацию, создавая текст с временным выравниванием, точными временными метками и согласованными метками говорящих, такими как [S01], [S02], и т. д.
MOSS-Transcribe-Diarize, созданный для работы с совещаниями, звонками, подкастами, интервью, лекциями и видеоконтентом, предназначен для обработки длинных, сложных записей с участием нескольких говорящих, где важна надежность. Он также может генерировать дополнительные аннотации акустических событий, предоставляя нижестоящим системам более полное представление о том, что происходило, кто говорил и когда.
Модель принимает необработанный аудиофайл и выдает компактную расшифровку с указанием времени.
#MOSS #Transcribe #Diarize #ASR #Транскрибация #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Fine-Tuning-Studio - Интерфейс чата, предназначенный для написания собственных примеров тонкой настройки и экспорта файла CSV/JSONL на ваше устройство.
🔗 https://github.com/StarpowerTechnology/Fine-Tuning-Studio
(Обсуждение)
#FineTuningStudio #FineTuning #AiLocal #LocalAi
(Обсуждение)
#FineTuningStudio #FineTuning #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
🎙 Sopro V2 Turbo — голосовой клонер на 120M параметров
Компактная модель для клонирования голоса, которая работает полностью на устройстве. Никаких GPU и облаков — только браузер или обычный ноутбук.
Что умеет:
• Клонирует голос по 5-20 секундам образца
• Первый звук через ~300 мс на CPU ноутбука
• Генерирует речь в 5 раз быстрее реального времени
• Поддерживает английский, португальский, французский и немецкий
Локальный веб-интерфейс запускается одной командой:
Заточен под слабое железо — всё работает прямо в браузере, без специальных ресурсов.
🌐 https://samuel-vitorino.github.io/sopro/
🔗 https://research.haloneuro.ai/posts/sopro-v2
🔗 https://github.com/samuel-vitorino/sopro
🔗 https://huggingface.co/samuel-vitorino/sopro-v2-turbo
🔗 https://huggingface.co/spaces/hugging-apps/sopro-v2-turbo-tts - Демо!
#SoproV2Turbo #Sopro #TTS #AiVoice #AiLocal #LocalAi
Компактная модель для клонирования голоса, которая работает полностью на устройстве. Никаких GPU и облаков — только браузер или обычный ноутбук.
Что умеет:
• Клонирует голос по 5-20 секундам образца
• Первый звук через ~300 мс на CPU ноутбука
• Генерирует речь в 5 раз быстрее реального времени
• Поддерживает английский, португальский, французский и немецкий
Локальный веб-интерфейс запускается одной командой:
uvx -from sopro soprotts serveЗаточен под слабое железо — всё работает прямо в браузере, без специальных ресурсов.
#SoproV2Turbo #Sopro #TTS #AiVoice #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Одно предложение — и готов целый курс, а теперь вы можете управлять процессом.
В версии OpenMAIC v1.0.0, выпущенной 27 августа 2026 года, наряду с классическим генератором в один клик появился рабочий стол Pro: общайтесь с агентом, который спланирует ваш учебный план, создаст и отредактирует каждую страницу и будет работать с вашими материалами.
🤖 Рабочее пространство агента — рабочее пространство с приоритетом чата, в котором можно планировать, создавать и редактировать целые курсы
💾 Долгосрочные сеансы — сеансы с поддержкой сервера, которые сохраняются после перезапуска; их можно отменить, возобновить или изменить в любой момент
📎 Материалы сеанса — загружайте документы, аудио- и видеофайлы или используйте результаты веб-поиска; на их основе агент создает контент
🧰 Инструменты курса + 20 встроенных навыков — слайды, тесты, интерактивные элементы, проблемно-ориентированное обучение, изображения, видео, озвучка, .pptx импорт
🔌 Нейтральный по своей сути — используйте собственные модели, медиафайлы, поисковые системы и серверные хранилища
🎓 OpenMAIC 1.0 — опенсорсная платформа для создания курсов из промта
Загружаешь тему, PDF, презентацию, аудио или видео — агент собирает программу, генерирует уроки и даёт править всё через чат. Внутри не только слайды: ИИ-преподаватель и виртуальные одноклассники спорят с тобой, рисуют на доске, проводят квизы, запускают 3D-симуляции, мини-игры и практические проекты.
Платформа работает с разными моделями, экспортирует курсы в PPTX и HTML, поддерживает локальный запуск.
#OpenMAIC #Обучение #Classroom #TTS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1👍1
- Gemma-4-26B-A4B в качестве переводчика
- Qwen3.6-35B-A3B в качестве корректора
Контекст: запускают конвейер, который локально переводит целые художественные книги с английского на русский — фрагмент + глоссарий + скользящие аннотации к главам → перевод → замечания рецензента → исправление → корректура → аннотации к фрагментам. Книга — это ~1,5–2 млн токенов! После года тренировок появилась конфигурация для запуска, которая достаточно быстрая, чтобы не надоедать: 2–3 книги в день.
Подробно: https://www.reddit.com/r/LocalLLaMA/comments/1w54s3q/running_a_2model_literary_booktranslation/
#booktranslation #book #Перевод #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
⚡️ slotstream - Запускайте Qwen3.8-Flash-Next (125B MoE, 104 ГБ в 4-битном формате) на компьютерах Mac с небольшим объемом оперативной памяти, используя потоковую передачу данных с SSD. MLX + Swift, API, совместимый с Ollama.
На 48GB Mac скорость ~12 tok/s
🔗 https://github.com/carloslfu/slotstream
(Обсуждение)
#slotstream #Qwen38FlashNext #MacOS #AiLocal #LocalAi
На 48GB Mac скорость ~12 tok/s
Запустите Qwen3.8-Flash-Next на Mac, который не справляется с этой задачей. Модель представляет собой смесь экспертов с 125B-параметрами, занимает 104 ГБ на диске в 4-битном формате; слотстрим считывает ее с SSD и запускает в любом объеме памяти, который вы выделите. Это один бинарный файл на Swift, без Python. Он поддерживает API чата Ollama и OpenAI, поэтому ваши существующие инструменты будут работать без изменений.
(Обсуждение)
#slotstream #Qwen38FlashNext #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - carloslfu/slotstream: Run Qwen3.8-Flash-Next (125B MoE, 104 GB at 4-bit) on Macs with a fraction of that RAM by streaming…
Run Qwen3.8-Flash-Next (125B MoE, 104 GB at 4-bit) on Macs with a fraction of that RAM by streaming experts from SSD. MLX + Swift, Ollama-compatible API. - carloslfu/slotstream
🔥1
Please open Telegram to view this post
VIEW IN TELEGRAM
Найдите нужный подкаст или вставьте его ссылку, выберите нужные эпизоды, и Repodify создаст один хронологический эпизод, который вы сможете прослушать или скачать. Он работает на вашем компьютере или с вашими собственными API-ключами (BYOK) — выбор за вами на каждом этапе.
Превратите фрагмент подкаста в один адаптированный/дополненный короткий дайджест: поиск/инсталляция RSS, расшифровка, обобщение, написание сценария и, наконец, синтез и создание адаптированного подкаста, при этом все этапы машинного обучения можно выполнять локально (единообразно или смешанно).
• загружает аудио
• расшифровывает его
• при необходимости определяет, кто говорил (& объединяет одного ведущего/гостя из разных выпусков)
• объединяет в одно хронологическое повествование
• пишет сценарий для озвучивания с заданной продолжительностью
• синтезирует новый выпуск, который можно прослушать или скачать
Все это должно работать на вашем компьютере или с вашими собственными API-ключами (BYOK) для каждого этапа и задания. Никаких «загрузок архива в чужое облако». Преобразование речи в текст, диаризация, большие языковые модели и синтез речи — все это можно заменить: локальный графический процессор (faster-whisper, pyannote, Ollama, F5-TTS / Kokoro) или BYOK (OpenRouter / Anthropic / pyannoteAI).
Клонирование голоса доступно по запросу и отключено по умолчанию.
(Обсуждение)
#Repodify #STT #TTS #AiPodcast #whisper #Kokoro #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
VoiceInk — это нативное приложение для macOS, которое практически мгновенно преобразует вашу речь в текст.
VoiceInk использует локальные ИИ-модели для мгновенной расшифровки сказанного с почти идеальной точностью и полной конфиденциальностью. Тут есть модель: Qwen 3 ASR 9B!
Функции:
🎙 Точная транскрипция: локальные модели искусственного интеллекта, которые практически мгновенно преобразуют ваш голос в текст с точностью 99%
🔒 Конфиденциальность превыше всего: 100 % автономная обработка гарантирует, что ваши данные никогда не покинут ваше устройство
⚡️ Режимы: интеллектуальное определение приложения автоматически применяет идеально подходящие для вас предварительно настроенные параметры в зависимости от приложения/URL, на котором вы находитесь
🧠 Контекстно-зависимый: умный искусственный интеллект, который понимает содержимое вашего экрана и адаптируется к контексту
🎯 Глобальные сочетания клавиш: настраиваемые сочетания клавиш для быстрой записи и функции «нажми и говори»
📝 Персональный словарь: обучите ИИ распознавать вашу уникальную терминологию с помощью пользовательских слов, отраслевых терминов и интеллектуальной замены текста
🔄 Умные режимы: мгновенное переключение между режимами на основе ИИ, оптимизированными для разных стилей письма и контекстов
🤖 ИИ-помощник: встроенный голосовой помощник для быстрого общения, как в ChatGPT
Для iOS: https://tryvoiceink.com/ios
#VoiceInk #Qwen3ASR9B #ASR #STT #Диктовка #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🎙 Открытая TTS-модель с клонированием голоса по 2 секундам!
Умеет клонировать голос по двухсекундному образцу. Можно настроить пол, возраст, высоту, акцент, стиль речи (включая шепот) и скорость. Генерация работает в режиме стриминга — не нужно ждать полного файла.
В архитектуре используется активный акустический адаптер: обрабатывает кодек-эмбеддинги до и после основного блока. Может пригодиться для озвучки на редких языках, где коммерческие TTS пока не добрались.
#ICE012Audio #DarkPs #TTS #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
⚡️ DSv4-streaming - Запуск DeepSeek-V4-Flash (284B MoE) на компьютере Mac объемом 64 ГБ экспертами по потоковой передаче данных из SSD
Экспертная потоковая передача данных на SSD для DeepSeek-V4-Flash (284B разреженных матричных элементов) на MacBook M5 Pro с 64 ГБ памяти.
DeepSeek-V4-Flash занимает 165 ГБ на диске, поэтому не помещается в 64 ГБ памяти. Но она все равно работает, потому что модель использует лишь небольшую часть своих весов для каждого токена. Неиспользуемые части остаются на SSD и загружаются только при необходимости.
🔗 https://github.com/kk-r/dsv4-streaming
(Обсуждение)
#dsv4streaming #DeepSeekV4Flash #DSV4 #MacOS #LocalAi #AiLocal
Экспертная потоковая передача данных на SSD для DeepSeek-V4-Flash (284B разреженных матричных элементов) на MacBook M5 Pro с 64 ГБ памяти.
DeepSeek-V4-Flash занимает 165 ГБ на диске, поэтому не помещается в 64 ГБ памяти. Но она все равно работает, потому что модель использует лишь небольшую часть своих весов для каждого токена. Неиспользуемые части остаются на SSD и загружаются только при необходимости.
dsv4-streaming запускает модель с 284B параметрами, наименьший опубликованный квант которой составляет 83 ГБ, на ноутбуке с 64 ГБ памяти, сохраняя неэкспертные веса на диске и передавая экспертные веса с SSD по запросу. Он содержит два движка: быстрый движок, построенный на среде выполнения ds4 от antirez (декодирование ~ 11 ток / с за 2 квартала) и полнокачественный движок, созданный с нуля стек MLX / Python, который запускает смешанную 4/8-битную контрольную точку с недоумением, сопоставляющим опубликованное число с -0.02%. Веб-приложение локального чата поддерживает оба движка с сеансами, потоковой передачей и API, совместимым с OpenAI.
Качество не падает. Проверили качество вывода с помощью стандартного теста (перплексия, чем ниже, тем лучше). Настройка показала результат 6,1250. Официальный показатель для этого файла модели — 6,1262. Такое же качество.
Скорость: около 11 токенов в секунду при использовании 2-битного файла модели меньшего размера или 1–2 токена в секунду при более высоком качестве. Для сравнения: 11 токенов в секунду — это быстрее, чем читает большинство людей.
Кэш меньшего размера работал быстрее, чем кэш большего размера. Автор выделил программе 8 ГБ памяти для кэша и получил 2,04 токена в секунду. При 32 ГБ показатель упал до 1,23. Причина: macOS уже кэширует файлы самостоятельно и делает это лучше. Выделение программе большего объема памяти привело к тому, что macOS стала использовать меньше памяти. То же самое произошло в отдельном движке (ds4 от antirez), так что это не ошибка этого кода.
Популярные приемы для повышения скорости здесь не помогли. Спекулятивное декодирование и предварительная выборка данных в этой конфигурации только замедляли работу. Узким местом является диск, а эти приемы увеличивают объем считываемых данных, а не уменьшают его.
(Обсуждение)
#dsv4streaming #DeepSeekV4Flash #DSV4 #MacOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - antirez/ds4: DeepSeek 4 Flash and PRO local inference engine for Metal, CUDA and ROCm
DeepSeek 4 Flash and PRO local inference engine for Metal, CUDA and ROCm - antirez/ds4
❤1
Ваше личное рабочее пространство для общения, обмена знаниями и выполнения работы.
Превратите свои файлы, заметки, электронную почту и повседневные инструменты в полезный контекст для ИИ, не прерывая рабочий процесс.
Модели могут меняться. Ваш контекст должен оставаться неизменным.
Большинство диалогов с ИИ начинаются с одного и того же утомительного ритуала: найти файл, скопировать электронное письмо, еще раз объяснить предысторию и надеяться, что ответ не будет оторван от контекста. Vyact объединяет полезные элементы вашей работы, чтобы вы могли задавать более качественные вопросы с меньшими трудозатратами.✔️ Он объединяет чат с ИИ, аналитику документов, заметки и инструменты, которые вы уже используете, в одном рабочем пространстве. Прикрепите документ, изучите источник ответа, превратите заметку в базу знаний с возможностью поиска или перенесите тот же контекст в Gmail, Диск, Календарь и Chrome.
Vyact, созданный на основе локальных языковых моделей с помощью llama.cpp и MLX, помогает хранить диалоги, документы и рабочий контекст в вашей собственной среде. Используйте локальную модель как практичное рабочее пространство — а не просто еще одну вкладку чат-бота — и подключайте облачные сервисы или собственную конечную точку языковой модели, совместимой с OpenAI, когда это необходимо.
Для macOS доступен файл DMG, для Windows — установщик EXE, а для Linux — пакеты AppImage и DEB. Компьютеры Mac на базе процессоров Intel в настоящее время не поддерживаются.
Используйте расширение для Chrome
(Подробнее и Обсуждение)
#Vyact #AiAgent #AgentAi #MacOS #Windows #Linux #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM