Local Ai
442 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
🎶 majiks.studio Ваши идеи. Ваш ПК. Ваша музыка.

Профессиональное создание музыки и песен с помощью ИИ на вашем компьютере — бесплатно, локально и навсегда в вашем распоряжении.
На базе ACE-Step 1.5.
За считаные минуты получайте полноценную песню с вокалом, текстом и семплами. Работает локально на вашем компьютере. Без облака. Без аккаунта. Без ограничений на создание контента.

Бесплатно включает:
Все, что вам нужно для творчества:
- Неограниченная генерация музыки с помощью искусственного интеллекта (ACE-Step 1.5)
- Сохранение в библиотеку с метаданными и обложкой альбома
- Экспорт: WAV, FLAC, MP3, M4A
- Выделение основного тона
- Чат с ИИ на основе 8+ языковых моделей
- Полный контроль параметров (темп, тональность, продолжительность, текст)
- Работает в автономном режиме после загрузки модели
- Все обновления включены
- Лицензия Apache 2.0 — открытый исходный код на GitHub

🔗 https://majiks.studio
🔗 https://github.com/Majiks-Studio/majiks-music-studio
🔗 https://majiks.online - созданные треки! Послушать!
Треком можно делиться как ссылкой!
(Обсуждение)
#majiksStudio #ACEStep15 #ACEStep #Suno #AiMusic #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🎙 Whispering - Нажмите сочетание клавиш → произнесите текст → получите результат. Бесплатно и с открытым исходным кодом!

Whispering — это приложение для преобразования речи в текст с открытым исходным кодом. Нажмите сочетание клавиш, произнесите текст, и приложение расшифрует, преобразует, скопирует и вставит его в нужное место.
У Whispering есть несколько интересных функций, таких как голосовой режим для управления без использования рук (без удержания кнопок) и настраиваемые преобразования с помощью искусственного интеллекта с использованием любых подсказок и моделей.
В Whispering есть два подхода к расшифровке. Выберите тот, который вам подходит:
🏠 Вариант А: локальная транскрипция (Whisper C++)
☁️ Вариант Б: облачная транскрипция (Groq)

Для MacOS, Windows, Linux
🔗 https://github.com/EpicenterHQ/epicenter/tree/main/apps/whispering
🎞 Демо: https://www.youtube.com/watch?v=1jYgBMrfVZs
#Whispering #Whisper #MacOS #Windows #Linux #Диктовка #Транскрибация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🎙 Vibe — транскрибация файлов, локально и бесплатно!

⌨️ Транскрибируйте аудио/видео в автономном режиме с помощью OpenAI Whisper.
Локальные модели, простой интерфейс!
🌟 Особенности: 🌟
🌍 Транскрибируйте практически на любом языке
🔒 Полная конфиденциальность: транскрипция без подключения к интернету, данные не покидают ваше устройство
🎨 Удобный дизайн
🎙 Транскрибируйте аудио/видео
🎶 Возможность транскрибировать аудио с популярных сайтов (YouTube, Vimeo, Facebook, Twitter и других!)
📂 Пакетная транскрипция нескольких файлов!
📝 Поддержка SRTVTT, TXT, HTML, PDF, JSON, DOCX форматов
👀 Предварительный просмотр в реальном времени
Обобщение расшифровок: получайте быстрые многоязычные сводки с помощью API Claude
🧠 Поддержка Ollama: выполняйте локальный анализ с помощью ИИ и создавайте пакетные сводки с помощью Ollama
🌐 Перевод на английский с любого языка
🖨 Печать расшифровки прямо на любом принтере
🔄 Автоматические обновления
💻 Оптимизировано для GPU (macOS, Windows, Linux)
🎮 Оптимизировано для Nvidia / AMD / Intel графических процессоров! (Vulkan/CoreML)
🔧 Полная свобода: легко настраивайте модели в разделе «Настройки»
⚙️ Аргументы модели для опытных пользователей
Расшифровка системного аудио
🎤 Расшифровка с микрофона
🖥 Поддержка интерфейса командной строки: используйте Vibe прямо из интерфейса командной строки! (см. --help)
👥 Диаризация динамиков
🎬 Режим стабильных временных меток для синхронизации субтитров и видео (с поддержкой VAD, медленнее)
📱 поддержка iOS и Android (скоро появится)
📥 Интегрируйте пользовательские модели со своего сайта: используйте vibe://download/?url=<model url>
📹 Выберите длину подписи, оптимизированную для видео / роликов
Для MacOS, Windows, Linux

🔗 https://thewh1teagle.github.io/vibe/
🔗 https://github.com/thewh1teagle/vibe
#Vibe #Whisper #MacOS #Windows #Linux #Транскрибация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🎙 OpenWhispr - Ваш голос в 3 раза быстрее, чем клавиатура.

Голосовой помощник с открытым исходным кодом. Конфиденциальность по умолчанию. Пишите быстрее в любом приложении.
Бесплатно, если локально. Подписка — если хочешь облачную обработку.
Можно подключить свои API-ключи от LLM-провайдеров.
Локально доступны к скачиванию все модели Whisper и что особенно замечательно - есть Parakeet TDT v3 (25 европейских языков, очень быстрая)
Для Mac на чипе Intel не так много программ с Parakeet, а она ну очень быстрая!
Транскрибация сохраняется как заметка! Есть к скачиванию и модели ИИ для автоисправлений и для Агентов и для чата с заметкой и... много функций!
Есть и Словарь для своих терминов!
Доступно на macOS (Intel и чипы М), Windows и Linux

🔗 https://openwhispr.com
(Подробнее в статье)
🎞 Подробно о установке и настройке: https://youtu.be/6TXOs0_ejhQ
⬇️ #iOS #iPhone #iPad https://apps.apple.com/us/app/openwhispr-voice-to-text/id6763804420
#OpenWhispr #Whisper #Parakeet #MacOS #Windows #Linux #Диктовка #Транскрибация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🎙 WLK - WhisperLiveKit: преобразование речи в текст с идентификацией говорящего с минимальной задержкой на собственном сервере!
Почему бы просто не запустить простую модель Whisper для каждой аудиозаписи? Модель Whisper предназначена для обработки полных высказываний, а не фрагментов в режиме реального времени. При обработке небольших сегментов теряется контекст, слова обрываются на середине слога, а транскрипция получается некачественной. В WhisperLiveKit используются передовые технологии одновременной обработки речи для интеллектуальной буферизации и инкрементальной обработки.
Серверная часть поддерживает одновременную работу нескольких пользователей. Функция обнаружения голосовой активности снижает нагрузку при отсутствии голосовых запросов.

WhisperLiveKit поддерживает Voxtral Mini, 4-параметрическую речевую модель от Mistral AI, которая изначально поддерживает более 100 языков с функцией автоматического определения языка. Whisper также поддерживает автоматическое определение (--language auto), но функция Voxtral для определения языка по фрагментам более надежна и не смещает акцент в сторону английского языка.
(в потоковом режиме мог бы переводить звук на другой язык!)

🔗 https://github.com/QuentinFuxa/WhisperLiveKit
#WLK #WhisperLiveKit #Whisper #Перевод #Транскрибация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Без цензуры: Сравнение Qwen 3/3.5 с моделями HauhauCS / Heretic / Huihui - Abliterlitics: сравнительный анализ бенчмарков и тензоров.

Компания HauhauCS описывает свои стёртые модели как "лучшие модели без цензуры и без потерь" с "без изменений в наборах данных и возможностях" . Чтобы это выяснить, провёли полный анализ. Сравнили результаты, оценили безопасность, проанализировали вес и дивергенцию Кульбака — Лейблера. Всё это было сделано в сравнении с двумя другими крупными методами стирания, применёнными к тем же базовым моделям.

Полные результаты тестов и анализ на HuggingFace:
🔗 https://huggingface.co/collections/DreamFast/hauhaucs-safetensor-benchmarks
(Подробно и обсуждение)
======
👉 Сравнение моделей Qwen3.5-4B|Gemma4-E2B/E4B без цензуры

#Abliterlitics #HauhauCS #Heretic #Huihui #Derestricted #UGI #Abliterix #Qwen3 #Qwen35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🎬 NexVid — расширение для апскейла видео прямо в браузере

🌐 Работает в Chrome и Firefox, улучшает качество видео на лету с помощью GPU. В арсенале — больше 15 профилей апскейла и 30+ WebGL-шейдеров.

💻 Можно настроить FPS, выставить порог разрешения для обработки и использовать встроенный видеоплеер. Всё локально, без отправки данных куда-то вовне.
NexVid — это лёгкое браузерное расширение для масштабирования и улучшения качества видео в реальном времени. Оно использует обработку Anime4K с ускорением на графическом процессоре, продвинутые фильтры и большую библиотеку шейдеров WebGL для улучшения качества аниме, мультфильмов, фильмов, музыкальных клипов и других веб-видео прямо в вашем браузере. Выбирайте из более чем 15 профилей качества масштабирования Anime4K, настраивайте целевой показатель FPS в соответствии с возможностями вашего оборудования, устанавливайте порог разрешения, чтобы не обрабатывать видео с высоким разрешением, и создавайте собственный набор улучшений, не загружая медиафайлы.

Особенности:
- Масштабирование в реальном времени с профилями от самого быстрого до максимально качественного.
- Управление производительностью, в том числе настройка целевого количества кадров в секунду и автоматическая обработка пороговых значений разрешения.
- Более 30 шейдеров WebGL в категориях ретро, свечения, глитча, хроматизма, художественных эффектов, аниме и экспериментальных категорий сверхвысокого разрешения.
- Расширенные фильтры и элементы управления изображением, в том числе яркость, насыщенность, контрастность, оттенки серого, сепия, поворот оттенка, размытие, гамма, тиснение, морфология, нерезкая маска и повышение резкости.
- Настраиваемые параметры шейдера, а также сохранение и загрузка предустановок для создания полноценных цепочек эффектов.
- Встроенный локальный видеоплеер для применения масштабирования, фильтров и шейдеров к локальным видеофайлам.
- Интерфейс доступен на английском, французском, испанском и упрощенном китайском языках.
- Обработка данных выполняется локально в браузере, что обеспечивает конфиденциальность.

Идеально подходит для пользователей, которым нужны более четкие линии, детализация и стилизованное воспроизведение без выхода из браузера.

🔗 https://chromewebstore.google.com/detail/nexvid-real-time-video-up/hiocbajaikpcckgeagcngaeoioncmbim
🔗 https://addons.mozilla.org/fr/firefox/addon/nexvid-realtime-video-upscaler/
🎞 https://www.youtube.com/watch?v=BNfx5D6811g
#NexVid #Anime4K #Chrome #Firefox #AiVideo #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Хорошие статьи:
Как я запускал Qwen 3.5 на Mac: бенчмарк 8 локальных LLM-серверов. Кто быстрее?
https://habr.com/ru/articles/1024880/

Пробуем использовать локальные LLM для написания кода
https://habr.com/ru/articles/1024884/
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 Web Bro - полностью браузерный агент Gemma 4 с реальным доступом к файловой системе (WebGPU + ONNX, без установки, без сервера)

Web Bro — локального агента для кодирования и исследований в области ИИ, который работает локально в вашем браузере.

Что это такое:
- Запускает Gemma 4 E2B-it ONNX квантованную модель прямо в браузере с помощью WebGPU
- Не требует установки, не требует серверной части, не требует API-ключей — все остается на вашем компьютере
- Вы можете выбрать любую локальную папку в качестве рабочей области с помощью API доступа к файловой системе
- Агент может выводить список файлов, искать текст, читать, редактировать и записывать файлы прямо в вашу реальную файловую систему
- Перед каждой записью автоматически создаются снимки предыдущих версий файлов в IndexedDB → можно легко отменить изменения
- Все чаты, сеансы и настройки сохраняются локально

По сути, это полностью клиентский ИИ-агент, ориентированный на конфиденциальность, который можно использовать для написания кода, исследований, ведения заметок и т. д. без передачи данных с вашего компьютера.

Демо:https://aeroxy.github.io/web-bro
GitHub: https://github.com/aeroxy/web-bro
(Обсуждение)
#WebBro #WebGPU #ONNX #Gemma4 #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
⚛️ Вышел Open WebUI для настольных компьютеров!

Ваш ИИ прямо на вашем рабочем столе. Откройте веб-интерфейс в виде нативного приложения. Запускайте модели локально или подключайтесь к любому серверу. Никакого Docker, терминала и настроек. Скачайте, запустите, общайтесь.
Основные моменты:
⚡️ Spotlight. Нажмите Shift+Cmd+I (macOS) или Shift+Ctrl+I (Windows/Linux), чтобы вызвать плавающую панель чата поверх того, что вы делаете. Перетащите ее, чтобы сделать снимок экрана с любой частью экрана.
🎙 Голосовой ввод. Системная функция «нажми и говори». Нажмите сочетание клавиш в любом приложении, чтобы начать запись. Ваша речь будет автоматически расшифрована и отправлена в чат.
🧠 Локальный вывод. Загружайте и запускайте модели на своем устройстве. Ваши данные никогда не покинут ваш компьютер.
🎯 Настройка в один клик. Все устанавливается автоматически. Просто нажмите «Начать».
🔌 Несколько подключений. Легко переключайтесь между серверами.
🔄 Автоматические обновления. Новые версии устанавливаются в фоновом режиме.
📡 Возможность работы в автономном режиме. После первоначальной настройки подключение к интернету не требуется.
💻 Кроссплатформенное решение. macOS, Windows и Linux.

Распознавание речи, изображений, извлечение данных, генерация, поиск. Расширяйте возможности с помощью Python. Готово к использованию с первого дня.
Инструменты: RAG, поиск, исполнение.
Модели: https://openwebui.com/models

🔗 https://openwebui.com
🔗 https://github.com/open-webui/desktop
🔗 https://github.com/open-webui/open-webui
(Обсуждение)
Очень много всего устанавливается при 1 запуске...
#OpenWebUI #WebUI #macOS #Windows #Linux #SoftAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
2
Модель: Новые модели - новые рейтинги!

🇨🇳 Kimi 2.6 стремительно всех подвинула! Но что удивительно и восхитительно - локальные модели все равно на 7 месте и ниже... Из топа 14 - 5 локальных, которые можно запускать дома! А если иметь Mac Studio 512 Gb - то этот список будет еще больше!
А если все таки выйдет Mac Studio M5 Ultra 1Tb. - то вообще на нем можно будет запустить эту новую Kimi 2.6 на 1.1 Т параметров! А к тому моменту (конец 26, начало 27 года) и модели выйдут еще покруче! Тренд радует!
(Обсуждение)
#AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Chaperone-Thinking-LQ-1.0 - Медицинская

Открыли исходный код Chaperone-Thinking-LQ-1.0 — 4-битной модели GPTQ + QLoRA, доработанной DeepSeek-R1-32B, которая показывает результат 84 % на MedQA при размере модели ~20 ГБ.
Она основана на DeepSeek-R1-Distill-Qwen-32B, но выходит далеко за рамки простого квантования.
Целевое использование:
- Задачи, связанные с медицинскими и клиническими рассуждениями
- Научные вопросы и ответы, а также исследовательские процессы
- Корпоративные развертывания, требующие суверенитета данных (локальные системы, частное облако)
- Анализ текста и извлечение полезной информации с учетом предметной области
Вот что сделали:
- 4-битное квантование GPTQ — сжатие модели с ~60 ГБ до ~20 ГБ
- Обучение с учетом квантования (Quantization-aware training, QAT) с помощью GPTQ и калибровкой для минимизации потери точности
- Тонкая настройка QLoRA на медицинских и научных корпусах
- Убран адаптивный слой идентификации для обеспечения прозрачности — модель корректно приписывает свою архитектуру оригинальной работе DeepSeek

MedQA — это то, что нужно: точность 84 %, что на 4 % меньше, чем у GPT-4o (~88 %), при этом модель работает на одном графическом процессоре L40/L40s.

Скорость: 36,86 токенов в секунду против 22,84 токенов в секунду у базовой модели DeepSeek-R1-32B — примерно в 1,6 раза быстрее и со средней задержкой на ~43 % ниже.

Зачем это сделали: нужна была модель логического вывода, которую можно было бы использовать локально для корпоративных клиентов в сфере здравоохранения со строгими требованиями к суверенитету данных. Никаких вызовов API в OpenAI, никаких данных, покидающих пределы здания. Оказывается, при правильной оптимизации можно добиться практически максимальной производительности за небольшую часть стоимости.

🔗 https://huggingface.co/empirischtech/DeepSeek-R1-Distill-Qwen-32B-gptq-4bit
Подробно: https://chaperoneai.net/benchmark
(Обсуждение)
#MedQA #Chaperone #chaperoneAi #DeepSeek #MedAi #AiMed #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM