Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
🔈 Murmur — превращайте длинные тексты и файлы в формате EPUB в аудио, которое можно слушать во время работы (офлайн на Mac)

Murmur превращает статьи, PDF-файлы, файлы, созданные с помощью ИИ, в аудио студийного качества, которые вы можете слушать во время работы, прогулок или других занятий — в 100% автономном режиме на вашем Mac.

Никаких подписок. Никакого облака. Никакого сбора данных. Работу выполняет только ваш Mac.

В работе: импорт PDF/EPUB, многоголосный диалог, клонирование голоса по коротким образцам, поддержка большего количества языков
🔗 https://3422223166764.gumroad.com/l/ruzpof
(Обсуждение) (Еще обсуждение с видео)
#Murmur #TTS #EPUB #EPUB2Voice #VoiceBook #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
💬 Vellium - Настольное приложение для общения с ИИ и ролевыми играми.

Характеристики:
- Чат с ветвлением, редактированием/удалением, перегенерации и многопользовательскими автоповоротами.
- Инструменты для ролевой игры: блоки подсказок, примечания автора, состояние сцены, пресеты.
- Персонажи пользователей включены в контекст генерации.
- Карточки персонажей: импорт, проверка, редактирование.
- Режим творческого письма: проекты, главы, сцены, проверка согласованности, экспорт.
- Настольная версия для macOS и Windows.

В Vellium v0.3.5: масштабное обновление режима написания, поддержка Native KoboldCpp и OpenAI TTS
🔗 https://github.com/tg-prplx/vellium
(Обсуждение)
#Vellium #MacOS #Windows #ChatRP #RP
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🎙 TranscriptionSuite - Полностью локальное приложение для преобразования речи в текст для Linux, Windows и macOS.
С использованием ускорителей faster-whisper и CUDA.

Особенности:
- 100% Локально: Все работает на вашем собственном компьютере, приложению не нужен интернет после первоначальной настройки
- По-настоящему многоязычный: поддерживает более 90 языков!
- Полнофункциональный графический интерфейс: настольное приложение Electron для Linux, Windows и macOS (Apple Silicon)
- Режим GPU + CPU: ускорение NVIDIA CUDA (рекомендуется) или режим только для процессора для любой платформы, включая macOS
- Транскрипция в длинной форме: Запишите столько, сколько захотите, и расшифруйте ее за считанные секунды
- Оперативный режим: транскрипция каждого предложения в режиме реального времени для непрерывного процесса диктовки
- Ведение дневника говорящего: идентификация говорящего на основе PyAnnote
- Статическая транскрипция файла: Транскрибируйте существующие аудио / видеофайлы с помощью очереди импорта нескольких файлов, повторных попыток и отслеживания прогресса.
- Удаленный доступ: безопасный доступ к вашему рабочему столу дома под управлением модели из любого места (с помощью Tailscale)
- Аудиозапись: режим аудиозаписи с просмотром на основе календаря, полнотекстовым поиском и интеграцией с LM Studio (делитесь своими заметками с искусственным интеллектом).
- Управление в системном трее: быстрый запуск / остановка записи, а также множество других элементов управления, доступных в системном трее.

🔗 https://github.com/homelab-00/TranscriptionSuite
(Обсуждение)
#TranscriptionSuite #Whisper #Transcription #Транскрибация #ASR #MacOS #Windows #Linux #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
🎙 Pocket TTS Server - Клонируйте любой голос, записав всего 20 секунд аудио, и мгновенно общайтесь с ИИ, используя этот голос. (альтернатива ElevenLabs)

Легкий сервер для клонирования голоса и общения в режиме реального времени с API, совместимым с OpenAI. Легко интегрируется в голосовых ботов (автор использует его для голосовых ответов в Telegram).
🎭 Основные характеристики:
🗣 Клонирование голоса
- Любой голос — загрузите 15–20 секунд чистого звука
- Автоматическое преобразование — MP3/OGG/FLAC → WAV автоматически
- Умная обрезка — длинная аудиозапись автоматически обрезается до 20 секунд (предотвращает появление неразборчивого шума)
- Система архивации — оригиналы сохраняются в voices-celebrities-archive/

💬 Голосовой чат в реальном времени
- Потоковый текст — слова появляются по мере их генерации LLM
- Потоковое аудио — аудио воспроизводится по предложениям
- Без ожидания — первое аудио через 2–3 секунды
- Последовательное воспроизведение — предложения выстраиваются в очередь и воспроизводятся по порядку

🔌 Совместимость с OpenAI
- Готовая замена API преобразования текста в речь от OpenAI
- Работает с OpenWebUI, SillyTavern и другими клиентами

⚡️ Производительность
- Поддержка 4000 токенов для длинных ответов
- 180-секундный тайм-аут для медленных языковых моделей
- Оптимизировано для центрального процессора (опционально для графического процессора)
- Более 76 голосов (знаменитости, персонажи, пользовательские)

🔗 https://github.com/ai-joe-git/pocket-tts-server
(Обсуждение)
#PocketTTSServer #PocketTTS #TTS #Windows #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
📖 Book2Movie - Скрипт для преобразования электронных книг в слайд-шоу или видеоролики с использованием нескольких типов генеративного ИИ.

🔗 https://github.com/Frozen-tuna/Book2Movie
(Обсуждение)
#Book2Movie #ComfyUI #Kokoro #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🦉 Makimus-AI — поиск изображений с помощью локального ИИ

Выполните поиск по всей библиотеке изображений с помощью естественного языка или изображения — просто введите то, что ищете, или загрузите изображение, и Makimus-AI мгновенно найдет визуально похожие результаты с помощью ИИ.

Пример: введите "Девушка в красных доспехах" или "собака, играющая в траве" — или просто Используйте изображение, чтобы найти визуально похожие изображения в своих папках.
🧠 Модель: В этом приложении используется OpenCLIP ViT-L-14, обученный на наборе данных LAION-2B от OpenAI/LAION.
💡Особенности:
🔍 Поиск изображений по естественному языку
🖼 Поиск изображений по изображениям — поиск визуально похожих изображений
🔄 Поиск во время индексации — не нужно ждать завершения индексации
⚡️ Ускорение с помощью графического процессора (CUDA, Apple MPS, DirectML)
🧠 Автоматическое определение видеопамяти и настройка размера пакета
📦 Оптимизация ONNX для ускорения логического вывода
🖼 Предварительный просмотр миниатюр с поддержкой экспорта
💾 Умное кэширование — проиндексируйте один раз, ищите вечно

🔗 https://github.com/Ubaida-M-Yusuf/Makimus-AI
(Обсуждение и еще тут)
#MakimusAI #OpenCLIP #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
This media is not supported in your browser
VIEW IN TELEGRAM
🥛 Не по теме: Infinite Kitchen - Приготовление слоеных круассанов с маслом на обновленной системе приготовления LLM Infinite Kitchen

ИИ для начинающих поваров и девочек! ИИ готовка!
Теперь с более интеллектуальной моделью приготовления с использованием ИИ и большим набором базовых ингредиентов и инструментов. Теперь можно готовить десятки тысяч блюд.
🔗 https://infinite-kitchen.com/kitchen
#Kitchen #AiKitchen #InfiniteKitchen
Please open Telegram to view this post
VIEW IN TELEGRAM
🔈 LoopMaker — музыкальный генератор на основе ИИ для Mac (офлайн, безлимитный)

LoopMaker - это нативное приложение для macOS, использующее современную музыкальную модель с ИИ. Опишите, что вы хотите, и LoopMaker создаст это локально, конфиденциально, за считанные минуты.
Поддерживает треки продолжительностью до 4 минут с опциональными текстами и вокалом!
Три мощных режима создания:

🎵 Generate — Создайте оригинальную музыку из текстовых подсказок. Добавьте пользовательские тексты песен со структурированными разделами (куплет, припев, переход). Выберите инструментальный или вокальный вариант.

🎸 Cover — Вставьте любой аудиофайл и преобразуйте его. Дополните вокал новыми инструментами, замените вокал инструментальной версией или напишите совершенно новый текст. Измените стиль от утонченного до драматичного.

🔄 Extend — Добавляйте от 10 секунд до 2 минут к любому треку с помощью интеллектуального наложения. Никаких сокращений, никаких артефактов.

6 жанровых пресетов для быстрого начала работы:
- Lo-Fi · Кинематографический · Эмбиентный · Электронный · Хип-хоп · Джазовый
- Каждый пресет настраивается с помощью оптимизированных подсказок или вы можете создать свой собственный с нуля.

Почему LoopMaker, а не Suno / Udio / AIVA? 
💰 Стоимость — они взимают 10-30 долларов в месяц навсегда. LoopMaker - это один платеж, ваш навсегда.
⚡️ Использование — у них есть кредиты и ежедневные ограничения. У LoopMaker неограниченное количество поколений.
Конфиденциальность — они загружают ваше аудио в облако. LoopMaker работает на 100% локально, ничего не покидает ваш Mac.
Интернет — он им нужен всегда. LoopMaker нужен только для начальной загрузки модели.
Право собственности — их лицензирование зависит от платформы. С LoopMaker вы являетесь владельцем всего, что создаете.

🔗 https://3422223166764.gumroad.com/l/loopmaker
Все программы Автора: https://3422223166764.gumroad.com
(Обсуждение) (Обсуждение 2) (Обновление)
#LoopMaker #AiSong #AiAudio #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
✈️ Рейтинг: Open Source LLM Leaderboard
Лучшие модели с открытым исходным кодом — рейтинг 2026 года!
Лучшие модели с открытым исходным кодом по задачам — рейтинг бенчмарков!

Какая языковая модель с открытым исходным кодом лучше всего подходит для программирования, логического мышления или математических вычислений?
Посмотрите, как каждая модель показывает себя в ключевых тестах. Для получения подробной информации наведите курсор на любую полосу.
🔗 https://www.onyx.app/open-llm-leaderboard
(Обсуждение)
#Leaderboard #openllm #OpenSourceLLM #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
🎭 FaceFusion — дипфейки это просто!

Софт для замены лиц на фото и видео. Работает локально, умеет больше, чем просто наложить чужую физиономию. Очень много функций!

Что внутри:
• Анализирует мимику и свет — новое лицо выглядит органично
• Синхронизирует губы с любой аудиодорожкой
• Встроенный апскейл до 4K
Редактор возраста — можно омолодить или состарить персонажа

Есть онлайн-демо и версия для установки на ПК.
🔗 https://facefusion.io
https://github.com/facefusion/facefusion
#facefusion #дипфейк #FaceSwap #Windows #macOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🎤 FreeFlow — бесплатная альтернатива Wispr Flow (Superwhisper / Monologue) для голосового ввода на macOS

Инструмент позволяет надиктовывать текст в любое активное поле на macOS через личный API-ключ. Никаких подписок и сторонних серверов.
Понимает контекст открытого приложения — не путает имена в почте с терминами в терминале. Связка Groq и LLM обрабатывает запрос меньше чем за секунду. Данные идут только через ваш API-ключ, без посредников.
(Нужно получить бесплатный ключ Groq API на groq.com)

Одна из крутых функций — контекстная поддержка. Если вы отвечаете на электронное письмо, приложение прочитает имена людей, которым вы отвечаете, и проверит правильность написания. То же самое происходит, когда вы диктуете текст в терминале или другом приложении. Это то же самое, что и функция «Глубокий контекст» в Monologue.

Дополнительный бонус заключается в том, что у нас нет сервера FreeFlow, поэтому никакие данные не хранятся и не резервируются, что обеспечивает более высокий уровень конфиденциальности по сравнению с SaaS-приложениями. Единственная информация, которая покидает ваш компьютер, — это вызовы API для расшифровки Groq и LLM API (LLM используется для постобработки расшифровки с учетом контекста).

Пока доступно только для #MacOS
Есть похожие: Handy и VoiceReader и Pindrop.
Аналоги по тегу: #Диктовка
🔗 https://github.com/zachlatta/freeflow
#FreeFlow #STT #Groq #AiДиктовка #Транскрибация
Please open Telegram to view this post
VIEW IN TELEGRAM
🤖 PocketPaw - Бесплатный ИИ-помощник, который можно запускать даже через Telegram.

Он способен управлять ПК и браузером, что позволяет упростить работу с документами, планирование задач и другие рутинные дела. Установка занимает всего 30 секунд и выполняется одной командой, при этом все данные хранятся локально.

Автономный ИИ-агент с веб-панелью. Общается с вами через Discord, Slack, WhatsApp, Telegram или браузер.
Без подписки. Без привязки к облаку. Ваши данные остаются на вашем устройстве.

🔗 https://pocketpaw.xyz
🔗 https://github.com/pocketpaw/pocketpaw

#PocketPaw #AiAgent #AgentAi #MacOS #Windows
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
This media is not supported in your browser
VIEW IN TELEGRAM
💬 Mycelia - Граф знаний из ваших чатов с ИИ
Вы общаетесь с ИИ. Фоновый ИИ автоматически превращает ваш диалог в набор связанных заметок. Локальные файлы остаются у вас навсегда.

Mycelia, ваш личный ИИ-помощник для работы с идеями и знаниями. Бесплатно с Ollama (local models)!
Mycelia пишет про себя: Я могу помочь вам думать, писать и находить связи между мыслями. В моем распоряжении есть ваш личный «сейф знаний» — там уже есть заметки на разные темы: от машинного обучения до стоицизма.

Могу:
- Находить связи между вашими идеями
- Помогать структурировать мысли
- Отвечать на вопросы, опираясь на ваши заметки
- Предлагать новые точки зрения
- А еще я автоматически сохраняю ключевые моменты

🔗 https://mycelia.garden
Демо: https://mycelia.garden/demo
=======
ℹ️Еще есть: OpenVault — агентная память для SillyTavern
🔗 https://github.com/vadash/openvault
#mycelia #MacOS #Windows #Linux #openvault
Please open Telegram to view this post
VIEW IN TELEGRAM
Модели Qwen3.5:
Qwen3.5-27B — dense, все 27B параметров активны. На SWE-bench Verified набирает 72.4% — столько же, сколько 397B. На IFEval (следование инструкциям) — 95.0%, лучший результат во всей линейке. (Qwen3.5-27B-heretic-GGUF)

Qwen3.5-35B-A3B — MoE, 35B параметров, 3B активных на токен. Превосходит Qwen3-235B-A22B, который был основной open-weight моделью Qwen3. Модель в 7 раз меньше, а результаты лучше. Облачная версия — Qwen3.5-Flash (контекст до 1M токенов, встроенные tools).

Qwen3.5-122B-A10B — MoE, 122B параметров, 10B активных. По бенчмаркам на уровне флагманской 397B, а на части задач (TAU2-Bench, BFCL-V4, HLE) обходит её.

Qwen3.5-397B-A17B — флагман линейки!

Отдельно выложили Qwen3.5-35B-A3B-Base — версия без файнтюна, для кастомного дообучения.

💡 Сравнение семейств Qwen 3.5 от ArtificialAnalysis.ai - ставит Qwen3.5-27B выше, чем Qwen3.5-122B-A10B и Qwen3.5-35B-A3B, по всем категориям тестов: индексу интеллекта, индексу кодирования и индексу агентности.

Пост: https://qwen.ai/blog?id=qwen3.5 - много видео примеров!

Пишут:
- Qwen3.5-122B-A10B в большинстве тестов превосходит gpt-5-mini и gpt-oss-120b.
- Qwen 3.5 122b/35b — огонь 🔥 Сравнение результатов Qwen 3 35B-A3B, GPT-5 High, Qwen 3 122B-A10B и GPT-OSS 120B.
- Обсуждение Qwen3.5-35B-A3B, ТУТ рекомендуют квант от AesSedai или Ubergarm - они лучше Unsloth!
- Qwen3.5-35B-A3B — это прорыв в агентном программировании.
- Обсуждение Qwen3.5-122B-A10B
- Qwen3.5 122B — лучшая модель на данный момент. (Q3_K_XL может работать не хуже 4-битных моделей)

⚡️Сравнить модели: https://compareqwen35.tiiny.site

#Qwen35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM