Local Ai
This media is not supported in your browser
VIEW IN TELEGRAM
Остальные игры наглядно в проекте: https://github.com/stormixus/openClaw-Desktop
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Локальный семантический поиск по файлам, потому что обычный поиск по файлам не учитывает контекст.
Он сканирует ваши файлы, локально генерирует эмбеддинги, сохраняет векторы и выполняет поиск по косинусному сходству. Никакого облака, никаких API-ключей, никакой телеметрии. Все остается на вашем компьютере.
Что он делает:
Локальный семантический поиск. Вы вводите запрос, а он находит файлы. Работает в системном трее, никогда не отвлекается.
- индексирует более 50 типов файлов (pdf, изображения, код, конфигурации, markdown, csv, журналы, dotfiles, что угодно)
- РАСПОЗНАВАНИЕ изображений с помощью встроенного в Windows движка. нулевая установка
- считывает EXIF из фотографий -> камера, объектив, диафрагма, ISO, фокусное расстояние, координаты gps
- преобразуйте геокоды GPS в реальные названия городов. Так что да, вы можете искать «фотографии из Стамбула», и это работает
- даты из EXIF преобразуются в понятные человеку слова — названия дней, месяцев, время суток, времена года на английском и турецком языках. найдите "летнее утро" и найдите июльскую фотографию
- гибридный поиск: векторное сходство + полнотекстовый + JINA cross-encoder reranker
- расширение запроса удаляет стоп-слова (EN + TR), генерирует варианты ключевых слов
- интеллектуальное разбиение на блоки -> разбивает rust на fn/struct, python на def/class, markdown на заголовки, yaml на ключи верхнего уровня. размеры блоков настраиваются в соответствии с форматом
- семантические контейнеры -> изолировать работу / личное / исследование. у каждого есть своя таблица базы данных. удалить один, без остатка
- параллельная извлечение файлов с помощью rayon --> все ядра вашего процессора работают одновременно
- поддержка i18n --> файлы локали в формате JSON, автоматическое определение языка системы. Добавьте файл json, чтобы указать свой язык
(Обсуждение)
#RecallLite #Windows #AiSearch #AiFind #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
🎙 Voicebox — клонируй любой голос за две секунды
Voicebox - локальная нейросеть для клонирования голоса. Работает офлайн, без подписок и ограничений — по сути, бесплатная альтернатива ElevenLabs.
Клонирование голоса с открытым исходным кодом на основе Qwen3-TTS. Создавайте естественную речь на основе текста с практически идеальной имитацией голоса.
Принцип простой: загрузил короткий кусок аудио — получил клон голоса. Дальше можно генерировать речь из текста, собирать диалоги из нескольких голосов, озвучивать видео или презентации.
Что умеет:
Всё работает локально — проекты и озвучки хранятся на твоём ПК.
🔗 https://voicebox.sh
https://github.com/jamiepine/voicebox
#Qwen3TTS #TTS #Voicebox #MacOS #Windows #AiLocal #LocalAi
Voicebox - локальная нейросеть для клонирования голоса. Работает офлайн, без подписок и ограничений — по сути, бесплатная альтернатива ElevenLabs.
Клонирование голоса с открытым исходным кодом на основе Qwen3-TTS. Создавайте естественную речь на основе текста с практически идеальной имитацией голоса.
Принцип простой: загрузил короткий кусок аудио — получил клон голоса. Дальше можно генерировать речь из текста, собирать диалоги из нескольких голосов, озвучивать видео или презентации.
Что умеет:
• Клонирует голос по короткому сэмплу
• Генерирует речь из текста любым клоном
• Собирает разговоры и подкасты из нескольких голосов
• Записывает и расшифровывает аудио
Всё работает локально — проекты и озвучки хранятся на твоём ПК.
https://github.com/jamiepine/voicebox
#Qwen3TTS #TTS #Voicebox #MacOS #Windows #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
Команда OpenMOSS выпустила семейство мультиязычных моделей для генерации голоса. Раньше от них были транскрибатор и видеогенератор, теперь — полноценный набор инструментов для работы со звуком.
Что умеют модели:
💬 Генерируют длинную речь без потери качества
💬 Клонируют голос по образцу
💬 Создают выразительные диалоги с несколькими говорящими
💬 Проектируют голос по текстовому описанию — без аудиопримеров
💬 Работают в реальном времени
💬 Генерируют звуковые эффекты по текстовому запросу
Есть студия для экспериментов, но вход только через китайский номер телефона. Демо можно посмотреть на Hugging Face и официальном сайте.
https://github.com/OpenMOSS/MOSS-TTS
https://huggingface.co/collections/OpenMOSS-Team/moss-tts
https://huggingface.co/spaces/OpenMOSS-Team/MOSS-TTSD-v1.0
https://studio.mosi.cn/voice-synthesis?mode=double
#MOSSTTS #MOSS #TTS #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Настольный ИИ-помощник с поддержкой локальных моделей!
Основные возможности:
✅ Планирование задач — визуальная панель задач с отслеживанием прогресса, сохраняемая для каждого сеанса
✅ Запланированные задачи — создание напоминаний и повторяющихся задач с автоматическим выполнением
✅ OpenAI SDK — полный контроль над API, совместимость с любой конечной точкой, совместимой с OpenAI
✅ Локальные модели — поддержка vLLM, Ollama, LM Studio
✅ Кодовые песочницы — выполнение кода на JavaScript (виртуальная машина Node.js) и Python (системный подпроцесс)
✅ Поддержка документов — извлечение текста из PDF и DOCX (в комплекте, работает «из коробки»)
✅ Веб-поиск — интеграция Tavily и Z.AI для поиска в интернете
✅ Парсинг Telegram — отображение каналов t.me с реакциями, просмотрами и автоматической прокруткой старых постов
✅ Безопасность — песочница для безопасных операций с файлами
✅ Кроссплатформенность — Windows, macOS, Linux с соответствующими командами оболочки
(Пост Автора)
(Опыт тестирования автором)
#ValeDesk #AiAgent #AgentAi #MacOS #Windows #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
INTELLECT-3.1 — это модель логического вывода на основе смеси экспертов с 106 миллиардами (A12B) параметров, созданная в результате дальнейшего обучения INTELLECT-3 с дополнительным обучением с подкреплением в области математики, программирования, разработки программного обеспечения и агентных задач.
INTELLECT-3 — это модель Mixture-of-Experts с 106 миллиардами параметров, обученная с использованием SFT и RL на основе базовой модели GLM 4.5 Air. Она демонстрирует высочайшую для своего размера производительность в тестах на математику, программирование, естественные науки и логическое мышление.
Блог: https://www.primeintellect.ai/blog/intellect-3
Модель: https://huggingface.co/PrimeIntellect/INTELLECT-3.1
Рабочий квант: https://huggingface.co/noctrex/INTELLECT-3.1-MXFP4_MOE-GGUF (MXFP4_MOE=67.4 GB)
#INTELLECT31 #INTELLECT3 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
Нового:
- Полноформатная система автоматического распознавания речи с автоматическим разбиением на фрагменты и сшиванием с перекрытием
- Более быстрая потоковая передача системы автоматического распознавания речи и меньше ненужного перекодирования при загрузке
- Поддержка MLX Parakeet
- Новые варианты 4-битных моделей (Parakeet, LFM2.5, чат Qwen3, принудительное выравнивание)
- Улучшения в системе преобразования речи в текст: ограничения на основе модели + адаптивные тайм-ауты
- Более удобный интерфейс управления моделями (Мои модели + модальное окно выбора модели)
Документы: https://izwiai.com
(Обсуждение)
#Izwi #TTS #MacOS #Windows #Linux #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Izwiai
Izwi | Voice AI runtime for private deployment
Run speech recognition, text to speech, diarization, and voice workflows inside your environment with a local-first runtime and OpenAI-compatible API.
👏1
This media is not supported in your browser
VIEW IN TELEGRAM
📱 Локальное приложение для преобразования речи в текст для iOS (альтернатива Wispr Flow)
Внутри модели: Parakeet V3 (200Mb), Whisper Large V3 Turbo (800Mb), Apple Speech.
Есть режимы: Заметки, Митинг, Клавиатура.
Есть свои Сокращения, Словарь, ИИ постОбработка, ...
Есть приложения для iOS, MacOS и Android.
Ссылка на тестовый режим:
https://testflight.apple.com/join/e5pcxwyq
Автор с радостью предоставит приложение бесплатно тем, кто оставит полезный отзыв о тестовом режиме. (ТУТ)
Еще есть приложение для MacOS с локальной обработкой. При желании пользователи могут синхронизировать свои сниппеты и словарь с помощью личного аккаунта iCloud.
#VoiceReader #Parakeet #Whisper #iPhone #App #Транскрибация #AiLocal #LocalAi
Внутри модели: Parakeet V3 (200Mb), Whisper Large V3 Turbo (800Mb), Apple Speech.
Есть режимы: Заметки, Митинг, Клавиатура.
Есть свои Сокращения, Словарь, ИИ постОбработка, ...
Есть приложения для iOS, MacOS и Android.
Ссылка на тестовый режим:
https://testflight.apple.com/join/e5pcxwyq
Автор с радостью предоставит приложение бесплатно тем, кто оставит полезный отзыв о тестовом режиме. (ТУТ)
Еще есть приложение для MacOS с локальной обработкой. При желании пользователи могут синхронизировать свои сниппеты и словарь с помощью личного аккаунта iCloud.
#VoiceReader #Parakeet #Whisper #iPhone #App #Транскрибация #AiLocal #LocalAi
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 Accomplish — агент, который кодит и гуглит одновременно
ИИ-агент, который пишет код и параллельно лазит по интернету. Называется Accomplish (ранее Openwork) , работает локально и не требует API-ключей (хотя и с ними может!).
🔗 https://www.accomplish.ai
https://github.com/accomplish-ai/accomplish
#Accomplish #AiAgent #AgentAi #MacOS #Windows #AiLocal #LocalAi
ИИ-агент, который пишет код и параллельно лазит по интернету. Называется Accomplish (ранее Openwork) , работает локально и не требует API-ключей (хотя и с ними может!).
Автоматизирует управление файлами, создание документов и выполнение задач в браузере на вашем ПК. Используйте собственные ключи API (OpenAI, Anthropic, Google, xAI) или запускайте локальные модели через Ollama.
Работает локально на вашем компьютере. Используйте свои API-ключи или локальные модели. Лицензия MIT.
Не нужны Claude Desktop, Cursor или ежемесячные подписки. Полностью open source — ставишь, запускаешь, используешь. Никаких сгоревших кредитов или лимитов на запросы.
Что он на самом деле делает:
- 📁 Управление файлами: Сортируйте, переименовывайте и перемещайте файлы в соответствии с их содержимым или заданными вами правилами.
- ✍️ Написание документа: Предложите ему написать, обобщить или переписать документы.
- 🔗 Соединения инструментов: Работает с Notion, Google Диском, Dropbox и другими сервисами (через локальные API)
- ⚙️ Индивидуальные навыки: Определите повторяющиеся рабочие процессы и сохраните их как навыки.
- 🛡 Полный контроль: Вы подтверждаете каждое действие. Вы можете просматривать логи. Вы можете остановить процесс в любой момент.
Варианты использования:
- Наведите порядок в папках по проектам, типам файлов или датам
- Создавайте черновики, обобщайте и переписывайте документы, отчеты и заметки о совещаниях
- Автоматизируйте рабочие процессы в браузере, такие как поиск информации и заполнение форм
- Создавайте еженедельные обновления на основе файлов и заметок
- Подготовьте материалы для совещаний на основе документов и календарей
Поддерживаемые модели и поставщики:
Anthropic (Claude)
OpenAI (GPT)
Google AI (Gemini)
xAI (Grok)
DeepSeek
Moonshot AI (Kimi)
Z.AI (GLM)
MiniMax
Amazon Bedrock
Azure Foundry
OpenRouter
LiteLLM
Ollama (локальные модели)
LM Studio (локальные модели)
https://github.com/accomplish-ai/accomplish
#Accomplish #AiAgent #AgentAi #MacOS #Windows #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Murmur превращает статьи, PDF-файлы, файлы, созданные с помощью ИИ, в аудио студийного качества, которые вы можете слушать во время работы, прогулок или других занятий — в 100% автономном режиме на вашем Mac.
Никаких подписок. Никакого облака. Никакого сбора данных. Работу выполняет только ваш Mac.
В работе: импорт PDF/EPUB, многоголосный диалог, клонирование голоса по коротким образцам, поддержка большего количества языков
(Обсуждение) (Еще обсуждение с видео)
#Murmur #TTS #EPUB #EPUB2Voice #VoiceBook #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Характеристики:
- Чат с ветвлением, редактированием/удалением, перегенерации и многопользовательскими автоповоротами.
- Инструменты для ролевой игры: блоки подсказок, примечания автора, состояние сцены, пресеты.
- Персонажи пользователей включены в контекст генерации.
- Карточки персонажей: импорт, проверка, редактирование.
- Режим творческого письма: проекты, главы, сцены, проверка согласованности, экспорт.
- Настольная версия для macOS и Windows.
В Vellium v0.3.5: масштабное обновление режима написания, поддержка Native KoboldCpp и OpenAI TTS
(Обсуждение)
#Vellium #MacOS #Windows #ChatRP #RP
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
С использованием ускорителей faster-whisper и CUDA.
Особенности:
- 100% Локально: Все работает на вашем собственном компьютере, приложению не нужен интернет после первоначальной настройки
- По-настоящему многоязычный: поддерживает более 90 языков!
- Полнофункциональный графический интерфейс: настольное приложение Electron для Linux, Windows и macOS (Apple Silicon)
- Режим GPU + CPU: ускорение NVIDIA CUDA (рекомендуется) или режим только для процессора для любой платформы, включая macOS
- Транскрипция в длинной форме: Запишите столько, сколько захотите, и расшифруйте ее за считанные секунды
- Оперативный режим: транскрипция каждого предложения в режиме реального времени для непрерывного процесса диктовки
- Ведение дневника говорящего: идентификация говорящего на основе PyAnnote
- Статическая транскрипция файла: Транскрибируйте существующие аудио / видеофайлы с помощью очереди импорта нескольких файлов, повторных попыток и отслеживания прогресса.
- Удаленный доступ: безопасный доступ к вашему рабочему столу дома под управлением модели из любого места (с помощью Tailscale)
- Аудиозапись: режим аудиозаписи с просмотром на основе календаря, полнотекстовым поиском и интеграцией с LM Studio (делитесь своими заметками с искусственным интеллектом).
- Управление в системном трее: быстрый запуск / остановка записи, а также множество других элементов управления, доступных в системном трее.
(Обсуждение)
#TranscriptionSuite #Whisper #Transcription #Транскрибация #ASR #MacOS #Windows #Linux #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
🎙 Pocket TTS Server - Клонируйте любой голос, записав всего 20 секунд аудио, и мгновенно общайтесь с ИИ, используя этот голос. (альтернатива ElevenLabs)
Легкий сервер для клонирования голоса и общения в режиме реального времени с API, совместимым с OpenAI. Легко интегрируется в голосовых ботов (автор использует его для голосовых ответов в Telegram).
🔗 https://github.com/ai-joe-git/pocket-tts-server
(Обсуждение)
#PocketTTSServer #PocketTTS #TTS #Windows #AiLocal #LocalAi
Легкий сервер для клонирования голоса и общения в режиме реального времени с API, совместимым с OpenAI. Легко интегрируется в голосовых ботов (автор использует его для голосовых ответов в Telegram).
🎭 Основные характеристики:
🗣 Клонирование голоса
- Любой голос — загрузите 15–20 секунд чистого звука
- Автоматическое преобразование — MP3/OGG/FLAC → WAV автоматически
- Умная обрезка — длинная аудиозапись автоматически обрезается до 20 секунд (предотвращает появление неразборчивого шума)
- Система архивации — оригиналы сохраняются в voices-celebrities-archive/
💬 Голосовой чат в реальном времени
- Потоковый текст — слова появляются по мере их генерации LLM
- Потоковое аудио — аудио воспроизводится по предложениям
- Без ожидания — первое аудио через 2–3 секунды
- Последовательное воспроизведение — предложения выстраиваются в очередь и воспроизводятся по порядку
🔌 Совместимость с OpenAI
- Готовая замена API преобразования текста в речь от OpenAI
- Работает с OpenWebUI, SillyTavern и другими клиентами
⚡️ Производительность
- Поддержка 4000 токенов для длинных ответов
- 180-секундный тайм-аут для медленных языковых моделей
- Оптимизировано для центрального процессора (опционально для графического процессора)
- Более 76 голосов (знаменитости, персонажи, пользовательские)
(Обсуждение)
#PocketTTSServer #PocketTTS #TTS #Windows #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
(Обсуждение)
#Book2Movie #ComfyUI #Kokoro #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - Frozen-tuna/Book2Movie: A script to process ebooks into slideshows or movies through the use of several different types…
A script to process ebooks into slideshows or movies through the use of several different types of generative AI. - Frozen-tuna/Book2Movie
This media is not supported in your browser
VIEW IN TELEGRAM
🦉 Makimus-AI — поиск изображений с помощью локального ИИ
Выполните поиск по всей библиотеке изображений с помощью естественного языка или изображения — просто введите то, что ищете, или загрузите изображение, и Makimus-AI мгновенно найдет визуально похожие результаты с помощью ИИ.
Пример: введите "Девушка в красных доспехах" или "собака, играющая в траве" — или просто Используйте изображение, чтобы найти визуально похожие изображения в своих папках.
🧠 Модель: В этом приложении используется OpenCLIP ViT-L-14, обученный на наборе данных LAION-2B от OpenAI/LAION.
🔗 https://github.com/Ubaida-M-Yusuf/Makimus-AI
(Обсуждение и еще тут)
#MakimusAI #OpenCLIP #AiLocal #LocalAi
Выполните поиск по всей библиотеке изображений с помощью естественного языка или изображения — просто введите то, что ищете, или загрузите изображение, и Makimus-AI мгновенно найдет визуально похожие результаты с помощью ИИ.
Пример: введите "Девушка в красных доспехах" или "собака, играющая в траве" — или просто Используйте изображение, чтобы найти визуально похожие изображения в своих папках.
🧠 Модель: В этом приложении используется OpenCLIP ViT-L-14, обученный на наборе данных LAION-2B от OpenAI/LAION.
💡Особенности:
🔍 Поиск изображений по естественному языку
🖼 Поиск изображений по изображениям — поиск визуально похожих изображений
🔄 Поиск во время индексации — не нужно ждать завершения индексации
⚡️ Ускорение с помощью графического процессора (CUDA, Apple MPS, DirectML)
🧠 Автоматическое определение видеопамяти и настройка размера пакета
📦 Оптимизация ONNX для ускорения логического вывода
🖼 Предварительный просмотр миниатюр с поддержкой экспорта
💾 Умное кэширование — проиндексируйте один раз, ищите вечно
(Обсуждение и еще тут)
#MakimusAI #OpenCLIP #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
This media is not supported in your browser
VIEW IN TELEGRAM
ИИ для начинающих поваров и девочек! ИИ готовка!
Теперь с более интеллектуальной моделью приготовления с использованием ИИ и большим набором базовых ингредиентов и инструментов. Теперь можно готовить десятки тысяч блюд.
#Kitchen #AiKitchen #InfiniteKitchen
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
Releases · BoltzmannEntropy/MimikaStudio
MimikaStudio - A local-first application for macOS (Apple Silicon) + Agentic MCP Support - BoltzmannEntropy/MimikaStudio
LoopMaker - это нативное приложение для macOS, использующее современную музыкальную модель с ИИ. Опишите, что вы хотите, и LoopMaker создаст это локально, конфиденциально, за считанные минуты.
Поддерживает треки продолжительностью до 4 минут с опциональными текстами и вокалом!
Три мощных режима создания:
🎵 Generate — Создайте оригинальную музыку из текстовых подсказок. Добавьте пользовательские тексты песен со структурированными разделами (куплет, припев, переход). Выберите инструментальный или вокальный вариант.
🎸 Cover — Вставьте любой аудиофайл и преобразуйте его. Дополните вокал новыми инструментами, замените вокал инструментальной версией или напишите совершенно новый текст. Измените стиль от утонченного до драматичного.
🔄 Extend — Добавляйте от 10 секунд до 2 минут к любому треку с помощью интеллектуального наложения. Никаких сокращений, никаких артефактов.
6 жанровых пресетов для быстрого начала работы:
- Lo-Fi · Кинематографический · Эмбиентный · Электронный · Хип-хоп · Джазовый
- Каждый пресет настраивается с помощью оптимизированных подсказок или вы можете создать свой собственный с нуля.
Почему LoopMaker, а не Suno / Udio / AIVA?
💰 Стоимость — они взимают 10-30 долларов в месяц навсегда. LoopMaker - это один платеж, ваш навсегда.
⚡️ Использование — у них есть кредиты и ежедневные ограничения. У LoopMaker неограниченное количество поколений.
✅ Конфиденциальность — они загружают ваше аудио в облако. LoopMaker работает на 100% локально, ничего не покидает ваш Mac.
✅ Интернет — он им нужен всегда. LoopMaker нужен только для начальной загрузки модели.
✅ Право собственности — их лицензирование зависит от платформы. С LoopMaker вы являетесь владельцем всего, что создаете.
Все программы Автора: https://3422223166764.gumroad.com
(Обсуждение) (Обсуждение 2) (Обновление)
#LoopMaker #AiSong #AiAudio #MacOS #AiLocal #LocalAi
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1