Собственная функция преобразования речи в текст для вашего Mac с возможностью диктовки на уровне всей системы, расшифровкой файлов, подсказками, профилями, историей, словарем и фрагментами.
Транскрибируйте аудио с помощью встроенных в устройство моделей искусственного интеллекта или облачных API (Groq, OpenAI), а затем обрабатывайте результат с помощью пользовательских подсказок для больших языковых моделей. Ваши голосовые данные остаются на вашем Mac с локальными моделями — или вы можете использовать облачные API для более быстрой обработки.
Транскрипция:
- Восемь движков — WhisperKit (более 99 языков, потоковая передача, перевод), Parakeet TDT v3 (25 европейских языков, очень быстрая), Apple SpeechAnalyzer (macOS 26+, загрузка модели не требуется), Qwen3 ASR (на основе MLX), Voxtral (локальный Voxtral Mini 4B, на основе MLX), Groq Whisper, OpenAI Whisper и OpenAI Compatible (любой API, совместимый с OpenAI)
- На устройстве или в облаке — вся обработка выполняется локально на вашем Mac или с использованием API Groq/OpenAI Whisper для более быстрой обработки.
- Предварительный просмотр трансляции — частичная расшифровка в режиме реального времени во время разговора (WhisperKit)
- Транскрипция файла — пакетная обработка нескольких аудио- и видеофайлов с помощью перетаскивания
- Экспорт субтитров — экспорт расшифровок в формате SRT или WebVTT с указанием временных меток.
- Словарь — термины повышают точность распознавания речи. Функция исправления автоматически устраняет распространенные ошибки при расшифровке. Автоматическое обучение на основе исправлений, внесенных вручную. Включает импортируемые наборы терминов!
(Windows Beta и iOS Alpha доступны для предварительного тестирования.)
Список Дополнений: https://www.typewhisper.com/en/addons/ (Движки скачиваются в этом разделе)
(Обсуждение)
#TypeWhisper #Траснкрибация #Диктовка #WhisperKit #Whisper #Parakeet #Voxtral #Qwen3ASR #ASR #MacOS #SoftAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Больше не нужно ждать, пока ваш Mac загрузится.
Встроенный в macOS сервер MLX с интеллектуальным кэшированием. Claude Code, OpenClaw и Cursor отвечают за 5 секунд, а не за 90.
Создано с учетом того, как на самом деле работают агенты.
Агенты кодирования аннулируют кэш KV десятки раз за сеанс. oMLX сохраняет каждый блок кэша на твердотельном накопителе, поэтому, когда агент возвращается к предыдущему префиксу, он восстанавливается с диска за миллисекунды, а не пересчитывается с нуля.
«Модели Qwen3.5, работающие на oMLX, настолько быстрые, что запускать локальный ИИ на Mac имеет смысл. Он намного быстрее, чем LMStudio, а вызовы инструмента гораздо надежнее».
❓ Чем oMLX отличается от Ollama или LM Studio?
Ollama и LM Studio кэшируют состояние KV в памяти, но при смене контекста в середине сеанса — что постоянно происходит при использовании агентов для написания кода — весь кэш становится недействительным и пересчитывается с нуля. oMLX сохраняет каждый блок кэша KV на SSD, поэтому ранее кэшированные фрагменты всегда можно восстановить. Время до первого результата сокращается с 30–90 секунд до менее чем 5 секунд при работе с длинными контекстами.
❓ Какие модели поддерживаются?
Любая модель в формате MLX от HuggingFace. К ним относятся Qwen, LLaMA, Mistral, Gemma, DeepSeek, MiniMax, GLM и другие. Модели логического вывода (DeepSeek, MiniMax, Qwen) автоматически обрабатывают тег <think>. С версии 0.2.0 поддерживаются визуально-языковые модели с тем же постраничным кэшированием на твердотельных накопителях.
#omlxai #oMLX #Ollama #LMStudio #MLX #MacOS #SoftAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Детерминированный эталонный монитор с функцией изоляции для локальных рабочих процессов с использованием ИИ-агентов. Его цель — обеспечить безопасную среду для работы вашего агента без риска повреждения ваших данных и личной информации.
У вашего агента есть реальное рабочее пространство для реальной работы, рискованные пересечения границ блокируются или требуют согласования, а каждое важное решение сопровождается квитанцией, чтобы вы могли видеть, что произошло, и не нависать над ним весь день, как встревоженный спасатель.
В настоящее время он поддерживает Openclaw, Claude Code и OpenCode, а также сеть TailScale и телеграм-канал (для OpenClaw используется встроенный телеграм-канал).
(Обсуждение)
#AgentRuler #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Компания Cohere выпустила свою первую модель преобразования речи в текст, которая теперь возглавляет рейтинг OpenASR (для английского языка, но модель поддерживает 14 различных языков).
Есть демонстрационная версия на WebGPU: запустить модель полностью локально прямо в браузере!
Ссылка на демонстрационную версию (+ исходный код):
(Обсуждение)
#CohereTranscribe #Transcribe #Транскрибация #STT #WebGPU #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🌎 Этот сайт поможет вам узнать, какие языковые модели можно запустить на вашем оборудовании или какое оборудование надо под модель ИИ?! (Модели сгруппированы под задачи!)
🔗 https://runthisllm.com
или аналог: https://www.vram.top
#runthisllm #LLM #AiModel #ModelAi #LocalAi #AiLocal
или аналог: https://www.vram.top
#runthisllm #LLM #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Интерактивная студия анонимизации видео. Браузерный инструмент для обнаружения, отслеживания и размытия объектов на видео — от 720p до 4K и 360° равнопромежуточных панорам.
Основные моменты:
- Встроенная обработка 4K — изначально поддерживает видео с разрешением 3840×2160. С RF-DETR Nano + skip=4 обеспечивает 76 эффективных кадров в секунду при разрешении 4K (в 2,5 раза выше, чем в реальном времени). Даже при skip=2 частота кадров RF-DETR Nano Det превышает 30 кадров в секунду при разрешении 4K.
- Поддержка панорамы 360° — встроенный конвейер равнопромежуточной проекции. Обрабатывает видео с камеры Insta360 X5 (до 8K: 7680×3840), извлекая перспективные субпроекции, выполняя обнаружение и повторно проецируя маски в равноугловое пространство.
- 8 моделей обнаружения — от быстрых детекторов (RF-DETR Nano: 15,7 кадров в секунду при разрешении 4K) до сегментации с точностью до пикселя (RF-DETR Medium Seg) и обнаружения по текстовым подсказкам (Grounding DINO: «размыть человека в красном»)..
- Возможность работы в режиме реального времени — отслеживание пропущенных кадров с помощью ByteTrack обеспечивает линейное ускорение: skip=4 → в 4 раза быстрее. RF-DETR Nano Det + skip=4 при разрешении 720p обеспечивает 305 эффективных кадров в секунду.
Работает полностью локально. В репозитории есть гифки, на которых сравниваются все подходы к моделированию на одном и том же кадре 4K.
(Обсуждение)
#privacyblur #размытие #анонимизация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Новый Qwen3.5-9b (полная версия и версия с квантованием GGUF), доработанный для агентной платформы (OpenClaw, AgentScope) на основе Copaw-9B (официальная агентная платформа Qwen) + Opus 4.6 Reasoning.
(используйте рекомендуемые параметры генерации)
Qwen3.5-9B-Opus-OpenClaw-Distilled — это усовершенствованная версия Qwen3.5-9b, в которой приоритет отдается логическому мышлению и агентной настройке. Она создана для того, чтобы объединить две сильные стороны в одной модели.
- Операционные / агентские инстинкты OpenClaw и CoPaw
- Структурированное мышление в стиле Клода Опуса
Цель проста: используйте строгий базовый режим -> настройте на агентурное использование, такое как openclaw и agentscope -> используйте рассуждения уровня opus-4.6 -> лучшее из обоих миров
Вкратце:
Он предназначен для пользователей, которые хотят:
- сохраненный чат + высокая агентская полезность в духе Openclaw / CoPaw
- модель, которая больше похожа на «планировщик + оператор», чем на «чат-бота»
Вдохновлено популярным Jackrong/Qwen3.5-27B-Claude-4.6-Opus-Reasoning-Distilled
ykarout/Qwen3.5-9b-Opus-Openclaw-Distilled
(Обсуждение)
#Qwen359B #GGUF #Qwen35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Квантованные модели APEX MoE ускоряют вывод данных на 33 % и поддерживают TurboQuant (ускорение обработки подсказок на 14 %)
Только что выпустили APEX (Adaptive Precision for EXpert Models) — новую технологию квантования MoE, которая превосходит Unsloth Dynamic 2.0 по точности и при этом в два раза меньше по размеру для архитектур MoE.
Протестировано на Qwen3.5-35B-A3B, но этот метод применим к любой модели MoE. Размер в два раза меньше, чем у Q8. Уровень сложности сопоставим с F16.
Благодаря TurboQuant при использовании контекста 8K каждый уровень APEX обрабатывает запросы примерно на 14 % быстрее!
Работает со стандартным llama.cpp без каких-либо патчей.
С открытым исходным кодом: http://github.com/mudler/LocalAI
- I-Quality: 21,3 ГБ — максимальная точность
- I-Balanced: 23,6 ГБ — оптимальный баланс
- I-Compact: 16,1 ГБ — подходит для графических процессоров с 24 ГБ видеопамяти
- Mini: 12,2 ГБ — подходит для графических процессоров с 16 ГБ видеопамяти
Модели: http://huggingface.co/mudler/Qwen3.5-35B-A3B-APEX-GGUF
Метод + техническая статья: http://github.com/mudler/apex-quant
Локальная установка: http://github.com/mudler/LocalAI
(Обсуждение)
#APEX #MoE #TurboQuant #apexquant #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
Please open Telegram to view this post
VIEW IN TELEGRAM
У этого Канала теперь есть "Зеркало" в Макс: https://max.ru/join/m9_yt1fhcVwQS9_oHxUCBSialkmNopz_CA8UhPD2v2Q - все посты будут дублироваться и туда.
💩4👍3🤮1
Google выпустила 4 открытых модели Gemma 4 с поддержкой 140 языков!
Модели различаются количеством параметров.
Для устройств с ограниченными ресурсами, включая смартфоны, предназначен ИИ на 2 миллиарда и 4 миллиарда параметров под названием Effective.
Более мощные системы получат 26 миллиардов параметров с 4B Активных для Mixture of Experts (MoE) и 31 миллиард параметров для Dense.
Увеличенное контекстное окно — модели меньшего размера имеют контекстное окно размером 128 К, а модели среднего размера — 256 К.
Все модели семейства Gemma 4 способны обрабатывать видео и изображения.
Две младшие модели также могут обрабатывать аудио данные и понимать речь.
(Статья)
https://huggingface.co/unsloth/gemma-4-26B-A4B-it-GGUF
https://huggingface.co/google/gemma-4-26B-A4B-it/raw/main/chat_template.jinja
или слегка измененная версия (лучше):
https://pastebin.com/raw/hnPGq0ht
https://huggingface.co/unsloth/gemma-4-31B-it-GGUF
https://huggingface.co/unsloth/gemma-4-E4B-it-GGUF
https://huggingface.co/unsloth/gemma-4-E2B-it-GGUF
Что нового в Gemma 4 - видео! (Обсуждение)
#Gemma4 #Gemma #Google #AiModel #MidelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Holo3 — модели, которые умеют выполнять рабочие процессы в корпоративных средах. Автоматизируют задачи, с которыми обычно справляются сотрудники за компьютером.
Младшая Holo3-35B-A3B выложена на Hugging Face и доступна бесплатно через Inference API с ограничением в 10 запросов в минуту.
Старшая версия Holo3-122B-A10B доступна только через API.
#Holo3 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 Приложение Google AI Edge Gallery
Обновилось - теперь с Gemma 4 и Agent Skills
⬇️ Android: https://play.google.com/store/apps/details?id=com.google.ai.edge.gallery
Скачать напрямую последнюю версию ТУТ.
Например Версия 1.0.11 .APK
📱 iOS: https://apps.apple.com/ru/app/google-ai-edge-gallery/id6749645337
(Пост, Обсуждение)
#AgentSkills #Android #iPhone #App #GoogleAIEdgeGallery #AIEdgeGallery #EdgeGallery #AiAgent #AgentAi #App #LocalAi #AiLocal
Обновилось - теперь с Gemma 4 и Agent Skills
Новое:
- Представляем Gemma 4: новейшие высокопроизводительные модели, работающие полностью в автономном режиме.
- Навыки агента: расширяйте возможности больших языковых моделей с помощью модульных инструментов, таких как интерактивные карты и поиск в Википедии. Поддержка пользовательских навыков, загружаемых из сообщества.
- Режим мышления в чат-боте с ИИ: визуализируйте процесс рассуждений модели для большей прозрачности. (Примечание: в настоящее время доступно только для поддерживаемых моделей, в том числе семейства Gemma 4).
Скачать напрямую последнюю версию ТУТ.
Например Версия 1.0.11 .APK
📱 iOS: https://apps.apple.com/ru/app/google-ai-edge-gallery/id6749645337
(Пост, Обсуждение)
#AgentSkills #Android #iPhone #App #GoogleAIEdgeGallery #AIEdgeGallery #EdgeGallery #AiAgent #AgentAi #App #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
(мультимодальный режим: зрение, видео, аудио)
ОРИГИНАЛЬНАЯ версия от Google, только без цензуры. Агрессивность означает отсутствие отказов. Это изначально мультимодальные модели, объединяющие текст, изображения, видео и аудио в одной модели. Для поддержки зрения и слуха прилагается файл mmproj.
❗️Отлично иметь на своем смартфоне модели без цензуры и отказов!
👉 Gemma 4 E4B (4B): https://huggingface.co/HauhauCS/Gemma-4-E4B-Uncensored-HauhauCS-Aggressive
👉 Gemma 4 E2B (2B): https://huggingface.co/HauhauCS/Gemma-4-E2B-Uncensored-HauhauCS-Aggressive
Следующие на очереди: Gemma 4 E31B (плотная) и E26B-A4B (MoE).
Все модели HauhauCS
(Обсуждение)
=============
👉 Gemma 4 - 31b abliterated https://huggingface.co/paperscarecrow/Gemma-4-31B-it-abliterated-gguf (Пост)
👉 Gemma-4-E2B-it-Heretic-ARA https://huggingface.co/p-e-w/gemma-4-E2B-it-heretic-ara (Пост)
#HauhauCS #Gemma4 #Gemma #Uncensored #abliterated #Heretic #ARA #AiModel #MidelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Qwen3.5 НАМНОГО лучше распознает изображения!
А по оценкам людей, Gemma 4 намного опережает Qwen 3.5: https://arena.ai/leaderboard/text?license=open-source
Еще пишут:
- Gemma 31B примерно на одном уровне с Qwen 27B по уровню интеллекта. Но Gemma медленнее, потому что она больше.
- Gemma гораздо лучше справляется с логическими задачами, она быстрее завершает логические цепочки и выдает окончательный ответ, чем Qwen. Это большой плюс.
- Qwen гораздо лучше справляется с распознаванием изображений и их серий. Qwen может обрабатывать и отвечать на вопросы о ~280 изображениях одновременно (как о кадрах видео). А Gemma — нет.
(Обсуждение)
#Gemma4 #Gemma #Qwen35 #Qwen #AiModel #MidelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Media is too big
VIEW IN TELEGRAM
🌎 Gemma 4 WebGPU: Запустите новую открытую модель Google локально в своем браузере
Мультимодальный ИИ, работающий локально в вашем браузере с использованием WebGPU без установки программ!
⬇️ https://huggingface.co/spaces/webml-community/Gemma-4-WebGPU - кликнуть по "Load model" и чат готов!
#Gemma4 #WebGPU #LocalAi #AiLocal
Мультимодальный ИИ, работающий локально в вашем браузере с использованием WebGPU без установки программ!
#Gemma4 #WebGPU #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Local Ai
📱 Приложение Google AI Edge Gallery Обновилось - теперь с Gemma 4 и Agent Skills Новое: - Представляем Gemma 4: новейшие высокопроизводительные модели, работающие полностью в автономном режиме. - Навыки агента: расширяйте возможности больших языковых…
Кроме приложения Google Ai Edge Gallery, новую модель Gemma 4 на сегодня, поддерживает только приложение:
https://secretai.io
Android: https://play.google.com/store/apps/details?id=io.secretai.llm
iOS: https://apps.apple.com/app/secret-ai/id6744668980
И на 2B и на 4B!
Все остальные ещё не обновились!
#App #Gemma4 #SecretAi #LocalAi #AiLocal #Android #iPhone
https://secretai.io
Android: https://play.google.com/store/apps/details?id=io.secretai.llm
iOS: https://apps.apple.com/app/secret-ai/id6744668980
И на 2B и на 4B!
Все остальные ещё не обновились!
#App #Gemma4 #SecretAi #LocalAi #AiLocal #Android #iPhone
Secret AI - 100% Offline & Secure AI Assistant
Secret AI is a secure private LLM chatbot that runs entirely on your device - your chats stay 100% private with zero data collection, no servers, no account required, no tracking, and completely anonymous.