Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
🔍 OpenResearcher — опенсорсный агент на 30B параметров для глубоких исследований

OpenResearcher — это полностью открытая агентная языковая модель (30B-A3B), предназначенная для долгосрочных глубоких исследований. Она демонстрирует впечатляющую точность 54,8% на BrowseComp-Plus, превосходя по этому показателю GPT-4.1, Claude-Opus-4, Gemini-2.5-Pro, DeepSeek-R1 и Tongyi-DeepResearch. Полностью открыли исходный код для обучения и оценки, включая данные, модель, методологию обучения и систему оценки, чтобы каждый мог заниматься глубокими исследованиями.
Модель заточена под анализ больших объёмов информации и построение структурированных выводов.

Nvidia Nemotron интегрировал OpenResearcher в свои инструменты. Модель доступна на GitHub и Hugging Face — можно запустить локально или потестить в демо.

🔗 https://github.com/TIGER-AI-Lab/OpenResearcher
🔗 https://huggingface.co/OpenResearcher/OpenResearcher-30B-A3B
🔗 https://huggingface.co/spaces/OpenResearcher/OpenResearcher
#OpenResearcher #DeepResearch #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔍 ИИ Для Поиска в Интернете

Список программ, позволяющих осуществлять поиск в интернете с помощью искусственного интеллекта:
🔗 https://hf.co/spaces/felladrin/awesome-ai-web-search
Список организован в виде временной шкалы и содержит программы, поддерживающие следующие сценарии использования:
- Веб-поиск с обобщением результатов с помощью больших языковых моделей и уточняющими вопросами.
- Чат с большими языковыми моделями с поддержкой веб-поиска через вызов функций.
- Веб-исследования с помощью агентов для создания отчетов.

🔗 https://github.com/felladrin/awesome-ai-web-search
#awesomeaiwebsearch #aiwebsearch
Please open Telegram to view this post
VIEW IN TELEGRAM
🎙 TypeWhisper для Mac - Траснкрибация и Диктовка

Собственная функция преобразования речи в текст для вашего Mac с возможностью диктовки на уровне всей системы, расшифровкой файлов, подсказками, профилями, историей, словарем и фрагментами.
Транскрибируйте аудио с помощью встроенных в устройство моделей искусственного интеллекта или облачных API (Groq, OpenAI), а затем обрабатывайте результат с помощью пользовательских подсказок для больших языковых моделей. Ваши голосовые данные остаются на вашем Mac с локальными моделями — или вы можете использовать облачные API для более быстрой обработки.

Транскрипция:
- Восемь движковWhisperKit (более 99 языков, потоковая передача, перевод), Parakeet TDT v3 (25 европейских языков, очень быстрая), Apple SpeechAnalyzer (macOS 26+, загрузка модели не требуется), Qwen3 ASR (на основе MLX), Voxtral (локальный Voxtral Mini 4B, на основе MLX), Groq Whisper, OpenAI Whisper и OpenAI Compatible (любой API, совместимый с OpenAI)
- На устройстве или в облаке — вся обработка выполняется локально на вашем Mac или с использованием API Groq/OpenAI Whisper для более быстрой обработки.
- Предварительный просмотр трансляции — частичная расшифровка в режиме реального времени во время разговора (WhisperKit)
- Транскрипция файла — пакетная обработка нескольких аудио- и видеофайлов с помощью перетаскивания
- Экспорт субтитров — экспорт расшифровок в формате SRT или WebVTT с указанием временных меток.
- Словарь — термины повышают точность распознавания речи. Функция исправления автоматически устраняет распространенные ошибки при расшифровке. Автоматическое обучение на основе исправлений, внесенных вручную. Включает импортируемые наборы терминов!
(Windows Beta и iOS Alpha доступны для предварительного тестирования.)

🔗 https://www.typewhisper.com/en/
🔗 https://github.com/TypeWhisper/typewhisper-mac
Список Дополнений: https://www.typewhisper.com/en/addons/ (Движки скачиваются в этом разделе)
(Обсуждение)
#TypeWhisper #Траснкрибация #Диктовка #WhisperKit #Whisper #Parakeet #Voxtral #Qwen3ASR #ASR #MacOS #SoftAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤖 omlx.ai - Локальный ИИ,
Больше не нужно ждать, пока ваш Mac загрузится.

Встроенный в macOS сервер MLX с интеллектуальным кэшированием. Claude Code, OpenClaw и Cursor отвечают за 5 секунд, а не за 90.
Создано с учетом того, как на самом деле работают агенты.
Агенты кодирования аннулируют кэш KV десятки раз за сеанс. oMLX сохраняет каждый блок кэша на твердотельном накопителе, поэтому, когда агент возвращается к предыдущему префиксу, он восстанавливается с диска за миллисекунды, а не пересчитывается с нуля.
«Модели Qwen3.5, работающие на oMLX, настолько быстрые, что запускать локальный ИИ на Mac имеет смысл. Он намного быстрее, чем LMStudio, а вызовы инструмента гораздо надежнее».

Чем oMLX отличается от Ollama или LM Studio?
Ollama и LM Studio кэшируют состояние KV в памяти, но при смене контекста в середине сеанса — что постоянно происходит при использовании агентов для написания кода — весь кэш становится недействительным и пересчитывается с нуля. oMLX сохраняет каждый блок кэша KV на SSD, поэтому ранее кэшированные фрагменты всегда можно восстановить. Время до первого результата сокращается с 30–90 секунд до менее чем 5 секунд при работе с длинными контекстами.

Какие модели поддерживаются?
Любая модель в формате MLX от HuggingFace. К ним относятся Qwen, LLaMA, Mistral, Gemma, DeepSeek, MiniMax, GLM и другие. Модели логического вывода (DeepSeek, MiniMax, Qwen) автоматически обрабатывают тег <think>. С версии 0.2.0 поддерживаются визуально-языковые модели с тем же постраничным кэшированием на твердотельных накопителях.

🔗 https://omlx.ai
#omlxai #oMLX #Ollama #LMStudio #MLX #MacOS #SoftAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 Agent Ruler — это эталонный монитор с ограничениями для рабочего процесса ИИ-агентов.

Детерминированный эталонный монитор с функцией изоляции для локальных рабочих процессов с использованием ИИ-агентов. Его цель — обеспечить безопасную среду для работы вашего агента без риска повреждения ваших данных и личной информации.
У вашего агента есть реальное рабочее пространство для реальной работы, рискованные пересечения границ блокируются или требуют согласования, а каждое важное решение сопровождается квитанцией, чтобы вы могли видеть, что произошло, и не нависать над ним весь день, как встревоженный спасатель.

В настоящее время он поддерживает Openclaw, Claude Code и OpenCode, а также сеть TailScale и телеграм-канал (для OpenClaw используется встроенный телеграм-канал).

🔗 https://github.com/steadeepanda/agent-ruler
(Обсуждение)
#AgentRuler #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🎙 Cohere Transcribe WebGPU: современное многоязычное распознавание речи локально в браузере!

Компания Cohere выпустила свою первую модель преобразования речи в текст, которая теперь возглавляет рейтинг OpenASR (для английского языка, но модель поддерживает 14 различных языков).
Есть демонстрационная версия на WebGPU: запустить модель полностью локально прямо в браузере!
Ссылка на демонстрационную версию (+ исходный код):
🔗 https://huggingface.co/spaces/CohereLabs/Cohere-Transcribe-WebGPU
(Обсуждение)
#CohereTranscribe #Transcribe #Транскрибация #STT #WebGPU #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🌎 Этот сайт поможет вам узнать, какие языковые модели можно запустить на вашем оборудовании или какое оборудование надо под модель ИИ?! (Модели сгруппированы под задачи!)

🔗 https://runthisllm.com
или аналог: https://www.vram.top
#runthisllm #LLM #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🎞 Инструмент для размытия/анонимизации видео на основе естественного языка работает в разрешении 4K с частотой 76 кадров в секунду

Интерактивная студия анонимизации видео. Браузерный инструмент для обнаружения, отслеживания и размытия объектов на видео — от 720p до 4K и 360° равнопромежуточных панорам.

Основные моменты:
- Встроенная обработка 4K — изначально поддерживает видео с разрешением 3840×2160. С RF-DETR Nano + skip=4 обеспечивает 76 эффективных кадров в секунду при разрешении 4K (в 2,5 раза выше, чем в реальном времени). Даже при skip=2 частота кадров RF-DETR Nano Det превышает 30 кадров в секунду при разрешении 4K.
- Поддержка панорамы 360° — встроенный конвейер равнопромежуточной проекции. Обрабатывает видео с камеры Insta360 X5 (до 8K: 7680×3840), извлекая перспективные субпроекции, выполняя обнаружение и повторно проецируя маски в равноугловое пространство.
- 8 моделей обнаружения — от быстрых детекторов (RF-DETR Nano: 15,7 кадров в секунду при разрешении 4K) до сегментации с точностью до пикселя (RF-DETR Medium Seg) и обнаружения по текстовым подсказкам (Grounding DINO: «размыть человека в красном»)..
- Возможность работы в режиме реального времени — отслеживание пропущенных кадров с помощью ByteTrack обеспечивает линейное ускорение: skip=4 → в 4 раза быстрее. RF-DETR Nano Det + skip=4 при разрешении 720p обеспечивает 305 эффективных кадров в секунду.

Работает полностью локально. В репозитории есть гифки, на которых сравниваются все подходы к моделированию на одном и том же кадре 4K.

🔗 https://github.com/Manojbhat09/privacy-blur
(Обсуждение)
#privacyblur #размытие #анонимизация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Qwen3.5-9b-Opus-Openclaw

Новый Qwen3.5-9b (полная версия и версия с квантованием GGUF), доработанный для агентной платформы (OpenClaw, AgentScope) на основе Copaw-9B (официальная агентная платформа Qwen) + Opus 4.6 Reasoning.
(используйте рекомендуемые параметры генерации)

Qwen3.5-9B-Opus-OpenClaw-Distilled — это усовершенствованная версия Qwen3.5-9b, в которой приоритет отдается логическому мышлению и агентной настройке. Она создана для того, чтобы объединить две сильные стороны в одной модели.
- Операционные / агентские инстинкты OpenClaw и CoPaw
- Структурированное мышление в стиле Клода Опуса

Цель проста: используйте строгий базовый режим -> настройте на агентурное использование, такое как openclaw и agentscope -> используйте рассуждения уровня opus-4.6 -> лучшее из обоих миров

Вкратце:
Он предназначен для пользователей, которые хотят:
- сохраненный чат + высокая агентская полезность в духе Openclaw / CoPaw
- модель, которая больше похожа на «планировщик + оператор», чем на «чат-бота»
Вдохновлено популярным Jackrong/Qwen3.5-27B-Claude-4.6-Opus-Reasoning-Distilled

ykarout/Qwen3.5-9b-Opus-Openclaw-Distilled
🔗 https://huggingface.co/ykarout/Qwen3.5-9b-Opus-Openclaw-Distilled-GGUF
(Обсуждение)
#Qwen359B #GGUF #Qwen35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Квантованные модели APEX MoE
Квантованные модели APEX MoE ускоряют вывод данных на 33 % и поддерживают TurboQuant (ускорение обработки подсказок на 14 %)

Только что выпустили APEX (Adaptive Precision for EXpert Models) — новую технологию квантования MoE, которая превосходит Unsloth Dynamic 2.0 по точности и при этом в два раза меньше по размеру для архитектур MoE.

Протестировано на Qwen3.5-35B-A3B, но этот метод применим к любой модели MoE. Размер в два раза меньше, чем у Q8. Уровень сложности сопоставим с F16.
Благодаря TurboQuant при использовании контекста 8K каждый уровень APEX обрабатывает запросы примерно на 14 % быстрее!
Работает со стандартным llama.cpp без каких-либо патчей.
С открытым исходным кодом: http://github.com/mudler/LocalAI

- I-Quality: 21,3 ГБ — максимальная точность
- I-Balanced: 23,6 ГБ — оптимальный баланс
- I-Compact: 16,1 ГБ — подходит для графических процессоров с 24 ГБ видеопамяти
- Mini: 12,2 ГБ — подходит для графических процессоров с 16 ГБ видеопамяти

Модели: http://huggingface.co/mudler/Qwen3.5-35B-A3B-APEX-GGUF
Метод + техническая статья: http://github.com/mudler/apex-quant
Локальная установка: http://github.com/mudler/LocalAI
(Обсуждение)
#APEX #MoE #TurboQuant #apexquant #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
У этого Канала теперь есть "Зеркало" в Макс: https://max.ru/join/m9_yt1fhcVwQS9_oHxUCBSialkmNopz_CA8UhPD2v2Q - все посты будут дублироваться и туда.
💩4👍3🤮1
Модель: Gemma 4 - 2B -4B -26B(A4B) -31B
Google выпустила 4 открытых модели Gemma 4 с поддержкой 140 языков!

Модели различаются количеством параметров.
Для устройств с ограниченными ресурсами, включая смартфоны, предназначен ИИ на 2 миллиарда и 4 миллиарда параметров под названием Effective.
Более мощные системы получат 26 миллиардов параметров с 4B Активных для Mixture of Experts (MoE) и 31 миллиард параметров для Dense.
Увеличенное контекстное окно — модели меньшего размера имеют контекстное окно размером 128 К, а модели среднего размера — 256 К.
Все модели семейства Gemma 4 способны обрабатывать видео и изображения.
Две младшие модели также могут обрабатывать аудио данные и понимать речь.

🔗 https://deepmind.google/models/gemma/gemma-4/
🔗 https://huggingface.co/collections/google/gemma-4
(Статья)

https://huggingface.co/unsloth/gemma-4-26B-A4B-it-GGUF
⚠️ используйте обновленный jinja (обновили недавно):
https://huggingface.co/google/gemma-4-26B-A4B-it/raw/main/chat_template.jinja
или слегка измененная версия (лучше):
https://pastebin.com/raw/hnPGq0ht

https://huggingface.co/unsloth/gemma-4-31B-it-GGUF
https://huggingface.co/unsloth/gemma-4-E4B-it-GGUF
https://huggingface.co/unsloth/gemma-4-E2B-it-GGUF
Что нового в Gemma 4 - видео! (Обсуждение)
#Gemma4 #Gemma #Google #AiModel #MidelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: 🤖 Holo3 — семейство агентных моделей для работы на ПК

Holo3 — модели, которые умеют выполнять рабочие процессы в корпоративных средах. Автоматизируют задачи, с которыми обычно справляются сотрудники за компьютером.

Младшая Holo3-35B-A3B выложена на Hugging Face и доступна бесплатно через Inference API с ограничением в 10 запросов в минуту.
Старшая версия Holo3-122B-A10B доступна только через API.

🔗 https://hcompany.ai/holo3
🔗 https://hcompany.ai/holo-models-api
🔗 https://huggingface.co/Hcompany/Holo3-35B-A3B
#Holo3 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 Приложение Google AI Edge Gallery
Обновилось - теперь с Gemma 4 и Agent Skills
Новое:
- Представляем Gemma 4: новейшие высокопроизводительные модели, работающие полностью в автономном режиме.
- Навыки агента: расширяйте возможности больших языковых моделей с помощью модульных инструментов, таких как интерактивные карты и поиск в Википедии. Поддержка пользовательских навыков, загружаемых из сообщества.
- Режим мышления в чат-боте с ИИ: визуализируйте процесс рассуждений модели для большей прозрачности. (Примечание: в настоящее время доступно только для поддерживаемых моделей, в том числе семейства Gemma 4).

⬇️ Android: https://play.google.com/store/apps/details?id=com.google.ai.edge.gallery
Скачать напрямую последнюю версию ТУТ.
Например Версия 1.0.11 .APK

📱 iOS: https://apps.apple.com/ru/app/google-ai-edge-gallery/id6749645337

(Пост, Обсуждение)
#AgentSkills #Android #iPhone #App #GoogleAIEdgeGallery #AIEdgeGallery #EdgeGallery #AiAgent #AgentAi #App #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Gemma 4 E4B + E2B без цензуры!
(мультимодальный режим: зрение, видео, аудио)

ОРИГИНАЛЬНАЯ версия от Google, только без цензуры. Агрессивность означает отсутствие отказов. Это изначально мультимодальные модели, объединяющие текст, изображения, видео и аудио в одной модели. Для поддержки зрения и слуха прилагается файл mmproj.
❗️Отлично иметь на своем смартфоне модели без цензуры и отказов!
👉 Gemma 4 E4B (4B): https://huggingface.co/HauhauCS/Gemma-4-E4B-Uncensored-HauhauCS-Aggressive
👉 Gemma 4 E2B (2B): https://huggingface.co/HauhauCS/Gemma-4-E2B-Uncensored-HauhauCS-Aggressive
Следующие на очереди: Gemma 4 E31B (плотная) и E26B-A4B (MoE).
Все модели HauhauCS
(Обсуждение)
=============
👉 Gemma 4 - 31b abliterated https://huggingface.co/paperscarecrow/Gemma-4-31B-it-abliterated-gguf (Пост)
👉 Gemma-4-E2B-it-Heretic-ARA https://huggingface.co/p-e-w/gemma-4-E2B-it-heretic-ara (Пост)

#HauhauCS #Gemma4 #Gemma #Uncensored #abliterated #Heretic #ARA #AiModel #MidelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📊 Уже сравнили Gemma 4 и Qwen3.5 в общих тестах

Qwen3.5 НАМНОГО лучше распознает изображения!
А по оценкам людей, Gemma 4 намного опережает Qwen 3.5: https://arena.ai/leaderboard/text?license=open-source
Еще пишут:
- Gemma 31B примерно на одном уровне с Qwen 27B по уровню интеллекта. Но Gemma медленнее, потому что она больше.
- Gemma гораздо лучше справляется с логическими задачами, она быстрее завершает логические цепочки и выдает окончательный ответ, чем Qwen. Это большой плюс.
- Qwen гораздо лучше справляется с распознаванием изображений и их серий. Qwen может обрабатывать и отвечать на вопросы о ~280 изображениях одновременно (как о кадрах видео). А Gemma — нет.

(Обсуждение)
#Gemma4 #Gemma #Qwen35 #Qwen #AiModel #MidelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1