Local Ai
443 subscribers
895 photos
250 videos
4 files
811 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
🎙 Cohere Transcribe WebGPU: современное многоязычное распознавание речи локально в браузере!

Компания Cohere выпустила свою первую модель преобразования речи в текст, которая теперь возглавляет рейтинг OpenASR (для английского языка, но модель поддерживает 14 различных языков).
Есть демонстрационная версия на WebGPU: запустить модель полностью локально прямо в браузере!
Ссылка на демонстрационную версию (+ исходный код):
🔗 https://huggingface.co/spaces/CohereLabs/Cohere-Transcribe-WebGPU
(Обсуждение)
#CohereTranscribe #Transcribe #Транскрибация #STT #WebGPU #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🌎 Этот сайт поможет вам узнать, какие языковые модели можно запустить на вашем оборудовании или какое оборудование надо под модель ИИ?! (Модели сгруппированы под задачи!)

🔗 https://runthisllm.com
или аналог: https://www.vram.top
#runthisllm #LLM #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🎞 Инструмент для размытия/анонимизации видео на основе естественного языка работает в разрешении 4K с частотой 76 кадров в секунду

Интерактивная студия анонимизации видео. Браузерный инструмент для обнаружения, отслеживания и размытия объектов на видео — от 720p до 4K и 360° равнопромежуточных панорам.

Основные моменты:
- Встроенная обработка 4K — изначально поддерживает видео с разрешением 3840×2160. С RF-DETR Nano + skip=4 обеспечивает 76 эффективных кадров в секунду при разрешении 4K (в 2,5 раза выше, чем в реальном времени). Даже при skip=2 частота кадров RF-DETR Nano Det превышает 30 кадров в секунду при разрешении 4K.
- Поддержка панорамы 360° — встроенный конвейер равнопромежуточной проекции. Обрабатывает видео с камеры Insta360 X5 (до 8K: 7680×3840), извлекая перспективные субпроекции, выполняя обнаружение и повторно проецируя маски в равноугловое пространство.
- 8 моделей обнаружения — от быстрых детекторов (RF-DETR Nano: 15,7 кадров в секунду при разрешении 4K) до сегментации с точностью до пикселя (RF-DETR Medium Seg) и обнаружения по текстовым подсказкам (Grounding DINO: «размыть человека в красном»)..
- Возможность работы в режиме реального времени — отслеживание пропущенных кадров с помощью ByteTrack обеспечивает линейное ускорение: skip=4 → в 4 раза быстрее. RF-DETR Nano Det + skip=4 при разрешении 720p обеспечивает 305 эффективных кадров в секунду.

Работает полностью локально. В репозитории есть гифки, на которых сравниваются все подходы к моделированию на одном и том же кадре 4K.

🔗 https://github.com/Manojbhat09/privacy-blur
(Обсуждение)
#privacyblur #размытие #анонимизация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Qwen3.5-9b-Opus-Openclaw

Новый Qwen3.5-9b (полная версия и версия с квантованием GGUF), доработанный для агентной платформы (OpenClaw, AgentScope) на основе Copaw-9B (официальная агентная платформа Qwen) + Opus 4.6 Reasoning.
(используйте рекомендуемые параметры генерации)

Qwen3.5-9B-Opus-OpenClaw-Distilled — это усовершенствованная версия Qwen3.5-9b, в которой приоритет отдается логическому мышлению и агентной настройке. Она создана для того, чтобы объединить две сильные стороны в одной модели.
- Операционные / агентские инстинкты OpenClaw и CoPaw
- Структурированное мышление в стиле Клода Опуса

Цель проста: используйте строгий базовый режим -> настройте на агентурное использование, такое как openclaw и agentscope -> используйте рассуждения уровня opus-4.6 -> лучшее из обоих миров

Вкратце:
Он предназначен для пользователей, которые хотят:
- сохраненный чат + высокая агентская полезность в духе Openclaw / CoPaw
- модель, которая больше похожа на «планировщик + оператор», чем на «чат-бота»
Вдохновлено популярным Jackrong/Qwen3.5-27B-Claude-4.6-Opus-Reasoning-Distilled

ykarout/Qwen3.5-9b-Opus-Openclaw-Distilled
🔗 https://huggingface.co/ykarout/Qwen3.5-9b-Opus-Openclaw-Distilled-GGUF
(Обсуждение)
#Qwen359B #GGUF #Qwen35 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Квантованные модели APEX MoE
Квантованные модели APEX MoE ускоряют вывод данных на 33 % и поддерживают TurboQuant (ускорение обработки подсказок на 14 %)

Только что выпустили APEX (Adaptive Precision for EXpert Models) — новую технологию квантования MoE, которая превосходит Unsloth Dynamic 2.0 по точности и при этом в два раза меньше по размеру для архитектур MoE.

Протестировано на Qwen3.5-35B-A3B, но этот метод применим к любой модели MoE. Размер в два раза меньше, чем у Q8. Уровень сложности сопоставим с F16.
Благодаря TurboQuant при использовании контекста 8K каждый уровень APEX обрабатывает запросы примерно на 14 % быстрее!
Работает со стандартным llama.cpp без каких-либо патчей.
С открытым исходным кодом: http://github.com/mudler/LocalAI

- I-Quality: 21,3 ГБ — максимальная точность
- I-Balanced: 23,6 ГБ — оптимальный баланс
- I-Compact: 16,1 ГБ — подходит для графических процессоров с 24 ГБ видеопамяти
- Mini: 12,2 ГБ — подходит для графических процессоров с 16 ГБ видеопамяти

Модели: http://huggingface.co/mudler/Qwen3.5-35B-A3B-APEX-GGUF
Метод + техническая статья: http://github.com/mudler/apex-quant
Локальная установка: http://github.com/mudler/LocalAI
(Обсуждение)
#APEX #MoE #TurboQuant #apexquant #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
У этого Канала теперь есть "Зеркало" в Макс: https://max.ru/join/m9_yt1fhcVwQS9_oHxUCBSialkmNopz_CA8UhPD2v2Q - все посты будут дублироваться и туда.
💩4👍3🤮1
Модель: Gemma 4 - 2B -4B -26B(A4B) -31B
Google выпустила 4 открытых модели Gemma 4 с поддержкой 140 языков!

Модели различаются количеством параметров.
Для устройств с ограниченными ресурсами, включая смартфоны, предназначен ИИ на 2 миллиарда и 4 миллиарда параметров под названием Effective.
Более мощные системы получат 26 миллиардов параметров с 4B Активных для Mixture of Experts (MoE) и 31 миллиард параметров для Dense.
Увеличенное контекстное окно — модели меньшего размера имеют контекстное окно размером 128 К, а модели среднего размера — 256 К.
Все модели семейства Gemma 4 способны обрабатывать видео и изображения.
Две младшие модели также могут обрабатывать аудио данные и понимать речь.

🔗 https://deepmind.google/models/gemma/gemma-4/
🔗 https://huggingface.co/collections/google/gemma-4
(Статья)

https://huggingface.co/unsloth/gemma-4-26B-A4B-it-GGUF
⚠️ используйте обновленный jinja (обновили недавно):
https://huggingface.co/google/gemma-4-26B-A4B-it/raw/main/chat_template.jinja
или слегка измененная версия (лучше):
https://pastebin.com/raw/hnPGq0ht

https://huggingface.co/unsloth/gemma-4-31B-it-GGUF
https://huggingface.co/unsloth/gemma-4-E4B-it-GGUF
https://huggingface.co/unsloth/gemma-4-E2B-it-GGUF
Что нового в Gemma 4 - видео! (Обсуждение)
#Gemma4 #Gemma #Google #AiModel #MidelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: 🤖 Holo3 — семейство агентных моделей для работы на ПК

Holo3 — модели, которые умеют выполнять рабочие процессы в корпоративных средах. Автоматизируют задачи, с которыми обычно справляются сотрудники за компьютером.

Младшая Holo3-35B-A3B выложена на Hugging Face и доступна бесплатно через Inference API с ограничением в 10 запросов в минуту.
Старшая версия Holo3-122B-A10B доступна только через API.

🔗 https://hcompany.ai/holo3
🔗 https://hcompany.ai/holo-models-api
🔗 https://huggingface.co/Hcompany/Holo3-35B-A3B
#Holo3 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📱 Приложение Google AI Edge Gallery
Обновилось - теперь с Gemma 4 и Agent Skills
Новое:
- Представляем Gemma 4: новейшие высокопроизводительные модели, работающие полностью в автономном режиме.
- Навыки агента: расширяйте возможности больших языковых моделей с помощью модульных инструментов, таких как интерактивные карты и поиск в Википедии. Поддержка пользовательских навыков, загружаемых из сообщества.
- Режим мышления в чат-боте с ИИ: визуализируйте процесс рассуждений модели для большей прозрачности. (Примечание: в настоящее время доступно только для поддерживаемых моделей, в том числе семейства Gemma 4).

⬇️ Android: https://play.google.com/store/apps/details?id=com.google.ai.edge.gallery
Скачать напрямую последнюю версию ТУТ.
Например Версия 1.0.11 .APK

📱 iOS: https://apps.apple.com/ru/app/google-ai-edge-gallery/id6749645337

(Пост, Обсуждение)
#AgentSkills #Android #iPhone #App #GoogleAIEdgeGallery #AIEdgeGallery #EdgeGallery #AiAgent #AgentAi #App #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель: Gemma 4 E4B + E2B без цензуры!
(мультимодальный режим: зрение, видео, аудио)

ОРИГИНАЛЬНАЯ версия от Google, только без цензуры. Агрессивность означает отсутствие отказов. Это изначально мультимодальные модели, объединяющие текст, изображения, видео и аудио в одной модели. Для поддержки зрения и слуха прилагается файл mmproj.
❗️Отлично иметь на своем смартфоне модели без цензуры и отказов!
👉 Gemma 4 E4B (4B): https://huggingface.co/HauhauCS/Gemma-4-E4B-Uncensored-HauhauCS-Aggressive
👉 Gemma 4 E2B (2B): https://huggingface.co/HauhauCS/Gemma-4-E2B-Uncensored-HauhauCS-Aggressive
Следующие на очереди: Gemma 4 E31B (плотная) и E26B-A4B (MoE).
Все модели HauhauCS
(Обсуждение)
=============
👉 Gemma 4 - 31b abliterated https://huggingface.co/paperscarecrow/Gemma-4-31B-it-abliterated-gguf (Пост)
👉 Gemma-4-E2B-it-Heretic-ARA https://huggingface.co/p-e-w/gemma-4-E2B-it-heretic-ara (Пост)

#HauhauCS #Gemma4 #Gemma #Uncensored #abliterated #Heretic #ARA #AiModel #MidelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
📊 Уже сравнили Gemma 4 и Qwen3.5 в общих тестах

Qwen3.5 НАМНОГО лучше распознает изображения!
А по оценкам людей, Gemma 4 намного опережает Qwen 3.5: https://arena.ai/leaderboard/text?license=open-source
Еще пишут:
- Gemma 31B примерно на одном уровне с Qwen 27B по уровню интеллекта. Но Gemma медленнее, потому что она больше.
- Gemma гораздо лучше справляется с логическими задачами, она быстрее завершает логические цепочки и выдает окончательный ответ, чем Qwen. Это большой плюс.
- Qwen гораздо лучше справляется с распознаванием изображений и их серий. Qwen может обрабатывать и отвечать на вопросы о ~280 изображениях одновременно (как о кадрах видео). А Gemma — нет.

(Обсуждение)
#Gemma4 #Gemma #Qwen35 #Qwen #AiModel #MidelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Media is too big
VIEW IN TELEGRAM
🌎 Gemma 4 WebGPU: Запустите новую открытую модель Google локально в своем браузере

Мультимодальный ИИ, работающий локально в вашем браузере с использованием WebGPU без установки программ!
⬇️ https://huggingface.co/spaces/webml-community/Gemma-4-WebGPU - кликнуть по "Load model" и чат готов!
#Gemma4 #WebGPU #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
📱 Secret AI: Локальный ИИ Чатбот

ИИ на вашем телефоне - 100% автономный и безопасный!
Нет серверов. Нет отслеживания. Нет загрузки данных.
Все ответы ИИ создаются непосредственно на вашем телефоне. Подключение к интернету не требуется. Данные никогда не покидают ваше устройство. Никаких входов в систему. Никаких файлов cookie. Никакого отслеживания. Хотя есть и добавление API (OpenRouter тоже есть!)

Secret AI предлагает различные движки ИИ, поддерживающие центральный и графический процессоры, а также популярные форматы моделей, такие как GGUF (llama.cpp), MNN, MLX.
❗️Минусы: Бесплатно есть лимит на 15 сообщений чата в день! А купить "навсегда" стоит или 60$ или 120$... Если 15 чатов мало, то стоит рассмотреть другие: https://t.me/Ai2Local/5

Уже есть новая модель: Gemma 4
🔗 https://secretai.io
Android: https://play.google.com/store/apps/details?id=io.secretai.llm
iOS: https://apps.apple.com/app/secret-ai/id6744668980

#App #Gemma4 #SecretAi #LocalAi #AiLocal #Android #iPhone #GGUF #MNN #MLX
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🔈 Morph Books - для чтения EPUB голосом TTS Kokoro

Morph - это приложение для чтения голосом.
Импортируйте любой EPUB и СЛУШАЙТЕ С ЕСТЕСТВЕННЫМИ ГОЛОСАМИ ИИ Превратите любую книгу в аудиокнигу с помощью преобразования текста в речь на основе ИИ. Следуйте выделению на уровне слов, которое поддерживает синхронизацию.
РАБОТАЕТ 100% ОФЛАЙН Morph запускает локальную голосовую модель AI непосредственно на вашем устройстве. Интернет не нужен, нет задержек потоковой передачи, нет буферизации. Импортируйте книгу, закройте Wi-Fi и слушайте.

📱 https://apps.apple.com/us/app/morph-books/id6760332618
#MorphBooks #Morph #EPUB #TTS #Kokoro #iPhone #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🤖 Zora — ваш помощник на основе ИИ

Zoraлокальный ИИ-сервис для Apple Silicon. В 8 раз быстрее Ollama. Надо 7 ГБ оперативной памяти. Эмоциональная речь, распределенный вывод, самосовершенствование.
Zora, по сути, это тот же Джарвис, но он работает на вашем собственном оборудовании. Никаких облачных сервисов, никаких подписок, никакие данные не покидают ваш компьютер (если только вы не используете режим API), который при желании может использовать Codex.

Zora запускает специально обученную модель искусственного интеллекта на Apple Silicon, обрабатывает электронную почту, WhatsApp, Teams, сортирует входящие письма, готовит к встречам, предоставляя информацию о людях, с которыми встречаетесь, отслеживает обязательства, контролирует инфраструктуру и даже работает ночью, пока спите.
У нее более 150 инструментов, она запоминает, как вы разговариваете с разными людьми, и пишет ответы в вашем стиле. 16-Гб. Mac Mini вполне хватает.

Кроме того, вы можете добавить вычислительные ресурсы, используя функцию узлов с неограниченным количеством узлов/вычислительным потенциалом. Это делается на уровне оркестратора.

У нее также есть собственный трехмерный кабинет, который она обустраивает сама. Растения со временем разрастаются. Она сама выбирает себе питомца. Все дело в мелочах.
Создано с помощью MLX, FastAPI.
Вы даже можете запустить код Claude для локальной модели через Zora на MLX, используя встроенный API.
Если у вас Mac и вы увлекаетесь искусственным интеллектом и самостоятельным хостингом, попробуйте.

🔗 https://github.com/Azkabanned/Zora
(Обсуждение)
#Zora #AgentAi #AiAgent #MacOS #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Стоит ли переходить с Qwen 3.5 на Gemma 4?
Сравнили Qwen 3.5-27B и Gemma 4-31B и похожие модели с MoE
Читаем! Ну и в комментариях пишут свои впечатления...
#Gemma4 #Gemma #Qwen35 #Qwen #AiModel #MidelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1