Local Ai
448 subscribers
936 photos
262 videos
4 files
828 links
Все про Локальные ИИ на ПК и Смартфонах - программы и модели, которые можно запустить на 96Gb VRAM. (Как сайт: https://t.me/s/ai2local )
ИИ для Здоровья: @Ai2Health
Download Telegram
ℹ Модель: KAT-Coder-V2.5-Dev
После выхода KAT-Coder-V2.5 в июле рады представить облегченную версию KAT-Coder-V2.5-Dev, модель с общим количеством параметров 35 миллиардов и 3 миллиардами активированных параметров.
Основные особенности KAT-Coder-V2.5-Dev
- Повышение производительности. Благодаря обучению с подкреплением и обучением с учителем KAT-Coder-V2.5-Dev достигает лучших результатов в области агентного кодирования среди моделей с аналогичными масштабами параметров.

- Оптимизация аномального поведения. Благодаря обучению с подкреплением удалось значительно оптимизировать некоторые аномальные модели поведения, такие как: аномальные метки инструментов — 9 пунктов (9,34 % -> 0,28 %), непрерывное повторение в одном направлении — 0,34 пункта (0,34 % -> 0 %).

🔗 https://huggingface.co/Kwaipilot/KAT-Coder-V2.5-Dev
(Обсуждение)
============
⚡️ Тест Kat Coder 2.5 (создание игры) с помощью этой подсказки:
Create a spaceship game inspired by Star Fox using vanilla Three.js and HTML. It should have at least five levels, keyboard and mouse controls, enemies, and a fully functional gameplay system.
Результат автора удивил (На видео). Он сгенерировал по-настоящему играбельную игру с управлением кораблем, несколькими типами врагов, разнообразным оружием, боссами, прохождением уровней, интерфейсом, визуальными эффектами и довольно хорошо организованной кодовой базой — и все это в одном HTML-файле.

Kat Coder 2.5 создан на основе Qwen 3.6 35B A3B, но в ходе тестов он стабильно показывал гораздо лучшие результаты. Также протестировали его на 3D-сценах, информационных панелях и задачах, требующих сложного логического программирования, и он отлично справился со всеми ними.

Разница стала очевидной в тесте Star Fox. Ни одна из других моделей с открытым исходным кодом, которые я тестировал, не смогла реализовать эту идею должным образом. Даже такие модели, как Gemini 3.6 Flash Extended, с трудом выдавали что-то связное и действительно играбельное.

Еще более впечатляющим является то, что запускали Kat Coder 2.5 с квантованием Q4_K_M.
Код на Plunker: https://plnkr.co/plunk/Sc7yFCPPdrBWvkA7
(Обсуждение)

#KATCoderV25 #KATCoderV25Dev #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔍 HuggingHack - Перенесите Hugging Face Hub к себе домой.
Просматривайте модели в реальном времени, выбирайте, какие файлы оставить, и создайте чистую локальную библиотеку на своем ПК или сетевом хранилище.
Поиск в Live Hub с практичными метаданными, возможностью загрузки с учетом хранилища и без облачной панели управления.
🔎 Discover
Найдите каталог моделей в реальном времени и сузьте поиск по задаче, формату, локальному приложению, количеству параметров или популярности.

🎯 Точная загрузка
Храните полный репозиторий, SafeTensors, один GGUF, только метаданные или собственные шаблоны включения и исключения.

🏠 Собственная библиотека
Храните модели в обычной папке на своем диске или сетевом хранилище и самостоятельно индексируйте файлы, которые туда скопировали.

🔗 https://github.com/tyedalwaves/HuggingHack/
(Обсуждение)
#HuggingHack #HuggingFace #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
ℹ Модель Медицинская: Reasoning-Medical-27B (Qwen3.6-27B finetune)

Из описания: "Reasoning-Medical-27B предназначена для универсального применения в области профессиональной медицины, медицинской генетики, биологии/медицины в рамках университетского курса и клинических знаний. Модель была доработана на основе большого набора данных, включающего 370 000 высококачественных примеров вопросов и ответов, с использованием метода Chain-of-Thought для улучшения пошагового решения медицинских задач. Обучение проводилось с использованием тренажера GRPO с использованием метода оптимизации Unsloth для эффективной точной настройки ".

Модель Reasoning-Medical-27B показывает точность 93 % при выполнении двухэтапного теста MedQA. В той же таблице указано, что точность модели Qwen 3.6 27B составляет 84,4%, то есть разница составляет 8,6 процентных пункта.

Модель: https://huggingface.co/EpistemeAI/Reasoning-Medical-27B
Демонстрация: https://huggingface.co/spaces/EpistemeAI/reasoning-medical-27b
(Обсуждение)
#ReasoningMedical27B #Qwen36 #Medical #HealthBench #MedQA #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
ℹ Модель: POCKET работает даже на iPhone

POCKET-EN-GGUF · Английский
Карманная сборка с упором на английский язык с использованием запатентованного метода квантования — защищает критически важные для качества слои, благодаря чему качество сохраняется при размере файла в 5 ГБ. Работает на iPhone (PocketPal) и любом процессоре ПК. Без форков.
🔗 https://huggingface.co/FINAL-Bench/POCKET-EN-GGUF
🔗 Все модели: https://huggingface.co/collections/FINAL-Bench/pocket-models
(Обсуждение)
#POCKET #POCKET35B #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
ℹ Модель: Macaron-V1 на основе Qwen3.6-35B-A3B
Macaron-V1 — первая официальная версия агентной модели после Macaron-V1-Preview.
V1 доступна в двух вариантах:
- Macaron-V1-Tall: модель с 50B-параметрами, состоящая из базовой модели с 35B-параметрами и четырех специалистов LoRA с 3,7B-параметрами. Он создан на основе Qwen 3.6 и предназначен для локального развертывания.
- Macaron-V1-Venti: флагманская модель с 748B-параметрами, состоящая из базовой модели с 744B-параметрами и четырех специалистов LoRA с 1B-параметрами. Это первая модель, прошедшая постобработку на GLM-5.2.
🔗 https://huggingface.co/mindlab-research/Macaron-V1-Tall
Блог: https://macaron.im/mindlab/research/introducing-macaron-v1
(Обсуждение)
#MacaronV1 #Macaron #Qwen36 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
ℹ Модель: Fable-Fusion: 27B для локальных AI-агентов

🔥На Hugging Face появилась Qwen3.6-27B Fable-Fusion-711 — мультимодальный fine-tune Qwen3.6 с акцентом на reasoning, tool calling и агентные сценарии. Модель выложена в GGUF с квантами под обычное железо.
Что внутри:
• ARC-C: 0.711 в 8-bit и 0.701 в 4-bit
• Контекст до 262K токенов
• Поддержка vision и tool calling
• Multi-stage fine-tune для улучшенной логики рассуждений
• GGUF-кванты от 12–17 ГБ
• Меньше отказов через Heretic/abliteration

Идея: приблизить 27B dense-модель по качеству reasoning к тяжёлым системам, оставив возможность запуска локально.

🔗 https://huggingface.co/DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF
#Qwen36 #Uncensored #Heretic #БезЦензуры #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🎙 Не пиши голосовое!
Бесплатное приложение для Android, которое записывает голосовые заметки и превращает их в текст прямо на телефоне. Без облака, без аккаунтов, без интернета = без блокировок.

Зажал кнопку, наговорил, получил расшифровку. Работает в самолёте, в метро, на даче без связи: распознавание речи запускается локально, на устройстве. Звук никуда не уходит.
Под капотом модель GigaAM v3 от Сбера, заточенная под русский язык. Записи и транскрипты хранятся только у вас на телефоне. Удалил приложение — удалил всё.

Что умеет:
• Диктофон с расшифровкой голоса в текст
• Транскрибация голосовых заметок на русском, офлайн
• Тёмная и светлая темы
• Редактирование транскрипта, копирование, шеринг в любой мессенджер

Как пользоваться:
• Запись. Зажмите кнопку микрофона, наговорите, отпустите — получите текст.
• Чужое аудио. Загрузите файл с телефона или перешлите голосовое через «Поделиться» из мессенджера, если он умеет делиться аудиофайлом.
• Удаление. Смахните запись влево, выедет красная кнопка «Удалить».
• Текст. Правьте, копируйте, отправляйте в любой мессенджер.

🔗 https://www.rustore.ru/catalog/app/com.baslie.negolosom
#GigaAM #GigaAMv3 #Транскрибация #Android #App #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
💩1
ℹ Модель: OpenMed 2.0 - деидентификация
Модель 279M выполняет многоязычную деидентификацию персональных медицинских данных в автономном режиме.
Превратите клинический текст в структурированную обезличенную аналитическую информацию без необходимости загружать данные.
OpenMed извлекает биомедицинские сущности и удаляет более 55 типов персональных медицинских данных непосредственно на оборудовании, которое вы контролируете, поэтому ваши данные никогда не покидают устройство. Те же более 2000 открытых моделей работают на всех устройствах — от телефона до сервера с графическим процессором — в полностью автономном режиме: iOS, iPadOS и Android через OpenMedKit, React Native, обычные процессоры, Apple Silicon, графические процессоры NVIDIA, браузер и сервисы REST/gRPC. Никакого облака. Никакой привязки к поставщику. Данные пациентов не покидают вашу сеть.

🔗 https://openmed.life
🔗 https://github.com/maziyarpanahi/openmed
(Обсуждение)
#OpenMed #OpenMed2 #PII #ПерсональныеДанные #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
ℹ Модель: Neutrino-1: тернарная модель на 8B в 2,56 ГБ

Fermion Research выпустила три модели под Apache 2.0. Старшая на 8 млрд параметров весит 2,56 ГБ в архиве и разворачивается до 3,88 ГБ.
🧠 Секрет в тернарных весах: каждый может быть −1, 0 или +1, а амплитуду задаёт общий множитель на блок. Если так квантовать готовую 8B-модель, MMLU падает до 24–25 баллов — это уровень случайного выбора.
Neutrino училась в этом формате с нуля и держит 72,1 на MMLU, 77,2 на IFEval и 68,9 на BFCL v3. В весах 62,6% нулей — обучение само выбросило лишнее.

MacBook M5 даёт 33,7 токена в секунду, NVIDIA L4 в GGUF — 30,7 токена при 4,68 ГиБ видеопамяти.
Младшая модель 0,6B весит 328 МБ и работает драфтером: разгоняет старшую на H100 с 396 до 763 токенов в секунду, выдавая идентичные токены.

Контекст 40 960 токенов — в три-четыре раза меньше, чем у конкурентов. Методику обучения не раскрывают, доступны только веса и движок.

🔗 https://huggingface.co/fermionresearch
🔗 Пост: https://x.com/yoitsmanan/status/2081793414472008008
#Neutrino1 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🔈 Traart - Транскрибация моделью GigaAM v3
Traart — бесплатное офлайн-приложение для macOS, специально предназначенное для транскрибации аудио/видео и использующее модель GigaAM v3 (RNNT от Sber).
Основные характеристики Traart:
- Модель: GigaAM v3 (WER ≈ 8.3 % на русском — заметно лучше Whisper-large-v3 на русскоязычных данных).
- Полностью локальная работа: аудио не уходит в облако; интернет нужен только при первом запуске для скачивания моделей (~2 ГБ).
- Диаризация спикеров (через pyannote).
- Поддержка аудио и видео (MP3, WAV, M4A, FLAC, MP4, MKV и др.).
- Вывод в TXT / Markdown / JSON с таймкодами и метками спикеров.
- Автоматический мониторинг папки (новые файлы транскрибируются сами).

Требования: macOS 13 (Ventura)+, Apple Silicon (M1/M2/M3/M4), от 8 ГБ RAM.

⬇️ Скачать: https://traart.ru
Сравнение: https://traart.ru/comparison
#Traart #GigaAM #GigaAMv3 #MacOS #Whisper #Транскрибация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🤮1