После выхода KAT-Coder-V2.5 в июле рады представить облегченную версию KAT-Coder-V2.5-Dev, модель с общим количеством параметров 35 миллиардов и 3 миллиардами активированных параметров.
Основные особенности KAT-Coder-V2.5-Dev
- Повышение производительности. Благодаря обучению с подкреплением и обучением с учителем KAT-Coder-V2.5-Dev достигает лучших результатов в области агентного кодирования среди моделей с аналогичными масштабами параметров.
- Оптимизация аномального поведения. Благодаря обучению с подкреплением удалось значительно оптимизировать некоторые аномальные модели поведения, такие как: аномальные метки инструментов — 9 пунктов (9,34 % -> 0,28 %), непрерывное повторение в одном направлении — 0,34 пункта (0,34 % -> 0 %).
(Обсуждение)
============
⚡️ Тест Kat Coder 2.5 (создание игры) с помощью этой подсказки:
Create a spaceship game inspired by Star Fox using vanilla Three.js and HTML. It should have at least five levels, keyboard and mouse controls, enemies, and a fully functional gameplay system.
Результат автора удивил (На видео). Он сгенерировал по-настоящему играбельную игру с управлением кораблем, несколькими типами врагов, разнообразным оружием, боссами, прохождением уровней, интерфейсом, визуальными эффектами и довольно хорошо организованной кодовой базой — и все это в одном HTML-файле.
Kat Coder 2.5 создан на основе Qwen 3.6 35B A3B, но в ходе тестов он стабильно показывал гораздо лучшие результаты. Также протестировали его на 3D-сценах, информационных панелях и задачах, требующих сложного логического программирования, и он отлично справился со всеми ними.
Разница стала очевидной в тесте Star Fox. Ни одна из других моделей с открытым исходным кодом, которые я тестировал, не смогла реализовать эту идею должным образом. Даже такие модели, как Gemini 3.6 Flash Extended, с трудом выдавали что-то связное и действительно играбельное.
Еще более впечатляющим является то, что запускали Kat Coder 2.5 с квантованием Q4_K_M.
Код на Plunker: https://plnkr.co/plunk/Sc7yFCPPdrBWvkA7
(Обсуждение)
#KATCoderV25 #KATCoderV25Dev #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Просматривайте модели в реальном времени, выбирайте, какие файлы оставить, и создайте чистую локальную библиотеку на своем ПК или сетевом хранилище.
Поиск в Live Hub с практичными метаданными, возможностью загрузки с учетом хранилища и без облачной панели управления.
🔎 Discover
Найдите каталог моделей в реальном времени и сузьте поиск по задаче, формату, локальному приложению, количеству параметров или популярности.
🎯 Точная загрузка
Храните полный репозиторий, SafeTensors, один GGUF, только метаданные или собственные шаблоны включения и исключения.
🏠 Собственная библиотека
Храните модели в обычной папке на своем диске или сетевом хранилище и самостоятельно индексируйте файлы, которые туда скопировали.
(Обсуждение)
#HuggingHack #HuggingFace #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Из описания: "Reasoning-Medical-27B предназначена для универсального применения в области профессиональной медицины, медицинской генетики, биологии/медицины в рамках университетского курса и клинических знаний. Модель была доработана на основе большого набора данных, включающего 370 000 высококачественных примеров вопросов и ответов, с использованием метода Chain-of-Thought для улучшения пошагового решения медицинских задач. Обучение проводилось с использованием тренажера GRPO с использованием метода оптимизации Unsloth для эффективной точной настройки ".
Модель Reasoning-Medical-27B показывает точность 93 % при выполнении двухэтапного теста MedQA. В той же таблице указано, что точность модели Qwen 3.6 27B составляет 84,4%, то есть разница составляет 8,6 процентных пункта.
Модель: https://huggingface.co/EpistemeAI/Reasoning-Medical-27B
Демонстрация: https://huggingface.co/spaces/EpistemeAI/reasoning-medical-27b
(Обсуждение)
#ReasoningMedical27B #Qwen36 #Medical #HealthBench #MedQA #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
POCKET-EN-GGUF · Английский
Карманная сборка с упором на английский язык с использованием запатентованного метода квантования — защищает критически важные для качества слои, благодаря чему качество сохраняется при размере файла в 5 ГБ. Работает на iPhone (PocketPal) и любом процессоре ПК. Без форков.
(Обсуждение)
#POCKET #POCKET35B #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Macaron-V1 — первая официальная версия агентной модели после Macaron-V1-Preview.
V1 доступна в двух вариантах:
- Macaron-V1-Tall: модель с 50B-параметрами, состоящая из базовой модели с 35B-параметрами и четырех специалистов LoRA с 3,7B-параметрами. Он создан на основе Qwen 3.6 и предназначен для локального развертывания.
- Macaron-V1-Venti: флагманская модель с 748B-параметрами, состоящая из базовой модели с 744B-параметрами и четырех специалистов LoRA с 1B-параметрами. Это первая модель, прошедшая постобработку на GLM-5.2.
Блог: https://macaron.im/mindlab/research/introducing-macaron-v1
(Обсуждение)
#MacaronV1 #Macaron #Qwen36 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Что внутри:
• ARC-C: 0.711 в 8-bit и 0.701 в 4-bit
• Контекст до 262K токенов
• Поддержка vision и tool calling
• Multi-stage fine-tune для улучшенной логики рассуждений
• GGUF-кванты от 12–17 ГБ
• Меньше отказов через Heretic/abliteration
Идея: приблизить 27B dense-модель по качеству reasoning к тяжёлым системам, оставив возможность запуска локально.
#Qwen36 #Uncensored #Heretic #БезЦензуры #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Бесплатное приложение для Android, которое записывает голосовые заметки и превращает их в текст прямо на телефоне. Без облака, без аккаунтов, без интернета = без блокировок.
Зажал кнопку, наговорил, получил расшифровку. Работает в самолёте, в метро, на даче без связи: распознавание речи запускается локально, на устройстве. Звук никуда не уходит.
Под капотом модель GigaAM v3 от Сбера, заточенная под русский язык. Записи и транскрипты хранятся только у вас на телефоне. Удалил приложение — удалил всё.
Что умеет:
• Диктофон с расшифровкой голоса в текст
• Транскрибация голосовых заметок на русском, офлайн
• Тёмная и светлая темы
• Редактирование транскрипта, копирование, шеринг в любой мессенджер
Как пользоваться:
• Запись. Зажмите кнопку микрофона, наговорите, отпустите — получите текст.
• Чужое аудио. Загрузите файл с телефона или перешлите голосовое через «Поделиться» из мессенджера, если он умеет делиться аудиофайлом.
• Удаление. Смахните запись влево, выедет красная кнопка «Удалить».
• Текст. Правьте, копируйте, отправляйте в любой мессенджер.
#GigaAM #GigaAMv3 #Транскрибация #Android #App #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
💩1
Модель 279M выполняет многоязычную деидентификацию персональных медицинских данных в автономном режиме.
Превратите клинический текст в структурированную обезличенную аналитическую информацию без необходимости загружать данные.
OpenMed извлекает биомедицинские сущности и удаляет более 55 типов персональных медицинских данных непосредственно на оборудовании, которое вы контролируете, поэтому ваши данные никогда не покидают устройство. Те же более 2000 открытых моделей работают на всех устройствах — от телефона до сервера с графическим процессором — в полностью автономном режиме: iOS, iPadOS и Android через OpenMedKit, React Native, обычные процессоры, Apple Silicon, графические процессоры NVIDIA, браузер и сервисы REST/gRPC. Никакого облака. Никакой привязки к поставщику. Данные пациентов не покидают вашу сеть.
(Обсуждение)
#OpenMed #OpenMed2 #PII #ПерсональныеДанные #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Fermion Research выпустила три модели под Apache 2.0. Старшая на 8 млрд параметров весит 2,56 ГБ в архиве и разворачивается до 3,88 ГБ.
🧠 Секрет в тернарных весах: каждый может быть −1, 0 или +1, а амплитуду задаёт общий множитель на блок. Если так квантовать готовую 8B-модель, MMLU падает до 24–25 баллов — это уровень случайного выбора.
Neutrino училась в этом формате с нуля и держит 72,1 на MMLU, 77,2 на IFEval и 68,9 на BFCL v3. В весах 62,6% нулей — обучение само выбросило лишнее.
MacBook M5 даёт 33,7 токена в секунду, NVIDIA L4 в GGUF — 30,7 токена при 4,68 ГиБ видеопамяти.
Младшая модель 0,6B весит 328 МБ и работает драфтером: разгоняет старшую на H100 с 396 до 763 токенов в секунду, выдавая идентичные токены.
Контекст 40 960 токенов — в три-четыре раза меньше, чем у конкурентов. Методику обучения не раскрывают, доступны только веса и движок.
#Neutrino1 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Traart — бесплатное офлайн-приложение для macOS, специально предназначенное для транскрибации аудио/видео и использующее модель GigaAM v3 (RNNT от Sber).
Основные характеристики Traart:
- Модель: GigaAM v3 (WER ≈ 8.3 % на русском — заметно лучше Whisper-large-v3 на русскоязычных данных).
- Полностью локальная работа: аудио не уходит в облако; интернет нужен только при первом запуске для скачивания моделей (~2 ГБ).
- Диаризация спикеров (через pyannote).
- Поддержка аудио и видео (MP3, WAV, M4A, FLAC, MP4, MKV и др.).
- Вывод в TXT / Markdown / JSON с таймкодами и метками спикеров.
- Автоматический мониторинг папки (новые файлы транскрибируются сами).
Требования: macOS 13 (Ventura)+, Apple Silicon (M1/M2/M3/M4), от 8 ГБ RAM.
Сравнение: https://traart.ru/comparison
#Traart #GigaAM #GigaAMv3 #MacOS #Whisper #Транскрибация #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1🤮1