Набор данных о совместимости локальных больших языковых моделей
Карта, на которой видно, какие локальные языковые модели подходят для каждого уровня оперативной памяти — от 8 до 128 ГБ!
93 модели с разбивкой по параметрам, квантованию и нагрузке на память. Работают локально на Apple Silicon и графических процессорах NVIDIA. Бесплатно по лицензии CC BY 4.0. Обновлено 26 июня 2026 года.
Проект: https://github.com/Wecko-ai/modelfit-hardware-dataset
(Обсуждение)
#ModelFit #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
ModelFit
Local LLM Compatibility Dataset (2026): Models × Hardware | ModelFit
Open dataset: 107 AI models by params, quantization, and memory load. Which run locally on Apple Silicon and NVIDIA GPUs. Free under CC BY 4.0, with JSON export.
Input Type(s): Text, Image, Video
Input Format(s): String, Red, Green, Blue (RGB), Video (MP4/WebM)
Context length up to 262K
(Обсуждение)
#Qwen36 #Qwen3627BNVFP4 #NVFP4 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Записывайте совещания, дополняйте текст и следите за тем, как прошел ваш день, — и все это на устройстве. Без аккаунта, без API-ключей, без облака.
LokalBot — это локальное рабочее пространство с искусственным интеллектом для macOS. Оно записывает обе стороны разговора, расшифровывает и обобщает его, индексирует все данные для поиска, отслеживает, как вы проводите свой день, и — с помощью Cotyping — предлагает варианты текста по мере его ввода в любом приложении. Все модели работают на устройстве на Apple Silicon, поэтому ваши аудиозаписи, расшифровки и заметки никогда не попадают на сервер.
Стек моделей:
- Summaries, чат и котинг работают на объединенном llama.cpp — внутрипроцессном libllama для обеспечения низкой задержки котинга, llama-server в остальных случаях. Настройте любой из них на свой собственный GGUF, Ollama или OpenAI-совместимую конечную точку или Apple Intelligence.
- Транскрипция: Granite Speech 4.1 / Parakeet / Whisper / Qwen3-ASR через CoreML/MLX на Neural Engine. Производительность Parakeet ~190× от реального времени.
- Семантический поиск: Qwen3-Embedding 0,6 млрд GGUF в секунду llama-server (--embeddings), векторы в SQLite, косинусное сходство методом полного перебора. В личном масштабе «метод полного перебора» — это просто «мгновенно», и он не требует дополнительных зависимостей.
- Диарризация: дополнительная пианнота (через FluidAudio) для разделения "Them" на "Them 1" и "Them 2".
- Встроенный в приложение браузер Hugging Face для поиска и загрузки GGUF с рекомендациями по совместимости с аппаратным обеспечением для каждой модели.
Настройки, которые автор считает оптимальными для реального использования (может ошибаться):
- Транскрипция: IBM Granite Speech 4.1 (2B) Q4
- Обобщение: Qwen 3.6 35B-A3B Q4_K_M
- Копирование: Gemma 4 E4B Q5 XL
Конфиденциальность — вот в чем суть. Единственный сетевой вызов — это однократная загрузка модели; после этого она работает полностью в автономном режиме. Покажите ее Little Snitch во время совещания и насладитесь самым плоским сетевым графиком, который вы когда-либо видели. Дополнительные скриншоты защищены алгоритмом AES-GCM и автоматически удаляются.
Только Apple Silicon / macOS 15+. Он интегрирован с Neural Engine, MLX и Core Audio, поэтому не работает на Linux/NVIDIA.
(Обсуждение)
#LokalBot #MacOS #Gemma4 #GraniteSpeech #Parakeet #Whisper #Транскрибация #Диктовка #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
LongPage для творческого письма в масштабах книги.
Статья: https://arxiv.org/abs/2605.17064
Модели: https://huggingface.co/collections/Pageshift-Entertainment/pagestorm-research-preview
(Обсуждение)
#PageStorm #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Ниже перевод поста с Reddit:
Я довольно пресыщен, как и большинство из вас. Меня уже не особо впечатляют новые модели. Последние несколько недель были так себе, если честно. В понедельник я наткнулся на модели Mixture of Transformers от SenseNova, и они кажутся чем-то особенным по сравнению с другими типичными моделями для генерации изображений.
Мне удалось запустить пару из них, и должен сказать, что эта серия моделей впечатляет меня, когда дело касается создания и редактирования плотной инфографики.
Я не видел ничего, кроме Ideogram 4, что могло бы сравниться с ними по качеству инфографики. Ideogram 4 — отличный инструмент, но у Ideogram ужасная лицензия, а у SenseNova — лицензия Apache 2, так что в моем рейтинге они вне конкуренции.
Я знаю, знаю, что последняя версия SenseNova-u1, версия 2, еще не в формате GGUF, но это не проблема. Вот что я сделал и что можете сделать вы: скажите своей любимой среде разработки, чтобы она «взяла модель SenseNova, обернула ее в FastAPI и использовала как конечную точку для генерации изображений, совместимую с OpenAi, и конечную точку для редактирования изображений в одном Docker-контейнере». Дайте этому немного времени, и вуаля — дело в шляпе. Через некоторое время у вас появится конечная точка API для генерации изображений, которую вы сможете использовать в своем любимом чат-клиенте в качестве генератора/редактора изображений. Это позволит вам обойтись без всего этого спагетти-интерфейса ComfyUI. Я никогда не был фанатом ComfyUI и вряд ли когда-нибудь стану. Передумал.
Вы можете попробовать несколько разных версий моделей SendeNova U1. Если захотите.
Модель Infographic V2 вышла всего пару дней назад и представляет собой базовую модель 50 Step. Кстати, она может создать практически любое изображение, просто она обучена делать инфографику очень хорошо.
https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-Infographic-V2
Инфографика V1 8-шаговая LORA — это модель слияния «флеш-типа» более низкого качества, которая работает очень быстро, но, очевидно, не так качественно, потому что 8 шагов — это меньше, чем 50 (ну конечно).
https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-LoRAs/blob/main/SenseNova-U1-8B-MoT-Infographic-LoRA-8step-V1.0.safetensors
Также доступна база Infographic V1 50 Step, но нет смысла ее использовать, если только вы не хотите использовать ее с 8 Step LoRA для высокоскоростной генерации.
https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-Infographic
Недавно они также выпустили очень интересную модель «Перекрестных изображений».
https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-Interleaved
Версия с чередованием позволит вам сгенерировать серию связанных изображений с одинаковыми персонажами, шрифтами, цветами и т. д. С ее помощью можно создавать презентации с единой темой, сборники рассказов и т. д. Версию с чередованием нужно обрабатывать по-другому, потому что стандартная конечная точка генератора изображений, совместимая с OpenAI, пока не поддерживает несколько изображений. Поэтому вам нужно создать конвейер инструментов с событиями-эмиттерами, чтобы генерировать несколько изображений в одном чате. Я уверен, что ваша система сможет разобраться, как это сделать, — моя смогла.
В любом случае, мне показалось, что эти модели интересны и их приятно запускать. Для полной версии bf16 вам, вероятно, понадобится около 36 ГБ видеопамяти, но есть и другие варианты. Думаю, самому маленькому из тех, что я видел, требовалось около 16 ГБ.
#SenseNovaU1 #Infographic #Инфографика #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Сбалансированный = легкая вводная часть с рассуждениями о самых острых темах перед тем, как дать полный ответ. Никаких изменений в характере и тому подобного. Это ОРИГИНАЛЬНЫЕ версии Gemma4-26B-A4B-QAT и Gemma4-31B-QAT без цензуры. Для этих выпусков агрессивный вариант не требуется.
НОВОЕ — MTP на обеих (многотокеновая предварительная головка для спекулятивного декодирования): примерно на 35 % быстрее на 26B-A4B и на 53 % быстрее на 31B, с идентичным результатом (модель проверяет каждый подготовленный токен, что обеспечивает высокую скорость без ущерба для качества). (Черновики MTP предоставлены командой Unsloth — спасибо!)
(Подробнее и Обсуждение)
#Gemma4 #Gemma426B #Gemma431B #QAT #Uncensored #MTP #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель использует архитектуру MoE и на длинных агентных задачах обходит более крупные системы: Kimi K2.6, DeepSeek V4 Pro и даже GPT-5.5. Речь про поиск информации, инженерные задачи, научные исследования, следование инструкциям и работу с инструментами.
Главное не в размере, а в подходе к обучению. Сначала полная SFT по всем доменам, затем отдельные модели-учителя под каждый домен, а в конце — дистилляция сразу от нескольких учителей на реальных траекториях агента. Средняя длина траектории 45 тысяч токенов. Контекст модели — 256 тысяч токенов.
По бенчмаркам Agents-A1 первая среди всех моделей на SEAL-0 (56,36), IFBench (80,61) и IFEval (94,82). Среди моделей своего размера лидирует на GAIA (96,04) и BrowseComp (75,51). Веса доступны на Hugging Face под лицензией Apache 2.0.
#AgentsA1 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
💵 GFusion - диффузионная LLM из GigaChat
Подробный пост: https://t.me/gigadev_channel/69
💡 Про DiffusionGemma от Google было: https://t.me/Ai2Local/775
#GFusion #GigaChat #AiModel #ModelAi #LocalAi #AiLocal
Подробный пост: https://t.me/gigadev_channel/69
💡 Про DiffusionGemma от Google было: https://t.me/Ai2Local/775
#GFusion #GigaChat #AiModel #ModelAi #LocalAi #AiLocal
Telegram
GigaDev — разработка GigaChat
💵 GFusion: как мы обучали диффузионную LLM в GigaChat
«А что, если LLM будет генерировать не строго по одному токену слева направо, а сразу блок текста?»
Именно эту идею мы проверяли в проекте GFusion — диффузионной языковой модели на базе GigaChat3-10B…
«А что, если LLM будет генерировать не строго по одному токену слева направо, а сразу блок текста?»
Именно эту идею мы проверяли в проекте GFusion — диффузионной языковой модели на базе GigaChat3-10B…
🎧 Abogen - Бесплатный генератор аудиокниг на нейросетях
Abogen — это мощный инструмент для преобразования текста в речь, который позволяет за считаные секунды превратить файлы в форматах ePub, PDF, текст, Markdown или субтитры в высококачественный аудиофайл с соответствующими субтитрами. Используйте его для создания аудиокниг, озвучки для Instagram, YouTube, TikTok или любого другого проекта, где требуется естественная озвучка текста с помощью Kokoro-82M.
Инструмент превращает текстовые книги в озвученные аудиофайлы. Работает с несколькими языками, использует голоса KokoroTTS и позволяет клонировать собственный голос.
Код полностью открытый — можно запустить локально и настроить под себя. Подойдёт тем, кто предпочитает слушать книги, а не читать с экрана.
🔗 https://pypi.org/project/abogen/
🔗 https://github.com/denizsafak/abogen
#Abogen #Kokoro #TTS #AiBook #AiAudio #LocalAi #AiLocal
Abogen — это мощный инструмент для преобразования текста в речь, который позволяет за считаные секунды превратить файлы в форматах ePub, PDF, текст, Markdown или субтитры в высококачественный аудиофайл с соответствующими субтитрами. Используйте его для создания аудиокниг, озвучки для Instagram, YouTube, TikTok или любого другого проекта, где требуется естественная озвучка текста с помощью Kokoro-82M.
Инструмент превращает текстовые книги в озвученные аудиофайлы. Работает с несколькими языками, использует голоса KokoroTTS и позволяет клонировать собственный голос.
Код полностью открытый — можно запустить локально и настроить под себя. Подойдёт тем, кто предпочитает слушать книги, а не читать с экрана.
#Abogen #Kokoro #TTS #AiBook #AiAudio #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
За 17 минут Тина Хуанг наглядно объясняет все про:
✅ Локальный запуск ИИ на компьютере через Ollama и другие движки и развертку простых моделей на телефоне.✅ Популярных API-провайдеров и хостинг-площадки с открытыми моделями и широкими лимитами — Grok, Cerebras, Arena AI, Hugging Face и другие.✅ Как (и зачем) поднимать локальную ИИ-модель на своем сервере.
#Ollama #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Meetily — open-source ассистент для звонков, который работает локально на вашем компьютере. Никакие данные не уходят в облако: всё остаётся на вашем диске.
ИИ-помощник для проведения совещаний с 4-кратной ускоренной транскрипцией в реальном времени по Parakeet / Whisper, диаризацией докладчиков и суммированием Ollama, созданный на Rust. 100% локальная обработка. Облако не требуется. Meetily (Meetly Ai) — это лучший саморазмещаемый ИИ-помощник для ведения заметок на совещаниях для macOS и Windows.
Умеет расшифровывать речь в реальном времени, различать спикеров и создавать саммари встречи через локальную нейросеть. Поддерживает macOS, Windows, Linux и русский язык. Можно подключить Claude или Codex для более детальных резюме.
Подойдёт для обсуждения контрактов, финансовых отчётов или NDA-проектов — там, где утечка данных критична.
#Meetily #Parakeet #Whisper #Транскрибация #MacOS #Windows #Linux #Ollama #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 Dyad — генератор приложений на локальной машине
Открытый инструмент, который собирает приложения прямо в чате. Описываешь задачу («форма обратной связи», «мини-игра») — получаешь интерфейс, логику и код. Работает локально, без регистрации и блокировок.
Базовая версия бесплатная. Dyad Pro за $30/месяц дает 300 AI-кредитов, режимы Turbo Edits и Smart Context.
Скачал, запустил — разговариваешь с ИИ как с разработчиком.
🔗 https://www.dyad.sh
#Dyad #SoftAi #AiSoft #App #LocalAi #AiLocal
Открытый инструмент, который собирает приложения прямо в чате. Описываешь задачу («форма обратной связи», «мини-игра») — получаешь интерфейс, логику и код. Работает локально, без регистрации и блокировок.
Базовая версия бесплатная. Dyad Pro за $30/месяц дает 300 AI-кредитов, режимы Turbo Edits и Smart Context.
Скачал, запустил — разговариваешь с ИИ как с разработчиком.
#Dyad #SoftAi #AiSoft #App #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Athanor Lite — это настольное приложение для Windows, которое сканирует ваше оборудование, сообщает, какие модели искусственного интеллекта с открытым исходным кодом подходят для вашего графического процессора (с учетом реальных характеристик памяти, а не наугад), и в один клик переводит вас из режима «Какая модель?» в приватный потоковый чат. Все работает на вашем компьютере. Ничто из того, что вы вводите, не покидает его.
Вот что умеет:
- сканирует ваше оборудование и показывает, что вы действительно можете запустить
- просматривает каталог моделей с фильтрами по размеру и квантовости
- управляет вашими локальными моделями (в том числе обнаруживает существующие установки Ollama)
- выполняет логический вывод с отображением в реальном времени таких показателей, как количество токенов в секунду, процент загрузки графического процессора, объем видеопамяти, температура
- система рабочих пространств, позволяющая использовать разные модели/контексты для разных задач
- элементы управления запуском/остановкой/перезапуском движка, чтобы вам не приходилось гадать, работает ли модель
Это версия 0.1.1. Она работает, она подписана, но это ранняя версия.
В планах: поддержка Mac, сравнение моделей, поддержка тонкой настройки.
(Обсуждение)
#Athanor #AthanorLite #Windows #SoftAi #AiSoft #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM