Ниже перевод поста с Reddit:
Я довольно пресыщен, как и большинство из вас. Меня уже не особо впечатляют новые модели. Последние несколько недель были так себе, если честно. В понедельник я наткнулся на модели Mixture of Transformers от SenseNova, и они кажутся чем-то особенным по сравнению с другими типичными моделями для генерации изображений.
Мне удалось запустить пару из них, и должен сказать, что эта серия моделей впечатляет меня, когда дело касается создания и редактирования плотной инфографики.
Я не видел ничего, кроме Ideogram 4, что могло бы сравниться с ними по качеству инфографики. Ideogram 4 — отличный инструмент, но у Ideogram ужасная лицензия, а у SenseNova — лицензия Apache 2, так что в моем рейтинге они вне конкуренции.
Я знаю, знаю, что последняя версия SenseNova-u1, версия 2, еще не в формате GGUF, но это не проблема. Вот что я сделал и что можете сделать вы: скажите своей любимой среде разработки, чтобы она «взяла модель SenseNova, обернула ее в FastAPI и использовала как конечную точку для генерации изображений, совместимую с OpenAi, и конечную точку для редактирования изображений в одном Docker-контейнере». Дайте этому немного времени, и вуаля — дело в шляпе. Через некоторое время у вас появится конечная точка API для генерации изображений, которую вы сможете использовать в своем любимом чат-клиенте в качестве генератора/редактора изображений. Это позволит вам обойтись без всего этого спагетти-интерфейса ComfyUI. Я никогда не был фанатом ComfyUI и вряд ли когда-нибудь стану. Передумал.
Вы можете попробовать несколько разных версий моделей SendeNova U1. Если захотите.
Модель Infographic V2 вышла всего пару дней назад и представляет собой базовую модель 50 Step. Кстати, она может создать практически любое изображение, просто она обучена делать инфографику очень хорошо.
https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-Infographic-V2
Инфографика V1 8-шаговая LORA — это модель слияния «флеш-типа» более низкого качества, которая работает очень быстро, но, очевидно, не так качественно, потому что 8 шагов — это меньше, чем 50 (ну конечно).
https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-LoRAs/blob/main/SenseNova-U1-8B-MoT-Infographic-LoRA-8step-V1.0.safetensors
Также доступна база Infographic V1 50 Step, но нет смысла ее использовать, если только вы не хотите использовать ее с 8 Step LoRA для высокоскоростной генерации.
https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-Infographic
Недавно они также выпустили очень интересную модель «Перекрестных изображений».
https://huggingface.co/sensenova/SenseNova-U1-8B-MoT-Interleaved
Версия с чередованием позволит вам сгенерировать серию связанных изображений с одинаковыми персонажами, шрифтами, цветами и т. д. С ее помощью можно создавать презентации с единой темой, сборники рассказов и т. д. Версию с чередованием нужно обрабатывать по-другому, потому что стандартная конечная точка генератора изображений, совместимая с OpenAI, пока не поддерживает несколько изображений. Поэтому вам нужно создать конвейер инструментов с событиями-эмиттерами, чтобы генерировать несколько изображений в одном чате. Я уверен, что ваша система сможет разобраться, как это сделать, — моя смогла.
В любом случае, мне показалось, что эти модели интересны и их приятно запускать. Для полной версии bf16 вам, вероятно, понадобится около 36 ГБ видеопамяти, но есть и другие варианты. Думаю, самому маленькому из тех, что я видел, требовалось около 16 ГБ.
#SenseNovaU1 #Infographic #Инфографика #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Сбалансированный = легкая вводная часть с рассуждениями о самых острых темах перед тем, как дать полный ответ. Никаких изменений в характере и тому подобного. Это ОРИГИНАЛЬНЫЕ версии Gemma4-26B-A4B-QAT и Gemma4-31B-QAT без цензуры. Для этих выпусков агрессивный вариант не требуется.
НОВОЕ — MTP на обеих (многотокеновая предварительная головка для спекулятивного декодирования): примерно на 35 % быстрее на 26B-A4B и на 53 % быстрее на 31B, с идентичным результатом (модель проверяет каждый подготовленный токен, что обеспечивает высокую скорость без ущерба для качества). (Черновики MTP предоставлены командой Unsloth — спасибо!)
(Подробнее и Обсуждение)
#Gemma4 #Gemma426B #Gemma431B #QAT #Uncensored #MTP #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель использует архитектуру MoE и на длинных агентных задачах обходит более крупные системы: Kimi K2.6, DeepSeek V4 Pro и даже GPT-5.5. Речь про поиск информации, инженерные задачи, научные исследования, следование инструкциям и работу с инструментами.
Главное не в размере, а в подходе к обучению. Сначала полная SFT по всем доменам, затем отдельные модели-учителя под каждый домен, а в конце — дистилляция сразу от нескольких учителей на реальных траекториях агента. Средняя длина траектории 45 тысяч токенов. Контекст модели — 256 тысяч токенов.
По бенчмаркам Agents-A1 первая среди всех моделей на SEAL-0 (56,36), IFBench (80,61) и IFEval (94,82). Среди моделей своего размера лидирует на GAIA (96,04) и BrowseComp (75,51). Веса доступны на Hugging Face под лицензией Apache 2.0.
#AgentsA1 #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
💵 GFusion - диффузионная LLM из GigaChat
Подробный пост: https://t.me/gigadev_channel/69
💡 Про DiffusionGemma от Google было: https://t.me/Ai2Local/775
#GFusion #GigaChat #AiModel #ModelAi #LocalAi #AiLocal
Подробный пост: https://t.me/gigadev_channel/69
💡 Про DiffusionGemma от Google было: https://t.me/Ai2Local/775
#GFusion #GigaChat #AiModel #ModelAi #LocalAi #AiLocal
Telegram
GigaDev — разработка GigaChat
💵 GFusion: как мы обучали диффузионную LLM в GigaChat
«А что, если LLM будет генерировать не строго по одному токену слева направо, а сразу блок текста?»
Именно эту идею мы проверяли в проекте GFusion — диффузионной языковой модели на базе GigaChat3-10B…
«А что, если LLM будет генерировать не строго по одному токену слева направо, а сразу блок текста?»
Именно эту идею мы проверяли в проекте GFusion — диффузионной языковой модели на базе GigaChat3-10B…
🎧 Abogen - Бесплатный генератор аудиокниг на нейросетях
Abogen — это мощный инструмент для преобразования текста в речь, который позволяет за считаные секунды превратить файлы в форматах ePub, PDF, текст, Markdown или субтитры в высококачественный аудиофайл с соответствующими субтитрами. Используйте его для создания аудиокниг, озвучки для Instagram, YouTube, TikTok или любого другого проекта, где требуется естественная озвучка текста с помощью Kokoro-82M.
Инструмент превращает текстовые книги в озвученные аудиофайлы. Работает с несколькими языками, использует голоса KokoroTTS и позволяет клонировать собственный голос.
Код полностью открытый — можно запустить локально и настроить под себя. Подойдёт тем, кто предпочитает слушать книги, а не читать с экрана.
🔗 https://pypi.org/project/abogen/
🔗 https://github.com/denizsafak/abogen
#Abogen #Kokoro #TTS #AiBook #AiAudio #LocalAi #AiLocal
Abogen — это мощный инструмент для преобразования текста в речь, который позволяет за считаные секунды превратить файлы в форматах ePub, PDF, текст, Markdown или субтитры в высококачественный аудиофайл с соответствующими субтитрами. Используйте его для создания аудиокниг, озвучки для Instagram, YouTube, TikTok или любого другого проекта, где требуется естественная озвучка текста с помощью Kokoro-82M.
Инструмент превращает текстовые книги в озвученные аудиофайлы. Работает с несколькими языками, использует голоса KokoroTTS и позволяет клонировать собственный голос.
Код полностью открытый — можно запустить локально и настроить под себя. Подойдёт тем, кто предпочитает слушать книги, а не читать с экрана.
#Abogen #Kokoro #TTS #AiBook #AiAudio #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
За 17 минут Тина Хуанг наглядно объясняет все про:
✅ Локальный запуск ИИ на компьютере через Ollama и другие движки и развертку простых моделей на телефоне.✅ Популярных API-провайдеров и хостинг-площадки с открытыми моделями и широкими лимитами — Grok, Cerebras, Arena AI, Hugging Face и другие.✅ Как (и зачем) поднимать локальную ИИ-модель на своем сервере.
#Ollama #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Meetily — open-source ассистент для звонков, который работает локально на вашем компьютере. Никакие данные не уходят в облако: всё остаётся на вашем диске.
ИИ-помощник для проведения совещаний с 4-кратной ускоренной транскрипцией в реальном времени по Parakeet / Whisper, диаризацией докладчиков и суммированием Ollama, созданный на Rust. 100% локальная обработка. Облако не требуется. Meetily (Meetly Ai) — это лучший саморазмещаемый ИИ-помощник для ведения заметок на совещаниях для macOS и Windows.
Умеет расшифровывать речь в реальном времени, различать спикеров и создавать саммари встречи через локальную нейросеть. Поддерживает macOS, Windows, Linux и русский язык. Можно подключить Claude или Codex для более детальных резюме.
Подойдёт для обсуждения контрактов, финансовых отчётов или NDA-проектов — там, где утечка данных критична.
#Meetily #Parakeet #Whisper #Транскрибация #MacOS #Windows #Linux #Ollama #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 Dyad — генератор приложений на локальной машине
Открытый инструмент, который собирает приложения прямо в чате. Описываешь задачу («форма обратной связи», «мини-игра») — получаешь интерфейс, логику и код. Работает локально, без регистрации и блокировок.
Базовая версия бесплатная. Dyad Pro за $30/месяц дает 300 AI-кредитов, режимы Turbo Edits и Smart Context.
Скачал, запустил — разговариваешь с ИИ как с разработчиком.
🔗 https://www.dyad.sh
#Dyad #SoftAi #AiSoft #App #LocalAi #AiLocal
Открытый инструмент, который собирает приложения прямо в чате. Описываешь задачу («форма обратной связи», «мини-игра») — получаешь интерфейс, логику и код. Работает локально, без регистрации и блокировок.
Базовая версия бесплатная. Dyad Pro за $30/месяц дает 300 AI-кредитов, режимы Turbo Edits и Smart Context.
Скачал, запустил — разговариваешь с ИИ как с разработчиком.
#Dyad #SoftAi #AiSoft #App #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Athanor Lite — это настольное приложение для Windows, которое сканирует ваше оборудование, сообщает, какие модели искусственного интеллекта с открытым исходным кодом подходят для вашего графического процессора (с учетом реальных характеристик памяти, а не наугад), и в один клик переводит вас из режима «Какая модель?» в приватный потоковый чат. Все работает на вашем компьютере. Ничто из того, что вы вводите, не покидает его.
Вот что умеет:
- сканирует ваше оборудование и показывает, что вы действительно можете запустить
- просматривает каталог моделей с фильтрами по размеру и квантовости
- управляет вашими локальными моделями (в том числе обнаруживает существующие установки Ollama)
- выполняет логический вывод с отображением в реальном времени таких показателей, как количество токенов в секунду, процент загрузки графического процессора, объем видеопамяти, температура
- система рабочих пространств, позволяющая использовать разные модели/контексты для разных задач
- элементы управления запуском/остановкой/перезапуском движка, чтобы вам не приходилось гадать, работает ли модель
Это версия 0.1.1. Она работает, она подписана, но это ранняя версия.
В планах: поддержка Mac, сравнение моделей, поддержка тонкой настройки.
(Обсуждение)
#Athanor #AthanorLite #Windows #SoftAi #AiSoft #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Перевод поста: С недавним выпуском Apple M5 и сверхкомпактных локальных моделей я все больше убеждаюсь в еще одной возможности, о которой мы все вместе как-то подзабыли: появлении локальных ИИ-приложений — продуктов, объединяющих локальные модели, рабочие процессы и пользовательский интерфейс для эффективного выполнения узконаправленных задач. Приложения устраняют проблемы, которые особенно остро ощущаются при повседневном использовании, и позволяют большему числу людей расширить возможности применения ИИ, охватывая с помощью ИИ-приложений различные рабочие процессы, а не концентрируясь на узких областях.
Я создал сайт-каталог для изучения местных приложений с искусственным интеллектом, и результаты оказались на удивление хорошими: в категориях «Чат с большими языковыми моделями», «Транскрипция», «Оптическое распознавание символов», «Редактирование фотографий» (более 50 приложений в каждой категории) есть множество вариантов, а также по-настоящему уникальные сценарии использования, например стилисты по подбору гардероба и помощники по уходу за домашними животными, о существовании которых я даже не подозревал. Сейчас доступно 82 категории. Пожалуйста, загляните сюда, если вам интересно! https://bunnysoft.app/local-ai-mac-apps
Ограничения:
- В настоящее время охватывает только Mac App Store (поскольку мне нужен надежный API для получения данных)
- Данные собраны 24 июня, поэтому совсем новые приложения не включены. Планирую выпускать ежемесячные обновления
- Если вы видите, что какого-то приложения здесь нет, пожалуйста, сообщите мне об этом, отправив заявку
Методология:
- Я собрал 20 435 приложений из API магазина приложений (513 поисковых запросов, а также профили разработчиков, создающих локальные ИИ-приложения)
- С помощью Deepseek v4 flash в качестве классификатора я отобрал 2259 приложений, которые действительно являются локальными ИИ-приложениями.
- Для категоризации и оценки я использовал комбинацию скриптов и LLM в качестве судьи. В рейтинге приоритет отдается приложениям, которые работают исключительно на устройстве. Я выборочно проверил крупные категории, но в списке из 2300 приложений могут быть ошибки. Если вы найдете что-то неверное, пожалуйста, сообщите мне, и я все исправлю.
Подробнее здесь: https://bunnysoft.app/local-ai-mac-apps/how-we-rank🔗 https://bunnysoft.app/local-ai-mac-apps
(Обсуждение)
#LocalAIMaxxing #Catalog #AiCatalog #CatalogAi #MacOS #SoftAi #AiSoft #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Бесплатный ИИ-помощник, который можно разместить на собственном сервере, видеть в действии, управлять им в режиме реального времени и легко отлаживать.
Сортируйте электронные письма, сообщения, календарь... К нему можно подключить практически что угодно без какой-либо настройки: просто попросите ИИ сделать это за вас
Общение и работа с агентами в одном интерфейсе
Полностью открытый исходный код, бесплатно и локально
(почти) Любые модели от (почти) любых поставщиков
Изолированные агенты с полным контролем над своей виртуальной средой (они могут настраивать программное обеспечение в своей виртуальной машине)
Вызовы инструментов, MCP, генерация изображений, выполнение оболочки, навыки и многое другое (совместимо с навыками openClaw)
Настраиваемое использование с одобрением инструмента
Прикрепите папку к любому разговору — используйте в ней код, например Claude Code, черновики документов или позвольте ему упорядочить ваш рабочий стол
Удаленные клиенты (vibe code на вашем ПК с вашего телефона)
Собственные приложения (мобильные и настольные) и веб
Дополнительные функции, такие как: CRON Scheduler, перехват Webhook, библиотека предустановок агента и т.д...
Plurality — это локальная платформа ИИ, которая сочетает в себе агентный рабочий процесс и интерфейс, похожий на чат-бот, что позволяет использовать один и тот же пользовательский интерфейс, конфигурацию и настройки как для фоновой автоматизации с помощью ИИ, так и для оперативного взаимодействия.
Он предоставляет агентам ИИ возможность фоновой обработки и изолированного доступа к оболочке и файловой системе, полностью совместим с навыками, MCP и т. д. и обладает дополнительными функциями, такими как удаленное управление, прикрепление папок (чтобы вы могли писать код или документацию в интерфейсе Plurality) и т. д.
(Обсуждение)
#Plurality #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM