💵 GFusion - диффузионная LLM из GigaChat
Подробный пост: https://t.me/gigadev_channel/69
💡 Про DiffusionGemma от Google было: https://t.me/Ai2Local/775
#GFusion #GigaChat #AiModel #ModelAi #LocalAi #AiLocal
Подробный пост: https://t.me/gigadev_channel/69
💡 Про DiffusionGemma от Google было: https://t.me/Ai2Local/775
#GFusion #GigaChat #AiModel #ModelAi #LocalAi #AiLocal
Telegram
GigaDev — разработка GigaChat
💵 GFusion: как мы обучали диффузионную LLM в GigaChat
«А что, если LLM будет генерировать не строго по одному токену слева направо, а сразу блок текста?»
Именно эту идею мы проверяли в проекте GFusion — диффузионной языковой модели на базе GigaChat3-10B…
«А что, если LLM будет генерировать не строго по одному токену слева направо, а сразу блок текста?»
Именно эту идею мы проверяли в проекте GFusion — диффузионной языковой модели на базе GigaChat3-10B…
🎧 Abogen - Бесплатный генератор аудиокниг на нейросетях
Abogen — это мощный инструмент для преобразования текста в речь, который позволяет за считаные секунды превратить файлы в форматах ePub, PDF, текст, Markdown или субтитры в высококачественный аудиофайл с соответствующими субтитрами. Используйте его для создания аудиокниг, озвучки для Instagram, YouTube, TikTok или любого другого проекта, где требуется естественная озвучка текста с помощью Kokoro-82M.
Инструмент превращает текстовые книги в озвученные аудиофайлы. Работает с несколькими языками, использует голоса KokoroTTS и позволяет клонировать собственный голос.
Код полностью открытый — можно запустить локально и настроить под себя. Подойдёт тем, кто предпочитает слушать книги, а не читать с экрана.
🔗 https://pypi.org/project/abogen/
🔗 https://github.com/denizsafak/abogen
#Abogen #Kokoro #TTS #AiBook #AiAudio #LocalAi #AiLocal
Abogen — это мощный инструмент для преобразования текста в речь, который позволяет за считаные секунды превратить файлы в форматах ePub, PDF, текст, Markdown или субтитры в высококачественный аудиофайл с соответствующими субтитрами. Используйте его для создания аудиокниг, озвучки для Instagram, YouTube, TikTok или любого другого проекта, где требуется естественная озвучка текста с помощью Kokoro-82M.
Инструмент превращает текстовые книги в озвученные аудиофайлы. Работает с несколькими языками, использует голоса KokoroTTS и позволяет клонировать собственный голос.
Код полностью открытый — можно запустить локально и настроить под себя. Подойдёт тем, кто предпочитает слушать книги, а не читать с экрана.
#Abogen #Kokoro #TTS #AiBook #AiAudio #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
За 17 минут Тина Хуанг наглядно объясняет все про:
✅ Локальный запуск ИИ на компьютере через Ollama и другие движки и развертку простых моделей на телефоне.✅ Популярных API-провайдеров и хостинг-площадки с открытыми моделями и широкими лимитами — Grok, Cerebras, Arena AI, Hugging Face и другие.✅ Как (и зачем) поднимать локальную ИИ-модель на своем сервере.
#Ollama #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Meetily — open-source ассистент для звонков, который работает локально на вашем компьютере. Никакие данные не уходят в облако: всё остаётся на вашем диске.
ИИ-помощник для проведения совещаний с 4-кратной ускоренной транскрипцией в реальном времени по Parakeet / Whisper, диаризацией докладчиков и суммированием Ollama, созданный на Rust. 100% локальная обработка. Облако не требуется. Meetily (Meetly Ai) — это лучший саморазмещаемый ИИ-помощник для ведения заметок на совещаниях для macOS и Windows.
Умеет расшифровывать речь в реальном времени, различать спикеров и создавать саммари встречи через локальную нейросеть. Поддерживает macOS, Windows, Linux и русский язык. Можно подключить Claude или Codex для более детальных резюме.
Подойдёт для обсуждения контрактов, финансовых отчётов или NDA-проектов — там, где утечка данных критична.
#Meetily #Parakeet #Whisper #Транскрибация #MacOS #Windows #Linux #Ollama #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 Dyad — генератор приложений на локальной машине
Открытый инструмент, который собирает приложения прямо в чате. Описываешь задачу («форма обратной связи», «мини-игра») — получаешь интерфейс, логику и код. Работает локально, без регистрации и блокировок.
Базовая версия бесплатная. Dyad Pro за $30/месяц дает 300 AI-кредитов, режимы Turbo Edits и Smart Context.
Скачал, запустил — разговариваешь с ИИ как с разработчиком.
🔗 https://www.dyad.sh
#Dyad #SoftAi #AiSoft #App #LocalAi #AiLocal
Открытый инструмент, который собирает приложения прямо в чате. Описываешь задачу («форма обратной связи», «мини-игра») — получаешь интерфейс, логику и код. Работает локально, без регистрации и блокировок.
Базовая версия бесплатная. Dyad Pro за $30/месяц дает 300 AI-кредитов, режимы Turbo Edits и Smart Context.
Скачал, запустил — разговариваешь с ИИ как с разработчиком.
#Dyad #SoftAi #AiSoft #App #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Athanor Lite — это настольное приложение для Windows, которое сканирует ваше оборудование, сообщает, какие модели искусственного интеллекта с открытым исходным кодом подходят для вашего графического процессора (с учетом реальных характеристик памяти, а не наугад), и в один клик переводит вас из режима «Какая модель?» в приватный потоковый чат. Все работает на вашем компьютере. Ничто из того, что вы вводите, не покидает его.
Вот что умеет:
- сканирует ваше оборудование и показывает, что вы действительно можете запустить
- просматривает каталог моделей с фильтрами по размеру и квантовости
- управляет вашими локальными моделями (в том числе обнаруживает существующие установки Ollama)
- выполняет логический вывод с отображением в реальном времени таких показателей, как количество токенов в секунду, процент загрузки графического процессора, объем видеопамяти, температура
- система рабочих пространств, позволяющая использовать разные модели/контексты для разных задач
- элементы управления запуском/остановкой/перезапуском движка, чтобы вам не приходилось гадать, работает ли модель
Это версия 0.1.1. Она работает, она подписана, но это ранняя версия.
В планах: поддержка Mac, сравнение моделей, поддержка тонкой настройки.
(Обсуждение)
#Athanor #AthanorLite #Windows #SoftAi #AiSoft #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Перевод поста: С недавним выпуском Apple M5 и сверхкомпактных локальных моделей я все больше убеждаюсь в еще одной возможности, о которой мы все вместе как-то подзабыли: появлении локальных ИИ-приложений — продуктов, объединяющих локальные модели, рабочие процессы и пользовательский интерфейс для эффективного выполнения узконаправленных задач. Приложения устраняют проблемы, которые особенно остро ощущаются при повседневном использовании, и позволяют большему числу людей расширить возможности применения ИИ, охватывая с помощью ИИ-приложений различные рабочие процессы, а не концентрируясь на узких областях.
Я создал сайт-каталог для изучения местных приложений с искусственным интеллектом, и результаты оказались на удивление хорошими: в категориях «Чат с большими языковыми моделями», «Транскрипция», «Оптическое распознавание символов», «Редактирование фотографий» (более 50 приложений в каждой категории) есть множество вариантов, а также по-настоящему уникальные сценарии использования, например стилисты по подбору гардероба и помощники по уходу за домашними животными, о существовании которых я даже не подозревал. Сейчас доступно 82 категории. Пожалуйста, загляните сюда, если вам интересно! https://bunnysoft.app/local-ai-mac-apps
Ограничения:
- В настоящее время охватывает только Mac App Store (поскольку мне нужен надежный API для получения данных)
- Данные собраны 24 июня, поэтому совсем новые приложения не включены. Планирую выпускать ежемесячные обновления
- Если вы видите, что какого-то приложения здесь нет, пожалуйста, сообщите мне об этом, отправив заявку
Методология:
- Я собрал 20 435 приложений из API магазина приложений (513 поисковых запросов, а также профили разработчиков, создающих локальные ИИ-приложения)
- С помощью Deepseek v4 flash в качестве классификатора я отобрал 2259 приложений, которые действительно являются локальными ИИ-приложениями.
- Для категоризации и оценки я использовал комбинацию скриптов и LLM в качестве судьи. В рейтинге приоритет отдается приложениям, которые работают исключительно на устройстве. Я выборочно проверил крупные категории, но в списке из 2300 приложений могут быть ошибки. Если вы найдете что-то неверное, пожалуйста, сообщите мне, и я все исправлю.
Подробнее здесь: https://bunnysoft.app/local-ai-mac-apps/how-we-rank🔗 https://bunnysoft.app/local-ai-mac-apps
(Обсуждение)
#LocalAIMaxxing #Catalog #AiCatalog #CatalogAi #MacOS #SoftAi #AiSoft #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Бесплатный ИИ-помощник, который можно разместить на собственном сервере, видеть в действии, управлять им в режиме реального времени и легко отлаживать.
Сортируйте электронные письма, сообщения, календарь... К нему можно подключить практически что угодно без какой-либо настройки: просто попросите ИИ сделать это за вас
Общение и работа с агентами в одном интерфейсе
Полностью открытый исходный код, бесплатно и локально
(почти) Любые модели от (почти) любых поставщиков
Изолированные агенты с полным контролем над своей виртуальной средой (они могут настраивать программное обеспечение в своей виртуальной машине)
Вызовы инструментов, MCP, генерация изображений, выполнение оболочки, навыки и многое другое (совместимо с навыками openClaw)
Настраиваемое использование с одобрением инструмента
Прикрепите папку к любому разговору — используйте в ней код, например Claude Code, черновики документов или позвольте ему упорядочить ваш рабочий стол
Удаленные клиенты (vibe code на вашем ПК с вашего телефона)
Собственные приложения (мобильные и настольные) и веб
Дополнительные функции, такие как: CRON Scheduler, перехват Webhook, библиотека предустановок агента и т.д...
Plurality — это локальная платформа ИИ, которая сочетает в себе агентный рабочий процесс и интерфейс, похожий на чат-бот, что позволяет использовать один и тот же пользовательский интерфейс, конфигурацию и настройки как для фоновой автоматизации с помощью ИИ, так и для оперативного взаимодействия.
Он предоставляет агентам ИИ возможность фоновой обработки и изолированного доступа к оболочке и файловой системе, полностью совместим с навыками, MCP и т. д. и обладает дополнительными функциями, такими как удаленное управление, прикрепление папок (чтобы вы могли писать код или документацию в интерфейсе Plurality) и т. д.
(Обсуждение)
#Plurality #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Local. Fast. Beautiful. Настольная студия для stable-diffusion.cpp
Характеристики:
Текст2изображение, Редактирование (inpaint / multi-ref Kontext & Qwen Edit / img2img), Видео (T2V, I2V, FLF2V)
Очередь заданий — создание во время занятости; изменение порядка, приостановка, отмена
Рецепты — шаблоны с полными настройками (поверхности, рамки, объекты, настроения); импорт / экспорт .flaxeo-recipe.json
Справка — автономное руководство, включающее поверхности, рамки и рабочие процессы обработки пакетов / очередей
Галерея с возможностью повторного использования параметров PNG, повышенным масштабированием и историей создания
Model Hub стартовые пакеты (SDXL, FLUX, Z-Image, Wan, LTX, Qwen, ...)
Двойной сервер: sd-cli (по умолчанию) или sd-сервер
Аппаратные помощники: флэш-память, VAE-плитка, низкий профиль видеопамяти, предустановки кэша
Квантование / преобразование моделей в GGUF из пользовательского интерфейса
(Обсуждение)
#FlaxeoImage #FlaxeoUI #StableDiffusion #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
🦋 Какой-то гений выпустил Colibri, которая запускает гигантскую GLM-5.2 на 744 миллиарда (!) параметров на домашнем ПК — требуется всего 25 ГБ оперативной памяти даже без видеокарты.
Как работает:
• Это один файл на чистом C на 2400 строк — во время работы ему не нужны Python, библиотеки и GPU.
• Трюк: модель занимает 370 ГБ на диске и подгружает только 10-20 ГБ данных в оперативную память по мере необходимости.
• Вместо хранения всей модели в RAM, тулза загружает нужные блоки с SSD, использует их и освобождает место.
• Ложка дёгтя в бочке мёда: на среднем железе скорость составляет 0,1 токена в секунду, но при быстром диске это можно ускорить.
• После установки запускается всего за 30 секунд.
🔗 https://github.com/JustVugg/colibri
(Обсуждение)
💡 А для запуска Hy3 на 10Гб. создали: https://github.com/ErikTromp/colibri-hy3
(Обсуждение)
#Colibri #GLM52 #Hy3 #LocalAi #AiLocal
Как работает:
• Это один файл на чистом C на 2400 строк — во время работы ему не нужны Python, библиотеки и GPU.
• Трюк: модель занимает 370 ГБ на диске и подгружает только 10-20 ГБ данных в оперативную память по мере необходимости.
• Вместо хранения всей модели в RAM, тулза загружает нужные блоки с SSD, использует их и освобождает место.
• Ложка дёгтя в бочке мёда: на среднем железе скорость составляет 0,1 токена в секунду, но при быстром диске это можно ускорить.
• После установки запускается всего за 30 секунд.
Идея:
Модель Mixture-of-Experts на 744B активирует всего ~40B параметров для каждого токена, и только ~11 ГБ из них меняются от токена к токену (маршрутизируемые эксперты).
Таким образом:
- плотная часть (внимание, общие эксперты, эмбеддинги — ~17 млрд параметров) остается в оперативной памяти на уровне int4 (~9,9 ГБ);
- 21 504 маршрутизируемых эксперта (75 слоев MoE × 256 экспертов + головка MTP, ~19 МБ каждый на уровне int4) хранятся на диске (~370 ГБ) и потребуются для потоковой передачи с использованием LRU-кэша для каждого слоя, опционального закрепленного горячего хранилища и страничного кэша ОС в качестве бесплатного уровня 2.
Движок представляет собой один файл на языке C (c/glm.c, ~2400 строк) плюс небольшие заголовочные файлы. Никаких BLAS, никакого Python во время выполнения, не требуется графический процессор!
(Обсуждение)
💡 А для запуска Hy3 на 10Гб. создали: https://github.com/ErikTromp/colibri-hy3
(Обсуждение)
#Colibri #GLM52 #Hy3 #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
This media is not supported in your browser
VIEW IN TELEGRAM
Прикольный сетап: LM Studio + Pi.
🪼 Схема такая:
Mac → LM Studio запускает модель → Pi подключается к ней → агент читает и правит файлы проекта🪼 А что, вместо того, чтобы каждый раз жечь токены популярных Claude Code или Codex, можно часть простых задач гонять локально. Заметьте, не в облаке, а на своем железе🤌 🪼 Но магии тут нет: Локальные модели пока не превращают ваш Mac в бесплатный Claude Code🥲 Нужно нормальное железо, достаточно памяти, чуть повозиться с настройкой, а качество на сложных задачах будет слабее, чем у топовых облачных моделей.
Зато для простых правок, экспериментов, учебных проектов + поиграться без страха сжечь лимиты - очень даже интересная история.
В общем, не "убийца" Claude Code, а вариант для тех, кто хочет вайбкодить локально и экономить токены.
#LMStudio #Pi #AiAgent #AgentAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Рассуждения, которые масштабируются в зависимости от проблемы. Агентная, мыслящая модель, которая принимает решения более взвешенно именно тогда, когда это важно, и не мешает себе, когда это не так.
Tess-4-27B — первый выпуск Tess за два года и первый выпуск, в котором обосновывается. Модель, созданная на основе Qwen/Qwen3.6-27BМигелем Тиссерой, прошла постобработку на специально подобранной смеси: 64-килобайтных агентных трассировках с длинным контекстом — реальных инженерных решениях, созданных с помощью Fable-5, а не синтетических поколениях, — со стилем рассуждений, приближенным к Fable-5, с помощью ансамбля из трех моделей-учителей (Opus-4.8, GPT-5.5 и GLM-5.2), объединенных в один целостный голос.
В результате получилась модель 27B, которая мыслит как старший инженер: выдвигает гипотезу, действует, проверяет и рассуждает с должной тщательностью на тех этапах, которые действительно этого заслуживают. Это не та модель, которая рассказывает, как пришла к уже известному ответу.
(Обсуждение)
#Tess4 #Tess427B #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Проблема: общие чат-модели могут писать маркетинговые тексты, но по умолчанию они используют одни и те же вводные фразы, такие как «В современном быстро меняющемся мире...», и расплывчатые формулировки вместо конкретных преимуществ. И доработали Gemma-4-31B-it, чтобы убрать эти вводные фразы и сделать текст более похожим на текст копирайтера, ориентированного на прямой отклик: начинать с проблемы, использовать конкретные, чёткие призывы к действию. В целом модель стала более эмоционально развитой.
Настройка оценки: на основе методологии EQ-Bench 3 (попарная оценка по шкале Эло + шкала оценки) был создан бенчмарк для копирайтинга, использующий 30 реальных брифов, связанных с рекламой в Facebook, холодным обзвоном, целевыми страницами, описаниями товаров, SMS, сценариями и т. д. Базовая модель и модель с тонкой настройкой ответили на все брифы, которые оценивались вслепую с помощью DeepSeek V4 Flash в обоих вариантах (A-vs-B и B-vs-A) для контроля позиционной предвзятости. Те же базовые веса, те же настройки декодирования, единственная переменная — тонкая настройка.
Самые значительные и стабильные улучшения были достигнуты в таких аспектах, как сила цепляния, конкретность и лаконичность — именно в этих областях и работает текст, побуждающий к прямому действию.
Сведения об обучении: QLoRA SFT на тщательно отобранном корпусе маркетинговых брифов в сочетании с вариантами их заполнения, включая реальные примеры рекламных объявлений. Окончательные веса объединены с полным bf16 (адаптера не будет). Контекст 256K, используется в vLLM или Transformers без изменений.
Для достижения наилучших результатов требуется enable_thinking=false . Включение режима логического вывода Gemma 4 на самом деле снижает качество вывода, так что имейте это в виду.
Описание модели + веса: https://huggingface.co/akwin123/copywriter-gemma4-31b
Квантования: https://huggingface.co/models?other=base_model:quantized:akwin123/copywriter-gemma4-31b (mradermacher)
(Обсуждение)
#Gemma4 #Gemma431B #copywriter #копирайтер #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
https://telegram.me/gigadev_channel/72
#GigaChat #GigaChatAudio #AiAudio #GigaAM #AiModel #ModelAi #LocalAi #AiLocal
Please open Telegram to view this post
VIEW IN TELEGRAM
Telegram
GigaDev — разработка GigaChat
GigaChat Audio и GigaAM Multilingual: новые Open Source модели с поддержкой длинного контекста и языков СНГ 🔥
Полноценные audio-native LLM — пока редкость в опенсорсе, а почти весь прогресс в Speech AI сфокусирован на английском языке и коротких аудио. Качество…
Полноценные audio-native LLM — пока редкость в опенсорсе, а почти весь прогресс в Speech AI сфокусирован на английском языке и коротких аудио. Качество…