Famegrid 2nd Gen (Krea 2 / Z-Image / Qwen)
Серия LoRA на реализм с закосом под смартфон
- Работает в связке с Turbo Distill LoRA — 6 шагов первый проход, 2 шага второй
- Вес LoRA: 0.7–0.9 (0.7 более естественно, 0.9 сильнее стиль, но чисто)
- С character LoRA вес не выше 0.6
- Триггер-слово:
#lora #realism #krea2 #zimage #qwenimage
VK | MAX
Серия LoRA на реализм с закосом под смартфон
- Работает в связке с Turbo Distill LoRA — 6 шагов первый проход, 2 шага второй
- Вес LoRA: 0.7–0.9 (0.7 более естественно, 0.9 сильнее стиль, но чисто)
- С character LoRA вес не выше 0.6
- Триггер-слово:
rls#lora #realism #krea2 #zimage #qwenimage
VK | MAX
🔥12👍7
Qwen3.8-Flash-Next
Ранний предпросмотр архитектуры Qwen4 с открытыми весами
Скорость Flash при размере большой модели. Плюс 51B n-gram эмбеддингов, которые добавляют параметров почти бесплатно по памяти
- Мультимодальная: понимает текст, изображения и видео
- 6B активных на токен из 125B - быстро и экономично
- Контекст 262K нативно, до 1M через YaRN
- Обходит Qwen3.7-Plus и DeepSeek-V4-Flash по большинству бенчмарков при куда меньших затратах
Гитхаб
HF
Квантизации
Демо
API
#multimodal #agent
VK | MAX
Ранний предпросмотр архитектуры Qwen4 с открытыми весами
Скорость Flash при размере большой модели. Плюс 51B n-gram эмбеддингов, которые добавляют параметров почти бесплатно по памяти
- Мультимодальная: понимает текст, изображения и видео
- 6B активных на токен из 125B - быстро и экономично
- Контекст 262K нативно, до 1M через YaRN
- Обходит Qwen3.7-Plus и DeepSeek-V4-Flash по большинству бенчмарков при куда меньших затратах
Гитхаб
HF
Квантизации
Демо
API
#multimodal #agent
VK | MAX
👍15🔥5❤2
Breeze TTS 2
Рилтайм говорилка
- Клонирование голоса: пара секунд речи + точная расшифровка → сохранение тембра, ритма, эмоций
- Дизайн голоса без референса по промпту
- Voice Direction: "говори медленно, серьезно" - голос остается, подача меняется
- Вокальные события в тексте: (laugh), (cough), (sigh)
- Стриминг с задержкой менее 40 мс до первого аудио, генерация в 3 раза быстрее реального времени
- 3B, ~7.7 GB VRAM, min 12 GB GPU
- английский и китайский
Гитхаб
HF
Попробовать
Демо
Спасибо @m_franz
#TTS #VOICECLONING #VOICEDESIGN
VK | MAX
Рилтайм говорилка
- Клонирование голоса: пара секунд речи + точная расшифровка → сохранение тембра, ритма, эмоций
- Дизайн голоса без референса по промпту
- Voice Direction: "говори медленно, серьезно" - голос остается, подача меняется
- Вокальные события в тексте: (laugh), (cough), (sigh)
- Стриминг с задержкой менее 40 мс до первого аудио, генерация в 3 раза быстрее реального времени
- 3B, ~7.7 GB VRAM, min 12 GB GPU
- английский и китайский
Гитхаб
HF
Попробовать
Демо
Спасибо @m_franz
#TTS #VOICECLONING #VOICEDESIGN
VK | MAX
👍7🤷♂5
GLM-5.3-Flash
оказалось это она пряталась под псевдонимом Ox Alpha
Первая GLM с настоящей мультимодальностью: изображения и видео принимаются нативно, без отдельных моделей-помощников
- Мультимодальность из коробки: текст, изображения, видео
- Контекст до 1M
- Агентские бенчмарки приближаются к Opus 4.8
- 321B параметров, активны 18B
- Цена: $0.075 вход / $0.25 выход, с 9 сентября вырастет до $0.15 / $0.50
- Работает полностью на китайских чипах
HF
GGUF / FP8
API
#flagship #gguf #fp8 #multimodal #agent
VK | MAX
оказалось это она пряталась под псевдонимом Ox Alpha
Первая GLM с настоящей мультимодальностью: изображения и видео принимаются нативно, без отдельных моделей-помощников
- Мультимодальность из коробки: текст, изображения, видео
- Контекст до 1M
- Агентские бенчмарки приближаются к Opus 4.8
- 321B параметров, активны 18B
- Цена: $0.075 вход / $0.25 выход, с 9 сентября вырастет до $0.15 / $0.50
- Работает полностью на китайских чипах
HF
GGUF / FP8
API
#flagship #gguf #fp8 #multimodal #agent
VK | MAX
🔥11👍5
Nvidia покупает HuggingFace за $12.9 млрд
Слухи ходили меньше недели. Nvidia забирает крупнейший репозиторий открытых моделей
Из рисков: монополия Nvidia на железо теперь получает контроль еще и над главным дистрибутором моделей. Но как минимум HuggingFace не угрожает судьба TensorFlow, его не закрывают, а инвестируют
#news
VK | MAX
Слухи ходили меньше недели. Nvidia забирает крупнейший репозиторий открытых моделей
Из рисков: монополия Nvidia на железо теперь получает контроль еще и над главным дистрибутором моделей. Но как минимум HuggingFace не угрожает судьба TensorFlow, его не закрывают, а инвестируют
#news
VK | MAX
CNBCTV18
Nvidia in talks to buy Hugging Face for $12.9 billion amid AI deal spree, reports say - CNBC TV18
Nvidia has reportedly agreed to acquire AI platform Hugging Face for $12.9 billion, as the chipmaker continues its aggressive AI acquisition spree and forecasts strong revenue growth.
🤯14👍4😱3👎1😁1
Gemini 3.5 Transcribe (Google)
Новая модель распознавания речи от Google. В отличие от обычных ASR сразу чистит мусор, форматирует и понимает контекст
- Умная транскрипция: убирает "эээ", "ммм", исправляет самоперебивы, автоматом форматирует
- Распознавание более 85 языков с региональными акцентами, должен понимать русский
- Определение до 3 спикеров в записи (3+ экспериментально)
- Пользовательский словарь: специфические термины, коды, названия
- Вызов функций: может делегировать сложные задачи вроде генерации картинок другим моделям Gemini
- Стриминг: субсекундная задержка через Live API
- Преемник Chirp 3 - значительный скачок по качеству
- Замена традиционным ASR-пайплайнам: одна модель вместо конвейера из детекции, диарнализации и пост-обработки
#ASR #STREAMING
VK | MAX
Новая модель распознавания речи от Google. В отличие от обычных ASR сразу чистит мусор, форматирует и понимает контекст
- Умная транскрипция: убирает "эээ", "ммм", исправляет самоперебивы, автоматом форматирует
- Распознавание более 85 языков с региональными акцентами, должен понимать русский
- Определение до 3 спикеров в записи (3+ экспериментально)
- Пользовательский словарь: специфические термины, коды, названия
- Вызов функций: может делегировать сложные задачи вроде генерации картинок другим моделям Gemini
- Стриминг: субсекундная задержка через Live API
- Преемник Chirp 3 - значительный скачок по качеству
- Замена традиционным ASR-пайплайнам: одна модель вместо конвейера из детекции, диарнализации и пост-обработки
#ASR #STREAMING
VK | MAX
👍16
LTX-2.5 Gemma-4 12B NVFP4
NVFP4 версия текстового энкодера для LTX-2.5
ComfyUI - меньше VRAM, прямая замена, без потери качества
#ltx25 #nvfp4
VK | MAX
NVFP4 версия текстового энкодера для LTX-2.5
ComfyUI - меньше VRAM, прямая замена, без потери качества
#ltx25 #nvfp4
VK | MAX
huggingface.co
Deadshot699/ltx-2.5-gemma4-12b-comfy-nvfp4 · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
👍8🥴2
MiniMax-H3-Acc-LoRAs
LoRA ускорения для MiniMax-H3 от Alibaba PAI
Параллельная дистилляция декодирования (PDD). Видео и аудио за 8 шагов вместо обычных 20
- Две версии: FL2VA (от первого кадра) и Ref2VA (по референсам)
HF
ComfyUI
Спасибо @m_franz
#optimization #minimaxH3 #lora
VK | MAX
LoRA ускорения для MiniMax-H3 от Alibaba PAI
Параллельная дистилляция декодирования (PDD). Видео и аудио за 8 шагов вместо обычных 20
- Две версии: FL2VA (от первого кадра) и Ref2VA (по референсам)
HF
ComfyUI
Спасибо @m_franz
#optimization #minimaxH3 #lora
VK | MAX
Telegram
Нейронавт | Нейросети в творчестве
FastGen-PDD
Дистилляция диффузных моделей с параллельным декодированием. Ускоряет генерацию изображений и видео без сильной потери качества.
Прикручено к LTX-2.3 и Wan2.1-14B
Гитхаб
Спасибо @m_franz
#optimization #t2v
Дистилляция диффузных моделей с параллельным декодированием. Ускоряет генерацию изображений и видео без сильной потери качества.
Прикручено к LTX-2.3 и Wan2.1-14B
Гитхаб
Спасибо @m_franz
#optimization #t2v
👍11
Keenable
Месяц бесплатного поиска для ИИ-агентов
Релиз российсксих разработчиков из соседнего канала. Не очередная обертка над Google, свой индекс с нуля
Поисковый API для ИИ-агентов. Свой краулер, свой индекс на 100 млрд документов, своя инфраструктура заточенная под то как агенты читают, а не под синие ссылки для людей
- Качество поиска на уровне лучших, но дешевле соседей
- Задержка менее 250 мс
- Time Machine: поиск по срезу веба на произвольную дату в прошлом
- API, MCP и CLI на одном ключе
- Fetch Page Content: агент не просто получает ссылки, а читает страницы
- От $1 за 1K запросов @ 100 RPS+ (Frontier Tier)
- 100K бесплатных запросов каждому на месяц с запуска
#search #agent #api #giveaway #sota
VK | MAX
Месяц бесплатного поиска для ИИ-агентов
Релиз российсксих разработчиков из соседнего канала. Не очередная обертка над Google, свой индекс с нуля
Поисковый API для ИИ-агентов. Свой краулер, свой индекс на 100 млрд документов, своя инфраструктура заточенная под то как агенты читают, а не под синие ссылки для людей
- Качество поиска на уровне лучших, но дешевле соседей
- Задержка менее 250 мс
- Time Machine: поиск по срезу веба на произвольную дату в прошлом
- API, MCP и CLI на одном ключе
- Fetch Page Content: агент не просто получает ссылки, а читает страницы
- От $1 за 1K запросов @ 100 RPS+ (Frontier Tier)
- 100K бесплатных запросов каждому на месяц с запуска
#search #agent #api #giveaway #sota
VK | MAX
👍6
This media is not supported in your browser
VIEW IN TELEGRAM
MiniMax H3 Max
Пост-трейн версия #MiniMaxH3 от fal
#1 на Artificial Analysis среди image-to-video
5 секунд 720p за 3 секунды генерации
Качество, скорость и цена — лидер во всех трёх
- $0.04 за секунду первую неделю (50% скидка)
- Пять бесплатных генераций в день через fal
- Социальные ролики, прототипы, консистентный контент - разработчики хвалят за стабильность
- Разрешение: 768p
- Скидка 50% первую неделю
- Планируют открыть веса (!!!)
fal.ai/models/minimax/h3-max/text-to-video
fal.ai/models/minimax/h3-max/image-to-video
#t2v #i2v
VK | MAX
Пост-трейн версия #MiniMaxH3 от fal
#1 на Artificial Analysis среди image-to-video
5 секунд 720p за 3 секунды генерации
Качество, скорость и цена — лидер во всех трёх
- $0.04 за секунду первую неделю (50% скидка)
- Пять бесплатных генераций в день через fal
- Социальные ролики, прототипы, консистентный контент - разработчики хвалят за стабильность
- Разрешение: 768p
- Скидка 50% первую неделю
- Планируют открыть веса (!!!)
fal.ai/models/minimax/h3-max/text-to-video
fal.ai/models/minimax/h3-max/image-to-video
#t2v #i2v
VK | MAX
👍11🔥6
🎬 Написать годный промпт — это половина дела. А вот как доказать, что сгенерированный контент принадлежит тебе, и не получить страйк за авторские права?
Сегодня, ко Дню российского кино, юрист в сфере ИИ и медиа Иван Шевелев собрал отличную шпаргалку: разбор главных ошибок в нейросетевом продакшене.
В карточках: кому принадлежат права на ИИ-сценарии, как легально использовать дипфейки и чистить права на генерации. Сохраняйте, чтобы использовать нейронки без правовых рисков.
#legal
Сегодня, ко Дню российского кино, юрист в сфере ИИ и медиа Иван Шевелев собрал отличную шпаргалку: разбор главных ошибок в нейросетевом продакшене.
В карточках: кому принадлежат права на ИИ-сценарии, как легально использовать дипфейки и чистить права на генерации. Сохраняйте, чтобы использовать нейронки без правовых рисков.
#legal
❤6🔥4⚡1👎1🍾1