Hermes Agent v0.20.0 - The Herald Release
Teknium пишет, - сильно прокачали Гермеса, - срочно обновляемся :)
Еще надёжнее работает теперь с атомарными задачами, при этом экономя токены.
#Hermes #update
———
@tsingular
Teknium пишет, - сильно прокачали Гермеса, - срочно обновляемся :)
Еще надёжнее работает теперь с атомарными задачами, при этом экономя токены.
hermes update
#Hermes #update
———
@tsingular
🔥15✍4⚡2❤1👌1
Cursor получил плагины Google Workspace
⚡️ Cursor добавил пять плагинов для прямой интеграции с Google Workspace: Gmail, Drive, Calendar, Docs и Sheets.
Теперь AI-агент внутри IDE может читать почту, искать файлы на диске, управлять календарём и редактировать документы.
📦 Плагины устанавливаются из Marketplace или через страницу Customize в самом Cursor.
После подключения аккаунта Google агент получает контекст из рабочих инструментов: может найти письмо с требованиями, открыть спецификацию в Docs, проверить расписание в Calendar, собрать всё это в код и занести результаты в таблицу Google Sheets.
Cursor продолжает превращать IDE из редактора кода в хаб, где агент работает со всей рабочей информацией, а не только с репозиторием.
Еще и дизайн поменяли в стиль Agent first.
Все превращается в однообразный офисный мультитул
#Cursor #Google #Workspace
———
@tsingular
⚡️ Cursor добавил пять плагинов для прямой интеграции с Google Workspace: Gmail, Drive, Calendar, Docs и Sheets.
Теперь AI-агент внутри IDE может читать почту, искать файлы на диске, управлять календарём и редактировать документы.
📦 Плагины устанавливаются из Marketplace или через страницу Customize в самом Cursor.
После подключения аккаунта Google агент получает контекст из рабочих инструментов: может найти письмо с требованиями, открыть спецификацию в Docs, проверить расписание в Calendar, собрать всё это в код и занести результаты в таблицу Google Sheets.
Cursor продолжает превращать IDE из редактора кода в хаб, где агент работает со всей рабочей информацией, а не только с репозиторием.
Еще и дизайн поменяли в стиль Agent first.
Все превращается в однообразный офисный мультитул
#Cursor #Google #Workspace
———
@tsingular
✍6💯3⚡2🤩1🆒1
Google Cloud собрал AI-конвейер для миграции с мейнфреймов
⚡️ Google Cloud представил четыре AI-инструмента для модернизации мейнфреймов, закрывающих полный цикл: оценка наследуемого кода, преобразование через AI-агентов, проверка на реальном трафике и перенос данных. Итеративный конвейер вместо рискованного единоразового переноса.
🔍 Mainframe Assessment Tool (MAT) занимается AI-реверс-инжинирингом. Сканирует кодовую базу, строит карту зависимостей (DB2, VSAM, IMS), извлекает бизнес-правила в виде простого текста и деревьев решений, генерирует документацию. Результаты передаются агентам через MCP.
🤖 Modernization Agents на базе Gemini и платформы Antigravity поддерживают два режима. Rewrite: агенты извлекают бизнес-логику, формируют спецификации и архитектуру, затем пишут облачную версию с нуля. Deterministic: код-в-код с жёстким контрактом, идентичное поведение без технического долга.
🛡️ Dual Run: страховка перед запуском. Прогоняет реальный продакшен-трафик параллельно через старую и новую систему, сравнивает результаты пошагово. Валидация идёт до полного совпадения, нулевой риск простоя.
📦 Mainframe Connector переносит данные в BigQuery, Spanner, Cloud SQL и Cloud Storage с автоматической конвертацией форматов, встраивается в существующие ETL-процессы.
Интересный пример реверса инфры.
Стоит изучить, если планируете агентов на управление конфигурациями натравливать.
#GoogleCloud #Mainframe #AI
———
@tsingular
⚡️ Google Cloud представил четыре AI-инструмента для модернизации мейнфреймов, закрывающих полный цикл: оценка наследуемого кода, преобразование через AI-агентов, проверка на реальном трафике и перенос данных. Итеративный конвейер вместо рискованного единоразового переноса.
🔍 Mainframe Assessment Tool (MAT) занимается AI-реверс-инжинирингом. Сканирует кодовую базу, строит карту зависимостей (DB2, VSAM, IMS), извлекает бизнес-правила в виде простого текста и деревьев решений, генерирует документацию. Результаты передаются агентам через MCP.
🤖 Modernization Agents на базе Gemini и платформы Antigravity поддерживают два режима. Rewrite: агенты извлекают бизнес-логику, формируют спецификации и архитектуру, затем пишут облачную версию с нуля. Deterministic: код-в-код с жёстким контрактом, идентичное поведение без технического долга.
🛡️ Dual Run: страховка перед запуском. Прогоняет реальный продакшен-трафик параллельно через старую и новую систему, сравнивает результаты пошагово. Валидация идёт до полного совпадения, нулевой риск простоя.
📦 Mainframe Connector переносит данные в BigQuery, Spanner, Cloud SQL и Cloud Storage с автоматической конвертацией форматов, встраивается в существующие ETL-процессы.
Интересный пример реверса инфры.
Стоит изучить, если планируете агентов на управление конфигурациями натравливать.
#GoogleCloud #Mainframe #AI
———
@tsingular
❤5⚡2✍1🔥1🆒1
Знакомые ищут Technical Owner / Tech Lead в SaaS AI-платформу 🚀
Нужен сильный технический специалист на стороне продукта, который будет контролировать качество реализации, принимать работы от внешних подрядчиков, которые ведут всю разработку, и помогать выбирать инженерные решения.
Детали:
по всем вопросам напрямую: @Elizgen
#вакансии
———
@tsingular
Нужен сильный технический специалист на стороне продукта, который будет контролировать качество реализации, принимать работы от внешних подрядчиков, которые ведут всю разработку, и помогать выбирать инженерные решения.
Детали:
Основные задачи:
— оценка кода и приёмка работ подрядчиков;
— проверка архитектуры, инфраструктуры и безопасности;
— выявление технических рисков;
— оценка сроков, трудозатрат и обоснованности выставленных часов;
— перевод бизнес-задач в технические требования;
— разбор критических сбоев и стабилизация системы.
Что нужно знать:
— Python, FastAPI или Django, PostgreSQL, очереди задач, API;
— Docker, CI/CD и облачную инфраструктуру;
— API Gateway, балансировку, TLS, VPC и управление доступом;
— таймауты, ретраи, резервные маршруты и переключение API-провайдеров;
— биллинг SaaS: тарифы, подписки, квоты и учёт потребления;
— объектные хранилища и длительные асинхронные задачи;
— генеративные API, self-hosted модели на GPU и RAG.
Плюсом будет опыт с высоконагруженным SaaS, внешними командами, SLO/SLA, инцидентами и юнит-экономикой.
Также нужно будет проводить технический онбординг, готовить инструкции, собирать обратную связь и объяснять сложные технические вещи понятным языком.
Ищут человека, которому действительно интересны нейросети: самостоятельно изучать новые модели, разворачивать их и оценивать применимость для продукта.
Работа в связке с AI-директором: он отвечает за продукт и стратегию, Technical Owner — за техническое качество и инженерные решения.
Возможна частичная занятость с переходом на полную. Удалённый или гибридный формат, работа под NDA.
Совмещать можно, но не с прямыми конкурентами.
по всем вопросам напрямую: @Elizgen
#вакансии
———
@tsingular
⚡5🔥3✍2😁1
Forwarded from Уставший техдир
Автоматизированные квалити гейты
Хочу поделиться практическими приемами. Они мне спасли очень много нервов
Поскольку агенты могут дрифтовать и цеплять функционал очень важно обеспечить надежность всех изменений. Особенно, когда мы трогаем архитектуру, шеренные либы или готовые фичи. Перекинуть проект на другой пакетный менеджер, заменить сборщик, распилить архитектуру на независимые модули, вынести фуникциональность в лейзи чанки, обновить и централизовать управление общими зависимостями (особенно в микрофронтовой архитектуре). Да даже просто вносить функциональные изменения и багфиксить — все это требует надежности, нужно чтобы агенты не наворотили лишнего и не сломали тебе код
Я собрал пачку рецептов, которые помогают удержать управление кодовой базой
1. Строгие требования о прокрытии тестами. Если создается новый, изменяется или удаляется существующий функционал, требуем от агентов покрывать все тестами, пишем правила как писать тесты, как мокировать, описываем принципы тестирования, настраиваем агентное ревью. Код без тестов и покрытия не принимается
2. Линтеры. Обязательно настраиваем все стандартные линтеры, как на чистоту кода, так и на следование архитектуре, цикличность зависимостей, протечки абстракций и всё всё всё, что мы считаем плохим кодом и можем быстро проверить программно
3. Тулинги для анализа всего до чего дотянетесь. Анализ лайтхауса, перформанс-графов, размера бандлов, содержание зависимостей в критическом пути. Пакуем все процедурные описания в скиллы, сопровождаем их скриптами и бейслайнами. Агент должен иметь возможность самостоятельно исполнить проверки, убедиться, что результаты соответствуют ожиданиям (не просел лайтхаус, бандл критического пути не распух и так далее)
4. Прекоммит-хуки. Ваше ненавистное. На каждый коммит запускать линтеры. Да. ждать больше не вам, пусть ждет агент. Отдельно убедитесь, что ваши хуки плюются ошибками и ворнингами прямо обратно агенту. Пусть он моментально получает обратную связь и идёт исправлять. Или это потом будете делать вы)
5. Прерпуш-хуки. Тесты. Все аффектед-тесты должны запускаться ДО попадания кода в репозиторий. Да на инфре он еще раз пробежит. Но оно вам потом надо?Важно, чтобы петля обратной связи была как можно быстрее и как можно ближе к работе агента. Пусть также получит всю инфу и инструкции, отлуп и пойдет фиксить
И только потом можно сказать, что "ну ок, можно пушнуть в pull/merge request и отправить собираться на инфрастурктуре.
Бонус: red-green bugfix. Если агент правит багу, он сначала пишет красный тест и воспроизводит баг, потом фиксит. Так вы получаете гарантию, что баг реально закрыт и баг не появится снова
А если вам все это впадлу и тяжело, чтож) квадратное катайте и круглое носите, кто ж вам запретит, бог в помощь!))
Хочу поделиться практическими приемами. Они мне спасли очень много нервов
Поскольку агенты могут дрифтовать и цеплять функционал очень важно обеспечить надежность всех изменений. Особенно, когда мы трогаем архитектуру, шеренные либы или готовые фичи. Перекинуть проект на другой пакетный менеджер, заменить сборщик, распилить архитектуру на независимые модули, вынести фуникциональность в лейзи чанки, обновить и централизовать управление общими зависимостями (особенно в микрофронтовой архитектуре). Да даже просто вносить функциональные изменения и багфиксить — все это требует надежности, нужно чтобы агенты не наворотили лишнего и не сломали тебе код
Я собрал пачку рецептов, которые помогают удержать управление кодовой базой
1. Строгие требования о прокрытии тестами. Если создается новый, изменяется или удаляется существующий функционал, требуем от агентов покрывать все тестами, пишем правила как писать тесты, как мокировать, описываем принципы тестирования, настраиваем агентное ревью. Код без тестов и покрытия не принимается
2. Линтеры. Обязательно настраиваем все стандартные линтеры, как на чистоту кода, так и на следование архитектуре, цикличность зависимостей, протечки абстракций и всё всё всё, что мы считаем плохим кодом и можем быстро проверить программно
3. Тулинги для анализа всего до чего дотянетесь. Анализ лайтхауса, перформанс-графов, размера бандлов, содержание зависимостей в критическом пути. Пакуем все процедурные описания в скиллы, сопровождаем их скриптами и бейслайнами. Агент должен иметь возможность самостоятельно исполнить проверки, убедиться, что результаты соответствуют ожиданиям (не просел лайтхаус, бандл критического пути не распух и так далее)
4. Прекоммит-хуки. Ваше ненавистное. На каждый коммит запускать линтеры. Да. ждать больше не вам, пусть ждет агент. Отдельно убедитесь, что ваши хуки плюются ошибками и ворнингами прямо обратно агенту. Пусть он моментально получает обратную связь и идёт исправлять. Или это потом будете делать вы)
5. Прерпуш-хуки. Тесты. Все аффектед-тесты должны запускаться ДО попадания кода в репозиторий. Да на инфре он еще раз пробежит. Но оно вам потом надо?Важно, чтобы петля обратной связи была как можно быстрее и как можно ближе к работе агента. Пусть также получит всю инфу и инструкции, отлуп и пойдет фиксить
И только потом можно сказать, что "ну ок, можно пушнуть в pull/merge request и отправить собираться на инфрастурктуре.
Бонус: red-green bugfix. Если агент правит багу, он сначала пишет красный тест и воспроизводит баг, потом фиксит. Так вы получаете гарантию, что баг реально закрыт и баг не появится снова
А если вам все это впадлу и тяжело, чтож) квадратное катайте и круглое носите, кто ж вам запретит, бог в помощь!))
🔥12⚡2🫡2✍1😐1
Barracuda Red Team: почтовые AI-ассистенты как инструмент захвата аккаунтов
Red Team компании Barracuda Networks показали в лабораторных условиях, как встроенный почтовый AI-ассистент (Copilot, Gemini и аналоги) превращается в идеальный инструмент для атаки.
После компрометации одного рядового аккаунта злоумышленник получает «умного инсайдера», который на скорости AI проводит его от начального доступа до кражи четверти миллиона долларов.
🔍 Атака в стиле Living off the Land: никакого внешнего вредоносного ПО, только легитимные функции почтового клиента.
Первым шагом после захвата учётки идет команда в Copilot создать правило, автоматически удаляющее уведомления о входе в «Корзину».
Дальше разведочные промпты «расскажи про оргструктуру» и «покажи важные переписки».
Copilot за секунды выдаёт схему компании и находит активную ветку переписки с CEO.
⚙️ Имея контекст, атакующий просит ассистента написать письмо CEO в стиле скомпрометированного сотрудника со ссылкой на «подтверждение счёта».
Письмо приходит с реального внутреннего адреса, проходит все проверки.
CEO кликает, ссылка ведёт через прокси-перехватчик сессионных токенов, двухфакторная аутентификация пройдена.
Аккаунт CEO захвачен.
💰 В почту руководителя прилетает новый запрос к Copilot: «напомни мне про недавние финансовые письма, суммы и готовящиеся переводы».
Ассистент находит платёж на $247 500. Дальше письмо в финотдел от лица CEO с просьбой сменить банковские реквизиты, удаление следов переписки и правило пересылки, скрывающее подтверждение от финотдела.
💡 Контекст: 85% компаний из Fortune 500 сидят на AI-платформах Microsoft, 15 миллионов платных мест Copilot.
Google встроил Gemini в Workspace.
Вендоры признают: полностью устранить prompt injection в текущей архитектуре LLM невозможно.
Уже есть LOLCopilot для манипуляции ассистентом и SearchLeak для скрытой эксфильтрации данных.
AI-ассистенты неслабо так качают фишинг, который и так работал.
#cybersecurity #AI #Copilot
———
@tsingular
Red Team компании Barracuda Networks показали в лабораторных условиях, как встроенный почтовый AI-ассистент (Copilot, Gemini и аналоги) превращается в идеальный инструмент для атаки.
После компрометации одного рядового аккаунта злоумышленник получает «умного инсайдера», который на скорости AI проводит его от начального доступа до кражи четверти миллиона долларов.
🔍 Атака в стиле Living off the Land: никакого внешнего вредоносного ПО, только легитимные функции почтового клиента.
Первым шагом после захвата учётки идет команда в Copilot создать правило, автоматически удаляющее уведомления о входе в «Корзину».
Дальше разведочные промпты «расскажи про оргструктуру» и «покажи важные переписки».
Copilot за секунды выдаёт схему компании и находит активную ветку переписки с CEO.
⚙️ Имея контекст, атакующий просит ассистента написать письмо CEO в стиле скомпрометированного сотрудника со ссылкой на «подтверждение счёта».
Письмо приходит с реального внутреннего адреса, проходит все проверки.
CEO кликает, ссылка ведёт через прокси-перехватчик сессионных токенов, двухфакторная аутентификация пройдена.
Аккаунт CEO захвачен.
💰 В почту руководителя прилетает новый запрос к Copilot: «напомни мне про недавние финансовые письма, суммы и готовящиеся переводы».
Ассистент находит платёж на $247 500. Дальше письмо в финотдел от лица CEO с просьбой сменить банковские реквизиты, удаление следов переписки и правило пересылки, скрывающее подтверждение от финотдела.
💡 Контекст: 85% компаний из Fortune 500 сидят на AI-платформах Microsoft, 15 миллионов платных мест Copilot.
Google встроил Gemini в Workspace.
Вендоры признают: полностью устранить prompt injection в текущей архитектуре LLM невозможно.
Уже есть LOLCopilot для манипуляции ассистентом и SearchLeak для скрытой эксфильтрации данных.
AI-ассистенты неслабо так качают фишинг, который и так работал.
#cybersecurity #AI #Copilot
———
@tsingular
✍4🔥3⚡2👻1
Media is too big
VIEW IN TELEGRAM
Grok Imagine знатно прокачали.
в принципе цепочку можно бесконечно генерить.
Это чисто тест 15+15 секунд
исходная картинка из MJ через describe промпта от Имперских чертогов
#Grok #Imagine
———
@tsingular
в принципе цепочку можно бесконечно генерить.
Это чисто тест 15+15 секунд
исходная картинка из MJ через describe промпта от Имперских чертогов
#Grok #Imagine
———
@tsingular
🔥38 9⚡3🤣3
Forwarded from Никита Шарипов
Физика запредельно гибкая. Seedance 2.5 тест движка на пределе возможностей.
🔥7❤3🏆2 2
Forwarded from Метаверсище и ИИще
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
FLUX 3 Video вышел в API
Ортодоксы, староверы и консерваторы победили. Но у меня нейросоломоново решение: пишу в старом формате, короткий пост-абзац в начале, подробности после него.
Мне жутко нравится возможность подписывать картинки и видео в постах, но в старом формате будут просто свалки.
TL;DR. Black Forest Labs наконец-то бахнули FLUX 3 Video через API. Модель делает до 20 секунд видео со звуком, липсинком, несколькими сценами, ключевыми кадрами и продолжением готового ролика. Первые тесты выглядят прельстиво: длинные планы не рассыпаются, звук норм, персонажи иногда даже помнят, кем были пять секунд назад.
Русский язык заявлен официально. Есть Draft Mode: сначала дёшево смотришь, насколько модель испортила идею, потом платишь ещё раз за красивую версию того же промпта. Если без шуток, то Draft Mode: сначала генерируется дешёвый черновик, а понравившуюся версию можно пересчитать в полном качестве с тем же движением, композицией и seed.
Подробнее:
Базовая генерация идёт в 720p, а Full HD получается через апскейлинг. FLUX 3 Image - не доступен. На вход можно подать обычный текстовый промпт, одну картинку, начальный и конечный кадры, последовательность ключевых кадров или до четырёх секунд исходного видео со звуком, которое модель должна продолжить.
Кстати, у Флюксовицкого нет такого полноценного reference-to-video, как у MiniMax H3, где можно отдельно загрузить до 9 картинок, 3 видео движения и 3 аудио, а потом обращаться к ним в промпте.
Цены
У BFL и fal обычная генерация в 720p стоит примерно $0,17 за секунду. Десять секунд - $1,70, двадцать - $3,40.
1080p на fal и Runware стоит около $0,29 за секунду, то есть $2,90 за десять секунд и $5,80 за двадцать.
Draft Mode на fal дешевле - около $0,06 за секунду. Replicate в некоторых режимах выходит примерно в $0,12 за секунду, хотя итог зависит от настроек.
Krea продаёт доступ через подписку и compute units: специально для тех, кто любит сначала купить кредитов, а потом выяснять, на сколько роликов его хватит.
Хиггсы, что удивительно, молчат.
Replicate сейчас указывает примерно 83 секунды генерации за $10, что соответствует приблизительно $0,12 за секунду. Это выглядит дешевле BFL и fal, хотя окончательная стоимость может зависеть от выбранного режима и разрешения
Тесты и черрипики демонстрируют длинные непрерывные планы, танцы с липсинком, говорящих персонажей и сцены с нескольких ракурсов. Особенно прикольные тесты, где одно событие одновременно показано двумя камерами. FLUX 3 пытается сохранить траекторию движения и расположение объектов. Не всегда идеально, но хотя бы понимает, что кот сверху и кот сбоку - это один кот, а не Шредингер попутал.
На реддите, как обычно ноют и ругаюцца.
Типа FLUX 3 зажал веса, а H3 уже тут, и наваливает NSFW.
В API FLUX 3 есть safety-фильтры, но Reddit подозревает, что часть ограничений сидит и в самой модели.
Пока BFL тормозит, MiniMax H3 уже работает локально, обрастает workflow и собирает вокруг себя сообщество.
Ждем весов и подлянок с дистиллятом.
https://bfl.ai/blog/flux-3-video
https://fal.ai/models/blackforestlabs/flux-3/keyframes-to-video
@cgevent
Ортодоксы, староверы и консерваторы победили. Но у меня нейросоломоново решение: пишу в старом формате, короткий пост-абзац в начале, подробности после него.
Мне жутко нравится возможность подписывать картинки и видео в постах, но в старом формате будут просто свалки.
TL;DR. Black Forest Labs наконец-то бахнули FLUX 3 Video через API. Модель делает до 20 секунд видео со звуком, липсинком, несколькими сценами, ключевыми кадрами и продолжением готового ролика. Первые тесты выглядят прельстиво: длинные планы не рассыпаются, звук норм, персонажи иногда даже помнят, кем были пять секунд назад.
Русский язык заявлен официально. Есть Draft Mode: сначала дёшево смотришь, насколько модель испортила идею, потом платишь ещё раз за красивую версию того же промпта. Если без шуток, то Draft Mode: сначала генерируется дешёвый черновик, а понравившуюся версию можно пересчитать в полном качестве с тем же движением, композицией и seed.
Подробнее:
Базовая генерация идёт в 720p, а Full HD получается через апскейлинг. FLUX 3 Image - не доступен. На вход можно подать обычный текстовый промпт, одну картинку, начальный и конечный кадры, последовательность ключевых кадров или до четырёх секунд исходного видео со звуком, которое модель должна продолжить.
Кстати, у Флюксовицкого нет такого полноценного reference-to-video, как у MiniMax H3, где можно отдельно загрузить до 9 картинок, 3 видео движения и 3 аудио, а потом обращаться к ним в промпте.
Цены
У BFL и fal обычная генерация в 720p стоит примерно $0,17 за секунду. Десять секунд - $1,70, двадцать - $3,40.
1080p на fal и Runware стоит около $0,29 за секунду, то есть $2,90 за десять секунд и $5,80 за двадцать.
Draft Mode на fal дешевле - около $0,06 за секунду. Replicate в некоторых режимах выходит примерно в $0,12 за секунду, хотя итог зависит от настроек.
Krea продаёт доступ через подписку и compute units: специально для тех, кто любит сначала купить кредитов, а потом выяснять, на сколько роликов его хватит.
Хиггсы, что удивительно, молчат.
Replicate сейчас указывает примерно 83 секунды генерации за $10, что соответствует приблизительно $0,12 за секунду. Это выглядит дешевле BFL и fal, хотя окончательная стоимость может зависеть от выбранного режима и разрешения
Тесты и черрипики демонстрируют длинные непрерывные планы, танцы с липсинком, говорящих персонажей и сцены с нескольких ракурсов. Особенно прикольные тесты, где одно событие одновременно показано двумя камерами. FLUX 3 пытается сохранить траекторию движения и расположение объектов. Не всегда идеально, но хотя бы понимает, что кот сверху и кот сбоку - это один кот, а не Шредингер попутал.
На реддите, как обычно ноют и ругаюцца.
Типа FLUX 3 зажал веса, а H3 уже тут, и наваливает NSFW.
В API FLUX 3 есть safety-фильтры, но Reddit подозревает, что часть ограничений сидит и в самой модели.
Пока BFL тормозит, MiniMax H3 уже работает локально, обрастает workflow и собирает вокруг себя сообщество.
Ждем весов и подлянок с дистиллятом.
https://bfl.ai/blog/flux-3-video
https://fal.ai/models/blackforestlabs/flux-3/keyframes-to-video
@cgevent
👍6✍2❤1⚡1🔥1
Кажется это чья-то шутка.
28B модель, которую можно запустить на 4090
И которая поддерживает 10 миллионов контекстного окна!!!
Some weights in Pokee-Isaac are fine-tuned from Qwen3.6-27B
слабо верится, надо проверять
что какой-то "ноунейм" выполз и ушатал по контексту фронтиров.
1× B200-class GPU
137,200 tok/s prefill at 10M context, decode flat near 335 tok/s.
1× RTX 4090 / RTX 5090
тут 10М не обещают прямо
Технический блог:
console.pokee.ai/model
Технический отчет
https://console.pokee.ai/
#Pokee #Isaac
———
@tsingular
28B модель, которую можно запустить на 4090
И которая поддерживает 10 миллионов контекстного окна!!!
Some weights in Pokee-Isaac are fine-tuned from Qwen3.6-27B
слабо верится, надо проверять
что какой-то "ноунейм" выполз и ушатал по контексту фронтиров.
1× B200-class GPU
137,200 tok/s prefill at 10M context, decode flat near 335 tok/s.
1× RTX 4090 / RTX 5090
тут 10М не обещают прямо
Технический блог:
console.pokee.ai/model
Технический отчет
https://console.pokee.ai/
#Pokee #Isaac
———
@tsingular
🤔2👀2🗿1