Метаверсище и ИИще
52.3K subscribers
6.61K photos
5.47K videos
49 files
7.74K links
Это не новости, это персональный экспертный взгляд на то, как развивается индустрия ИИ, графики, метаверса, крипты, нейротехнологий и в каком направлении катится все это безобразие.
Для связи: @SergTsyp
Download Telegram
ИИ-мокап на стероидах или нас всех побреют.

Вот вы говорите, данные для обучения скоро закончатся.

Комон.

Мы с вами самый жирный хавчик для ИИ.

Обучение будет включать в себя то, что мы делаем, как мы себя ведем и, на итоге, что мы думаем.

Здесь прекрасно все:


Это Индия, где очень много кожаных.

Это барбер, а не всякие там сборщики на конвейере или пошивальщицы тапочек. ИИ обучается брить и стричь кожаных. А не разбирать посудомойку дрожащими клешнями. Следит за руками, смотрит глазами(камерой), чует датчиками. Обратите внимание на браслеты.

После этого робаты возьмутся за кожаных. Ну и тут конечно, вспоминаем анекдот "у всех же разная форма головы - это только в первый раз"

И после первого раза мы будем ходить ко второму индусу - с идеальной формой головы. На массаж.

Потом на второго индуса наденут обвес от барбера (скрипач не нужен более), и обучат ИИ.

И вот у же робаты весело хлещут по башке кожаных с одинаковыми головами и приговаривают: иди сюда, мой сладкий датасет.

Шел сентябрь 2026...

@cgevent
😁53🔥12👍117
Если вы думаете, что предыдуший пост - это шутачки и прибаутачки (как обычно у Нейродеда), то нет, шутки закончились, вместе с интернетом.

Прямо щас:

Компания Human Archive (кладбище кожаных) официально пишет, что собирает RGB, RGB-D, tactile, mocap и robot data, разрабатывает собственные перчатки, wrist cameras и другие системы сбора. Компания заявляет о 100 000+ участниках и 500+ партнёрах в 30+ странах.

Это вам не Толока и «разметка картинок». Здесь пытаются записать то, что раньше почти не существовало в интернетике в больших объёмах - как именно человек взаимодействует своими неловкими конечностями с физическим миром.

А Индия уже сейчас стала огромной фабрикой кожаных данных.

Bloomberg описывает работников в переработке отходов, на фабриках, складах, фермах, стройках и других предприятиях, которые носят камеры и записывают собственную работу. По их расследованию, таких людей уже десятки тысяч.
TechCrunch отдельно писал о Human Archive, у которой тысячи активных гарнитур в Индии. Работников из сервисных компаний, гостиниц и ресторанов снимали при выполнении обычных задач. Компания дополнительно экспериментирует с tactile gloves, full-body motion capture и несколькими синхронными камерами.

Варвары из Objectways вообще открыто набирают людей для egocentric data collection (идеальный нейминг). В одной из официальных промо-кампаний предлагали аж 250 рупий за час пригодных данных за запись вроде складывания белья, раскладывания продуктов или сервировки стола.

А буквально сейчас Instawork запустила в Индии модный костюмчик Instacore. Их комплект содержит пять камер - на голове, груди и запястьях. Компания прямо говорит, что записывает реальную работу в индийских кухнях, складах, гостиницах и производстве для robotics training data. Готовить будут робаты.

С LLM кожаные обнаружили, что интернет уже содержит гигантскую часть текстового человеческого опыта. Для робатов такой халявы нет: интернетик почти не содержит нужные триллионы хорошо снятых примеров того, как человеческие руки (или другие ловкие члены) физически выполняют свою работу.

Поэтому сейчас возникает новая индустриальная революция:
Кожаных буквально превращают в сенсоры (станки) для создания «болванок физических действий».
Болванки идут производство робатов.
Все (ИИ и робаты) - довольны.

https://techcrunch.com/2026/05/26/human-archive-taps-into-indias-services-startups-to-collect-data-for-physical-ai/

Сентябрь 2026

@cgevent
😱45🔥225👍4👎4😁1
Астра и Дипсик

Тут вот чувак протестил риггинг и анимацию в Блендоре через MCP.

Суть не в том, что Астра чуть получше, а в том, что у Дипсика запас токенов типа "неограниченный". Чувак пишет про в 330 раз больше, что, конечно, преувеличение, но смысл в том, что они у него в принципе не заканчиваются.

На итоге:
V4.1 Flash настолько дешёв, что появляется новая стратегия - чуть слабее модель, но гораздо больше итераций, проверок и субагентов для решения "черновых" задач.

@cgevent
This media is not supported in your browser
VIEW IN TELEGRAM
🔥62👍198😁4
Т-Технологии выложили подробный туториал по Perseus — опенсорсному фреймворку для обучения моделей персонализации на основе истории пользовательских событий.

Взяли малую версию датасета T‑ECD и на ней прогнали четыре сценария:

кандидатогенерация - прогноз кликов пользователя по товарам на следующий день;
ранжирование - сортировка товаров по релевантности;
классификация - прогноз того, совершит ли пользователь хотя бы одно активное действие в течение следующих семи дней;
регрессия - прогноз суммарной стоимости товаров, с которыми пользователь положительно провзаимодействует в следующем месяце.

В статье рассказали, как в каждом сценарии готовили данные, считали бейзлайн, обучали модель, запускали инференс и сравнивали метрики. Perseus во всех четырех экспериментах обошел базовые решения, хотя с разным отрывом.

А главное, чтобы добавить новые признаки или подключить события из другого домена, не нужно пересобирать все с нуля — достаточно изменить несколько строк в YAML-конфиге.

Если работаете с рекомендательными системами и мультидоменными данными – стоит почитать. Туториал лежит на Хабре, а сам код уже на GitHub.

https://habr.com/ru/companies/tbank/articles/1081276/

https://github.com/perseus2026/perseus/blob/main/tutorial.ipynb

@cgevent
👍3729🔥20👎11
This media is not supported in your browser
VIEW IN TELEGRAM
В комментариях к посту про разметку кожаных движений спросили, а есть обучение робатов древнейшей профессии?

О да.

@cgevent
😁66😱13🔥6👎4🙏2
ИИ-шоу, которое мы заслужили

С интересом наблюдаю за ИИ-льной оперой, где Амодейчик возопил "Нам надо притормозить!". Ольтман - "Да, согласен". Муск - Дарио дело говорит. Демис Карибидис - надо созвать совещание по этому вопросу.

И тут старина Дональд: да вы охерели, зумеры, а кто будет Китай нахлобучивать!!

У меня есть циничная аналогия: даже если ИИ так опасен (предположим, что да), то сидит такой крупный поставщик вооружений и говорит "надо притормозить, оружие ведь может убить". Конкурирующий поставщик оружия: "Да, надо снизить темпы и разработку новых видов". Третий - вы правы!

Представили?

Я - нет.

Есть рефлексия, а есть государственные интересы. Которые, скажем так, в приоритете.

Пока от ИИ разом не погибнет значимое количество кожаных, никто ничего тормозить не будет.

Простите за цинизм.

Для тех, кто в танке, ниже хронология шоу.

- 9 сентября внутри Антропика подгорело. Исследователь Джейкоб Коксон ушёл из компании и заявил, что OpenAI и Anthropic «мчатся прямо к самоулучшающемуся суперинтеллекту». Его публично поддержали ещё два действующих исследователя Anthropic - глава alignment science Эван Хубингер и руководитель scalable oversight Сэмюэл Маркс.

- 12 сентября вышел Дарио Амодеи с эссе *We Must Pace the Frontier*. План из трёх ступеней: постоянные независимые аудиторы прямо внутри frontier-лабораторий; координация между компаниями демократических стран; затем попытка договориться глобально, прежде всего с Китаем.

- И тут неожиданно образовался ИИ-бойз-бэнд. Илон Маск: «Dario is right». Сэм Альтман: «I agree with Dario that we need to pace the frontier» - причём OpenAI пообещала последовать конкретному предложению Амодеи и дать независимым оценщикам доступ уровня сотрудников. А вечером присоединился Демис Хассабис из Google DeepMind: направление правильное, детали надо дорабатывать. Сатья Наделла (Микрософт) сегодня тоже заговорил о том, что суперинтеллект имеет смысл только под человеческим контролем

- Однако есть нон-конформисты: CEO Cohere Айдан Гомес практически назвал предложение попыткой создать «картель»: мол, взрослые мальчики хотят получить механизм, при котором кто-то сможет решать, кто достаточно безопасен, а кто нет.

- И тут выходит Трамп. В воскресенье в Ирландии его спрашивают, надо ли замедлить AI. Ответ: США впереди Китая, «whoever wins AI wins». А сегодня он бахнул, что единственный необходимый AI-«guardrail» - это «STRONG AND SMART (High IQ!) PRESIDENT», а разговоры против AI и дата-центров назвал «SICK conspiracy», выгодным Китаю. Амодеи отдельно досталось: Трамп обозвал его человеком, который теперь притворяется «perfect little angel».

Китайская государственная Global Times тем временем посмотрела на план Амодеи и объявила его .. ээ .. «Cold War playbook» против Китая. То есть Вашингтон считает замедление подарком Китаю, а Пекин считает предложение о замедлении американским заговором против Китая.

И тут рыночек, который решает: «CEO крупнейших AI-компаний говорят притормозить?» - Nvidia сегодня падала примерно на 3%, индекс полупроводников почти на 5%.

На сегодня все, ждем продолжения.

@cgevent
31😁22👍6🔥5👎2
Media is too big
VIEW IN TELEGRAM
#Нейропрожарка

МҰРАГЕР / THE HEIR / НАСЛЕДНИК

Автор Jinazis

Инструменты:
-Seedance 2.0
-GPT image
-CapCut
-Suno 6

По желанию поддержать автора в X репост+коммент желательно на ENG: https://x.com/Jinaz1s/status/2099213532860502382?s=20

В общем, между основной работой и другими делами решил просто по фану поучаствовать в конкурсе от Higgsfield. По ночам, когда было свободное время, садился на пару часов и неспешно делал. Ушло где-то неделю-полторы.

Не торопился, скорее отвлекался от основных проектов и тестил новые фишки в Seedance. Такая разгрузка головы)

Пайплайн супер изи: персы, ассеты и локации в GPT Image, само видео в Seedance 2.0, 1080p. Уложился в одну месячную подписку Higgsfield. До этого у них не был зареган, взял Ultra на 9000 токенов, плюс первую неделю Seedance был безлимитный. В итоге всё вышло в 270 баксов.

Музло сделал буквально за день, как только вышел Сунарь 6. Озвучка тоже родная, из Seedance. Цветкор вообще просто капкатовский фильтр, но, как по мне, подошёл идеально)

На призовые особо не рассчитываю. Можно было сделать лучше, но полной сосредоточенности на проекте не было. Больше делал в удовольствие, чтобы переключаться между основными задачами.

Сеттинг, кстати, выбран не случайно. Ситуативный маркетинг)

В общем, приятного просмотра!


В качестве тут: https://youtu.be/onM4nuF0nSg?si=QqNt8pKD2bPf6Ypx

@cgevent
3👍55👎17🔥1211
This media is not supported in your browser
VIEW IN TELEGRAM
Эппле бахнула Siri AI и новое поколение Apple Intelligence

Стартанул публичный rollout Siri AI вместе с iOS 27, iPadOS 27, macOS 27, watchOS 27 и visionOS 27. Пока Siri AI выходит в beta и только на английском, ещё пять языков обещаны в следующем месяце. 

Это не просто обновлённый голосовой Siri. Теперь Сирийская получает personal context из сообщений, почты и фотографий, понимает содержимое экрана, ведёт нормальный многоходовый диалог, ищет актуальную информацию в интернете и, что особенно важно, сама выполняет действия между приложениями. Например, может найти информацию в переписке и письме, после чего добавить нужные данные в Reminders или Calendar. 

Где-то мы это уже видели, но лучше поздно, чем никогда.

Под капотом работает семейство Apple Foundation Models 3. Оно включает 3B dense on-device AFM 3 Core, 20B sparse AFM 3 Core Advanced с активацией всего 1-4B параметров, серверные AFM 3 Cloud и AFM 3 Cloud Pro, а также отдельную image-модель ADM 3 Cloud.

Модели создавались Apple совместно с Google и Gemini. 

Дальше интереснее - полноценное обновление генерации изображений. Image Playground теперь умеет photorealistic generation и instruction-based editing, а Photos получила generative Extend, улучшенный Clean Up и Spatial Reframing. Генерация работает через ADM 3 Cloud в Private Cloud Compute. 

Для нищебродов: самый мощный локальный AFM 3 Core Advanced доступен только на части новых устройств, включая iPhone Duo, iPhone 18 Pro/Pro Max, iPhone Air, iPhone 17 Pro/Pro Max, iPad M4+ и Mac M3+ с минимум 12 GB unified memory. 

Кредиты и лимиты. Серверные функции Siri AI, Image Playground, intelligent photo editing и AFM 3 Cloud имеют дневные лимиты. Конкретные числа Apple не публикует - лимит динамический. Эппле говорит, что в будущем(когда?) за расширенный доступ можно будет доплачивать. 

Сегрегация: Siri AI  недоступна в ЕС на iPhone, iPad и Apple Watch. В Китае новое Apple Intelligence пока вообще не запускается. 

Сорс:

Официальный анонс Apple от 14 сентября:

https://www.apple.com/newsroom/2026/09/siri-ai-a-profoundly-more-capable-and-personal-assistant-is-here/

Техническое описание Apple Foundation Models 3:

https://machinelearning.apple.com/research/introducing-third-generation-of-apple-foundation-models

@cgevent
😁18👍96👎5
Комфи Копайлот

ComfyUI_Assistant добавляет прямо в интерфейс ComfyUI AI-ассистента, который понимает текущий workflow и может его менять сам.

Он умеет читать граф и установленные ноды, добавлять/удалять ноды, соединять их, менять параметры и промпты, переставлять ноды и затем проверять, не осталось ли незаполненных обязательных входов. Все изменения попадают в обычную историю Undo ComfyUI.

Может пояснить за определенные ноды и соединения - что происходит в этой области.

Плюс он видит входные и сгенерированные картинки, поэтому можно сказать примерно: «посмотри на результат и поправь prompt».

Есть локальная база документации по установленным custom nodes и официальной документации ComfyUI, память о ваших исправлениях и отдельный чат для каждого workflow.

Ещё он может искать custom nodes в интернете и, после подтверждения, сам установить нужный пакет через git/pip.

Работает с LM Studio, Ollama, OpenAI-compatible API и Anthropic, но автор на данный момент полноценно протестировал только LM Studio.

Умеет в веб-поиск, но через апи-провайдеров.

Важно, что никто не пишет, что это небесплатно.

Точнее это бесплатно для и спользования с LM Studio локально + Tavily free (куцые лимиты на веб-поиск)

В остальных случаях придется вонзать за вызовы провайдеров моделей.

https://github.com/BobbtheBuilder/ComfyUI_Assistant

@cgevent
🔥309👍4😁2👎1
Ситуация с уравнением Навье Стокса
😁19410👍4🔥2👎1
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1410🔥6👎1
This media is not supported in your browser
VIEW IN TELEGRAM
Вот что я имел в виду про Snap Camera на стероидах в предыдущем посте.

Если это работает в реальном времени, то это круто.

Но.

Это все на серверах Виду, а камера шарашила на слабых ноутах.

Ну и вопрос цены открыт. Хотя, повторюсь, для целей бродкаста - любая цена - ничто.

@cgevent
12😱5🔥2👎1
Media is too big
VIEW IN TELEGRAM
Подписчик пишет:

Зацени какая херовина вышла))
Поделюсь, экспериментом. По техстеку там собственный харнесс который правильно заставляет модель рассматривать задачу в цикле нанимая команду некожаных специалистов, и несколько моделей для текстур и изображений в целом.
Но в основном это Астра.

Ниже можно глянуть:
https://content.loremax.ai/Demos/istanbul-suleymaniye-20260911/v2/delivery/v2.html

Задача  - воспроизвести рандомный объект наследия юнеско, на тему ближнего востока, в низком полигонаже (Но можно и выше, зависит от требований). Сцена, лвл дизайн, свет, рендер и тд всё тоже сделано иишкой=)
Всё что тут сделано заняло 13 часов чистого времени.

Я такой: эташ скоко это стоило?

- один недельный лимит Codex

Я такой: расписывай!

Читаем, кто в теме:

🏛 Сулеймание — игровой квартал Стамбула

Проект выполнен примерно за 3 дня на удалённых машинах, по этому это выглядело как выкрики в чат "Сделай хорошо".
Вся работа сделана с помощью ЛЛМ харнесса, в ручную ничего не правилось и не генерилось. Максмум это QA с скриншотами где что поправить.
Активное время работы ЛЛМ — около 13 часов.

🎯 Цель

Собрать небольшой игровой квартал Стамбула с узкими улицами, площадью, мечетью Сулеймание и доступным интерьером молитвенного зала, и в низком полигонаже.

Что сделано

• Собран городской квартал и площадь
• Доработаны фасад мечети и входная зона
• Создан интерьер молитвенного зала
• Добавлены своды, купола, михраб, минбар, ковры, окна и люстры
• Исправлены пересечения мешей, щели, зависшие фонари и проблемы с объектами
• Настроены утреннее, вечернее и ночное освещение
• Добавлены Lumen, облака, туман и воздушная перспектива
• Настроены материалы камня, дерева, стекла и металла
• Добавлен персонаж с режимами от первого и третьего лица
• Сделана пробежка по улице, площади, двору и интерьеру мечети

🎨 Референсы и изображения

Все концепты, референсные изображения и изображения текстур подготовлены через B2B-платформу Loremax.

• Изображения — GPT Image 2.5
• Текстуры — специализированная обученная модель под архитектурные материалы и PBR
• Исторические фотографии использовались для сверки фасадов и интерьера

🧰 Технический стек

Unreal Engine 5.8.2, Blender, GLB, PBR, UV/lightmap UV, Lumen, виртуальные карты теней, объёмные облака, туман, Sequencer, FFmpeg и Windows Packaging.

Весь harness работы — доработка дворца, интерьера, материалов, света, level design, персонажа, камер и QC — выполнялся через Bridex (https://bridex.app/).

Bridex позволяет оркестрировать агентов с помощью агентских команд и распределять задачи между ними.

🎥 Видео

• Главный ролик (https://content.loremax.ai/Demos/istanbul-suleymaniye-20260911/v2/delivery/unreal/night-concept-v3-20260914/Videos/Istanbul_Night_Concept_GrandTour.mp4)

• Видео работы Bridex: (https://content.loremax.ai/Demos/istanbul-suleymaniye-20260911/v2/delivery/media/Bridex.mp4)
Базовая модель - GPT Astra + GLM + KIMI иногда для более простых задач.

🎮 Unreal-сборка для Windows

Скачать ZIP-сборку (https://content.loremax.ai/Demos/istanbul-suleymaniye-20260911/v2/delivery/unreal/gallery-refresh-20260915/IstanbulSuleymaniye-Windows.zip)

📐 Полигонаж

• Средний размер основного GLB-ассета — около 20 292 треугольников
• Внешняя модель мечети — 88 971 треугольник
• Интерьер молитвенного зала — 263 850 экспортированных треугольников
• Мобильный квартал V7 — 164 771 треугольник

Часть геометрии упрощена для мобильной оптимизации. Unreal-версия используется как демонстрационная игровая сцена.

Оценка расходов:

- ЛЛМ: ≈ $1000 (Недельный лимит GPT)
- Изображения, музыка, текстуры: €30;

@cgevent
👍34👎19🔥73
Media is too big
VIEW IN TELEGRAM
Сегодня прям марафон крутые подписчики

Мигель тут пишет и вопрошает, люблю ли я Кэролла.

И бахает вот такой вот видос:
https://www.youtube.com/watch?v=QLfT7cUI6ew

Я такой: падробности!

Мигель:
- скрипт прислали 11 сентябя. Все производство сделали за выходные (что?)
- весь продакшен полностью чистый от копирайта. все сделанно из текста. буквально. в качестве рефов использовались ТОЛЬКО оригинальные иллюстрации сэра Джона Тенниела.
- половина шотов в финальном монтаже - это первая попытка в генерации.

Жду от Мигеля мейкингофа.

Кстати:
как вы качаете видосы с ютюба?
Я вот так:

- chatGPT Work, скачай видос, проверим - https://www.youtube.com/watch?v=QLfT7cUI6ew

- Апажалста!

- Как?!?!

- Сначала открыл ссылку и проверил видео. Затем:
Скачал временный yt-dlp.
Через него загрузил видеопоток и аудиопоток YouTube.
Объединил их в один MP4.
Сохранил файл в outputs.
Итоговый файл: [Al!CE [QLfT7cUI6ew\].mp4]
Скачать сразу одним потоком можно, например, в режиме best[acodec!=none], но качество или разрешение могут оказаться ниже.

Я: - спасибо, дорогой

@cgevent
🔥84👍1815👎7
Media is too big
VIEW IN TELEGRAM
И опять круты Астроподписчики.

Мой приятель Дима Киселев скромно так пишет:

Привет! Я ни разу не из геймдева, просто решил проверить новую модель и вот что получилось. Скажу, что многие серьезные проекты в которые я играл были сделаны хуже чем то, что сделала Астра за выходные без участия человека. В интересное время живем.

Я такой: она сама? за сколько?

Дима: сама, 30 часов непрерывной работы!

Я такой: этошскокостоит?

Дима: 35% токенов от плана за 200$.

Я: шо?

Дима: Дал доступ к блендору, комфи и трипо. Годот скачала сама. Результат на видео.

Кстати, обложку для видео астра сама тоже предложила. Клод отказался генерить, сказал что это аффилированные действия и вообще зашквар

Я: Дима, а результат в виде файлов - что из себя представляет? Это чорный ящик или там есть какие-то редактируемые файлы-ассеты?

Дима: Полноценный набор с ассетами и кучей файлов. Там есть папка Fleet где вся флотилия ассетов. Завтра на гитхаб могу выложить, я так понимаю что он все сам под движок Godot сделал

Ну и результат:
https://github.com/Deekey1/ASTER-Motorsport

Поглядите видос: как колеса отрабатывают!
https://youtu.be/Mk6-F1amHgE

И тут блохоловы такие: он столбики сбивает!

Ребятки, а сколько по времени делались игры такой категории обычно? С каким бюджетом?

Еще раз: 30 часов автономной работы. И все.

Игроделы, на завод!

@cgevent
🔥83👎11😱93😁3🙏2👍1
Media is too big
VIEW IN TELEGRAM
Рубрика крутые поканеподписчики

Лучанский сбросил в коментах вот такую работу. Это русская озвучка работы того же автора, Степана Романенко.

Разыскал его канал в телеге через фб.

Канал невыносимо хорош тем, что там не новости, а прям реальное производство контента и огромный опыт VFX

Особенно мне зашел кружок про то, что Астра в реальном времени делает цветокор на музыкальный клип.

За монтаж и цветокор - следующие два поста.

И нет, это не реклама, взаимопиар и что там вы еще влажно напридумывали.

Это просто крутой чувак.

Иногда чувак - это просто чувак

@cgevent
🔥33👎15👍53
Media is too big
VIEW IN TELEGRAM
Ну, за монтажеров!

Я видел ну очень много стартапов для ИИ-автоматизации монтажа.
Все сдохли. Задача сложная.
Те, кто не сдохли, сдохнут сейчас.

Ибо.

OpenAI тут рассказала, что внутри компании **GPT-6 Astra вместе с Codex уже использовали для монтажа трёх часов мультикамерного видео - на итоге получился ролик в шапке.

И это хорошо показывает, куда они двигают Astra. Не просто «посмотреть видео и рассказать, что там происходит», а работать с обычными профессиональными инструментами через computer use: открывать приложения, находить нужные фрагменты, выполнять действия и доводить длинную задачу до результата.

*Модель должна уметь сама работать за компьютером в существующем софте, даже если для него нет специального API
.

Там еще пара кейсов по ссылке:

Excel-кейс: OpenAI заявляет, что Astra через computer use выполняет задания Financial Modeling World Cup примерно в четыре раза быстрее кожаного победителя в Ексель чемпионате 2023..
Ещё один внутренний кейс - модель нашла bottleneck с memory allocation в тестовой среде Codex; после смены allocator они получили заявленные в 25 раз ниже turn latency, хотя peak memory вырос примерно на 30%

OpenAI при этом предлагает смотреть не столько на цену токена, сколько на стоимость законченной задачи. По их данным, Astra требует меньше шагов и повторных попыток, поэтому в ряде сценариев оказывается дешевле предыдущих моделей.

А мой пойнт в том, что модели общего назначения на стероидах MCP и Computer Use догоняют специализированные модели, генераторы, пайплайны. И будут еще умнее. И 3Д-генераторы, например, могут помереть.
Равно как и стартапы по ИИ-монтажу.

https://openai.com/index/gpt-6-astra-next-generation-work/

@cgevent
👍16👎127😁2
This media is not supported in your browser
VIEW IN TELEGRAM
Ну, за монтажеров - 2

Чувак дал GPT-6 Astra доступ к DaVinci Resolve и набору из 84 исходных клипов.

Дальше Астроагент действует примерно так:

- агент обнаруживает, что таймлайн пуст, и начинает заново собирать длинную версию из исходников;
- находит в папке с музыкой композицию The Last Duel;
- добавляет реакции персонажей, rooftop-сцену, aerial attack и меняет длительности монтажных кусков;
- доводит монтаж примерно до 2:02;
- кладёт музыку на отдельную дорожку A2, уменьшает громкость и делает fade-in/fade-out;
- добавляет отдельный reaction cutaway на V2;
- запускает в Resolve Create Subtitles from Audio;
- Resolve генерирует 15 японских сегментов субтитров;
- агент сохраняет итоговый таймлайн.

Причём интерфейс прямо показывает вызовы Com.blackmagic Design.davinciresolve integration и выполнение команд. То есть это не обычный Computer Use.

Ибо.

8 сентября Blackmagic выпустила DaVinci Resolve 21.1, и это действительно официальный релиз с интеграцией AI-агентов. Blackmagic прямо пишет, что Resolve Studio теперь может работать с Claude, Claude Code и ChatGPT Codex, которым разрешено анализировать проекты, организовывать медиа, менять настройки, делать highlight edits и запускать рендер по обычным текстовым командам.

Ключевая новинка - native MCP server в DaVinci Resolve Studio 21.1. MCP здесь является прослойкой:

GPT/Claude -> MCP -> API DaVinci Resolve -> реальный проект

С титрами прикольно.

агент сам дошёл до этой функции и запустил её как часть многошагового процесса. На скриншоте он сообщает, что Resolve создал 15 японских subtitle segments.

Сам speech-to-text выполняет Resolve, кстати.

@cgevent
👍399🔥8
Media is too big
VIEW IN TELEGRAM
V - Мультимодальность (см ниже)
🔥5👍2