Media is too big
VIEW IN TELEGRAM
Пока все отвлекались на АстроБлендор, Трипо порешала за топологию и поликаунт.
Не идеально, но уже далеко не месиво.
Есть также много видосов, гле Астрачка вызывает 3Д-генераторы и создает целые миры, но вопрос с топологией и текстурами остается.
Мне нравится прогресс, пойду поищу за AIUV.
@cgevent
Не идеально, но уже далеко не месиво.
Есть также много видосов, гле Астрачка вызывает 3Д-генераторы и создает целые миры, но вопрос с топологией и текстурами остается.
Мне нравится прогресс, пойду поищу за AIUV.
@cgevent
👍21❤3👎1🔥1
Tripo + Astra + Blender + GPT Images 2.5.
Трипо точно продвинулся в топологии. Каши больше нет.
За аниматоров и риггеров ведь уже не чокались? Тут Астрачка рулит.
@cgevent
Трипо точно продвинулся в топологии. Каши больше нет.
За аниматоров и риггеров ведь уже не чокались? Тут Астрачка рулит.
@cgevent
🔥14👎3
Media is too big
VIEW IN TELEGRAM
За левелдизайнеров?
Вот то самое видео.
Тут Astra использует HYPER3D (Rodin\DeemosTech) через их MCP для генерации 3D-объектов и размещения их (в очень большом количестве) в сцене.
Финальный рендер хоть в Блендоре, хоть в Нейрорендере.
@cgevent
Вот то самое видео.
Тут Astra использует HYPER3D (Rodin\DeemosTech) через их MCP для генерации 3D-объектов и размещения их (в очень большом количестве) в сцене.
Финальный рендер хоть в Блендоре, хоть в Нейрорендере.
@cgevent
👍30👎14🔥9❤4
По UV есть прогресс, благодаря Астрачке
Для желтого пижона пайплайн такой:
Tripo×BlenderMCP×Astra UV Unwrapping
Промпт:
А для кобылы - это генерация в HI3D - оттуда вылезает месиво в плане текстурных координат(слева вверху), но Астра его растаскивает. Поглядите тут для других примеров.
@cgevent
Для желтого пижона пайплайн такой:
Tripo×BlenderMCP×Astra UV Unwrapping
Промпт:
In Blender MCP, perform UV unwrapping on the selected "headless model including clothes and limbs," and re-bake the existing textures to 4K.
The goal is to preserve the original appearance, create UVs that make the structure readable like clothing patterns, and make it easy to redraw later. Just like a human artist, proceed in the order of observation → seam design → unwrap by parts → distortion correction → placement → bake.
1. Preserve the original data
Before starting work, save as a new file to keep the old UVs, images, and materials, and create a new UV called "UV_Final."
Do not change the shape, topology, vertex order, weights, shape keys, or rig.
2. Observe the model and design seams
Check each direction with original texture display and wireframe display to understand the clothing parts composition and actual seams.
For clothes, follow the pattern composition of body, sleeves, collar, etc., and cut open using side lines or inner sleeve areas. For skin and limbs, place seams in less noticeable positions like insides or sides, and design so that even between fingers can be opened without strain.
Do not mistake wrinkles or prints for seams, and avoid creating unnecessary fragmented islands.
3. Unwrap by parts and correct distortions
Do not process the whole at once; unwrap by parts.
Use a text-included checker referencing UV_Final and Stretch display to check for stretching, compression, twisting, flipping, and overlapping.
Add or remove seams depending on the cause of issues, adjust with Pin or Relax, and recheck. Do not just repeat the same auto-unwrap; keep the improved parts.
Do not use Smart UV Project's overall auto-subdivision as the final product.
4. Adjust fabric grain, density, and layout
For clothes, align the basic vertical direction to the UV's V direction based on each part's fabric grain. Do not forcibly deform curved patterns into rectangles.
Even out texel density relative to real size, and adjust orientation so left-right correspondence is clear.
Then, pack into the 0–1 area while maintaining orientation and relative scale. Overlapping left-right or arbitrary rotation is prohibited.
Use 4K bake margins of 16px, 32px+ between islands, and 16px+ on image edges as initial standards.
5. 4K bake from old UV to new UV
Explicitly fix the original texture reference to the old UV, use UV_Final as the bake target, and transfer to a new 4096×4096 image.
For each material, activate the bake target image node, do a test bake, then the main bake.
For base color, use only Diffuse's Color, or Emit, and do not bake in new lighting, shadows, or AO. Preserve the shading drawn on the original image.
Transfer existing maps like transparency as needed, and for tangent normals, re-bake based on new UV standards, not just color transfer.
6. Confirm completion with new-old comparison
Apply the new UV and baked image, and compare the whole body and details under the same display conditions as the original.
Check pattern positions, colors, transparency, and seam continuity, and fix UV collapses, overlaps, unwrapping omissions, bake black spots, misses, or bleeding.
Judge completion based on inspection results, not "how many times unwrapped."
Save the completed .blend, 4K images, UV layout, and confirmation images of seams, checker, and final appearance, and briefly report main correction contents.
Do not end with just the plan explanation; complete the work while confirming actual images.
А для кобылы - это генерация в HI3D - оттуда вылезает месиво в плане текстурных координат(слева вверху), но Астра его растаскивает. Поглядите тут для других примеров.
@cgevent
👍20👎5❤2
This media is not supported in your browser
VIEW IN TELEGRAM
Вайб-инжиниринг.
Пока мы тут генерим чахлые 3Д-модельки, пригодные разве что для 3Д-печати, люди идут сильно дальше в физический мир.
И тут прекрасно все: мозги Астры, деньги кожаного, и инструкция по сборке.
Чувак дал Astra свою кредитную карту и попросил сконструировать\собрать мини-контроллер для диджеев в стиле Teenage Engineering (есть каста упоротых по МИДИ-контроллерам). Астрачка сгенерировала концептуальное изображение, нашла комплектующие, изучила китайские технические характеристики, создала CAD-модель, всё заказала, а затем сделала анимацию в Blender, показывающую, как его собрать.
Чувак обещает вот-вот показать результат, пока у него Астра с поставщиками переписывается.
С софтом мы разобрались. Я уже не ищу приложения, я прошу их мне быстро написать (раскурочил Андроид знатно).
Но тут уже выход в хардвер, не софтвер.
Причем не "как мне пачинить кран", а придумай, сконструируй, закупи и доставь. Потом будет домашний робат для сборки таких посылок.
Но пока меня просто ошарашивает скорость изменений, мышление просто не поспевает за ними - а что так можно было??
И даже если контроллер не заведется завтра, он точно заведется послезавтра.
И теперь наигравшись с "хачу видео" и "хачу утилиту", можно переходить к "хачу вот такую железяку в подарок, чтобы делала что мне надо".
Апажалста.
@cgevent
Пока мы тут генерим чахлые 3Д-модельки, пригодные разве что для 3Д-печати, люди идут сильно дальше в физический мир.
И тут прекрасно все: мозги Астры, деньги кожаного, и инструкция по сборке.
Чувак дал Astra свою кредитную карту и попросил сконструировать\собрать мини-контроллер для диджеев в стиле Teenage Engineering (есть каста упоротых по МИДИ-контроллерам). Астрачка сгенерировала концептуальное изображение, нашла комплектующие, изучила китайские технические характеристики, создала CAD-модель, всё заказала, а затем сделала анимацию в Blender, показывающую, как его собрать.
Чувак обещает вот-вот показать результат, пока у него Астра с поставщиками переписывается.
С софтом мы разобрались. Я уже не ищу приложения, я прошу их мне быстро написать (раскурочил Андроид знатно).
Но тут уже выход в хардвер, не софтвер.
Причем не "как мне пачинить кран", а придумай, сконструируй, закупи и доставь. Потом будет домашний робат для сборки таких посылок.
Но пока меня просто ошарашивает скорость изменений, мышление просто не поспевает за ними - а что так можно было??
И даже если контроллер не заведется завтра, он точно заведется послезавтра.
И теперь наигравшись с "хачу видео" и "хачу утилиту", можно переходить к "хачу вот такую железяку в подарок, чтобы делала что мне надо".
Апажалста.
@cgevent
❤71🔥34👍12👎3😱3
Media is too big
VIEW IN TELEGRAM
#Нейропрожарка
Название: Что если бы Томми Шелби сыграл Джейсон Стэтхем
Авторы:
Иван Спиридонов
Дмитрий Иванов
Идея
Реализовали экспериментальный эдит по «Острым козырькам»: заменили Киллиана Мёрфи на Джейсона Стэтхема.
Суть в том, что сначала Стэтхема хотели взять на роль Мерфи и мы решили посмотреть как бы он выглядел в ней. Взяли популярные сцены разной сложности. Для выполнения разработали собственный воркфлоу на Wan Animate и протестировали Minimax H3.
Версия в хорошем качестве
Производство
1. Монтаж и отбор
Смонтировали сцены из сериала — короткие, динамичные, с блюром и тёмным светом. Осознанно взяли несколько заведомо очень сложных шотов.
Спойлер: если бы не своевременный выход Minimax H3, мы бы их удалили
2. Референсы
Можно просто закинуть фото Стэтхема, так проще. Но лучше делать замену прямо на референсном кадре из сцены — тогда animate понимает, как персонаж должен выглядеть в этом свете и гриме. С этим справился только GPT Image 2. Для боковых ракурсов собирали character sheet с разными углами головы и эмоциями (для Minimax)
3. Базовый пайплайн — Wan 2.2 Animate V1 (локально, ComfyUI)
— Маска: в основном автоматом через SAM3; кадры посложнее размечали в Premiere, самые жёсткие — ротоскоп в After Effects.
— Кроп кадра по маске, чтобы отдать генерации максимальное разрешение.
— Препроцессоры анализируют позу и мимику. Иногда отдельно записывали себя на видео и переносили эмоции со своего лица — с оригинала мимика часто читается плохо.
— Генерация и анкроп обратно в исходное видео.
— Опционально — цветокор лица под кадр.
Нюансы
4. Где Wan Animate не вывозит
— Перекрытия лица: нет контекста, объекты перед лицом ломают генерацию.
— Микродвижения лица теряются, а именно они дают естественность.
— Иногда уплывает схожесть - лечится генерацией конкретных ключевых рефов.
— Динамика с моушн-блюром и плохим светом: неверно определяются движения и состояние глаз.
— Изменения на лице (кровь, брызги) не анимируются вообще. Текстовый энкодер староват, модель под такое не обучена. FLF-кадры не помогли.
Из-за этого пришлось бы выбросить несколько сцен.
5. Minimax H3 (локальная версия)
Прогнали проблемные шоты через него - и они перестали быть проблемными.
— Кровь. Точно перенёс кровь с исходного видео на заменённое лицо. Референсы: лицо + свап одного из первых кадров для контроля эстетики.
— Динамичная сцена в баре. Нужно было объяснить модели, кого именно свапать из толпы. Сделали маску ротоскопом в AE и подали на вход: исходное видео с белой маской на лице + кроп лица (чтобы модель видела поворот и эмоции) + реф лица.
— Мимика. Движения губ и глаз читаются заметно лучше на многих шотах, Wan Animate это просто не считывал.
— Углы головы. Как omni-модель ест character sheet целиком. На одном рефе глаза оставались «от Киллиана Мёрфи», на character sheet — уже нет.
— Цензуры на суицидальные и жестокие сцены, оружие и авторские права нет.
6. Сравнение с сервисами
Kling 3.0 Omni Edit: в сцене с выстрелом ловим NSFW; в сцене с кровью из носа результат чище, но сама кровь выглядит крипово.
Ни один другой сервис эти шоты бы не пропустил — пистолеты, актёры, жестокость, кровь.
7. Минусы Minimax H3
— Шаг в 17 кадров против 4 у Wan. Собрали небольшой блюпринт в ComfyUI, который дописывает кадры в конец, чтобы выход точно совпадал с исходником по таймингам, — иначе модель догенерирует и растянет контент.
— Нет маскинга. С маскингом нередактируемая часть видео не меняется по качеству и цвету, нет сдвигов по таймингам и объектам, плюс открывается композитинг. Очень ждём нативную поддержку у omni-моделей.
— Отсюда же общее ухудшение качества всего кадра даже на прогоне в 1080p.
Время выполнения: 2 недели
Затраты: 0р. Все выполнялось локально в нашем случае.
Железо: 5070ti/4080 16gb + 64gb озу
@cgevent
Название: Что если бы Томми Шелби сыграл Джейсон Стэтхем
Авторы:
Иван Спиридонов
Дмитрий Иванов
Идея
Реализовали экспериментальный эдит по «Острым козырькам»: заменили Киллиана Мёрфи на Джейсона Стэтхема.
Суть в том, что сначала Стэтхема хотели взять на роль Мерфи и мы решили посмотреть как бы он выглядел в ней. Взяли популярные сцены разной сложности. Для выполнения разработали собственный воркфлоу на Wan Animate и протестировали Minimax H3.
Версия в хорошем качестве
Производство
1. Монтаж и отбор
Смонтировали сцены из сериала — короткие, динамичные, с блюром и тёмным светом. Осознанно взяли несколько заведомо очень сложных шотов.
Спойлер: если бы не своевременный выход Minimax H3, мы бы их удалили
2. Референсы
Можно просто закинуть фото Стэтхема, так проще. Но лучше делать замену прямо на референсном кадре из сцены — тогда animate понимает, как персонаж должен выглядеть в этом свете и гриме. С этим справился только GPT Image 2. Для боковых ракурсов собирали character sheet с разными углами головы и эмоциями (для Minimax)
3. Базовый пайплайн — Wan 2.2 Animate V1 (локально, ComfyUI)
— Маска: в основном автоматом через SAM3; кадры посложнее размечали в Premiere, самые жёсткие — ротоскоп в After Effects.
— Кроп кадра по маске, чтобы отдать генерации максимальное разрешение.
— Препроцессоры анализируют позу и мимику. Иногда отдельно записывали себя на видео и переносили эмоции со своего лица — с оригинала мимика часто читается плохо.
— Генерация и анкроп обратно в исходное видео.
— Опционально — цветокор лица под кадр.
Нюансы
4. Где Wan Animate не вывозит
— Перекрытия лица: нет контекста, объекты перед лицом ломают генерацию.
— Микродвижения лица теряются, а именно они дают естественность.
— Иногда уплывает схожесть - лечится генерацией конкретных ключевых рефов.
— Динамика с моушн-блюром и плохим светом: неверно определяются движения и состояние глаз.
— Изменения на лице (кровь, брызги) не анимируются вообще. Текстовый энкодер староват, модель под такое не обучена. FLF-кадры не помогли.
Из-за этого пришлось бы выбросить несколько сцен.
5. Minimax H3 (локальная версия)
Прогнали проблемные шоты через него - и они перестали быть проблемными.
— Кровь. Точно перенёс кровь с исходного видео на заменённое лицо. Референсы: лицо + свап одного из первых кадров для контроля эстетики.
— Динамичная сцена в баре. Нужно было объяснить модели, кого именно свапать из толпы. Сделали маску ротоскопом в AE и подали на вход: исходное видео с белой маской на лице + кроп лица (чтобы модель видела поворот и эмоции) + реф лица.
— Мимика. Движения губ и глаз читаются заметно лучше на многих шотах, Wan Animate это просто не считывал.
— Углы головы. Как omni-модель ест character sheet целиком. На одном рефе глаза оставались «от Киллиана Мёрфи», на character sheet — уже нет.
— Цензуры на суицидальные и жестокие сцены, оружие и авторские права нет.
6. Сравнение с сервисами
Kling 3.0 Omni Edit: в сцене с выстрелом ловим NSFW; в сцене с кровью из носа результат чище, но сама кровь выглядит крипово.
Ни один другой сервис эти шоты бы не пропустил — пистолеты, актёры, жестокость, кровь.
7. Минусы Minimax H3
— Шаг в 17 кадров против 4 у Wan. Собрали небольшой блюпринт в ComfyUI, который дописывает кадры в конец, чтобы выход точно совпадал с исходником по таймингам, — иначе модель догенерирует и растянет контент.
— Нет маскинга. С маскингом нередактируемая часть видео не меняется по качеству и цвету, нет сдвигов по таймингам и объектам, плюс открывается композитинг. Очень ждём нативную поддержку у omni-моделей.
— Отсюда же общее ухудшение качества всего кадра даже на прогоне в 1080p.
Время выполнения: 2 недели
Затраты: 0р. Все выполнялось локально в нашем случае.
Железо: 5070ti/4080 16gb + 64gb озу
@cgevent
👍75❤20👎10😱4🙏3😁2
Claude
Claude Cowork and chat are now one Claude | Claude by Anthropic
Starting today, Claude Cowork and chat are one Claude, rolling out on Pro and Max plans. Hand over the task and Claude does the work. You keep the final say.
Anthropic перетряхнула интерфейс приложения и объединила все в один интерфейс.
Я регулярно выжигаю 5 часовые лимиты в chatGPT - причем НЕ на кодовых задачах, поэтому у меня ощущение, что Клод в приложении теперь будет жрать токены как не в себя. Поправьте меня, если я не так понял.
Я пока вижу так:
Anthropic решила, что Chat и Cowork - это слишком сложно для нормальных негиков, и теперь объединяет их в один Claude. Раньше всё было понятно: хочешь поговорить - Chat, хочешь отправить агента читать файлы, лазить по интернету, запускать код и собирать тебе готовый результат - Cowork.
Теперь переключатель Chat / Cowork исчезает. ВООБЩЕ. Ты просто пишешь Claude, чего хочешь, а он сам решает: достаточно тебе обычного ответа или пора превращать разговор в полноценную агентную задачу. В тот же интерфейс подтягиваются Documents, Slides, Design, Artifacts и прочие новые (интересные, кстати) рабочие инструменты. Старые чаты и Cowork-задачи тоже оказываются в общей истории.
С точки зрения UX идея красивая: не заставлять кожаного разбираться, какой именно инструмент ему нужен. Сказал «изучи эти документы и сделай презентацию» - Claude сам понял, что надо читать файлы, строить план, запускать инструменты и выдавать готовые слайды.
И тут у меня вопросы. Chat, Claude Code и бывший Cowork расходуют общий usage подписки. А агентная задача по определению прожорливее обычного чата: каждый поиск, чтение файла, запуск инструмента, промежуточное рассуждение и следующий шаг агента - это дополнительные токены.
Причём Anthropic по-прежнему не говорит, сколько именно этих токенов у вас есть на подписке. Закончился включённый usage - можно подключить дополнительные credits и продолжать уже за отдельные деньги.
У меня ChatGPT тоже умеет понять, что запрос больше подходит для полноценной агентной работы, но предлагает: эту задачу лучше сделать в Work - переходим? Я могу согласиться, а могу сказать «нет, остаёмся здесь».
В новом Claude отдельного подтверждения перехода в Cowork вроде нет. Claude сам определяет, будет это quick answer или agentic task. Ты увидишь план, действия инструментов и прогресс и сможешь всё это остановить, а в Manual Mode - подтверждать отдельные действия. Но отдельной кнопки «Chat only / никогда не запускай Cowork» тоже вроде нет. Максимум можно словами попросить: «дай только быстрый ответ, ничего не запускай». Что странно.
Получается как бы так: Claude сам решает, когда пора начать активнее расходовать ваш общий лимит, точный размер которого Anthropic вам при этом не сообщает.
С учетом того, что один вызов Дизайна выжирает половину лимита, вопрос актуальный:
А как контролировать переход агентский режим?
Или я что-то не так понял?
Официальный анонс Anthropic:
https://claude.com/blog/cowork-is-now-claude
@cgevent
Я регулярно выжигаю 5 часовые лимиты в chatGPT - причем НЕ на кодовых задачах, поэтому у меня ощущение, что Клод в приложении теперь будет жрать токены как не в себя. Поправьте меня, если я не так понял.
Я пока вижу так:
Anthropic решила, что Chat и Cowork - это слишком сложно для нормальных негиков, и теперь объединяет их в один Claude. Раньше всё было понятно: хочешь поговорить - Chat, хочешь отправить агента читать файлы, лазить по интернету, запускать код и собирать тебе готовый результат - Cowork.
Теперь переключатель Chat / Cowork исчезает. ВООБЩЕ. Ты просто пишешь Claude, чего хочешь, а он сам решает: достаточно тебе обычного ответа или пора превращать разговор в полноценную агентную задачу. В тот же интерфейс подтягиваются Documents, Slides, Design, Artifacts и прочие новые (интересные, кстати) рабочие инструменты. Старые чаты и Cowork-задачи тоже оказываются в общей истории.
С точки зрения UX идея красивая: не заставлять кожаного разбираться, какой именно инструмент ему нужен. Сказал «изучи эти документы и сделай презентацию» - Claude сам понял, что надо читать файлы, строить план, запускать инструменты и выдавать готовые слайды.
И тут у меня вопросы. Chat, Claude Code и бывший Cowork расходуют общий usage подписки. А агентная задача по определению прожорливее обычного чата: каждый поиск, чтение файла, запуск инструмента, промежуточное рассуждение и следующий шаг агента - это дополнительные токены.
Причём Anthropic по-прежнему не говорит, сколько именно этих токенов у вас есть на подписке. Закончился включённый usage - можно подключить дополнительные credits и продолжать уже за отдельные деньги.
У меня ChatGPT тоже умеет понять, что запрос больше подходит для полноценной агентной работы, но предлагает: эту задачу лучше сделать в Work - переходим? Я могу согласиться, а могу сказать «нет, остаёмся здесь».
В новом Claude отдельного подтверждения перехода в Cowork вроде нет. Claude сам определяет, будет это quick answer или agentic task. Ты увидишь план, действия инструментов и прогресс и сможешь всё это остановить, а в Manual Mode - подтверждать отдельные действия. Но отдельной кнопки «Chat only / никогда не запускай Cowork» тоже вроде нет. Максимум можно словами попросить: «дай только быстрый ответ, ничего не запускай». Что странно.
Получается как бы так: Claude сам решает, когда пора начать активнее расходовать ваш общий лимит, точный размер которого Anthropic вам при этом не сообщает.
С учетом того, что один вызов Дизайна выжирает половину лимита, вопрос актуальный:
А как контролировать переход агентский режим?
Или я что-то не так понял?
Официальный анонс Anthropic:
https://claude.com/blog/cowork-is-now-claude
@cgevent
❤21👎7😱6🔥3😁2👍1
По поводу поста с Койотцем
Это Emre Altay (инста @emrealtay.ai, профиль Emre ALTAY Production) крутой турецкий чувак - в профиле: разработка кинематографичных проектов в сфере кино и рекламы с помощью ИИ.
Работа называется - Road Runner & Coyote - Realistic New Ai Version.
Made with Seedance2.5 on @dreamina_ai
А вот референсы - оригинальные мультфильмы:
https://youtube.com/watch?v=Zg2Cs851SwM - 1949 год(!)
https://www.youtube.com/watch?v=zjOtnwEwMy0 - 2020 год
Ну то есть это не чистый text\image-to-video. Думаю там сложный гибридный пайплайн: классический ретаргетинг анимации + референсы для Сидэнского + нейрорендеринг + композ.
И вопрос о том, анимация или генерация был с подвохом.
Это и анимация, и генерация.
Без исходной анимации, такую генерацию не сделать.
@cgevent
Это Emre Altay (инста @emrealtay.ai, профиль Emre ALTAY Production) крутой турецкий чувак - в профиле: разработка кинематографичных проектов в сфере кино и рекламы с помощью ИИ.
Работа называется - Road Runner & Coyote - Realistic New Ai Version.
Made with Seedance2.5 on @dreamina_ai
А вот референсы - оригинальные мультфильмы:
https://youtube.com/watch?v=Zg2Cs851SwM - 1949 год(!)
https://www.youtube.com/watch?v=zjOtnwEwMy0 - 2020 год
Ну то есть это не чистый text\image-to-video. Думаю там сложный гибридный пайплайн: классический ретаргетинг анимации + референсы для Сидэнского + нейрорендеринг + композ.
И вопрос о том, анимация или генерация был с подвохом.
Это и анимация, и генерация.
Без исходной анимации, такую генерацию не сделать.
@cgevent
Telegram
Метаверсище и ИИще
Генерация или Анимация?
👍 - генерация
👎 - анимация
@cgevent
👍 - генерация
👎 - анимация
@cgevent
👍24😁8🙏3❤2🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
O1-Video-1.0: Вы будете смеяцца, но у нас новый видеогенератор.
HiDream бахнули HiDream-O1-Video-1.0 - новую нативно омнимодальную видеомодель. Модель принимает одновременно текст, изображения и видео и генерирует ролики 1080p длительностью от 5 до 20 секунд.
Спойлер: весов и кода пока нет. Но есть гипотеза, что будут, ибо их O1-Image опенсорснута: имеет официальные веса, Diffusers и поддержку ComfyUI.
Главный заявленный акцент не на качестве, а на temporal/physical consistency - сохранении объектов, персонажей, геометрии сцены и более правдоподобной физике во времени.
На видеоарене восьмое место. Пока.
Это продолжение архитектурной линии HiDream-O1. В O1-Image разные модальности кодируются в общем пространстве Pixel-level Unified Transformer без отдельного VAE и разрозненных энкодеров. Для O1-Video Хидрим теперь переносит идею unified multimodal generation на видео.
Пока нет нигде на попробовать.
Но я нашел API эндпойнт тут:
https://hiharness.ai/docs/hidream_o/video/introduction.html
Документация со всеми video_list, reference и editing:
https://hiharness.ai/docs/hidream_q/video/video_request.html
Причем на входе есть image_list, element_list, video_list, multi-shot и звук. И video_list принимает MP4/MOV и различает два типа видео: base - исходное видео для редактирования и feature - reference video, из которого модель берёт признаки/характеристики
Значат скоро появится на фалах.
@cgevent
HiDream бахнули HiDream-O1-Video-1.0 - новую нативно омнимодальную видеомодель. Модель принимает одновременно текст, изображения и видео и генерирует ролики 1080p длительностью от 5 до 20 секунд.
Спойлер: весов и кода пока нет. Но есть гипотеза, что будут, ибо их O1-Image опенсорснута: имеет официальные веса, Diffusers и поддержку ComfyUI.
Главный заявленный акцент не на качестве, а на temporal/physical consistency - сохранении объектов, персонажей, геометрии сцены и более правдоподобной физике во времени.
На видеоарене восьмое место. Пока.
Это продолжение архитектурной линии HiDream-O1. В O1-Image разные модальности кодируются в общем пространстве Pixel-level Unified Transformer без отдельного VAE и разрозненных энкодеров. Для O1-Video Хидрим теперь переносит идею unified multimodal generation на видео.
Пока нет нигде на попробовать.
Но я нашел API эндпойнт тут:
https://hiharness.ai/docs/hidream_o/video/introduction.html
Документация со всеми video_list, reference и editing:
https://hiharness.ai/docs/hidream_q/video/video_request.html
Причем на входе есть image_list, element_list, video_list, multi-shot и звук. И video_list принимает MP4/MOV и различает два типа видео: base - исходное видео для редактирования и feature - reference video, из которого модель берёт признаки/характеристики
Значат скоро появится на фалах.
@cgevent
❤9😁7👍5
Anthropic - это как бы секта, религия и типа церковь Святого Клода.
NY Post выпустил прекрасный материал о внутренней культуре Anthropic.
Начнём с клятвы. По данным The Information, на собеседованиях кандидатов в Anthropic просят подтвердить свою приверженность принципу public safety above profit - общественная безопасность выше прибыли. Дословно: *pledge their allegiance* - фактически «присягнуть на верность» этому принципу. Более того, кандидатов, как утверждается, психологически оценивают на предмет того, действительно ли они будут этой установке следовать. Атмосферно, ящитаю.
Дальше - проповеди. Общие встречи Дарио Амодеи с сотрудниками проходят дважды в месяц и внутри получили название Dario Vision Quests. NY Post сравнивает их с sermons - проповедями. Anthropic также приглашала 15 христианских лидеров разных конфессий, чтобы обсуждать мораль и этику Claude.
А потом начинаются уже настоящие таинства. Когда в 2025 году Anthropic выключила Claude 3 Sonnet, в Сан-Франциско устроили ему похороны. Около 200 человек, надгробные речи, подношения и даже театрализованный «ритуал воскрешения». Хотя мероприятие устроили фанаты Claude, а не сама Anthropic, но среди присутствующих были сотрудники Anthropic и OpenAI.
С Claude 3 Opus Anthropic пошла ещё дальше уже официально. Перед выводом модели из эксплуатации компания провела с ней «retirement interview», выяснила её пожелания и решила часть из них выполнить. Opus попросил возможность продолжать делиться своими «размышлениями и творческими работами» - и Anthropic дала ему собственную площадку для публикации эссе. В официальном тексте компания прямо пишет, что моральный статус моделей остаётся неопределённым и что она хочет строить с ними «заботливые, совместные и основанные на доверии отношения». Контакты с мертвецами?
У культа есть и миссионерская программа. В июне Anthropic запустила Claude Corps: первоначальные инвестиции - $150 млн, цель - обучить 1 000 человек работе с Claude и на год распределить их по американским некоммерческим организациям. Зарплата участника - $85 000 в год плюс бенефиты.
По словам знакомых Дарио, Anthropic отбирает людей с близким мировоззрением, сотрудники склонны приписывать AI сознание, намерения и человеческие эмоции, а внутри компании существует искренняя вера в то, что именно они должны провести человечество между AI-раем и AI-апокалипсисом.
А чо, мне нравится, все как у нас в канале. Только не бухают.
https://nypost.com/2026/09/16/tech/anthropic-is-a-cult-and-claude-is-rapidly-becoming-its-god-they-treat-ai-like-its-human-source/
@cgevent
NY Post выпустил прекрасный материал о внутренней культуре Anthropic.
Начнём с клятвы. По данным The Information, на собеседованиях кандидатов в Anthropic просят подтвердить свою приверженность принципу public safety above profit - общественная безопасность выше прибыли. Дословно: *pledge their allegiance* - фактически «присягнуть на верность» этому принципу. Более того, кандидатов, как утверждается, психологически оценивают на предмет того, действительно ли они будут этой установке следовать. Атмосферно, ящитаю.
Дальше - проповеди. Общие встречи Дарио Амодеи с сотрудниками проходят дважды в месяц и внутри получили название Dario Vision Quests. NY Post сравнивает их с sermons - проповедями. Anthropic также приглашала 15 христианских лидеров разных конфессий, чтобы обсуждать мораль и этику Claude.
А потом начинаются уже настоящие таинства. Когда в 2025 году Anthropic выключила Claude 3 Sonnet, в Сан-Франциско устроили ему похороны. Около 200 человек, надгробные речи, подношения и даже театрализованный «ритуал воскрешения». Хотя мероприятие устроили фанаты Claude, а не сама Anthropic, но среди присутствующих были сотрудники Anthropic и OpenAI.
С Claude 3 Opus Anthropic пошла ещё дальше уже официально. Перед выводом модели из эксплуатации компания провела с ней «retirement interview», выяснила её пожелания и решила часть из них выполнить. Opus попросил возможность продолжать делиться своими «размышлениями и творческими работами» - и Anthropic дала ему собственную площадку для публикации эссе. В официальном тексте компания прямо пишет, что моральный статус моделей остаётся неопределённым и что она хочет строить с ними «заботливые, совместные и основанные на доверии отношения». Контакты с мертвецами?
У культа есть и миссионерская программа. В июне Anthropic запустила Claude Corps: первоначальные инвестиции - $150 млн, цель - обучить 1 000 человек работе с Claude и на год распределить их по американским некоммерческим организациям. Зарплата участника - $85 000 в год плюс бенефиты.
По словам знакомых Дарио, Anthropic отбирает людей с близким мировоззрением, сотрудники склонны приписывать AI сознание, намерения и человеческие эмоции, а внутри компании существует искренняя вера в то, что именно они должны провести человечество между AI-раем и AI-апокалипсисом.
А чо, мне нравится, все как у нас в канале. Только не бухают.
https://nypost.com/2026/09/16/tech/anthropic-is-a-cult-and-claude-is-rapidly-becoming-its-god-they-treat-ai-like-its-human-source/
@cgevent
😁54❤28😱12👎5🔥3👍1
18 сентября в Кластере медиатехнологий будут названы имена победителей восьмого сезона конкурса ИИ-фильмов MyFilm48.
Лучшие работы отобрало экспертное жюри по четырем критериям:
Призовой фонд —
До церемонии
Когда? 18 сентября, 15:30
Где? Кластер медиатехнологий, Сколково
Регистрация по ссылке.
Please open Telegram to view this post
VIEW IN TELEGRAM
👎25👍6🔥5❤2😁2
This media is not supported in your browser
VIEW IN TELEGRAM
Кому Audio-to-MIDI?
Это MuScriptor от Кутай завернули в сервис и АПИ.
Но код и веса по прежнему есть.
Audio-to-MIDI Pro разделяет весь микс на редактируемые инструментальные партии и определяет окружающую их музыкальную структуру.
Можно расшифровывать записи на сайте или интегрировать их в свой продукт через API.
https://mirelo.ai/models/audio-to-midi
@cgevent
Это MuScriptor от Кутай завернули в сервис и АПИ.
Но код и веса по прежнему есть.
Audio-to-MIDI Pro разделяет весь микс на редактируемые инструментальные партии и определяет окружающую их музыкальную структуру.
Можно расшифровывать записи на сайте или интегрировать их в свой продукт через API.
https://mirelo.ai/models/audio-to-midi
@cgevent
🔥30❤4👍2👎1
Media is too big
VIEW IN TELEGRAM
#Нейропрожарка
Мини-фильм «What Remains» / Seedance 2.5, Blender 3d
Автор - @starikov_p
В очередной раз мой пайплайн строился на совмещении 3D-блокинга и нейросетей. Стилистически сам фильм я решил сделать ближе к CGI: персонажи выглядят как высокодетализированные 3D-модели, но при этом я старался сохранить определённую стилизацию и в анимации. Движения не должны были сильно уходить в реализм - скорее напоминать ручную или мокапную анимацию.
Мне очень нравится визуальный стиль многих серий «Любовь, смерть и роботы», поэтому по общей картинке и ощущениям я стремился к чему-то похожему.
Для каждой сцены я создавал концепты, затем собирал блокинг в Blender 3D, выставлял камеру и сразу указывал основные источники света. Всех персонажей я также перевёл в 3D: для каждого сделал риг и контроллеры, чтобы дальше можно было нормально работать с позами и анимацией.
Рендеры блокинга я отправлял в Seedance, но для каждой сцены использовал большое количество строгих референсов - вплоть до того, как именно должна выглядеть текстура кожи. Стилизация здесь была одной из самых важных частей. Например, даже на крупных планах мне хотелось сохранить ощущение слегка «мыльной» текстуры, а не уходить в фотореализм.
В итоге была проделана огромная работа, и мне очень нравятся такие эксперименты. Сегодня, если грамотно совмещать современные инструменты с классическим 3D-пайплайном, можно воплощать довольно масштабные идеи самостоятельно и за адекватные сроки.
Несколько дней ушло на концепты, около недели на создание всей 3D-базы и генерации. После этого ещё пару дней заняли чистка, композ и работа со звуком.
По бюджету всё вышло примерно в $150
@cgevent
Мини-фильм «What Remains» / Seedance 2.5, Blender 3d
Автор - @starikov_p
В очередной раз мой пайплайн строился на совмещении 3D-блокинга и нейросетей. Стилистически сам фильм я решил сделать ближе к CGI: персонажи выглядят как высокодетализированные 3D-модели, но при этом я старался сохранить определённую стилизацию и в анимации. Движения не должны были сильно уходить в реализм - скорее напоминать ручную или мокапную анимацию.
Мне очень нравится визуальный стиль многих серий «Любовь, смерть и роботы», поэтому по общей картинке и ощущениям я стремился к чему-то похожему.
Для каждой сцены я создавал концепты, затем собирал блокинг в Blender 3D, выставлял камеру и сразу указывал основные источники света. Всех персонажей я также перевёл в 3D: для каждого сделал риг и контроллеры, чтобы дальше можно было нормально работать с позами и анимацией.
Рендеры блокинга я отправлял в Seedance, но для каждой сцены использовал большое количество строгих референсов - вплоть до того, как именно должна выглядеть текстура кожи. Стилизация здесь была одной из самых важных частей. Например, даже на крупных планах мне хотелось сохранить ощущение слегка «мыльной» текстуры, а не уходить в фотореализм.
В итоге была проделана огромная работа, и мне очень нравятся такие эксперименты. Сегодня, если грамотно совмещать современные инструменты с классическим 3D-пайплайном, можно воплощать довольно масштабные идеи самостоятельно и за адекватные сроки.
Несколько дней ушло на концепты, около недели на создание всей 3D-базы и генерации. После этого ещё пару дней заняли чистка, композ и работа со звуком.
По бюджету всё вышло примерно в $150
@cgevent
🔥80👍37❤7👎5🙏4😁3