Forwarded from Thomas Haevy
Всё чаще съёмку еды заменяет нейрогенерация. Например, эти кадры я сделал для ТРЦ «Аура».
На первый взгляд, более экономное производство звучит привлекательно. Не нужно собирать команду, организовывать логистику оборудования и людей. Можно сколько угодно менять героев, локации, одежду и образы, не привлекая стилистов и арт директора.
Но здесь кроется ловушка. Когда менять можно всё, очень легко начать менять всё. Это не фотография, где после съёмки ничего не подвинешь и никого не переоденешь.
Каждая новая идея кажется дешёвой и быстрой, поэтому количество итераций растёт, а вместе с этим (неожиданно для клиента и очевидно для команды продакшна) растягиваются сроки проекта.
Дополнительные сложности возникают, если изображение потом нужно анимировать: любой артефакт дорого клинапить, поэтому приходится возвращаться на шаг назад и ретушировать стиллшот.
Ещё из минусов. Размеры и пропорции объектов от кадра к кадру варьируются, кроме того, сложно передать необходимую физику еды при анимации.
Главное в таких проектах — максимально подробно как при реальной съёмке описать все детали и согласовать на всех уровнях, чтобы тратить меньше времени и сил на итерации, вовремя фиксировать результат
#ai
На первый взгляд, более экономное производство звучит привлекательно. Не нужно собирать команду, организовывать логистику оборудования и людей. Можно сколько угодно менять героев, локации, одежду и образы, не привлекая стилистов и арт директора.
Но здесь кроется ловушка. Когда менять можно всё, очень легко начать менять всё. Это не фотография, где после съёмки ничего не подвинешь и никого не переоденешь.
Каждая новая идея кажется дешёвой и быстрой, поэтому количество итераций растёт, а вместе с этим (неожиданно для клиента и очевидно для команды продакшна) растягиваются сроки проекта.
Дополнительные сложности возникают, если изображение потом нужно анимировать: любой артефакт дорого клинапить, поэтому приходится возвращаться на шаг назад и ретушировать стиллшот.
Ещё из минусов. Размеры и пропорции объектов от кадра к кадру варьируются, кроме того, сложно передать необходимую физику еды при анимации.
Главное в таких проектах — максимально подробно как при реальной съёмке описать все детали и согласовать на всех уровнях, чтобы тратить меньше времени и сил на итерации, вовремя фиксировать результат
#ai
Forwarded from Thomas Haevy
«Требуется человек-оркестр»
Примерно так сегодня выглядит половина вакансий в сфере нейросетей.
Это одна из немногих сфер, где один человек действительно может одинаково хорошо делать всё. Но это большая редкость. Потому что помимо генерации нужно уметь монтировать, ретушировать, режиссировать и тд
В попытке сэкономить компании ищут «человека-студию», при провале теряют деньги, а потом я слышу от коллег о том, как сложно найти настоящих спецов.
Люблю работать на проектах, где каждый отвечает за то, в чём действительно силён и где его экспертиза наработана годами. Когда на проекте есть и режиссер и композер и 3д спец.
Примерно так сегодня выглядит половина вакансий в сфере нейросетей.
Это одна из немногих сфер, где один человек действительно может одинаково хорошо делать всё. Но это большая редкость. Потому что помимо генерации нужно уметь монтировать, ретушировать, режиссировать и тд
В попытке сэкономить компании ищут «человека-студию», при провале теряют деньги, а потом я слышу от коллег о том, как сложно найти настоящих спецов.
Люблю работать на проектах, где каждый отвечает за то, в чём действительно силён и где его экспертиза наработана годами. Когда на проекте есть и режиссер и композер и 3д спец.
😁1
Российские бигтех-компании попросили Минцифры разрешить использовать персональные данные россиян без их согласия для обучения моделей ИИ. Причина: «это может ускорить развитие ИИ в РФ» Компании считают, что риск раскрытия личности равен нулю или «не превышает малые доли процента»*.
Для этого ведомству нужно будет внести поправки к закону о персональных данных в Госдуму.
*То есть всё-таки риск есть. В масштабах страны это сотни тысяч человек.
Ученые из Массачусетского технологического института (MIT) провели классическое исследование на основе «обезличенных» мобильных данных 1,5 миллиона человек.
Выяснилось, что достаточно знать всего 4 пространственно-временные точки (например: в 8:15 человек был в кофейне у дома, в 9:00 — в офисе, в 13:00 — в спортзале, в 19:00 — в супермаркете), чтобы идентифицировать 95% людей в базе данных.
У каждого из нас уникальный цифровой почерк. Двух людей с абсолютно одинаковыми маршрутами и графиком жизни в масштабах мегаполиса просто не существует.
В другом исследовании Science ученые взяли полностью анонимную базу данных покупок по банковским картам (без имен, номеров карт, только время, сумма и категория магазина). Зная дату и место всего трех покупок конкретного человека (которые легко узнать, просто пообщавшись с ним или заглянув в его соцсети), его личность раскрывали в 80% случаев.
Если к этим данным добавлялась информация о цене товара или поле покупателя, точность воссоздания личности мгновенно вырастала до тех самых 90% и выше.
Для этого ведомству нужно будет внести поправки к закону о персональных данных в Госдуму.
*То есть всё-таки риск есть. В масштабах страны это сотни тысяч человек.
Даже если убрать из базы имена и паспорта, сопоставление нескольких «обезличенных» датасетов (например, геопозиции из такси, времени покупок и пола) позволяет вычислить конкретного человека с точностью до 90%
Ученые из Массачусетского технологического института (MIT) провели классическое исследование на основе «обезличенных» мобильных данных 1,5 миллиона человек.
Выяснилось, что достаточно знать всего 4 пространственно-временные точки (например: в 8:15 человек был в кофейне у дома, в 9:00 — в офисе, в 13:00 — в спортзале, в 19:00 — в супермаркете), чтобы идентифицировать 95% людей в базе данных.
У каждого из нас уникальный цифровой почерк. Двух людей с абсолютно одинаковыми маршрутами и графиком жизни в масштабах мегаполиса просто не существует.
В другом исследовании Science ученые взяли полностью анонимную базу данных покупок по банковским картам (без имен, номеров карт, только время, сумма и категория магазина). Зная дату и место всего трех покупок конкретного человека (которые легко узнать, просто пообщавшись с ним или заглянув в его соцсети), его личность раскрывали в 80% случаев.
Если к этим данным добавлялась информация о цене товара или поле покупателя, точность воссоздания личности мгновенно вырастала до тех самых 90% и выше.
Сегодня тестировал Seedance 2.5
Пока заметил пару ключевых отличий от 2.0:
— Лучше различает ‘Close up’, ‘Medium close up‘ и т.д.
— Лучше анимирует камеру
— Если вы прикладываете референсы, то 2.0 часто интерполирует между этими кадрами, и приходится указывать в промте, как модели стоит интерпретировать референсы. 2.5 более гибкая в работе сприкреплёнными изображениями и воспринимает их менее буквально
Пока заметил пару ключевых отличий от 2.0:
— Лучше различает ‘Close up’, ‘Medium close up‘ и т.д.
— Лучше анимирует камеру
— Если вы прикладываете референсы, то 2.0 часто интерполирует между этими кадрами, и приходится указывать в промте, как модели стоит интерпретировать референсы. 2.5 более гибкая в работе сприкреплёнными изображениями и воспринимает их менее буквально
Future Framez
2.0 часто интерполирует между этими кадрами, и приходится указывать в промте, как модели стоит интерпретировать референсы
Чтобы это нивелировать, указываю в промте следующее:
REFERENCE IMAGES:
The attached reference images are provided as VISUAL REFERENCES, NOT AS KEYFRAMES OR A REQUIRED SHOT SEQUENCE. Use them only as visual guidance for character appearance, environment, composition, proportions, camera setup and overall visual continuity.
Do NOT treat the attached references as frames that must be reproduced literally or followed as an animation sequence. Do NOT interpolate between the reference images. The animation must follow the ACTION AND TIMING described in this prompt, while preserving the established character designs, environment and visual style from the references.
Продолжаю тестировать Seedance 2.5. Вот что ещё я заметил:
— Заметно точнее следует промту. Если я прописываю, что персонаж делает два шага вперёд, он не делает ни больше, ни меньше шагов
— Заметно хуже липсинк с русским языком. Для липиснка во многих случаях лучше продолжать пользоваться 2.0
— Генерация занимает больше времени
— Контраст ниже
— Заметно точнее следует промту. Если я прописываю, что персонаж делает два шага вперёд, он не делает ни больше, ни меньше шагов
— Заметно хуже липсинк с русским языком. Для липиснка во многих случаях лучше продолжать пользоваться 2.0
— Генерация занимает больше времени
— Контраст ниже
Forwarded from Что вы мне рекламируете?
Ну вот, приплыли
hh добавили (причем в свою подписку PRO) ИИ-редактор, который помогает соискателям составлять красивые сопроводительные письма. Однако, недавно hh начал подсказывать рекрутёрам, которые эти отклики получают — что кандидат воспользовался этой функцией (так и пишут в отклике на вакансию)
Прикиньте что за продакты-сверхразумы там работают, которые берут с соискателя деньги за фичу при этом подставляя его же и паля, что он слопит сопроводилки😲
hh добавили (причем в свою подписку PRO) ИИ-редактор, который помогает соискателям составлять красивые сопроводительные письма. Однако, недавно hh начал подсказывать рекрутёрам, которые эти отклики получают — что кандидат воспользовался этой функцией (так и пишут в отклике на вакансию)
Прикиньте что за продакты-сверхразумы там работают, которые берут с соискателя деньги за фичу при этом подставляя его же и паля, что он слопит сопроводилки
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯1
Media is too big
VIEW IN TELEGRAM
Автор 10 раз нажал на кнопку “extend video”, сохранив промт “song about bananas”. Всё обрело очень неожиданный поворот
😱1
Forwarded from Сеньор генеративщик 🏴☠️
Методы восстановления кадров после редактирования через Nano Banana
Хорошая новость — Nano Banana классно генерит изображения, плохая — редактирует она их мягко говоря, не очень 😬 После первой перегенерации теряется свет и цвет, а на третьей превращается в ужасное мыло. Все текстуры, объекты и лица плывут как тапки в огороде после дождя.
Закинуть кадр взад в банану "а ну повысь качество!" получается не очень. Генеративщики в курсе про этот бич, побеждать его не просто. Но я придумал как) Делюсь рабочими способами, которые каждый день использую.
Во вложении скринкасты — как восстанавливать качество через скетчи, GPT-Image, Nano Banana (спойлер — толку нет ).
Работая постоянно с кучей правок от клиентов, однажды допер до прикольного метода перегенеривания кадра через скетчи.
На простых кадрах он работает буквально за две тычки (особенно, если есть вложения, с которыми генерился кадр до изменений), со сложными чуть дольше. Есть ощущение, что говорить про его применение можно как минимум целый день, а не час. Менять ракурсы, впиливать объекты и все такое.
Давно хотел поселить это зерно про скетчи, оказалось, очень универсальная история.
Приятного просмотра. Старался особо не сокращать басню, чтобы показать какой-то кусочек своего образа мыслей.
Качество видео пришлось чуть даунгрейднуть, чтобы вес не зашкаливал, но на пояснение способов это не влияет.
Лучше способов чем эти, и еще заплаточной генерации, пока не придумал. Приятного генерения.
Хорошая новость — Nano Banana классно генерит изображения, плохая — редактирует она их мягко говоря, не очень 😬 После первой перегенерации теряется свет и цвет, а на третьей превращается в ужасное мыло. Все текстуры, объекты и лица плывут как тапки в огороде после дождя.
Закинуть кадр взад в банану "а ну повысь качество!" получается не очень. Генеративщики в курсе про этот бич, побеждать его не просто. Но я придумал как) Делюсь рабочими способами, которые каждый день использую.
Во вложении скринкасты — как восстанавливать качество через скетчи, GPT-Image, Nano Banana (
Работая постоянно с кучей правок от клиентов, однажды допер до прикольного метода перегенеривания кадра через скетчи.
На простых кадрах он работает буквально за две тычки (особенно, если есть вложения, с которыми генерился кадр до изменений), со сложными чуть дольше. Есть ощущение, что говорить про его применение можно как минимум целый день, а не час. Менять ракурсы, впиливать объекты и все такое.
Давно хотел поселить это зерно про скетчи, оказалось, очень универсальная история.
Приятного просмотра. Старался особо не сокращать басню, чтобы показать какой-то кусочек своего образа мыслей.
Качество видео пришлось чуть даунгрейднуть, чтобы вес не зашкаливал, но на пояснение способов это не влияет.
Лучше способов чем эти, и еще заплаточной генерации, пока не придумал. Приятного генерения.