Forwarded from Точки над ИИ
Большой гайд по Codex и GPT-6.pdf
1.6 MB
Заморочился и сделал очень подробный гайд по Codex и новой GPT-6 Astra
Понимаю, что сейчас мало кто читает гайды. Все смотрят ролики на полторы минуты и спрашивают у ChatGPT. Но вдруг вы из тех, кто по старинке любит открыть учебник и пройти путь глазами в удобном мягком кресле.
Внутри 58 страниц. Перелопатил официальную документацию OpenAI, кучу статей и, что самое главное, практику людей, которые последний месяц работали в Codex и особенно с новой моделькой, в общем собрал оттуда лайфхаки, которых в документации нет.
Писал, конечно же с агентом. В первую очередь это для тех, кто только начинает вайбкодить, каждая штука объясняется с нуля, с примерами и аналогиями. При этом старался держать емкий формат.
Сохраняйте на память📓
Понимаю, что сейчас мало кто читает гайды. Все смотрят ролики на полторы минуты и спрашивают у ChatGPT. Но вдруг вы из тех, кто по старинке любит открыть учебник и пройти путь глазами в удобном мягком кресле.
Внутри 58 страниц. Перелопатил официальную документацию OpenAI, кучу статей и, что самое главное, практику людей, которые последний месяц работали в Codex и особенно с новой моделькой, в общем собрал оттуда лайфхаки, которых в документации нет.
Писал, конечно же с агентом. В первую очередь это для тех, кто только начинает вайбкодить, каждая штука объясняется с нуля, с примерами и аналогиями. При этом старался держать емкий формат.
Сохраняйте на память
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍135❤44🔥25👎7🙏3😁1
Слушайте, меня одного бесит, что в Телеграме нельзя ничего толком найти. Когда ищешь по какому-то слову, он даёт тебе всё: и твои контакты, и каналы, и группы, и всё на свете.
Меня это ужасно бесило всегда. Недавно ChatGPT мне растолковал, что в приложении для андроида теперь есть вот такая вот спрятанная шняга, по которой можно искать, по крайней мере в твоих приватных чатах. Но, к сожалению, в клиенте для винды этого в помине нет. Как вы вообще выкручиваетесь в этом случае?
У меня много подписок и они все лезут в поиск, а иногда надо искать в личных...
@cgevent
Меня это ужасно бесило всегда. Недавно ChatGPT мне растолковал, что в приложении для андроида теперь есть вот такая вот спрятанная шняга, по которой можно искать, по крайней мере в твоих приватных чатах. Но, к сожалению, в клиенте для винды этого в помине нет. Как вы вообще выкручиваетесь в этом случае?
У меня много подписок и они все лезут в поиск, а иногда надо искать в личных...
@cgevent
👍37❤8😁8🙏3👎1
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Ибо Реал
У нас новый генератор видео. Быстрый и дешевый.
Точно также как пацаны ускоряют Минимакс, смышленые мальчики из Creatify Labs бахнули Boreal - сверхбыстрый и очень дешёвый генератор видео, и он, внимание!, на базе LTX-2.5.
Модель умеет в text-to-video и image-to-video, вместе с видео может генерировать речь, звуки и аудио. В основе - открытая LTX-2.5 22B , которую Creatify дополнительно дообучила на рекламных видео и UGC-контенте.
И вот тут интересно, сегодня "на UGC-контенте" означает на вашем нейрослопе?
Главная фишка - экономика.
На fal 720p стоит $0.01 за секунду видео: пятисекундный ролик - около $0.05, десятисекундный - $0.10.
Огонь!
1080p стоит $0.03/с, 2K - $0.12/с.
Со скоростью тоже нарядно. Creatify заявляет примерно реалтайм 1:1 - пять секунд видео примерно за пять секунд генерации, и до 40 раз быстрее некоторых закрытых моделей в их сравнении.
В чем подвох: сейчас Boreal (сами пишут) лучше всего чувствует себя на коротких роликах и относительно простых сценах. Это скорее очень дешёвая машина для быстрого перебора десятков рекламных креативов.
Уже доступна через Creatify Labs API, Model Playground, AdFlow и fal. На fal есть 720p, 1080p и 2K, разные aspect ratio, референсное изображение и возможность подать собственную аудиодорожку.
А теперь бочка дегтя: несмотря на то, что это на базе открытой LTX - никаких весов!!
Вот так пацаны зарабатывают на опенсорсе.
@cgevent
У нас новый генератор видео. Быстрый и дешевый.
Точно также как пацаны ускоряют Минимакс, смышленые мальчики из Creatify Labs бахнули Boreal - сверхбыстрый и очень дешёвый генератор видео, и он, внимание!, на базе LTX-2.5.
Модель умеет в text-to-video и image-to-video, вместе с видео может генерировать речь, звуки и аудио. В основе - открытая LTX-2.5 22B , которую Creatify дополнительно дообучила на рекламных видео и UGC-контенте.
И вот тут интересно, сегодня "на UGC-контенте" означает на вашем нейрослопе?
Главная фишка - экономика.
На fal 720p стоит $0.01 за секунду видео: пятисекундный ролик - около $0.05, десятисекундный - $0.10.
Огонь!
1080p стоит $0.03/с, 2K - $0.12/с.
Со скоростью тоже нарядно. Creatify заявляет примерно реалтайм 1:1 - пять секунд видео примерно за пять секунд генерации, и до 40 раз быстрее некоторых закрытых моделей в их сравнении.
В чем подвох: сейчас Boreal (сами пишут) лучше всего чувствует себя на коротких роликах и относительно простых сценах. Это скорее очень дешёвая машина для быстрого перебора десятков рекламных креативов.
Уже доступна через Creatify Labs API, Model Playground, AdFlow и fal. На fal есть 720p, 1080p и 2K, разные aspect ratio, референсное изображение и возможность подать собственную аудиодорожку.
А теперь бочка дегтя: несмотря на то, что это на базе открытой LTX - никаких весов!!
Вот так пацаны зарабатывают на опенсорсе.
@cgevent
👍22🔥6👎5❤2😁1
Please open Telegram to view this post
VIEW IN TELEGRAM
❤32👎15🔥13👍8😁7
This media is not supported in your browser
VIEW IN TELEGRAM
В чате попросили версию с блондинкой и светлыми глазами, чтобы формулы не так били по мозгам.
А там где блондинка, сразу появляются шпагаты и разные трюки.
Стереотипы и у Сиданского имеюцца.
@cgevent
А там где блондинка, сразу появляются шпагаты и разные трюки.
Стереотипы и у Сиданского имеюцца.
@cgevent
1😁50🔥12👍6😱1🙏1
Media is too big
VIEW IN TELEGRAM
Пока все отвлекались на АстроБлендор, Трипо порешала за топологию и поликаунт.
Не идеально, но уже далеко не месиво.
Есть также много видосов, гле Астрачка вызывает 3Д-генераторы и создает целые миры, но вопрос с топологией и текстурами остается.
Мне нравится прогресс, пойду поищу за AIUV.
@cgevent
Не идеально, но уже далеко не месиво.
Есть также много видосов, гле Астрачка вызывает 3Д-генераторы и создает целые миры, но вопрос с топологией и текстурами остается.
Мне нравится прогресс, пойду поищу за AIUV.
@cgevent
👍21❤3👎1
Tripo + Astra + Blender + GPT Images 2.5.
Трипо точно продвинулся в топологии. Каши больше нет.
За аниматоров и риггеров ведь уже не чокались? Тут Астрачка рулит.
@cgevent
Трипо точно продвинулся в топологии. Каши больше нет.
За аниматоров и риггеров ведь уже не чокались? Тут Астрачка рулит.
@cgevent
🔥14👎3
Media is too big
VIEW IN TELEGRAM
За левелдизайнеров?
Вот то самое видео.
Тут Astra использует HYPER3D (Rodin\DeemosTech) через их MCP для генерации 3D-объектов и размещения их (в очень большом количестве) в сцене.
Финальный рендер хоть в Блендоре, хоть в Нейрорендере.
@cgevent
Вот то самое видео.
Тут Astra использует HYPER3D (Rodin\DeemosTech) через их MCP для генерации 3D-объектов и размещения их (в очень большом количестве) в сцене.
Финальный рендер хоть в Блендоре, хоть в Нейрорендере.
@cgevent
👍30👎14🔥8❤4
По UV есть прогресс, благодаря Астрачке
Для желтого пижона пайплайн такой:
Tripo×BlenderMCP×Astra UV Unwrapping
Промпт:
А для кобылы - это генерация в HI3D - оттуда вылезает месиво в плане текстурных координат(слева вверху), но Астра его растаскивает. Поглядите тут для других примеров.
@cgevent
Для желтого пижона пайплайн такой:
Tripo×BlenderMCP×Astra UV Unwrapping
Промпт:
In Blender MCP, perform UV unwrapping on the selected "headless model including clothes and limbs," and re-bake the existing textures to 4K.
The goal is to preserve the original appearance, create UVs that make the structure readable like clothing patterns, and make it easy to redraw later. Just like a human artist, proceed in the order of observation → seam design → unwrap by parts → distortion correction → placement → bake.
1. Preserve the original data
Before starting work, save as a new file to keep the old UVs, images, and materials, and create a new UV called "UV_Final."
Do not change the shape, topology, vertex order, weights, shape keys, or rig.
2. Observe the model and design seams
Check each direction with original texture display and wireframe display to understand the clothing parts composition and actual seams.
For clothes, follow the pattern composition of body, sleeves, collar, etc., and cut open using side lines or inner sleeve areas. For skin and limbs, place seams in less noticeable positions like insides or sides, and design so that even between fingers can be opened without strain.
Do not mistake wrinkles or prints for seams, and avoid creating unnecessary fragmented islands.
3. Unwrap by parts and correct distortions
Do not process the whole at once; unwrap by parts.
Use a text-included checker referencing UV_Final and Stretch display to check for stretching, compression, twisting, flipping, and overlapping.
Add or remove seams depending on the cause of issues, adjust with Pin or Relax, and recheck. Do not just repeat the same auto-unwrap; keep the improved parts.
Do not use Smart UV Project's overall auto-subdivision as the final product.
4. Adjust fabric grain, density, and layout
For clothes, align the basic vertical direction to the UV's V direction based on each part's fabric grain. Do not forcibly deform curved patterns into rectangles.
Even out texel density relative to real size, and adjust orientation so left-right correspondence is clear.
Then, pack into the 0–1 area while maintaining orientation and relative scale. Overlapping left-right or arbitrary rotation is prohibited.
Use 4K bake margins of 16px, 32px+ between islands, and 16px+ on image edges as initial standards.
5. 4K bake from old UV to new UV
Explicitly fix the original texture reference to the old UV, use UV_Final as the bake target, and transfer to a new 4096×4096 image.
For each material, activate the bake target image node, do a test bake, then the main bake.
For base color, use only Diffuse's Color, or Emit, and do not bake in new lighting, shadows, or AO. Preserve the shading drawn on the original image.
Transfer existing maps like transparency as needed, and for tangent normals, re-bake based on new UV standards, not just color transfer.
6. Confirm completion with new-old comparison
Apply the new UV and baked image, and compare the whole body and details under the same display conditions as the original.
Check pattern positions, colors, transparency, and seam continuity, and fix UV collapses, overlaps, unwrapping omissions, bake black spots, misses, or bleeding.
Judge completion based on inspection results, not "how many times unwrapped."
Save the completed .blend, 4K images, UV layout, and confirmation images of seams, checker, and final appearance, and briefly report main correction contents.
Do not end with just the plan explanation; complete the work while confirming actual images.
А для кобылы - это генерация в HI3D - оттуда вылезает месиво в плане текстурных координат(слева вверху), но Астра его растаскивает. Поглядите тут для других примеров.
@cgevent
👍19👎5❤2
This media is not supported in your browser
VIEW IN TELEGRAM
Вайб-инжиниринг.
Пока мы тут генерим чахлые 3Д-модельки, пригодные разве что для 3Д-печати, люди идут сильно дальше в физический мир.
И тут прекрасно все: мозги Астры, деньги кожаного, и инструкция по сборке.
Чувак дал Astra свою кредитную карту и попросил сконструировать\собрать мини-контроллер для диджеев в стиле Teenage Engineering (есть каста упоротых по МИДИ-контроллерам). Астрачка сгенерировала концептуальное изображение, нашла комплектующие, изучила китайские технические характеристики, создала CAD-модель, всё заказала, а затем сделала анимацию в Blender, показывающую, как его собрать.
Чувак обещает вот-вот показать результат, пока у него Астра с поставщиками переписывается.
С софтом мы разобрались. Я уже не ищу приложения, я прошу их мне быстро написать (раскурочил Андроид знатно).
Но тут уже выход в хардвер, не софтвер.
Причем не "как мне пачинить кран", а придумай, сконструируй, закупи и доставь. Потом будет домашний робат для сборки таких посылок.
Но пока меня просто ошарашивает скорость изменений, мышление просто не поспевает за ними - а что так можно было??
И даже если контроллер не заведется завтра, он точно заведется послезавтра.
И теперь наигравшись с "хачу видео" и "хачу утилиту", можно переходить к "хачу вот такую железяку в подарок, чтобы делала что мне надо".
Апажалста.
@cgevent
Пока мы тут генерим чахлые 3Д-модельки, пригодные разве что для 3Д-печати, люди идут сильно дальше в физический мир.
И тут прекрасно все: мозги Астры, деньги кожаного, и инструкция по сборке.
Чувак дал Astra свою кредитную карту и попросил сконструировать\собрать мини-контроллер для диджеев в стиле Teenage Engineering (есть каста упоротых по МИДИ-контроллерам). Астрачка сгенерировала концептуальное изображение, нашла комплектующие, изучила китайские технические характеристики, создала CAD-модель, всё заказала, а затем сделала анимацию в Blender, показывающую, как его собрать.
Чувак обещает вот-вот показать результат, пока у него Астра с поставщиками переписывается.
С софтом мы разобрались. Я уже не ищу приложения, я прошу их мне быстро написать (раскурочил Андроид знатно).
Но тут уже выход в хардвер, не софтвер.
Причем не "как мне пачинить кран", а придумай, сконструируй, закупи и доставь. Потом будет домашний робат для сборки таких посылок.
Но пока меня просто ошарашивает скорость изменений, мышление просто не поспевает за ними - а что так можно было??
И даже если контроллер не заведется завтра, он точно заведется послезавтра.
И теперь наигравшись с "хачу видео" и "хачу утилиту", можно переходить к "хачу вот такую железяку в подарок, чтобы делала что мне надо".
Апажалста.
@cgevent
❤70🔥34👍12👎3😱3
Media is too big
VIEW IN TELEGRAM
#Нейропрожарка
Название: Что если бы Томми Шелби сыграл Джейсон Стэтхем
Авторы:
Иван Спиридонов
Дмитрий Иванов
Идея
Реализовали экспериментальный эдит по «Острым козырькам»: заменили Киллиана Мёрфи на Джейсона Стэтхема.
Суть в том, что сначала Стэтхема хотели взять на роль Мерфи и мы решили посмотреть как бы он выглядел в ней. Взяли популярные сцены разной сложности. Для выполнения разработали собственный воркфлоу на Wan Animate и протестировали Minimax H3.
Версия в хорошем качестве
Производство
1. Монтаж и отбор
Смонтировали сцены из сериала — короткие, динамичные, с блюром и тёмным светом. Осознанно взяли несколько заведомо очень сложных шотов.
Спойлер: если бы не своевременный выход Minimax H3, мы бы их удалили
2. Референсы
Можно просто закинуть фото Стэтхема, так проще. Но лучше делать замену прямо на референсном кадре из сцены — тогда animate понимает, как персонаж должен выглядеть в этом свете и гриме. С этим справился только GPT Image 2. Для боковых ракурсов собирали character sheet с разными углами головы и эмоциями (для Minimax)
3. Базовый пайплайн — Wan 2.2 Animate V1 (локально, ComfyUI)
— Маска: в основном автоматом через SAM3; кадры посложнее размечали в Premiere, самые жёсткие — ротоскоп в After Effects.
— Кроп кадра по маске, чтобы отдать генерации максимальное разрешение.
— Препроцессоры анализируют позу и мимику. Иногда отдельно записывали себя на видео и переносили эмоции со своего лица — с оригинала мимика часто читается плохо.
— Генерация и анкроп обратно в исходное видео.
— Опционально — цветокор лица под кадр.
Нюансы
4. Где Wan Animate не вывозит
— Перекрытия лица: нет контекста, объекты перед лицом ломают генерацию.
— Микродвижения лица теряются, а именно они дают естественность.
— Иногда уплывает схожесть - лечится генерацией конкретных ключевых рефов.
— Динамика с моушн-блюром и плохим светом: неверно определяются движения и состояние глаз.
— Изменения на лице (кровь, брызги) не анимируются вообще. Текстовый энкодер староват, модель под такое не обучена. FLF-кадры не помогли.
Из-за этого пришлось бы выбросить несколько сцен.
5. Minimax H3 (локальная версия)
Прогнали проблемные шоты через него - и они перестали быть проблемными.
— Кровь. Точно перенёс кровь с исходного видео на заменённое лицо. Референсы: лицо + свап одного из первых кадров для контроля эстетики.
— Динамичная сцена в баре. Нужно было объяснить модели, кого именно свапать из толпы. Сделали маску ротоскопом в AE и подали на вход: исходное видео с белой маской на лице + кроп лица (чтобы модель видела поворот и эмоции) + реф лица.
— Мимика. Движения губ и глаз читаются заметно лучше на многих шотах, Wan Animate это просто не считывал.
— Углы головы. Как omni-модель ест character sheet целиком. На одном рефе глаза оставались «от Киллиана Мёрфи», на character sheet — уже нет.
— Цензуры на суицидальные и жестокие сцены, оружие и авторские права нет.
6. Сравнение с сервисами
Kling 3.0 Omni Edit: в сцене с выстрелом ловим NSFW; в сцене с кровью из носа результат чище, но сама кровь выглядит крипово.
Ни один другой сервис эти шоты бы не пропустил — пистолеты, актёры, жестокость, кровь.
7. Минусы Minimax H3
— Шаг в 17 кадров против 4 у Wan. Собрали небольшой блюпринт в ComfyUI, который дописывает кадры в конец, чтобы выход точно совпадал с исходником по таймингам, — иначе модель догенерирует и растянет контент.
— Нет маскинга. С маскингом нередактируемая часть видео не меняется по качеству и цвету, нет сдвигов по таймингам и объектам, плюс открывается композитинг. Очень ждём нативную поддержку у omni-моделей.
— Отсюда же общее ухудшение качества всего кадра даже на прогоне в 1080p.
Время выполнения: 2 недели
Затраты: 0р. Все выполнялось локально в нашем случае.
Железо: 5070ti/4080 16gb + 64gb озу
@cgevent
Название: Что если бы Томми Шелби сыграл Джейсон Стэтхем
Авторы:
Иван Спиридонов
Дмитрий Иванов
Идея
Реализовали экспериментальный эдит по «Острым козырькам»: заменили Киллиана Мёрфи на Джейсона Стэтхема.
Суть в том, что сначала Стэтхема хотели взять на роль Мерфи и мы решили посмотреть как бы он выглядел в ней. Взяли популярные сцены разной сложности. Для выполнения разработали собственный воркфлоу на Wan Animate и протестировали Minimax H3.
Версия в хорошем качестве
Производство
1. Монтаж и отбор
Смонтировали сцены из сериала — короткие, динамичные, с блюром и тёмным светом. Осознанно взяли несколько заведомо очень сложных шотов.
Спойлер: если бы не своевременный выход Minimax H3, мы бы их удалили
2. Референсы
Можно просто закинуть фото Стэтхема, так проще. Но лучше делать замену прямо на референсном кадре из сцены — тогда animate понимает, как персонаж должен выглядеть в этом свете и гриме. С этим справился только GPT Image 2. Для боковых ракурсов собирали character sheet с разными углами головы и эмоциями (для Minimax)
3. Базовый пайплайн — Wan 2.2 Animate V1 (локально, ComfyUI)
— Маска: в основном автоматом через SAM3; кадры посложнее размечали в Premiere, самые жёсткие — ротоскоп в After Effects.
— Кроп кадра по маске, чтобы отдать генерации максимальное разрешение.
— Препроцессоры анализируют позу и мимику. Иногда отдельно записывали себя на видео и переносили эмоции со своего лица — с оригинала мимика часто читается плохо.
— Генерация и анкроп обратно в исходное видео.
— Опционально — цветокор лица под кадр.
Нюансы
4. Где Wan Animate не вывозит
— Перекрытия лица: нет контекста, объекты перед лицом ломают генерацию.
— Микродвижения лица теряются, а именно они дают естественность.
— Иногда уплывает схожесть - лечится генерацией конкретных ключевых рефов.
— Динамика с моушн-блюром и плохим светом: неверно определяются движения и состояние глаз.
— Изменения на лице (кровь, брызги) не анимируются вообще. Текстовый энкодер староват, модель под такое не обучена. FLF-кадры не помогли.
Из-за этого пришлось бы выбросить несколько сцен.
5. Minimax H3 (локальная версия)
Прогнали проблемные шоты через него - и они перестали быть проблемными.
— Кровь. Точно перенёс кровь с исходного видео на заменённое лицо. Референсы: лицо + свап одного из первых кадров для контроля эстетики.
— Динамичная сцена в баре. Нужно было объяснить модели, кого именно свапать из толпы. Сделали маску ротоскопом в AE и подали на вход: исходное видео с белой маской на лице + кроп лица (чтобы модель видела поворот и эмоции) + реф лица.
— Мимика. Движения губ и глаз читаются заметно лучше на многих шотах, Wan Animate это просто не считывал.
— Углы головы. Как omni-модель ест character sheet целиком. На одном рефе глаза оставались «от Киллиана Мёрфи», на character sheet — уже нет.
— Цензуры на суицидальные и жестокие сцены, оружие и авторские права нет.
6. Сравнение с сервисами
Kling 3.0 Omni Edit: в сцене с выстрелом ловим NSFW; в сцене с кровью из носа результат чище, но сама кровь выглядит крипово.
Ни один другой сервис эти шоты бы не пропустил — пистолеты, актёры, жестокость, кровь.
7. Минусы Minimax H3
— Шаг в 17 кадров против 4 у Wan. Собрали небольшой блюпринт в ComfyUI, который дописывает кадры в конец, чтобы выход точно совпадал с исходником по таймингам, — иначе модель догенерирует и растянет контент.
— Нет маскинга. С маскингом нередактируемая часть видео не меняется по качеству и цвету, нет сдвигов по таймингам и объектам, плюс открывается композитинг. Очень ждём нативную поддержку у omni-моделей.
— Отсюда же общее ухудшение качества всего кадра даже на прогоне в 1080p.
Время выполнения: 2 недели
Затраты: 0р. Все выполнялось локально в нашем случае.
Железо: 5070ti/4080 16gb + 64gb озу
@cgevent
👍72❤19👎9😱4🙏3😁2