VAI
5.08K subscribers
552 photos
111 videos
4 files
184 links
16 лет в компьютерной графике, 6 лет - арт-директор.
Работал над десятками проектов.
Изучаю ИИ для развития и собираю здесь свой опыт, находки и эксперименты.
Присоединяйтесь!
Личный контакт - @AlexBakakin
Boosty - boosty.to/vai_art

AI l ИИ
Download Telegram
Media is too big
VIEW IN TELEGRAM
Я сделал новую модель и записал вам таймлапс...

Сказал бы я,если бы у меня было больше времени поскульптить. 😁

А этот таймлапс сделал не я, а видеогенератор.В данном случае MiniMax H3.

Пример промпта.

Create a 15-second fast-paced 3D character sculpting timelapse inside a professional digital sculpting application (ZBrush-style interface: dark grey viewport, tool shelves on the left and right, subtool stack, no readable text).

Use the provided character reference only as the final target for the sculpt's silhouette, proportions, costume, feather layout and distinctive features. The process must visibly start from a single primitive sphere and rebuild the referenced character from scratch. The whole sculpt stays in a monochrome grey clay / matcap material — no color, no textures.

Show a visible mouse cursor actively controlling the entire process. Every major change must feel caused by cursor strokes on the mesh surface. The model is frequently rotated by dragging in the viewport, so the sculpt is always read as a real 3D object, not a drawing.

0:00-0:02
Start on an empty grey viewport with one smooth low-resolution sphere. The cursor pulls and drags the mass out into a rough humanoid blockout — torso, head, limbs, digitigrade bird legs — using large Move-brush strokes. Blobby, low-poly, no detail.

0:02-0:04
Remesh pass. The wireframe briefly flashes on, the mesh becomes denser and cleaner, then the wireframe disappears. The cursor refines proportions, defines the shoulder mass, hunched posture, arm length and the raven skull with a long curved beak. Rotate the model 90 degrees to check the profile.

0:04-0:06
Anatomy and costume blockout. The cursor masks regions and extracts new subtools: hood, shoulder cape, tunic, belts, wrapped shins. New objects visibly pop into the subtool stack as separate grey pieces. Clay build-up strokes thicken forms, TrimDynamic-style strokes flatten planes.

0:06-0:09
Hard-surface and prop pass. Insert-mesh strokes place straps, buckles, pouches, small blades and the recurve bow across the back. The cursor drags each piece into position, scales and rotates it. Continuous slow orbiting of the model between placements.

0:09-0:12
Feather pass — the most dramatic stage. Using an alpha/insert-brush, the cursor rapidly stamps overlapping feathers layer by layer over the shoulders, chest ruff, forearms and the long ragged cape. Feathers accumulate in fast successive passes from broad to fine, building the shaggy silhouette from the reference.

0:12-0:14
High-frequency detail and polish. Sharp carving strokes cut cloth folds, torn hems, stitching, leather grain and scale texture on the legs and talons. The viewport briefly zooms into the beak and hood to refine the face, then pulls back out. Subdivision level rises one more time, surface noise appears on the fabric.

0:14-0:15
The UI panels fade away. The finished sculpt is presented on a clean white background, centered, in the same standing pose and framing as the reference, slowly rotating and settling into the exact frontal reference view. End on the final beauty render.

STYLE:
High-speed 3D sculpting timelapse, professional digital sculpting workflow, believable sculpting software UI, matte grey clay material with soft studio lighting, smooth cursor movement, rapid but readable operations, no random text, no fake dialogue, no unrelated popups.

MOTION:
Continuously productive for the full 15 seconds. No long pauses. Compress many hours of sculpting into an energetic timelapse while keeping the progression clearly readable: sphere → rough blockout → refined anatomy → costume subtools → props and straps → layered feathers → fine detail → final render. Mesh density and surface complexity must visibly increase over time, never jump instantly.

CAMERA:
Screen-recording style. Camera navigation is 3D viewport orbiting — the model rotates around its vertical axis while being worked on, with occasional dolly-zooms toward the head, hands or feather clusters and back out. Keep the UI stable and readable. No cinematic cuts


@VAI_ART
#VAI_Notes
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥84😁31
Нам обещали, что ИИ заберёт рутину и освободит время. Он и правда освободил. Только отдыхать в это время никто не пошёл - все пошли работать ещё больше. 🥹

Последнее время много общаюсь с людьми, которые сидят в агентах каждый день. Картинка везде одна: рабочий день по 16-18 часов, в голове бесконечная очередь идей и фич. Не потому что кто-то заставляет. Потому что стало можно.

Раньше узким местом были руки. Сейчас руки почти бесплатные, на что уходила неделя, собирается за вечер. Узкое место переехало в голову. А голова, в отличие от агента, не запускается в двадцати параллельных сессиях.
Я сам работаю немало. Но глядя на людей вокруг, понимаю - это ещё мало. И вот это “мало” настораживает меня больше всего.

Потому что выгорание, переутомление и хроническая усталость никуда не делись. Их просто перестали замечать. На этом кураже кажется, что ты не устаёшь. Но психика не масштабируется.

И вот здесь самое неприятное. ИИ сгенерит картинку за пять секунд, соберёт пайплайн, напишет код. Но он не вернёт интерес к работе, нормальный сон и желание вообще что-то делать. Это чинится годами и не всегда до конца.

Поэтому отдых - это обязательный этап пайплайна, а не потеря темпа.

Гонка длинная. Выигрывает не тот, кто бежит быстрее, а тот, кто добежит.

Не забывайте отдыхать!🦄

@VAI_ART
#VAI_Notes
Please open Telegram to view this post
VIEW IN TELEGRAM
21👍14💯8👎3🔥2🌚2
Неделя была достаточно жаркой, но судя по анонсам до конца года наша жизнь станет еще более интересной. Пробежимся.

🔹 GPT-6 Astra — OpenAI выпустили модель,которая работает за компьютером вместо вас
Новый флагман.$10 и $50 за миллион токенов,контекст 1 млн.На Plus доступна только в Codex и Work,в обычном чате её там нет.
— сама водит мышкой и браузером: собирает презентации, таблицы,сайты и целые игры по одному запросу и вдвое быстрее прошлой модели
— держит длинную задачу целиком: ищет референсы,делает,проверяет результат и переделывает, не бросая на середине
— для меня одним из главных - 3D: в связке с Blender MCP сама собирает сцену, рендерит тестовые кадры,сверяет их с рефами и правит ошибки


Пример — архвиз целиком: дом от планировки до 30-секундного тура и интерактивной сборки в Unreal Engine 5.

Графики презентация,примеры в комментариях.

🔹 Claude Fable 5.1 — Anthropic обновили флагман и сделали его дешевле
Доступна всем в API и подписке. Цена прежняя, но реальный счёт за задачу падает на 25–45%.
— чтение из кэша подешевело на 75%, до $0,25 за миллион - а именно на кэш уходит основная часть денег в агентных задачах
— вдвое лучше тянет длинные технические задачи в терминале: 55,8% против 42% у прошлой версии
— и наконец пишет нормальным языком,без нагромождения терминов


Графики в комментариях.

🔹 Gemini 3.8 Flash — дешёвая модель Google подобралась к дорогим
Уже в API, AI Studio и приложении Gemini для Pro и Ultra. $0,75 и $3,75 за миллион токенов - вводная цена до конца года,потом вдвое дороже.
— апгрейд в коде и многошаговых задачах: планировать,дёргать инструменты,править свои ошибки
— Google разрешила ей думать дольше на сложном: токен дешёвый,а задача целиком может выйти дороже прошлой версии


График в комментариях.

🔹 World Labs Atlas — камера в генерации наконец стала управляемой
Работает сразу с текстом,картинками, видео и 3D.Ранний доступ по заявке,цены пока нет.
— траектория камеры задаётся заранее, до генерации: облёты, рефрейминг, bullet time внутри сцены
— до минуты видео в 1440p
— собирает 3D-сцену от одной картинки до десятков ракурсов, на выходе облако точек или гауссовы сплаты


Примеры в комментариях.

🔹 Runway GWM Worlds 2 — мир, который генерируется на лету и слушается вас
— 720p, 24 кадра в секунду со звуком, и генерация не заканчивается: мир продолжается, пока вы в нём
— задаёте окружение, персонажей, стиль и правила мира, дальше командуете ими, меняете погоду и свет, водите камеру
— постоянного 3D-состояния она не хранит: на долгой сессии геометрия и текстуры плывут


Пример в комментариях.

🔹 Hyper3D WorldGen — одна картинка превращается в разбираемую 3D-сцену
Deemos, авторы Rodin, выпустили генератор не объектов, а сцен целиком.
— ключевые предметы становятся отдельными мешами: стол подвинуть, стул заменить; окружение восстанавливается гауссовыми сплатами
— под игры масштаб пока маловат, авторы сами это признают; целятся в кино, XR и симуляции роботов


Пример в комментариях.

🔹 Viggle-Animate — замена персонажа в видео, впервые с открытыми весами
Берёте кадр из ролика, перерисовываете в нём персонажа - модель протягивает замену через всё видео, сохраняя движение и камеру. Никаких скелетов и масок, и в шесть раз быстрее Wan2.2-Animate. Аппетиты соответствующие: рекомендуют 96 ГБ видеопамяти.

Пример в комментариях.

🔹 OpenClaw 2.0 — самое крупное обновление опенсорсного личного ассистента
Собрал примерно половину всех правок за историю проекта.
— установка цепляется к тому, что уже стоит: подписка ChatGPT или Claude, ключи, локальные модели - час в конфигах больше не нужен
— появились общие облачные сессии: подключаете второго человека или передаёте ему задачу со всем контекстом


🔹 Gemini 4 — утекла таблица с цифрами, и они выше всего,что сейчас есть
Google подтвердил только сам факт обучения - "самый амбициозный pre-training run" в истории компании. В самой таблице столбец Gemini 4 помечен как предсказанный, а не измеренный, так что пока это слух.

Если верить, то это отличный комбэк. А то смотреть на Гугл было уже печально

Таблица в комментариях.

@VAI_ART
#VAI_News
👍5🔥2
С тем, насколько сейчас выходят крутые модели, лично у меня есть ощущение, что через год нам не нужна будет куча нейронок. Будет достаточно одной LLM, которая будет полностью мультимодальной. Нужно сделать модель - сделает, нужно сгенерировать видео - сгенерирует и т.д. Я уже давно заметил, еще в достаточно старых моделях того же GPT, что она хорошо понимала топологию сетки. Достаточно было попросить наложить сетку на объект или персонажа, и она это делала, но на тот момент у нее не было рук, того же MCP. Или как Claude с помощью математики делает видеоролики, с сюжетом. Т.е. там даже нет и близко модели для генерации видео, но он настолько умный, что она ему и не нужна. Или как сейчас уже можно генерировать звуки через те же LLM-модели, и многое, многое другое. В общем, звоночки были уже давно.

На прошлой неделе вышла новая модель GPT Astra, и с помощью своих мозгов и имеющихся рук ее спокойно подключают к тому же Blender - она очень хорошо понимает форму, сетку и т.д. Понятно, что еще есть косяки, но интернет заполонили модели в достаточно хорошем качестве, которые сделала Astra в Blender. Настройку рендера, материалов - все уже можно делать руками агентов.

Я думаю, что это еще не все. Пока модели недостаточно умные и используют вспомогательные программы для работы. Через год моделям уже будут не нужны эти прокладки и они сами будут делать все внутри себя.

@VAI_ART
#VAI_Notes
👍11😱4🫡1
Думаю, все уже знают, что вышла Imagen 2.5, но поделюсь.

Зачем осенью 2026 года расписывать, что может модель, если она это может сделать сама.

@VAI_ART
#VAI_News
👍8🔥4
Пока все пытаются примостить Astra к 3D, генераторы не отстают. В Tripo наконец-то появилась умная сетка, которая делает сетку из квадратов. На треугольниках она уже давно была.

Генерирует очень быстро, буквально секунд за 15–30. И сетку, и текстуру. Автоматом понимает, где нужно разделить, и разбивает на объекты. Полигонаж можно задавать. С развёрткой всё ещё беда, но тем не менее.

Как и всё, что связано с ИИ, бывает, что косячит, но в целом делает неплохо.

Найдите 10 отличий между концептом и финальной моделью с текстурой)

@VAI_ART
#VAI_Notes
🔥64👍41
Релизов за неделю немного, но все очень крутые. Кратко пробежимся 👾

🔹 ChatGPT Images 2.5 — генератор картинок OpenAI наконец держится за исходник при правках
Вышла 8 сентября, раскатывается на все тарифы ChatGPT, Codex и API. До 50% быстрее второй версии. В API две модели: Flare — быстрая, Sunburst — медленнее, но точнее в сложном редактировании.
— правит один элемент, не разваливая остальное: лицо, персонаж и композиция после цепочки правок держатся, фон не дёргается
— режим Sketch: рисуете каракули прямо в чате, добавляете описание — модель берёт рисунок как инструкцию
— комментарии прямо на картинке для точечных правок, шаблоны Poster и Merch
— в API произвольное разрешение до 4K и шесть уровней качества; максимум в 1024 — около $0,21 за картинку


Презентация в комментариях.

🔹 Suno v6 — три модели сразу и правка отдельных слов в готовом треке
Вышли 9 сентября: v6 и v6-wild для Pro/Premier ($10 и $30 в месяц), v6-mini — всем, включая бесплатный тариф. Старые модели отключают. Обучена на лицензированных каталогах Warner, BMG и Believe.
— меняет фрагмент песни текстовой командой, не пересобирая трек: одну строку или даже слово
— вырезает кусок аудио, например гитарный рифф, и строит вокруг него новый бит; собирает мэшап из своих треков
— на вход принимает текст, аудио, картинку и видео вместе — можно дать ролик и получить музыку под него
— v6-wild — та же модель с выкрученной непредсказуемостью: ловите странную идею там, дорабатываете в обычной v6


🔹 FLUX Video Edit — загружаете своё видео, пишете текстом что поменять, получаете тот же ролик с правкой
Black Forest Labs выпустили 10 сентября. Суть: берёте уже снятый или сгенерированный клип, пишете «замени суши на мясо» или «сделай ночь вместо дня» — и получаете тот же самый ролик, где изменилось только это, а движение камеры, актёры и всё остальное остались как были. Раньше ради одной детали приходилось перегенерировать сцену целиком. Доступно на сайте BFL и на fal, $0,03 за секунду ролика: 10-секундный клип — 30 центов, независимо от сложности правки.
— что можно менять: убрать или добавить предмет, заменить персонажа, поменять фон, материал, освещение, надпись в кадре
— можно переозвучить героя: пишете новую реплику, модель меняет речь и подгоняет губы — но фраза должна быть той же длины, что оригинал
— чего нельзя: ролик дольше 15 секунд не возьмёт, на выходе всегда 720p, показать картинкой «вот такой объект хочу» нельзя — только описать словами


Презентация в комментариях.

🔹 DeepSeek V4.1 Flash — открытая модель, которая в агентных задачах догнала Opus 5
Вышла 10 сентября, веса под MIT — можно крутить у себя или у любого хостера, не завися от API DeepSeek. Одна модель вместо трёх: быстрые ответы, глубокое рассуждение и понимание картинок, режим выбирать не нужно. Контекст 1 млн токенов.
— в задачах «сделай сам в терминале» — 74% против 74% у Opus 5 и 73% у GPT-5.6 Sol, а в автоматизации рутинных цепочек действий — первое место среди всех
— видит картинки: можно кинуть рендер или референс и обсуждать его, а не описывать словами
— глубина рассуждения регулируется по шкале от 1 до 100 — на простое отвечает мгновенно, на сложное думает долго, и это ваш выбор, а не модели
— память под длинный контекст ужали в четыре раза — большие проекты и длинные диалоги не тормозят и не забываются
— при этом стоит как самая дешёвая младшая модель: $0,15 за миллион на входе


График в комметариях.

🔹 Unity Agent Plugin — официальный плагин Unity для Claude Code и Codex
Вышел 9 сентября, ставится одной командой. 29 готовых скиллов от инженеров Unity для Unity 6+ плюс Unity CLI и MCP-сервер для управления редактором.
— задача обычным текстом: экран настроек, внутриигровые покупки, мультиплеер с голосовым чатом, шейдеры и URP
— агент сам определяет область задачи и подгружает нужные инструкции


Презентация в комментариях.

@VAI_ART
#VAI_News
👍3🔥1
Media is too big
VIEW IN TELEGRAM
Обновление Arcadia Effector 1.02

Всем привет друзья!
Я вернулся из отпуска, где классно отдохнул, набрался идей и впечатлений, часть из который пойдут в HEXSTORM, часть в новый проект на 3D движке. А какие-то уже реализованы в моем редакторе спецэффектов Arcadia Effector.

Что нового:
- Post FX - Pixel Art. Возможность превращать любые ваши творения в достаточно качественный и хорошо тюнингуемый пиксель-арт.
- Оптимизация GPU. Частицы считаются на CPU и достаточно шустро уже сейчас, а GPU занимается пост-обработкой, там были проблемы с производительностью, вроде решены.
- Полностью обновленный инструментарий работы с атласами, теперь есть превьюшка, можно выбирать конкретные кадры, задавать FPS плейбека.
- Добавлены всплывающие подсказки с описанием того, как действует каждая кнопка и параметр.

[Скачать Arcadia Effector с github]

В ближайшее время планирую показать интересный и экономичный пайплайн работы с 3D играми.
И если поддежите вашим огненным лайком - 🔥, то будет отдельное видео по пайплайну прозводства 2D спрайтовых анимаций, где на полную катушку применю и поделюсь всеми своими инструментами.

P.S. Приятно видеть, как в Чате Чайных Пакетиков сформировалось очень крутое комьюнити начинающих и не только разработчиков, которые вместе поддерживают друг-друга, делятся своими проектами и вместе погружаются в новый удивительный мир ИИ-геймдева. За неделю число участников выросло вдвое и собралось множество талантливых и пытливых умов. Если у вас есть вопросы о том, как начать, или есть желание показать свой проект, то добро пожаловать в чат (вступить в группу можно через комментарии).
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥155
Мне очень нравится то что создают нейронки через Three.js.

Three.js - это инструмент, с помощью которого на обычной веб-странице можно показывать 3D. Не картинку и не видео, а живую сцену: её можно вращать мышью, она реагирует на действия и считается в реальном времени на видеокарте того, кто открыл страницу.

Браузер умеет работать с видеокартой напрямую (эта технология называется WebGL), но писать под неё вручную очень долго и сложно. Three.js берёт всю эту сложность на себя и даёт понятные вещи: сцена, камера, свет, материалы, объекты, постобработка - всё то же, что в 3ds Max или Blender, только задаётся кодом, а не в интерфейсе.

Хорошо подходит для интерактивных сайтов (конфигураторы, промо, портфолио, где объект крутится мышью), визуализация данных и архитектуры, игры и AR/VR без установки, генеративная графика и шейдеры.

Сделал сайт-артефакт, который частично показывает возможности. Там можно покрутить и докрутить в настройках снизу.

@VAI_ART
#VAI_Gallery
🔥83
Подсмотрел неплохой пайплайн для прокачки навыков скиллов практически в любой сфере. Понравился настолько, что делюсь.

Схема такая:

🔹 Идёшь на Amazon и Goodreads (любой другой источник), находишь лучшие книги по теме - по рейтингам и отзывам.
🔹 Из них отбираешь только те, что реально закрывают твою задачу.
🔹 Достаёшь PDF (берём с Anna's Archive).
🔹 Конвертируешь PDF в Markdown - так модель читает текст нормально.
🔹 Отдаёшь ИИ: пусть выберет релевантное, сформулирует основные принципы и обязательно цитирует первоисточник.

Последний пункт ключевой - без цитат получаешь пересказ пересказа, с цитатами каждый тезис можно проверить.

P.S. Идти и отбирать необязательно руками - можно натравить агентов. В общем, процесс можно выстроить практически на автомате, и вот у вас скилл практически под любую задачу.

@VAI_ART
#VAI_Notes
1🔥4👍3😁1