VAI
5.09K subscribers
552 photos
111 videos
4 files
184 links
16 лет в компьютерной графике, 6 лет - арт-директор.
Работал над десятками проектов.
Изучаю ИИ для развития и собираю здесь свой опыт, находки и эксперименты.
Присоединяйтесь!
Личный контакт - @AlexBakakin
Boosty - boosty.to/vai_art

AI l ИИ
Download Telegram
Нам обещали, что ИИ заберёт рутину и освободит время. Он и правда освободил. Только отдыхать в это время никто не пошёл - все пошли работать ещё больше. 🥹

Последнее время много общаюсь с людьми, которые сидят в агентах каждый день. Картинка везде одна: рабочий день по 16-18 часов, в голове бесконечная очередь идей и фич. Не потому что кто-то заставляет. Потому что стало можно.

Раньше узким местом были руки. Сейчас руки почти бесплатные, на что уходила неделя, собирается за вечер. Узкое место переехало в голову. А голова, в отличие от агента, не запускается в двадцати параллельных сессиях.
Я сам работаю немало. Но глядя на людей вокруг, понимаю - это ещё мало. И вот это “мало” настораживает меня больше всего.

Потому что выгорание, переутомление и хроническая усталость никуда не делись. Их просто перестали замечать. На этом кураже кажется, что ты не устаёшь. Но психика не масштабируется.

И вот здесь самое неприятное. ИИ сгенерит картинку за пять секунд, соберёт пайплайн, напишет код. Но он не вернёт интерес к работе, нормальный сон и желание вообще что-то делать. Это чинится годами и не всегда до конца.

Поэтому отдых - это обязательный этап пайплайна, а не потеря темпа.

Гонка длинная. Выигрывает не тот, кто бежит быстрее, а тот, кто добежит.

Не забывайте отдыхать!🦄

@VAI_ART
#VAI_Notes
Please open Telegram to view this post
VIEW IN TELEGRAM
21👍14💯8👎3🔥2🌚2
Неделя была достаточно жаркой, но судя по анонсам до конца года наша жизнь станет еще более интересной. Пробежимся.

🔹 GPT-6 Astra — OpenAI выпустили модель,которая работает за компьютером вместо вас
Новый флагман.$10 и $50 за миллион токенов,контекст 1 млн.На Plus доступна только в Codex и Work,в обычном чате её там нет.
— сама водит мышкой и браузером: собирает презентации, таблицы,сайты и целые игры по одному запросу и вдвое быстрее прошлой модели
— держит длинную задачу целиком: ищет референсы,делает,проверяет результат и переделывает, не бросая на середине
— для меня одним из главных - 3D: в связке с Blender MCP сама собирает сцену, рендерит тестовые кадры,сверяет их с рефами и правит ошибки


Пример — архвиз целиком: дом от планировки до 30-секундного тура и интерактивной сборки в Unreal Engine 5.

Графики презентация,примеры в комментариях.

🔹 Claude Fable 5.1 — Anthropic обновили флагман и сделали его дешевле
Доступна всем в API и подписке. Цена прежняя, но реальный счёт за задачу падает на 25–45%.
— чтение из кэша подешевело на 75%, до $0,25 за миллион - а именно на кэш уходит основная часть денег в агентных задачах
— вдвое лучше тянет длинные технические задачи в терминале: 55,8% против 42% у прошлой версии
— и наконец пишет нормальным языком,без нагромождения терминов


Графики в комментариях.

🔹 Gemini 3.8 Flash — дешёвая модель Google подобралась к дорогим
Уже в API, AI Studio и приложении Gemini для Pro и Ultra. $0,75 и $3,75 за миллион токенов - вводная цена до конца года,потом вдвое дороже.
— апгрейд в коде и многошаговых задачах: планировать,дёргать инструменты,править свои ошибки
— Google разрешила ей думать дольше на сложном: токен дешёвый,а задача целиком может выйти дороже прошлой версии


График в комментариях.

🔹 World Labs Atlas — камера в генерации наконец стала управляемой
Работает сразу с текстом,картинками, видео и 3D.Ранний доступ по заявке,цены пока нет.
— траектория камеры задаётся заранее, до генерации: облёты, рефрейминг, bullet time внутри сцены
— до минуты видео в 1440p
— собирает 3D-сцену от одной картинки до десятков ракурсов, на выходе облако точек или гауссовы сплаты


Примеры в комментариях.

🔹 Runway GWM Worlds 2 — мир, который генерируется на лету и слушается вас
— 720p, 24 кадра в секунду со звуком, и генерация не заканчивается: мир продолжается, пока вы в нём
— задаёте окружение, персонажей, стиль и правила мира, дальше командуете ими, меняете погоду и свет, водите камеру
— постоянного 3D-состояния она не хранит: на долгой сессии геометрия и текстуры плывут


Пример в комментариях.

🔹 Hyper3D WorldGen — одна картинка превращается в разбираемую 3D-сцену
Deemos, авторы Rodin, выпустили генератор не объектов, а сцен целиком.
— ключевые предметы становятся отдельными мешами: стол подвинуть, стул заменить; окружение восстанавливается гауссовыми сплатами
— под игры масштаб пока маловат, авторы сами это признают; целятся в кино, XR и симуляции роботов


Пример в комментариях.

🔹 Viggle-Animate — замена персонажа в видео, впервые с открытыми весами
Берёте кадр из ролика, перерисовываете в нём персонажа - модель протягивает замену через всё видео, сохраняя движение и камеру. Никаких скелетов и масок, и в шесть раз быстрее Wan2.2-Animate. Аппетиты соответствующие: рекомендуют 96 ГБ видеопамяти.

Пример в комментариях.

🔹 OpenClaw 2.0 — самое крупное обновление опенсорсного личного ассистента
Собрал примерно половину всех правок за историю проекта.
— установка цепляется к тому, что уже стоит: подписка ChatGPT или Claude, ключи, локальные модели - час в конфигах больше не нужен
— появились общие облачные сессии: подключаете второго человека или передаёте ему задачу со всем контекстом


🔹 Gemini 4 — утекла таблица с цифрами, и они выше всего,что сейчас есть
Google подтвердил только сам факт обучения - "самый амбициозный pre-training run" в истории компании. В самой таблице столбец Gemini 4 помечен как предсказанный, а не измеренный, так что пока это слух.

Если верить, то это отличный комбэк. А то смотреть на Гугл было уже печально

Таблица в комментариях.

@VAI_ART
#VAI_News
👍5🔥2
С тем, насколько сейчас выходят крутые модели, лично у меня есть ощущение, что через год нам не нужна будет куча нейронок. Будет достаточно одной LLM, которая будет полностью мультимодальной. Нужно сделать модель - сделает, нужно сгенерировать видео - сгенерирует и т.д. Я уже давно заметил, еще в достаточно старых моделях того же GPT, что она хорошо понимала топологию сетки. Достаточно было попросить наложить сетку на объект или персонажа, и она это делала, но на тот момент у нее не было рук, того же MCP. Или как Claude с помощью математики делает видеоролики, с сюжетом. Т.е. там даже нет и близко модели для генерации видео, но он настолько умный, что она ему и не нужна. Или как сейчас уже можно генерировать звуки через те же LLM-модели, и многое, многое другое. В общем, звоночки были уже давно.

На прошлой неделе вышла новая модель GPT Astra, и с помощью своих мозгов и имеющихся рук ее спокойно подключают к тому же Blender - она очень хорошо понимает форму, сетку и т.д. Понятно, что еще есть косяки, но интернет заполонили модели в достаточно хорошем качестве, которые сделала Astra в Blender. Настройку рендера, материалов - все уже можно делать руками агентов.

Я думаю, что это еще не все. Пока модели недостаточно умные и используют вспомогательные программы для работы. Через год моделям уже будут не нужны эти прокладки и они сами будут делать все внутри себя.

@VAI_ART
#VAI_Notes
👍11😱4🫡1
Думаю, все уже знают, что вышла Imagen 2.5, но поделюсь.

Зачем осенью 2026 года расписывать, что может модель, если она это может сделать сама.

@VAI_ART
#VAI_News
👍8🔥4
Пока все пытаются примостить Astra к 3D, генераторы не отстают. В Tripo наконец-то появилась умная сетка, которая делает сетку из квадратов. На треугольниках она уже давно была.

Генерирует очень быстро, буквально секунд за 15–30. И сетку, и текстуру. Автоматом понимает, где нужно разделить, и разбивает на объекты. Полигонаж можно задавать. С развёрткой всё ещё беда, но тем не менее.

Как и всё, что связано с ИИ, бывает, что косячит, но в целом делает неплохо.

Найдите 10 отличий между концептом и финальной моделью с текстурой)

@VAI_ART
#VAI_Notes
🔥64👍41
Релизов за неделю немного, но все очень крутые. Кратко пробежимся 👾

🔹 ChatGPT Images 2.5 — генератор картинок OpenAI наконец держится за исходник при правках
Вышла 8 сентября, раскатывается на все тарифы ChatGPT, Codex и API. До 50% быстрее второй версии. В API две модели: Flare — быстрая, Sunburst — медленнее, но точнее в сложном редактировании.
— правит один элемент, не разваливая остальное: лицо, персонаж и композиция после цепочки правок держатся, фон не дёргается
— режим Sketch: рисуете каракули прямо в чате, добавляете описание — модель берёт рисунок как инструкцию
— комментарии прямо на картинке для точечных правок, шаблоны Poster и Merch
— в API произвольное разрешение до 4K и шесть уровней качества; максимум в 1024 — около $0,21 за картинку


Презентация в комментариях.

🔹 Suno v6 — три модели сразу и правка отдельных слов в готовом треке
Вышли 9 сентября: v6 и v6-wild для Pro/Premier ($10 и $30 в месяц), v6-mini — всем, включая бесплатный тариф. Старые модели отключают. Обучена на лицензированных каталогах Warner, BMG и Believe.
— меняет фрагмент песни текстовой командой, не пересобирая трек: одну строку или даже слово
— вырезает кусок аудио, например гитарный рифф, и строит вокруг него новый бит; собирает мэшап из своих треков
— на вход принимает текст, аудио, картинку и видео вместе — можно дать ролик и получить музыку под него
— v6-wild — та же модель с выкрученной непредсказуемостью: ловите странную идею там, дорабатываете в обычной v6


🔹 FLUX Video Edit — загружаете своё видео, пишете текстом что поменять, получаете тот же ролик с правкой
Black Forest Labs выпустили 10 сентября. Суть: берёте уже снятый или сгенерированный клип, пишете «замени суши на мясо» или «сделай ночь вместо дня» — и получаете тот же самый ролик, где изменилось только это, а движение камеры, актёры и всё остальное остались как были. Раньше ради одной детали приходилось перегенерировать сцену целиком. Доступно на сайте BFL и на fal, $0,03 за секунду ролика: 10-секундный клип — 30 центов, независимо от сложности правки.
— что можно менять: убрать или добавить предмет, заменить персонажа, поменять фон, материал, освещение, надпись в кадре
— можно переозвучить героя: пишете новую реплику, модель меняет речь и подгоняет губы — но фраза должна быть той же длины, что оригинал
— чего нельзя: ролик дольше 15 секунд не возьмёт, на выходе всегда 720p, показать картинкой «вот такой объект хочу» нельзя — только описать словами


Презентация в комментариях.

🔹 DeepSeek V4.1 Flash — открытая модель, которая в агентных задачах догнала Opus 5
Вышла 10 сентября, веса под MIT — можно крутить у себя или у любого хостера, не завися от API DeepSeek. Одна модель вместо трёх: быстрые ответы, глубокое рассуждение и понимание картинок, режим выбирать не нужно. Контекст 1 млн токенов.
— в задачах «сделай сам в терминале» — 74% против 74% у Opus 5 и 73% у GPT-5.6 Sol, а в автоматизации рутинных цепочек действий — первое место среди всех
— видит картинки: можно кинуть рендер или референс и обсуждать его, а не описывать словами
— глубина рассуждения регулируется по шкале от 1 до 100 — на простое отвечает мгновенно, на сложное думает долго, и это ваш выбор, а не модели
— память под длинный контекст ужали в четыре раза — большие проекты и длинные диалоги не тормозят и не забываются
— при этом стоит как самая дешёвая младшая модель: $0,15 за миллион на входе


График в комметариях.

🔹 Unity Agent Plugin — официальный плагин Unity для Claude Code и Codex
Вышел 9 сентября, ставится одной командой. 29 готовых скиллов от инженеров Unity для Unity 6+ плюс Unity CLI и MCP-сервер для управления редактором.
— задача обычным текстом: экран настроек, внутриигровые покупки, мультиплеер с голосовым чатом, шейдеры и URP
— агент сам определяет область задачи и подгружает нужные инструкции


Презентация в комментариях.

@VAI_ART
#VAI_News
👍3🔥1
Media is too big
VIEW IN TELEGRAM
Обновление Arcadia Effector 1.02

Всем привет друзья!
Я вернулся из отпуска, где классно отдохнул, набрался идей и впечатлений, часть из который пойдут в HEXSTORM, часть в новый проект на 3D движке. А какие-то уже реализованы в моем редакторе спецэффектов Arcadia Effector.

Что нового:
- Post FX - Pixel Art. Возможность превращать любые ваши творения в достаточно качественный и хорошо тюнингуемый пиксель-арт.
- Оптимизация GPU. Частицы считаются на CPU и достаточно шустро уже сейчас, а GPU занимается пост-обработкой, там были проблемы с производительностью, вроде решены.
- Полностью обновленный инструментарий работы с атласами, теперь есть превьюшка, можно выбирать конкретные кадры, задавать FPS плейбека.
- Добавлены всплывающие подсказки с описанием того, как действует каждая кнопка и параметр.

[Скачать Arcadia Effector с github]

В ближайшее время планирую показать интересный и экономичный пайплайн работы с 3D играми.
И если поддежите вашим огненным лайком - 🔥, то будет отдельное видео по пайплайну прозводства 2D спрайтовых анимаций, где на полную катушку применю и поделюсь всеми своими инструментами.

P.S. Приятно видеть, как в Чате Чайных Пакетиков сформировалось очень крутое комьюнити начинающих и не только разработчиков, которые вместе поддерживают друг-друга, делятся своими проектами и вместе погружаются в новый удивительный мир ИИ-геймдева. За неделю число участников выросло вдвое и собралось множество талантливых и пытливых умов. Если у вас есть вопросы о том, как начать, или есть желание показать свой проект, то добро пожаловать в чат (вступить в группу можно через комментарии).
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥155
Мне очень нравится то что создают нейронки через Three.js.

Three.js - это инструмент, с помощью которого на обычной веб-странице можно показывать 3D. Не картинку и не видео, а живую сцену: её можно вращать мышью, она реагирует на действия и считается в реальном времени на видеокарте того, кто открыл страницу.

Браузер умеет работать с видеокартой напрямую (эта технология называется WebGL), но писать под неё вручную очень долго и сложно. Three.js берёт всю эту сложность на себя и даёт понятные вещи: сцена, камера, свет, материалы, объекты, постобработка - всё то же, что в 3ds Max или Blender, только задаётся кодом, а не в интерфейсе.

Хорошо подходит для интерактивных сайтов (конфигураторы, промо, портфолио, где объект крутится мышью), визуализация данных и архитектуры, игры и AR/VR без установки, генеративная графика и шейдеры.

Сделал сайт-артефакт, который частично показывает возможности. Там можно покрутить и докрутить в настройках снизу.

@VAI_ART
#VAI_Gallery
🔥83
Подсмотрел неплохой пайплайн для прокачки навыков скиллов практически в любой сфере. Понравился настолько, что делюсь.

Схема такая:

🔹 Идёшь на Amazon и Goodreads (любой другой источник), находишь лучшие книги по теме - по рейтингам и отзывам.
🔹 Из них отбираешь только те, что реально закрывают твою задачу.
🔹 Достаёшь PDF (берём с Anna's Archive).
🔹 Конвертируешь PDF в Markdown - так модель читает текст нормально.
🔹 Отдаёшь ИИ: пусть выберет релевантное, сформулирует основные принципы и обязательно цитирует первоисточник.

Последний пункт ключевой - без цитат получаешь пересказ пересказа, с цитатами каждый тезис можно проверить.

P.S. Идти и отбирать необязательно руками - можно натравить агентов. В общем, процесс можно выстроить практически на автомате, и вот у вас скилл практически под любую задачу.

@VAI_ART
#VAI_Notes
1🔥4👍3😁1