VAI
5.09K subscribers
552 photos
111 videos
4 files
184 links
16 лет в компьютерной графике, 6 лет - арт-директор.
Работал над десятками проектов.
Изучаю ИИ для развития и собираю здесь свой опыт, находки и эксперименты.
Присоединяйтесь!
Личный контакт - @AlexBakakin
Boosty - boosty.to/vai_art

AI l ИИ
Download Telegram
С тем, насколько сейчас выходят крутые модели, лично у меня есть ощущение, что через год нам не нужна будет куча нейронок. Будет достаточно одной LLM, которая будет полностью мультимодальной. Нужно сделать модель - сделает, нужно сгенерировать видео - сгенерирует и т.д. Я уже давно заметил, еще в достаточно старых моделях того же GPT, что она хорошо понимала топологию сетки. Достаточно было попросить наложить сетку на объект или персонажа, и она это делала, но на тот момент у нее не было рук, того же MCP. Или как Claude с помощью математики делает видеоролики, с сюжетом. Т.е. там даже нет и близко модели для генерации видео, но он настолько умный, что она ему и не нужна. Или как сейчас уже можно генерировать звуки через те же LLM-модели, и многое, многое другое. В общем, звоночки были уже давно.

На прошлой неделе вышла новая модель GPT Astra, и с помощью своих мозгов и имеющихся рук ее спокойно подключают к тому же Blender - она очень хорошо понимает форму, сетку и т.д. Понятно, что еще есть косяки, но интернет заполонили модели в достаточно хорошем качестве, которые сделала Astra в Blender. Настройку рендера, материалов - все уже можно делать руками агентов.

Я думаю, что это еще не все. Пока модели недостаточно умные и используют вспомогательные программы для работы. Через год моделям уже будут не нужны эти прокладки и они сами будут делать все внутри себя.

@VAI_ART
#VAI_Notes
👍11😱4🫡1
Думаю, все уже знают, что вышла Imagen 2.5, но поделюсь.

Зачем осенью 2026 года расписывать, что может модель, если она это может сделать сама.

@VAI_ART
#VAI_News
👍8🔥4
Пока все пытаются примостить Astra к 3D, генераторы не отстают. В Tripo наконец-то появилась умная сетка, которая делает сетку из квадратов. На треугольниках она уже давно была.

Генерирует очень быстро, буквально секунд за 15–30. И сетку, и текстуру. Автоматом понимает, где нужно разделить, и разбивает на объекты. Полигонаж можно задавать. С развёрткой всё ещё беда, но тем не менее.

Как и всё, что связано с ИИ, бывает, что косячит, но в целом делает неплохо.

Найдите 10 отличий между концептом и финальной моделью с текстурой)

@VAI_ART
#VAI_Notes
🔥64👍41
Релизов за неделю немного, но все очень крутые. Кратко пробежимся 👾

🔹 ChatGPT Images 2.5 — генератор картинок OpenAI наконец держится за исходник при правках
Вышла 8 сентября, раскатывается на все тарифы ChatGPT, Codex и API. До 50% быстрее второй версии. В API две модели: Flare — быстрая, Sunburst — медленнее, но точнее в сложном редактировании.
— правит один элемент, не разваливая остальное: лицо, персонаж и композиция после цепочки правок держатся, фон не дёргается
— режим Sketch: рисуете каракули прямо в чате, добавляете описание — модель берёт рисунок как инструкцию
— комментарии прямо на картинке для точечных правок, шаблоны Poster и Merch
— в API произвольное разрешение до 4K и шесть уровней качества; максимум в 1024 — около $0,21 за картинку


Презентация в комментариях.

🔹 Suno v6 — три модели сразу и правка отдельных слов в готовом треке
Вышли 9 сентября: v6 и v6-wild для Pro/Premier ($10 и $30 в месяц), v6-mini — всем, включая бесплатный тариф. Старые модели отключают. Обучена на лицензированных каталогах Warner, BMG и Believe.
— меняет фрагмент песни текстовой командой, не пересобирая трек: одну строку или даже слово
— вырезает кусок аудио, например гитарный рифф, и строит вокруг него новый бит; собирает мэшап из своих треков
— на вход принимает текст, аудио, картинку и видео вместе — можно дать ролик и получить музыку под него
— v6-wild — та же модель с выкрученной непредсказуемостью: ловите странную идею там, дорабатываете в обычной v6


🔹 FLUX Video Edit — загружаете своё видео, пишете текстом что поменять, получаете тот же ролик с правкой
Black Forest Labs выпустили 10 сентября. Суть: берёте уже снятый или сгенерированный клип, пишете «замени суши на мясо» или «сделай ночь вместо дня» — и получаете тот же самый ролик, где изменилось только это, а движение камеры, актёры и всё остальное остались как были. Раньше ради одной детали приходилось перегенерировать сцену целиком. Доступно на сайте BFL и на fal, $0,03 за секунду ролика: 10-секундный клип — 30 центов, независимо от сложности правки.
— что можно менять: убрать или добавить предмет, заменить персонажа, поменять фон, материал, освещение, надпись в кадре
— можно переозвучить героя: пишете новую реплику, модель меняет речь и подгоняет губы — но фраза должна быть той же длины, что оригинал
— чего нельзя: ролик дольше 15 секунд не возьмёт, на выходе всегда 720p, показать картинкой «вот такой объект хочу» нельзя — только описать словами


Презентация в комментариях.

🔹 DeepSeek V4.1 Flash — открытая модель, которая в агентных задачах догнала Opus 5
Вышла 10 сентября, веса под MIT — можно крутить у себя или у любого хостера, не завися от API DeepSeek. Одна модель вместо трёх: быстрые ответы, глубокое рассуждение и понимание картинок, режим выбирать не нужно. Контекст 1 млн токенов.
— в задачах «сделай сам в терминале» — 74% против 74% у Opus 5 и 73% у GPT-5.6 Sol, а в автоматизации рутинных цепочек действий — первое место среди всех
— видит картинки: можно кинуть рендер или референс и обсуждать его, а не описывать словами
— глубина рассуждения регулируется по шкале от 1 до 100 — на простое отвечает мгновенно, на сложное думает долго, и это ваш выбор, а не модели
— память под длинный контекст ужали в четыре раза — большие проекты и длинные диалоги не тормозят и не забываются
— при этом стоит как самая дешёвая младшая модель: $0,15 за миллион на входе


График в комметариях.

🔹 Unity Agent Plugin — официальный плагин Unity для Claude Code и Codex
Вышел 9 сентября, ставится одной командой. 29 готовых скиллов от инженеров Unity для Unity 6+ плюс Unity CLI и MCP-сервер для управления редактором.
— задача обычным текстом: экран настроек, внутриигровые покупки, мультиплеер с голосовым чатом, шейдеры и URP
— агент сам определяет область задачи и подгружает нужные инструкции


Презентация в комментариях.

@VAI_ART
#VAI_News
👍3🔥1
Media is too big
VIEW IN TELEGRAM
Обновление Arcadia Effector 1.02

Всем привет друзья!
Я вернулся из отпуска, где классно отдохнул, набрался идей и впечатлений, часть из который пойдут в HEXSTORM, часть в новый проект на 3D движке. А какие-то уже реализованы в моем редакторе спецэффектов Arcadia Effector.

Что нового:
- Post FX - Pixel Art. Возможность превращать любые ваши творения в достаточно качественный и хорошо тюнингуемый пиксель-арт.
- Оптимизация GPU. Частицы считаются на CPU и достаточно шустро уже сейчас, а GPU занимается пост-обработкой, там были проблемы с производительностью, вроде решены.
- Полностью обновленный инструментарий работы с атласами, теперь есть превьюшка, можно выбирать конкретные кадры, задавать FPS плейбека.
- Добавлены всплывающие подсказки с описанием того, как действует каждая кнопка и параметр.

[Скачать Arcadia Effector с github]

В ближайшее время планирую показать интересный и экономичный пайплайн работы с 3D играми.
И если поддежите вашим огненным лайком - 🔥, то будет отдельное видео по пайплайну прозводства 2D спрайтовых анимаций, где на полную катушку применю и поделюсь всеми своими инструментами.

P.S. Приятно видеть, как в Чате Чайных Пакетиков сформировалось очень крутое комьюнити начинающих и не только разработчиков, которые вместе поддерживают друг-друга, делятся своими проектами и вместе погружаются в новый удивительный мир ИИ-геймдева. За неделю число участников выросло вдвое и собралось множество талантливых и пытливых умов. Если у вас есть вопросы о том, как начать, или есть желание показать свой проект, то добро пожаловать в чат (вступить в группу можно через комментарии).
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥155
Мне очень нравится то что создают нейронки через Three.js.

Three.js - это инструмент, с помощью которого на обычной веб-странице можно показывать 3D. Не картинку и не видео, а живую сцену: её можно вращать мышью, она реагирует на действия и считается в реальном времени на видеокарте того, кто открыл страницу.

Браузер умеет работать с видеокартой напрямую (эта технология называется WebGL), но писать под неё вручную очень долго и сложно. Three.js берёт всю эту сложность на себя и даёт понятные вещи: сцена, камера, свет, материалы, объекты, постобработка - всё то же, что в 3ds Max или Blender, только задаётся кодом, а не в интерфейсе.

Хорошо подходит для интерактивных сайтов (конфигураторы, промо, портфолио, где объект крутится мышью), визуализация данных и архитектуры, игры и AR/VR без установки, генеративная графика и шейдеры.

Сделал сайт-артефакт, который частично показывает возможности. Там можно покрутить и докрутить в настройках снизу.

@VAI_ART
#VAI_Gallery
🔥72
Подсмотрел неплохой пайплайн для прокачки навыков скиллов практически в любой сфере. Понравился настолько, что делюсь.

Схема такая:

🔹 Идёшь на Amazon и Goodreads (любой другой источник), находишь лучшие книги по теме - по рейтингам и отзывам.
🔹 Из них отбираешь только те, что реально закрывают твою задачу.
🔹 Достаёшь PDF (берём с Anna's Archive).
🔹 Конвертируешь PDF в Markdown - так модель читает текст нормально.
🔹 Отдаёшь ИИ: пусть выберет релевантное, сформулирует основные принципы и обязательно цитирует первоисточник.

Последний пункт ключевой - без цитат получаешь пересказ пересказа, с цитатами каждый тезис можно проверить.

P.S. Идти и отбирать необязательно руками - можно натравить агентов. В общем, процесс можно выстроить практически на автомате, и вот у вас скилл практически под любую задачу.

@VAI_ART
#VAI_Notes
1🔥4👍3😁1