Революция Чайных Пакетиков
3.31K subscribers
176 photos
90 videos
139 links
Авторский канал о том, как нейросети меняют наш мир. Делаю игры. Рассказываю, как работают топовые ИИ. Делюсь халявными сервисами. Экспериментирую и угораю над реальностью.
Download Telegram
Новая быстрая и дешевая модель появилась на fal.ai.

Lucy-14b, неплохая и очень дешевая (всего 8 центов за генерацию). По ночным тестам понял, что хорошо слушается промпта, понимает мелкие детали. Но по качеству картинки, даже близко не veo 3. Едва дотягивает до wan 2.2. Но есть неплохое понимание принципов физического мира.

Уверен, Lucy очень скоро появится на freepik и krea, а пока его можно протестировать на fal.ai.

К слову, напоминаю, что мой оптимизатор промтов для видеогенераций до сих пор актуален и регулярно обновляется. Для тех, кто использует не чатГПТ - оставлю промпт-инструкции в первом комментарии.

Как вам модель? Стоит ли она своих восьми центовв?🔥
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥17👍76👎1
Media is too big
VIEW IN TELEGRAM
Reve вернулись!

Самый реалистичный, на мой взгляд, генератор фото снова в строю.

Ребята представили не только обновлённую модель, но и контекстный режим редактирования (как у Nano Banana и Seedream). Умеет добавлять, изменять, и удалять объекты. Менять стиль и работает с текстами.

Кроме того, они выкатили в бету объектно-ориентированный режим (см. видео). Модель распознаёт объекты на картинке и разбивает их на слои, которые можно двигать, задавая точное положение в новой генерации.

Официальный сайт.

Из-за наплыва желающих временно ограничили вход.
Но по-моему, очень круто🔥
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥16👍94❤‍🔥1👎1
hunyuan 3D обновился до версии 3.0!

И без того отличный генератор 3D-моделей получил апдейт. Подняли детализацию, результат заметно лучше.

Чтобы создать модель, достаточно загрузить фото на официальный сайт, и нажать «Generate». Но есть более грамотный способ.

Сначала загружаем фото в Seedream или Nano Banana и получаем объект с трёх сторон. Для этого используем мой генератор и пишем промпт по примеру:

PROMPT 1 (вид спереди)
A [object], shown from the exact front view. Keep only [object], isolated without surroundings.


PROMPT 2 (вид сбоку)
A [object], displayed in a precise side profile view. Keep only [object], isolated without surroundings.


PROMPT 3 (вид сзади)
A [object], shown from the exact rear view. Keep only [object], isolated without surroundings.


После этого загружаем три картинки в Хуньянь и запускаем генерацию.

Еще один крутой инструмент для разработчиков🔥
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥20👍103❤‍🔥3👎1
С помощью Nano Banana можно получить цикл бега для анимации.

Первым изображением нужно загрузить понятную и хорошо читаемую карту бега в хорошем разрешении. Чем больше изображение на входе, тем меньше артефактов. Важно загружать максимально квадратные изображения, так как с ними нейросети проще работать.

Вторым изображением загружаем нашего персонажа.

После этого пишем промпт:

Place the character from the second image into a 9-frame running cycle, following the sequence of poses from the first image. Keep the character’s design, outfit, hairstyle, and proportions unchanged. Align each frame of the character with the corresponding running posture from the blue-green silhouette chart. Maintain consistent lighting, shading, and coloring across all frames. Output should be a clean sequence of 9 frames showing the character running.


Из коробки эта история работает не с первого раза, так как Nano Banana не идеальна и потребует несколько минут на склейку и корректировку.
У меня ушло около десяти минут. Но десять минут это ничто по сравнению с многочасовой ручной работой художника.

В комментариях добавлю исходники.

Ставьте 🔥 если нравятся такие короткие типсы.
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥354👍3😱2👎1
This media is not supported in your browser
VIEW IN TELEGRAM
Производим работу над ошибками.

Вчера я скинул принцип по которому можно получить раскадровку цикла бега, из одного изображения. Но как заметили многие - сам цикл не то, чтобы правильный. И требует длительного времени доработки.

Я попробовал доработать руками, комбинируя разные генерации. И вроде получилось, но провозился почти час. Что непозволительная роскошь для такой маленькой задачи в эпоху AI.

Поэтому подумал, а зачем заставлять генератор картинок генерировать анимацию, если для этого есть генераторы анимации (видео)?

Поэтому рабочий процесс выглядит так:
1. Берем персонажа, закидываем в нанобанану, просим сделать первый кадр бега, на зеленом фоне, буквально:

"Персонаж в позе бега, вид сбоку, на зеленом фоне"

2. Кидаем первый кадр в любой видеогенератор на выбор: kling, seedance, veo. И пишем промпт:

A looping animation of a character running forward. The movement should appear seamless, with continuous leg and arm motion to simulate running.

3. Закидываем получившееся видео в АЕ/Pr/CupCut по вкусу. Удаляем зеленый фон. Экспортим png секвенцию.

Исходники в комментариях.
🔥36👍86
Правильная 3D-генерация

Всю неделю я активно тестировал актуальные 3D-генераторы и изучал разные подходы для получения качественной модели.

Самой удачной считаю связку Nano Banana (или Seedream) и новый Hunyuan 3D 3.0. С ними и будем работать.

Представим задачу:
Из фото сомнительного качества конкретной машины нужно получить её в конкретном ракурсе и условиях.

Попытки подобрать нужный ракурс промптом, скорее всего, приведут к бесконечному перебору генераций. Более контролируемый способ: создать полную 3D-модель объекта.

Начнём.

1. Берём изображение. Я специально выбрал фото сомнительного качества для усложнения. Нанобананой убираем вотермарки. Делаем апскейл.

2. Далее нам необходимо получить 4 ракурса этой машины. Здесь так же используем Nano Banana. Так как мы имеем дело с реально существующим автомобилем, добавляем к промпту реальный блюпринт (заводскую схему). Объединяем фото, блюпринт и промпт:

Place the blue Audi TT car in the exact same positions and angles as shown in the technical sketch: left side view, right side view, front view, and rear view. Keep proportions, details, reflections, and lighting consistent with the real car photo. Background should be removed and replaced with a clean white studio setting.


Важный момент. Нам нужно получить все четыре ракурса на одной картинке, чтобы это была одна и та же машина внутри одной генерации. Просить модель делать отдельные ракурсы по фото — неправильный метод. Пропорции будут различаться, и это помешает 3D-генератору корректно считывать формы.

3. Получив картинку с четырьмя ракурсами, разбиваем её на четыре отдельных изображения в фотошопе или любом другом редакторе.

4. Загружаем эти четыре изображения в Hunyuan 3D, как показано на скриншоте. Чтобы перевести интерфейс с китайского, нажмите правой кнопкой мыши и выберите «Перевести на русский».

5. Hunyuan сгенерирует модель. Её можно скачать или выставить в нужный ракурс прямо в браузере.

6. Делаем скриншот модели и возвращаемся в Nano Banana или Seedream для визуализации со следующим промптом:

A dark blue Audi TT 8S in the exact same position and angle as the reference image, driving fast across a bridge at sunrise, with a glowing megacity skyline in the background. Cinematic wide-angle shot with warm golden lighting, motion blur emphasizing speed, dramatic atmosphere, and realistic reflections on the car’s surface.


Готово. Мы получили конкретный ракурс с конкретным автомобилем. Всё максимально контролируемо и предсказуемо.

В комментариях будут исходники и скриншоты высокого качества.
🔥4413👍12
Media is too big
VIEW IN TELEGRAM
Потестировал новый Kling 2.5 Turbo.

Вчера любимый многими, уже можно сказать «ванильный» генератор обновился до версии 2.5. Следуя трендам, создатели пока выкатили только «малую» модель. Она немного быстрее и в теории чуть послушнее. Но главное - дешевле. На сайте Kling одно видео стоит 25 центов, что приятно, ведь это заметно дешевле Veo 3. Но не сильно дешевле нового фаворита AI-сообщества - Seedance.

Я прогнал ночные тесты и пока что разницы в «послушности» не заметил. Может, в сравнении с 2.1 стало лучше, но по уровню контроля модель всё ещё не дотягивает до лидеров. Да и по скорости прирост не очевиден (2 минуты, против 2:30 старой версии). В общем ждем релиз "старшей" 2.5 версии для полноценного обзора.

Уже можно использовать в агрегаторах типа: freepik и krea.ai. Ну и конечно на официальном сайте.

Интересно ваше мнение, кто уже щупал?🔥
Please open Telegram to view this post
VIEW IN TELEGRAM
8👍4🔥3
Эпичный тест 2D генераторов.

Привет друзья! Много месяцев назад я создал таблицу актуальных моделей и сервисов. Там я сравнил агрегаторы, LLM, генераторы для арта, видео и звука.

Это не список «лучших», а мой личный топ. Когда решаю задачу, сначала пробую верхние строчки, если не работает - иду дальше.

И совсем недавно я сравнил 15 самых актуальных моделей для генерации 2D-изображений. Описал их плюсы и минусы и сделал сравнительные тесты каждой с другими. Таблица будет полезна и новичкам, и тем, кто давно работает с ИИ-генерацией.

Результаты тестов и экспериментов я зафиксировал в новой рейтинговой таблице с наглядными примерами и более 200 картинками. Как и в прошлый раз, я буду обновлять и расширять этот рейтинг по мере выхода новых моделей.

Ссылка на таблицу.
P.S. Таблица реально огромная, поэтому наберитесь терпения при ее загрузке.

Ну и с вас 🔥 если оказалось полезным.
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥69👍1210
Утиные истории (Suno 5)
tearevo
"Технологии становятся настолько сложными и непостижимыми для обычного человека, что воспринимаются как сверхъестественные явления, подобно магии."

Я вроде бы слегка разобрался в устройстве LLM и ImgGen, всё это уже более-менее понятно. Но технология генерация музыки в Suno до сих пор кажется для меня настоящей магией.

Утро моего обычного выходного выглядит так: просыпаюсь, иду к пианино, наигрываю мелодию, записываю её на диктофон, затем загружаю в Suno и прошу: «Сделай красиво». А потом продолжаю день, наслаждаясь своими же мелодиями.

У меня нет дорогой Hi-Fi-системы, чтобы по-настоящему оценить качество звучания, но уже на версии 4.5+ я думал: «Разве можно лучше?» Вышла пятерка и оказалось, что можно. Браво!

А ещё там есть отличная функция Remaster, куда можно подмешать любой стиль или, например, продлить интро. Так что вот вам посвежевшая, но всеми любимая песня.
👍259🔥8
В Cursor завезли Claude 4.5 Sonnet, и я сразу полез тестировать.

Вчерашний вечер начался с задачи: "Создай конвертер пресетов между Adobe Camera Raw и Capture One".
Если не в теме, это такая штука, которая может быть очень полезна фотографам для обработки фотографий.

ChatGPT 5 думал долго и с очень серьезным лицом. Разбил все на подзадачи, по-создавал кучу файлов. Сделал документацию, отчеты и многое другое. Но не взлетело. Десять попыток багофикса ни к чему не привели. Новенький блестящий Claude 4.5 Sonnet справился за десять минут. Да, какое-то время ушло на ручную калибровку и нужно еще повозиться с цветовыми кольцами и чувствительностью кривых. Но тем не менее он справился. За пару вечеров можно сделать вполне себе рабочий инструмент на продажу.

Думается мне, что очень скоро вместо того, чтобы искать нужный софт, мы просто будем заказывать его у LLM. Причем под свой интерфейс и стиль.

Это все бесконечно вдохновляет, потому что между идеей и продуктом будет всего одна ночь. Больше не нужны будут годы учебы техническим знаниям, огромные бюджеты и команды разработчиков. Достаточно мысли и ИИ, чтобы превратить замысел в инструмент и найти свою аудиторию.

Короче, мы входим в эпоху, где главным капиталом становится идея.
🔥30👍106🤔2
Media is too big
VIEW IN TELEGRAM
А помните?

Как то я рассказывал, про будущее, где сериалы мы будем не выбирать, а генерировать под себя .

Обычный чувак, из комментов паблика Сергея Цыпцына просто за вечер сгенерировал кусок Рика и Морти.

Да, это Sora 2. Новый генератор от создателей chatGPT. И вероятно, главный герой наших будущих рилсов.

Примерно такую штуку мы ждали пол года назад, но дождались Veo 3.
- Качество 360p.
- Доступно только под VPN США.
- Требует инвайт кода.

Но невероятно весело😂

P.S. спасибо добрым людям за инвайт❤️
🔥15👍105😁5🤯4
Media is too big
VIEW IN TELEGRAM
Это ВАУ!

Никак иначе описать впечатления от Sora 2 невозможно. Но давайте разберемся. Что именно в ней такого, от чего все так бурно реагируют?

Все дело в том, что это бесконечно интересно. В отличие от Kling/Veo/Seedance - вторая Sora способна выдавать реально осмысленные видео, которые интересно смотреть. Самое захватывающее это наблюдать, как ИИ реализует твою идею по простому односложному промпту.

Хочешь увидеть, как выглядела бы Москва в Minecraft'e? Забирай. Хочешь знать, как бы выглядела рыбалка на Плутоне? Да пожалуйста. На входе ты бросаешь не детально прописанный промпт, а просто идею, а chatGPT 5 додумывает все за тебя. И это самое увлекательное. В отличие от Veo 3, который не делает ничего, о чем не просишь, Sora очень много деталей додумывает, но делает это достаточно вкусно. Модели оставили огромную творческую свободу. Да, это не очень хорошо для серьезного продакшена. Но для этого есть другие нейронки.

Плюсы:
- Результаты реально удивляет. Это первая модель, где t2v режим принес мне такое удовольствие.
- Минимум ошибок: монтаж логичный, сюжет цельный, никакой хаотичной "фантасмагории", как в первой версии.
- Физика и движения персонажей выглядят максимально естественно.

Минусы:
- Бедная реализация визуальных эффектов (все виды симуляции в Kling 2.1-2.5 на голову выше).
- Очень скучная фантазия на несуществующие объекты. Драконы, големы и прочие фэнтезийные твари выглядят простовато.
- Общее качество картинки хуже Veo3 и Seedance

Итог: Sora 2 не про продакшен, а про кайф взаимодействия с ИИ-инструментом. Про радость от того, как твои фантазии оживают на экране.
20👍15🔥5
Media is too big
VIEW IN TELEGRAM
Сравнение Sora 2 с другими генераторами.

Как я уже писал ранее, Sora не про продакшен, а про фан. Но это не значит, что режим img2video совсем непригоден для продакшена. Он показывает весьма неплохие результаты, хотя и отстает от veo 3 и seadream в плане точного следованию промпту:

Cinematic forward moving camera shot, slight camera shake. Steampunk airships with glowing hexagonal sails rushing toward a besieged city. The city is burning, smoke rising, distant flashes of explosions. Dramatic golden sunset light, tense atmosphere, epic scale, flying war machines in the sky


В комментариях оставлю исходники.
А с вас -🔥
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥41👍32
Media is too big
VIEW IN TELEGRAM
Grok Imagine

Давненько не было рубрики #чайная_халява. А тут такой повод.

С самого первого дня существования канала я с большим скептисом относился к ИИ от Маска. Громко на словах, красивые бенчи. Но в коде и личных тестах - все ИИшки от xAI очень отставали.

Но новый генератор от Грок реально неплох. А самое главное - доступен.

На официальном сайте бесплатно дают аж 20 генераций раз в 2 часа. И в целом, за день можно неплохое такое кино наснимать. Качество достаточно вкусное, и главное скорость (5 секундное видео делается около 30 секунд). Буду переодически включать его в быстрые фановые ролики.

P.S. готовлю очень большой видеоматериал для совсем новичков.

P.P.S Накидайте
🔥 за хомяка😁
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥8817😁5
Генератор Изображений от Microsoft.

Мелкомягкие создали свой генератор изображений - MAI-Image-1.

Выдает неплохое качество text2img (слабее nano-banana и seedream 4). Хорошо подчиняется промту, но "шакалит" картинку. Чем сильно напоминает SeeDream 3. Понимает по-русски и умеет делать текст.

Вероятно, Microsoft будут вставлять эту модель во всю свою экосистему.

Можно тестировать в LM-Arena, где модель занимает 9-е место.
👍53❤‍🔥1🔥1