Революция Чайных Пакетиков
3.32K subscribers
176 photos
90 videos
139 links
Авторский канал о том, как нейросети меняют наш мир. Делаю игры. Рассказываю, как работают топовые ИИ. Делюсь халявными сервисами. Экспериментирую и угораю над реальностью.
Download Telegram
Veo 3, Flow и другое из Google I/O.

Вчера Google показали Veo 3 и новые возможности Veo 2, доступные на их обновленной платформе Flow (требует VPN США, и американского аккаунта гугл).

Выглядит всё очень круто, но чертовски дорого. Veo3 будет доступен только премиум юзерами Flow за ($125 первые 3 месяца) и $250 после. У новой модели сильно улучшили качество, прикрутили генерацию звука к видео.
Улучшили и Veo2: добавили принудительный контроль камеры, появилась first-last frame и multi-elements, как у Kling (но проверил, пока не доступно).

Как только откроются все функции - проведу сравнительный тест новой модели с veo 2 и Kling 2.0.
👍16🔥82
Токены, мотоциклисты и чашка чая

Впервые понятие "очки внимания" или "attention points" ввёл американский мотоинструктор Кейт Код. Многие мотоциклисты, в том числе и в России, знают его книги и используют их как "библию по выживанию на мотоцикле".

Код объясняет, что у каждого мотоциклиста есть ограниченный объём внимания — как чашка, наполненная до краёв. Когда вы только начинаете ездить, всё — от переключения передач до поворота головы — требует концентрации. Вы не знаете, на чём сфокусироваться, поэтому пытаетесь удержать в поле зрения всё сразу. Ни одно движение ещё не дошло до «мышечной памяти» — каждое приходится продумывать. В такой перегрузке любая неожиданность легко переполняет чашку — и в этот момент вы теряете контроль или делаете ошибку.

Ровно так же работает контекстное окно LLM. Когда вы общаетесь с нейросетью (например, с ChatGPT, Gemini или любой другой), вы "наливаете" в эту чашку чая информацию:

- Ваши вопросы и промпты.
- Предыдущие реплики в диалоге (чтобы нейросеть помнила, о чем вы говорили раньше).
- Любые изображения или файлы, которые вы ей предоставляете.
- "Размышления" или "Chain-of-Thought" мыслящих моделей тоже наполняют чашку.

Нейросеть не видит текст так, как мы – целыми словами и предложениями. Она разбивает его на маленькие кусочки – токены. И каждая такая частичка – это как капля, добавляемая в чашку чая.

Проще говоря: Одно слово может быть одной каплей ("привет"), а может быть и несколькими "каплями", если слово длинное или сложное (например, "искусственный" = "искусств" + "енн" + "ый" – три капли). Даже знаки препинания – это отдельные маленькие "капельки"!

Понимание этого помогает лучше общаться с нейросетями:

- Цените каждую каплю. Пишите по-делу. Чем меньше воды тем крепче чай, и тем меньше токенов он занимает. Значит, больше останется на ответ.

- Не бойтесь начать с чистого листа. Если модель начинает "галлюцинировать" или писать чушь — возможно, контекстное окно переполнено. В таких случаях я обычно прошу сделать сводку нашего разговора в 3-4 тыс. символов, и создаю новый чат. Можете, конечно, тезисно напомнить ей важные вещи, но скорее всего это поможет не на долго.

Теперь вы знаете что такое токены, и как работает контекстное окно LLM.
Приятного вам чаепития и аккуратнее на дорогах
🔥
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥35👍176❤‍🔥2
Самый важный навык успешного специалиста в эпоху AI.

Свой путь в IT я начал лет 18 назад: с дизайна сайтов, затем перешёл в концепт-арт для инди-проектов, после чего стал художником в «Аллодах Онлайн». Потом основал отдел видеопродакшена и трейлер-мейкинга, где много лет руководил командой и изучал моушн-дизайн, режиссуру, композ, менеджмент и арт-дирекшен. В итоге стал... да хрен его знает, кем я стал. Каждый раз, когда меня спрашивают, чем занимаюсь, вопрос вгоняет в лёгкий ступор. Но сейчас это не важно. Важнее другое: весь этот опыт позволяет мне понять, что бы я делал, если бы прямо сейчас захотел попасть в IT-индустрию с нуля.

И это действительно крутой вопрос, ведь AI-технологии уже сильно поменяли правила игры, порождая целую кучу других вопросов.

Например, кому теперь будут нужны джуны? (Джун, или junior — это начальный уровень развития айтишника; далее идут мидл (middle), сеньор (senior) и лид (lead).) Раньше джуны были необходимы, чтобы скидывать на них мелкие задачки, но теперь с этим быстро и качественно справляется ИИ. Это проблема не только для начинающих специалистов, но и для всей индустрии: без джунов не будет мидлов, сеньоров и лидов. Вся стандартная цепочка развития айтишника рискует поломаться.

Получается, чтобы стать востребованным на рынке, теперь нужно развиваться по-другому и мыслить нестандартно. Я думаю, стоит сразу метить на уровень крепкого специалиста. Это не значит «пропустить» наработку фундаментальных навыков, а скорее освоить их на порядок быстрее и глубже, используя новые подходы, чтобы традиционный этап «джуна» стал максимально коротким. А для этого необходимо применять более эффективные методы обучения.

Но какие именно? Эффективны ли курсы?
На мой взгляд, не совсем.

Во-первых, большинство курсов имеют слишком узкую направленность. После них вы становитесь джуном с ограниченными функциями, который, как мы уже выяснили, легко заменяется ИИ-инструментами. А нам нужен уровень выше. Кроме того, создание курсов занимает много времени, и к моменту их выхода изучаемый инструмент или тема может уже потерять актуальность. Т.к. вы сами прекрасно видите скорость развития технологий.

Во-вторых, на мой личный взгляд, главное и самое ценное свойство айтишника — это способность находить, критически оценивать и применять информацию самостоятельно. Если человек не может воспринимать информацию без курсов и учителей, ему будет очень сложно. По моим многолетним наблюдениям, самые крутые специалисты формировались именно благодаря желанию самостоятельно искать и изучать информацию в открытых источниках. Да, линейные курсы могут дать базу, но гораздо полезнее научиться самому разбираться во всём, используя Google, youtube и ChatGPT. Есть мнение, что некоторым новичкам нужны хотя бы базовые навыки, чтобы не захлебнуться в хаосе информации. Но я считаю, что именно способность уметь "плавать" в этой информации — ключевой навык.

И тут нам на помощь приходит сам искусственный интеллект. Ведь LLM — это невероятно удобный и действенный инструмент для получения знаний практически по любому вопросу. И это абсолютно правильно при любой необходимости дёргать ChatGPT, Gemini и других кремнеголовых ребят. Кроме того, опыт взаимодействия с ИИ еще и усилит получаемые навыки.

Т.е. вместо покупки курса по Python идём в LLM и прямо пишем:
Я занимаюсь таким-то, умею то-то. Хочу изучить Python. Напиши план действий для эффективного и интересного обучения.

Он пишет план. Берём первый пункт и просим его подробно расписать, затем просим создать практические задачи. А ещё круче — ставим перед собой реальные цели. Например, «создать Telegram-бота для друзей», чтобы кайфануть и от процесса, и от результата. Это чертовски эффективный подход.

В общем, индустрии нужны не вчерашние джуны, а сегодняшние архитекторы своего роста, способные учить машин, учиться у машин и учиться вместе с машинами.

Понравился пост? Дайте огня! 🔥
🔥7610👍8❤‍🔥4
Как ChatGPT помогает не тупить в жизни?

Итак, все вроде научились основам LLM. Мы просим ChatGPT придумать поздравление, Gemini — проверить код или текст статьи. Студенты пишут дипломы, а школьники делают домашку. Люди всё меньше гуглят и всё больше ищут ответ в LLM.

А теперь давайте сделаем так, чтобы он помог не только с текстами, но и с жизнью.

Я собрал 7 крутых промптов, которые не просто помогут вам что-то сделать, но и разобраться — что именно вам нужно делать. И нужно ли это делать вообще.

1. В работе или жизни часто мы придерживаемся самых разных убеждений. И порой, для объективной оценки нужна щепотка критического мышления. Тогда я использую промпт:

Я верю в [ваше убеждение]. Какие подводные камни я, возможно, не вижу? Что может противоречить этому?


В таком случае чат-бот начинает подкидывать идеи и концепции, которые мы могли пропустить.

2. Похожий промпт, но уже с идеями. Возможно, спасёт вас от преждевременных решений:

Я собираюсь [ваша идея]. Твоя задача — доказать мне, что это полнейшая хрень. Какие были бы самые сильные твои аргументы?


3. Порой, решая какую-либо задачу, я раз за разом захожу в тупик, иногда упуская очевидное.

Я постоянно сталкиваюсь с [ваша проблема], хотя уже попробовал [решения]. Что я не замечаю?


4. "Из коробки" LLM предлагает самые очевидные и распространённые идеи. Но вы можете сильно улучшить свою задумку, заставив его искать менее очевидные подходы:

Мы всегда делали [текущий подход], и это не работает. Почему этот метод проваливается? Какие радикальные альтернативы могут оказаться лучше?


5. Не всегда понятно, ведёт ли твоя цель к успеху или в глубокую задницу. Этот промпт помогает быстро разобраться:

Сейчас я иду к [ваша цель]. Это реально соответствует моим ценностям или я занимаюсь какой-то фигнёй?


6. Промпт, если вы боитесь принять решение и хотите избежать иррациональных тревог:

Я торможу, потому что боюсь [ваш страх]. Этот страх рационален? Что реально худшее может случиться?


7. Есть два стула. Психологи рекомендуют выписать плюсы и минусы каждого сложного решения. Но зачем, если можно спросить об этом LLM?

Я выбираю между [вариант А] и [вариант Б]. Какие скрытые плюсы и минусы каждого варианта я могу не видеть?


Помните, ИИ не даёт готовых решений — он помогает задать себе правильные вопросы. А это уже половина пути.

Эти 7 промптов не просто полезны, они тренируют ваш мозг думать иначе, используя LLM как спарринг-партнера. Попробуйте, и поймёте сами. Результат, возможно, удивит вас больше, чем вы думаете.

И да, если пост зашёл— ставьте 🔥,
🔥54👍164👎2❤‍🔥1
Google Veo 3 без VPN и Google аккаунтов.

Самый хайповый генератор видео сегодня выкатили на всех агрегаторах. Вчера он был на fal.ai, сегодня доступен на krea.ai и freepik (не требует VPN).

Цены🤯

~460 рублей за 1 видео со звуком.
~300 рублей за 1 видео без звука.

Тем временем Kling раздает годовые подписки с 50% скидкой.

Кто уже работал с ним, делитесь впечатлениями в комментариях!

Руки никак не доходят завершить один проектик, где использовал и veo 3, и Kling 2.1. Но тоже напишу свое мнение:

Сравнивал оба генератора. Однозначно, veo 3 лучше, но Kling 2.1 местами интереснее: чуть более живая камера и очень сочные эффекты взрывов и частиц. Они явно богаче, чем у veo 3.

Где veo 3 бесспорно лидирует:

* Крупные планы людей: кожа, мимика, анимация.
* Движение транспорта: машины, самолёты, вертолёты, мотоциклы.

А вот где Kling 2.1 на мой взгляд выигрывает:

- Фантастические VFX. Если надо, чтобы персонаж эпично стрельнул из бластера — точно в Kling.
- Футуристические миры. Veo отлично тянет реализм и повторяющиеся сеттинги, но стоит его отправить в фантастическую среду — начинает жестко сбоить и лепить рандомные каты.
- Любая абстрактная графика.

И опять же, в veo 3 до сих пор нет image2video, а Kling 2.1 даже круче второй версии от гугла. Поэтому, если нужна консистентность в продакшене, veo 3 пока не годится.
👍8🤯64🔥4🤔2
This media is not supported in your browser
VIEW IN TELEGRAM
Будущее уже здесь!

Помните, как Том Круз в «Особом мнении» эффектно вращал сцену в погоне за деталями будущего? Теперь это не фантастика — это наш сегодняшний день!

ИИ научился создавать полное 3D-пространство из обычного видео. Вы можете прямо сейчас бесплатно погрузиться в эту технологиюо вот тут.

Представьте какие возможности это открывает эта технология. Например, смотрить любимый фильм, ставить его на паузу, чтобы осмотреть каждый угол сцены и разглядеть детали с любого ракурса.

Или представьте, как легко можно будет корректировать операторскую работу на постах.

Я тут погуглил. За всей этой крутью стоят два увлечённых китайских энтузиаста — Сунь Цзямин и Чжан Сиюй. Чуваки, вдохновлённые мечтой создать технологию, где каждый сможет буквально «войти» в видеоролик, они бросили престижные работы и ушли в рискованный мир стартапов. Как по сценарию хорошего кино, их первый проект столкнулся с разочарованиями, но не сломил их дух — наоборот, научил видеть возможности там, где другие видят провалы. И вот их новая идея — стрельнула. И не просто стрельнула, а потрясает воображение даже опытных инженеров.

Огонь же? Ну? 🔥
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥657👍7🤔1
Привет, друзья!

Как многим из вас, возможно, известно, у меня есть страсть - авто-мото гонки и всё, что с этим связано. Это отнимает достаточно много времени, и могло показаться, что я забросил канал. Но нет: за лето я придумал и реализовал огромное количество проектов, исследовал тонны новейших ИИ-сервисов и собрал кучу классного опыта, которым хочу с вами поделиться. А раз мотосезон подходит к концу, значит, самое время возвращаться. И совсем скоро канал снова будет работать в обычном ритме.

А пока - вот вам крутой промпт для генерации постера на стену по любимым кино-произведениям. Лучше всего он работает в ChatGPT, но и MidJourney тоже справляется отлично.

Ultra-detailed retro vintage collage of [название произведение]. Central image: [что именно мы хотим тут увидеть, если нет идей - стираем]. Collage elements include torn paper textures, halftone dots, grainy vintage poster effects, scattered music notes, cassette tapes, and fragments of car dashboards. Neon accents of pink, blue, and orange glow subtly, symbolizing speed, tension, and rhythm. Style: chaotic but balanced 80s/90s underground poster art, layered, textured, and cinematic, with dynamic lighting, subtle film grain, motion blur, hyper-detailed, 8K resolution, bold composition, visually striking, and immersive.
👍22🔥125❤‍🔥4👎1
Вероятно, вы уже слышали про Google Nano Banana: новая разрывная модель по редактированию изображения.. Она умеет трансформировать любую картинку по простому текстовому описанию: сохраняет сцену, меняет персонажей, и делает это сильно круче и чище, чем Flux Kontext.

Это идеальный инструмент для видеомейкера, для получения дополнительных шотов. Например, у вас есть первый кадр среднего плана и вы хотите получить новый шот с общим планом - пожалуйста. Сохранит все детали окружения, свет и поменяет ракурс как вам нужно.

C сегодняшнего дня модель доступна на FreePik и других крупных агрегаторах. Кроме того, т.к. это модель принадлежит гуглу, а значит его всегда можно использовать бесплатно в AI STUDIO (он работает при выборе gemini-2.5-flash)

Причем, моделька удивительно круто справляется даже с таким непростым промптом, как: "change alien to ALIEN".

Вы можете сами бесплатно сравнить его с flux kontext или image_gpt в LM Arena (Nano Banana там живет под именем gemini-2.5-flash).

#ЧАЙНАЯ_ХАЛЯВА
🔥24👍86
И снова про вайб-кодинг.

Весной я сделал игру, и даже запустил её на Яндекс.Играх. Там она повисела пару месяцев и неожиданно собрала какие-то деньги на рекламе.

Эксперимент был простой: проверить, можно ли пройти путь от идеи до деплоя без знаний программирования. Сложность я добавил сам: игра должна быть уникальной, без прямых аналогов, чтобы LLM не могла просто скопировать механику из готовых проектов.

Эксперимент считаю удачным. Поэтому спустя время можно сделать некоторые выводы:

Во-первых, на мой взгляд это лучший способ заработка на ИИ в данный момент. Проект, на который ушло около 80 часов, приносил 7–9 тысяч в месяц при закупке трафика на 2.5к. И это только на Яндексе. Публиковать куда-то ещё у меня не было возможности, но банальная математика и сравнение аудитории подсказывают, что Android и iOS давали бы кратно больше. Монетизации в игре не было, жанр для игроков оказался непривычным, метрики держались на дне, но даже в таком виде результат поражал: за две недели работы получаем игру. За год можно собрать штук 20 таких. Даже если каждая будет приносить по 7к, в сумме выходит 100к+ пассива в месяц. И это только Яндекс. А если проект выстрелит? А если выпустить на мобилках? А если провести анализ рынка и попробовать скопировать востребованные жанры/механики? Смекаете?

Во-вторых, знать код действительно не обязательно. Но никто не говорит, что будет легко. Вся механика должна быть в голове. Нужно чётко понимать, как будет ощущаться игровой процесс, и очень-очень-очень много тестировать.

И наконец. Лучшая связка для вайб-кодинга сейчас - это ChatGPT-5 + Cursor. Модель от OpenAI значительно превзошла обновленные Opus 4.1 и Grok 4, а также проверенные временем Gemini и Sonnet, которые остались далеко позади. Она лучше всех справилась с жёсткими вайб-кодинг-задачами. Кроме того, она показала себя как выдающийся кодинг-агент, отлично работающий с внешними инструментами.

Но двухнедельные поделки это интересно, но слишком просто. Поэтому я решил пойти дальше и собрать полноценную игру с метой, экономикой, монетизацией, сложным балансом и ИИ врагов. Прототип вы можете видеть на втором видео. С моей текущей занятостью на такой проект до финала уйдет пару месяцев, т.к. занимаюсь этим в свободное время. Тем не менее:

Если интересна эта тема ставьте 🔥- буду делиться в этом канале результатами и инструментами, которые я применяю. И будем делать игру вместе.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥100👍11❤‍🔥53
Серьезный конкурент для Google и его Nano Banana подъехал из Китая.

Новая модель Seedream 4 умеет все то же самое, что Nano Banana от Google, а местами даже лучше. Уже добавлена во все агрегаторы вроде Freepik и Krea.ai.

После насыщенных ночных тестов понял, что теперь это будет для меня основным инструментом.

Лучше Google понимает промпты, даже на русском языке. Не так боится вносить серьезные изменения. Хорошо понимает углы камер и соблюдает их. Для вас собрал три показательных теста, которые помогут оценить основные отличия и преимущества.

В первом тесте я попросил вставить машину из первого фото во второе. Seedream справился с первой же попытки. Модель от Google ломалась долго, но в итоге сломалась, хотя результат не совсем тот, который я ожидал. Как и с Veo, Nano Banana очень «боится» испортить исходник, поэтому если видит задачу слишком сложной, то просто игнорирует промпт.

Во втором тесте я попросил сделать локацию заснеженной. С 3–4 попытки Nano Banana лишь слегка присыпала землю снегом и вырастила сосульки. Seedream же полностью перерисовал локацию, оставив ее узнаваемость и геометрию.

Третий тест был самым сложным. Необходимо было сделать постер из шести изображений на входе. Обе модельки справились. Но опять же, на мой взгляд, Seedream сделал интереснее. Хотя, конечно, оба варианта далеки до продакшн-качества.

Seedream более «смелый», он легко выполняет любую хотелку пользователя и не боится ошибаться. К задаче подходит более креативно, чем аналог от Google. Но есть и минусы: он сильнее шакалит картинку и ломает лица и тексты. Особенно на дальних планах.

Как вам новая модель? Огонь же?🔥
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥354👍3👎1
Всем привет!

На основе документации к Seedream и опыта работы с Nano Banana я собрал инструкции для генератора промптов, который подходит и для Seedream 4, и для модели от Google.

Вы просто пишете на любом языке, что хотите, и получаете корректный промпт на английском с учётом всех лингвистических особенностей модели.

Если у вас есть доступ к GPT-5, переходите по ссылке.

Если используете другую LLM, можете напрямую вставить инструкции (оставлю их в первом комментарии). Сначала вставляете их, затем описываете задачу.

Сохраняйте пост, если часто редактируете изображения в ИИ🔥
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥30👍118❤‍🔥3