AI Роман | Про нейросети
7.24K subscribers
427 photos
315 videos
3 files
434 links
Полезные инструкции к нейросетям, которые упростят вам жизнь и работу.

Канал Романа Куцева @roman_kucev – Founder LLM Arena & VseLLM. Выпускник ВМК МГУ, 10 лет в сборе и разметке данных.

👉🏼 Для сотрудничества: @grigoryev_ni
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
☝️ Новый тренд в инсте

AI-блогеры сейчас поголовно отклеивают себя от экрана. Пока выглядит свежо и трендово, забираем для своего блога.

Рассказываю, как повторить ⤵️
1⃣ Берём любое своё фото
2⃣ Копируем промпт:
Cinematic hybrid fashion editorial combining studio and abstract street aesthetic in a 1:1 composition. Same female stylish model with sleek bun and black mesh outfit. Multi-angle storytelling: one panel with a studio circular cutout portrait, one panel with outdoor blurred neon city vibe, one panel with an extreme close-up beauty shot with dramatic lighting. Color palette shifting between teal shadows and warm orange highlights. Vogue-inspired cinematic depth, high-fashion storytelling, ultra-realistic photography, no text, no typography, no captions, clean visual composition only.

3⃣ Идём со своей фотографией и этим промптом в SeeDance 2.0

Когда всё получится – не забудьте поблагодарить реакцией, комментом или бустом

Если что-то не работает – идём в чат и пытаемся разобраться вместе

Сохраните, чтобы не потерять 📌

❤️ – нужно больше инструкций
Please open Telegram to view this post
VIEW IN TELEGRAM
18🔥3😁2❤‍🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
🥺 ByteDance анонсировали Seedance 2.5

Всё, что вам нужно знать об этом:
➡️ Модель сможет генерировать 30-секундные видео за один раз
➡️ Дроп планируется в июле
➡️ Появится платформа для коммерциализации авторских прав на ИИ-контент
➡️ Для Seedance 2.0 уже включили вывод в 4K-формате

Сколько это полуминутное добро в 4K будет стоить – другой вопрос. Возможно, будет дешевле сшить несколько коротких видео от Veo, чем делать одно длинное в SeeDance. Такие новости.

В чате спрашивали про бесплатный доступ к SeeDance – такого, насколько я знаю, нет. Изучу актуальные платформы дам повестку на днях, где лучше брать.

Ставьте ❤️, если надо
Please open Telegram to view this post
VIEW IN TELEGRAM
220🔥2👍1
❗️ Пост-предупреждение

Если читали канал Метаверсище и ИИще – знайте, что акк его владельца взломали, угнали паблик и поэтому там сейчас крипто-шлак. Не ведитесь, а лучше просто отпишитесь – восстановить доступ к каналу сложно и почти невозможно.

И главное – если вам пишут об оставшихся в каком-то боте ваших персональных данных или с другими подобными заявлениями – блокируйте сразу. Чтобы и свой аккаунт оставить в безопасности.

Я тоже не напишу вам первым, никаких продуктов у меня на данный момент нет – а если бы был, сообщил здесь, на канале.

Берегите себя и свои кровные.
Please open Telegram to view this post
VIEW IN TELEGRAM
8👍42💔1🤝1
This media is not supported in your browser
VIEW IN TELEGRAM
💜 Добавил VFX-эффекты в генерацию

Тестил в SeeDance танцы с неоновыми линиями, получилось красиво и свежо.

P.S. Качество подъела телега, на выходе картинка лучше и плавнее.

Как вам?

Промпт в комментариях ⤵️
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥183😍2❤‍🔥1
📌 Что нового в мире ИИ

🤪 ByteDance обновила Seedance 2.0 и показала 2.5
Во вторую версию завезли вывод в 4K, картинка стала заметно чётче.
В 2.5 обещают добавить ролики до 30 секунд без склейки.

🐡 Sakana AI выпустила Fugu
Модель сама собирает команду из других нейронок под задачу.
Версии две: обычная Fugu для повседневки и Fugu Ultra для сложных многошаговых сценариев. Это дирижёр, который сам ничего не считает, но заставляет играть весь оркестр.

🔊 ElevenLabs запустила Ads Engine
Сервис адаптирует рекламу под 50+ языков. Берёт готовый ролик, делает дубляж, меняет текст, картинки и видео под конкретный рынок и собирает локальные версии одной кампании.

🙀 Mistral выпустила OCR 4 для распознавания документов
Она не просто вытаскивает текст из сканов, а понимает структуру страницы: заголовки, таблицы, формулы, подписи и места, где распознавание вышло неуверенным.
Поддерживает 170 языков, ставится на свои серверы. Цена – $4 за 1000 страниц или $2 через batch API.

Genspark выпустила дизайн-инструмент на Claude Opus 4.7
Внутри можно собирать UI-прототипы, постеры, HTML-анимации и видео.
Главная фишка: макет потом превращается в рабочий код через Genspark Code. От картинки до готового интерфейса, без передачи разработчику.

💻 DeepReinforce выпустила Ornith-1.0
Семейство открытых моделей для агентного кодинга. Четыре версии: 9B, 31B, 35B MoE и 397B MoE.
Флагман набрал 77.5 на Terminal-Bench 2.1 и 82.4 на SWE-Bench Verified. Веса уже на Hugging Face.

🤖 OpenAI показала GPT-5.6, но пока только проверенным партнёрам
В семействе три модели: Sol самая мощная, Terra дешевле и сбалансированнее, Luna самая быстрая.
Sol поставила новый рекорд OpenAI на Terminal-Bench 2.1, а в кибербезе вышла на уровень Mythos Preview, потратив при этом меньше токенов.

🫷 Perplexity запустила продукт для юристов
Ищет по судебным решениям, нормативке, публичным документам и файлам клиента, к каждому ответу прикладывает источники.
Ещё собирает досье перед встречей, следит за изменениями в законах, вытаскивает пункты из договоров в таблицу и ищет патентные аналоги.

🫢 Google добавил в Gemini раздел Study Notebooks
Пространство для учёбы и подготовки к экзаменам. Загружаешь конспекты или программу, Gemini прогоняет короткий тест и понимает, что ты уже знаешь, что нужно докрутить.

Сохраните, чтобы не потерять ⭐️
Please open Telegram to view this post
VIEW IN TELEGRAM
12👍3🔥2
🤖 Затестил новый Grok Imagine Video 1.5

Модель стала заметно лучше: физика движений выглядит более естественно и плавнее, картинка чище, генерация быстрее. В качестве и стабильности модель прокачали.

Из минусов – лимиты стали жёстче. Если генерите часто и в больших количествах – почувствуете ограничения.

Вам как?
🔥 – первое видео лучше (Grok Imagine)
❤️ – второе лучше (Grok Imagine 1.5)
👍 – не вижу разницы вообще

Подписаться на канал AI Роман
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
26👍6🔥3
🥸 Anthropic ворвались с кучей новостей

➡️ Вышел Sonnet 5. По параметрам почти дотягивает до Opus 4.8. Уже затестил в приложении – пока особо разницы не увидел.

➡️ Запустили Claude Science. Этот рабочий стол с агентами помогает гонять анализы, ходить в научные базы, собирать графики, таблицы и сразу собирать из этого черновик статьи.

➡️ Сегодня Fable 5 обещают вернуть в общий доступ. Экспортные ограничения сняты. Пока не ясно, восстановят ли неделю доступа по подписке или сразу начнут брать оплату по API-ценам, но новость топ.

Как скачать Claude и другие заблокированные в РФ приложения себе на iPhone – рассказал в этом посте.

В веб-версии включаем прокси, на Android ставим USA-почту в Play Market.

Приятных генераций 🔥
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥123👍3
🥸 МОЛНИЯ: Claude Fable 5 вернули в общий доступ

До 7 июля можно использовать до 50% недельного лимита своего тарифа на Fable 5. Если лимит будет исчерпан, можно продолжить работу с моделью, используя кредиты. При этом Fable 5 расходует лимит быстрее, чем Opus 4.8. И стоят кредиты немало.

Также Anthropic ужесточили классификаторы безопасности: если запрос покажется подозрительным, то его перекинут на Opus 4.8.

Все платные пользователи Claude уже могут пользоваться этой версией на сайте и в мобильном приложении.

Как скачать Claude и другие заблокированные в РФ приложения себе на iPhone – рассказал в этом посте.

В веб-версии включаем прокси, на Android ставим usa-почту в Play Market.

Приятных генераций 🔥
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1121👍1
This media is not supported in your browser
VIEW IN TELEGRAM
🏗 Повторяем самый хайповый тренд в инсте*

Мне не особо нравится, что лента в моменте забита подобными видосами, но это тренды, и вы сами их просите, поэтому рассказываю ⤵️

Как повторить:
1⃣ Заходим в GPT Image или Nano Banana, прикрепляем своё фото в качестве референса и вставляем промпт:
Use the uploaded photo as the identity reference for the person: preserve the overall identity, silhouette, and recognizability from the reference, but do not redesign the model. Create a realistic cinematic photo in 9:16 vertical format.

Show
one single person standing on the very top of a skyscraper antenna / mast, high above New York City. The composition is dramatic and vertigo-inducing: the person is positioned near the top center-left of the frame, balancing on the small metal structure at the summit, while holding a large black flag that extends diagonally across the frame. The background shows a hazy panoramic Manhattan skyline far below, with the Empire State Building clearly visible on the right side and the river plus dense city blocks fading into atmospheric distance.

The person should wear the same style of outfit as in the reference image:
all-black outfit, including a black sleeveless fitted top, black pants, black shoes, and a black face covering / balaclava or mask, creating a bold minimalist urban look. Keep the outfit clean, tactical, and striking.

The flag should be
large, black, and wind-blown, attached to a pole and occupying a big portion of the middle-right of the image. Leave a clearly visible area for text on the flag. Render the flag text as [ТЕКСТ НА ФЛАГЕ] in a bold uppercase condensed sans-serif font, large white letters, centered and highly legible.

The antenna structure should include realistic industrial details: metal ladder sections, safety rails, a narrow platform, and a small red warning beacon light near the top. The overall framing should feel like a high-end extreme urban photography shot captured with a long lens: compressed city background, realistic scale, and intense sense of height.

Lighting should be
soft daylight / overcast haze, with natural muted colors, subtle contrast, and realistic shadows. Style: ultra-realistic photography, cinematic tension, documentary/editorial feel, high detail, slight atmospheric haze, no fantasy look.

Negative prompt: two people, extra people, different outfit colors, cartoon, CGI, surreal fantasy, low detail city, distorted anatomy, extra limbs, unreadable flag, messy text, low resolution, watermark, logo, text outside the flag.

2⃣ Переходим на платформу, где есть SeeDance 2.0 (здесь рассказывал, как получить доступ к нейронке)
3⃣ Вставляем получившееся фото и промпт (оставил его в комментариях)

🔥 – нужно больше трендовых инструкций

*запрещена в рф
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥152❤‍🔥2🤣2
↔️ Промпты в стиле GTA искали?

Заходим в ChatGPT Image, копируем промпт, вставляем его и прикрепляем своё фото в качестве референса.

1-ый промпт:
Convert this image into a 9:16 official GTA VI-style game poster for the charactera as in the reference image standing full-body confidently from extreme low angle camera angle: high-energy, collage-driven cinematic poster art in the game's native promotional language preserving the subject's face and requested pose for immediate recognition while allowing full creative re-layout of background, props, and color-driven mood. CHARACTER: Render the subject as the poster's central playable-character in a full-body shot standing and supporting vignette figures in the same frame; preserve facial likeness, wearing gta character clothing, and signature accessories. Translate clothing into stylized gta vi game-asset costume blocks with sharp edge read, layered foreground/backdrop separation, and strong silhouette hierarchy.FACE & ANATOMY: Use canonical Rockstar-style face logic: realis-tic-but-stylized proportions, clean jaw definition, slightly angular noses, and crisp eyebrow planes; eyes retain recognizable placement but reduced microdetail. Body ratios remain realistic with confident stamding posture; hands simplified for legibility and scaled for cam-era-read impact.ENVIRONMENT: DEVELOP the background into a Miami/urban neon coastal montage: make the attached image characer doing different missions in each montage shape in the background. Make a layered midground architecture, palm silhouettes, fast cars, and neon signage arranged in triangular composition that points to the main portrait.
Keep original character pose and placement but rebuild environment as dynamic, narra-tive-driven vignettes without overpowering the central portrait.RENDER PIPELINE: Medium: stylized digital game-poster illustration. Rendering technique: hard-contour vector-aware paint with painterly texture accents, crisp ink-like edgework, and selective halftone grit in background planes. Shading logic: softened cel-to-painterly hybrid with strong rim highlights and high-contrast cast shadows; no photographic depth-of-field or camera optics.-COLOR & LIGHT: Saturation-forward palette anchored in warm magentas, teal-cyan contrast accents, saturated gold highlights, and deep near-black shadows. Lighting: cinematic key from upper-left with neon rim light accents; highlights clipped for graphic punch and mid-tones kept richly saturated. MATERIALS & TEXTURES: Skin reads as smooth stylized matte with subtle micro-tone but no photographic pores. Hair uses layered painterly strokes with specular strips for neon catch.Clothing and vehicles use simplified PBR-inspired surfaces: clean specular blocks, brushed metal sheens, and soft fabric matte fills. DETAILS: Add high-impact poster elements: bold title area reserved for the exact official GTA VI logo (place once, unmodified, in lower center or upper-center as composition requires). Integrate diegetic props (car silhouettes, palm trees, skyline) as separated graphic planes with light bloom halos and selective film grain.Apply minimal paper-grain and a few controlled brush-scuff marks for authentic promo texture. STYLE EXCLUSIONS: Exclude photorealistic live-action photography, anime/cel-shaded cartooning, flat icon vector art, vintage/retro film treatments, plastic toy or chibi caricature styles.


Остальные промпты в комментариях, своими результатами делитесь там же.

Приятных генераций ☑️
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥123👍2🤣1
🤣 Как исчерпать безлимит?

Последние 3 месяца использовал Runway на тарифе Unlimited для генерации видео и вот что понял.

Безлимит – громко сказано. Да, SeeDance 2.0 работал всё это время в неограниченном доступе, я успел наклепать кучу контента, но:
- приходилось постоять в очереди за роликами,
- больше двух генераций одновременно запускать было нельзя
- и качество со второго месяца стали резать до 720р.

В сентябре безлимит на SeeDance планируют снять вообще – оставить Veo и Kling. Но Veo генерит только за токены ещё с прошлого месяца, а SeeDance выдаёт ошибку уже сейчас.

В месяц на тарифе Unlimited вам дают 3400 кредитов. 1 видео на 10 секунд в качестве 720p стоит 360 кредитов. То есть за $95 вы можете сделать 10 роликов. Вот такой вот безлимит получается)

Вместо безлимита предлагают тариф Max с 9500 кредитами. Значит за 95 долларов вы можете сделать 26 видео по 10 сек в качестве 720p. То есть 1 видео на 1 секунду будет стоит $3,6. Тоже такая себе математика.

В общем, в этом месяце вряд ли буду продлевать – платить 95$ за безлимитный Kling не то же самое, что $50 за Kling + Veo + SeeDance (брал по промо на 3 месяца со скидкой).

Мысли?
👍 – обдиралово
❤️ – пользуюсь другой платформой и мне спокойно
🔥 – расскажи, чё будешь брать вместо runway
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥19👍831
☝️ Сегодня вышли сразу две модели: GPT-Live и Grok 4.5

🤖 OpenAI сделала голосового помощника, с которым можно болтать как с живым человеком: без пауз, можно перебивать на полуслове, отвечает сразу.

Что умеет:
- Слушает и говорит одновременно, а не по очереди
- Пока думает над сложным (например, ищет что-то в интернете) - не молчит, а продолжает поддерживать разговор
- Различает, когда ты просто задумался или закончил фразу; убирает уличный шум; поддакивает, показывая, что слушает
- Прямо во время звонка показывает в приложении карточки: погода, спорт, курс акций
- Можно выбрать режим: быстрый ответ или подольше, но поумнее

С камерой и демонстрацией экрана пока не работает - для этого остался старый голосовой режим.

Где взять: уже раскатывают на iPhone, Android и в браузере. На платных тарифах (Go, Plus, Pro) дают полную версию, на бесплатном - облегчённую mini. Доступ для разработчиков обещают позже.

🤖 xAI выпустил новую модель
Grok 4.5 заточена под код - её натаскивали на огромном количестве рабочих сессий в редакторе кода Cursor.

По тестам вплотную подбирается к GPT-5.5. Но есть нюанс: похоже, модель могли тренировать прямо на тех задачах, по которым потом и замеряли, так что верить цифрам на все сто рановато.

Что по цифрам:
- Держит в памяти до 500К за раз - можно закинуть очень много текста (примерно пара толстых книг)
- Цена $2 / $6 за млн токенов
- Уже доступна в Grok Build, API и в вебе
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🔥42
This media is not supported in your browser
VIEW IN TELEGRAM
😏 Куда так часто пропадаешь?

Получилось снова выбраться в Америку. И, к сожалению, не таким я себе представлял Лос-Анджелес…

LA оставил крайне мерзко-грустные ощущения и дикое разочарование.

Тысячи талантливых, творческих людей тут просто загибаются от нар🥱иков.

Так, например, выглядит вечерний пляж в Санта Монике…

Какие эмоции у вас вызывает это видео?
Please open Telegram to view this post
VIEW IN TELEGRAM
💔1722
🥸 Anthropic оставляет Fable 5 в подписках

С 20 июля модель войдет во все подписки Max и Team Premium. Причем пользователи этих тарифов получат доступ за половину стандартной стоимости.

Для владельцев Pro и Team Standard Fable останется доступен, но пользоваться им придется за счёт кредитов. В качестве компенсации Anthropic начислит дополнительный кредит на 100 долларов.

Компания также уточнила, что для активных пользователей Fable базовый уровень доступа составит 50% от полного объема ресурсов, предусмотренных тарифом.

Ждём теперь Gemini 3.5 Pro – думаю, уровень будет около Fable 5 🔥
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥132👍2
This media is not supported in your browser
VIEW IN TELEGRAM
Все обсуждают, что новая Kimi K3 умеет гонять 300 агентов параллельно

Но это не главная новость – агент-свармы Moonshot внедряли ещё в прошлых версиях Kimi.

Важнее вот что:
➡️ у модели 2,8 триллиона параметров – это одна из крупнейших опенсорс-моделей на сегодня
➡️ контекст в 1 миллион токенов – под огромные кодовые базы, длинные документы и многошаговые агентские задачи
➡️ новая архитектура внимания Kimi Delta Attention + Attention Residuals – экономит вычисления примерно в 2,5 раза эффективнее, чем у K2
➡️ нативная работа с текстом, картинками и видео

По собственным бенчмаркам Moonshot, K3 обходит Claude Opus 4.8 и GPT-5.5 в ряде задач, но по их же признанию Fable 5 и GPT-5.6 всё равно впереди по общему счёту.

Что по лимитам:
☺️ 3$ за 1М входных токенов
☺️ 15$ за 1М выходных
☺️ 0,30$ за 1М кэшированных входных

Модель явно заточена под масштабный код и агентские задачи, а не под обычный чат.

Забавная деталь: рекламный ролик к запуску смонтировал сам Kimi K3 – ему дали 56 исходных клипов, он сам нарезал всё под ритм и прошёл несколько раундов правок без монтажёра.

Комьюнити не теряло времени: за первый день на K3 уже собрали браузерные игры, десктопные интерфейсы, расширения для браузера, 3D-сцены и полноценные full-stack приложения.

Попробовать можно уже сейчас – через Kimi, Kimi Code или API. Открытые веса обещают выложить 27 июля.

Тестим тут:
🔗 kimi.com
🔗 kimi.com/code
Please open Telegram to view this post
VIEW IN TELEGRAM
👍102🔥2
☝️ Где бесплатно генерить картинки в 2K

Собрал сервисы с ежедневными кредитами без подписок. Актуально на момент написания, всё быстро меняется – пишите в комментах, если есть инфа точнее ⤵️

1⃣ Google Flow
Изначально студия под ИИ-видео (Veo 3.1), но картинки там тоже генерятся, причём в 2K.

Бесплатно дают 50 кредитов в день (сброс каждые 24 часа) плюс 100 приветственных при первом входе, карту привязывать не надо. Одна картинка стоит 1-2 кредита, то есть десятки штук в день.

Под капотом Nano Banana 2 Pro, разрешение до 2048×2048, до 4 картинок за один промпт. Сейчас разрабы тестят приложение на iOS, кстати, ждите дроп. Пока в веб-версии работает норм.

2⃣ Genspark AI
На бесплатном тарифе примерно 100-200 кредитов в день, обновляются каждые 24 часа.

Внутри – доступ к Nano Banana Pro 2K, GPT Image, FLUX 2 Pro, Seedream 4.5. По сути агрегатор моделей.

3⃣ Adobe Firefly
В 2026-м Adobe переделали фри-тариф: вместо 25 кредитов в месяц теперь ежедневно обновляемые генерации с потолком в 2K.

Отдельный жирный плюс – Firefly обучен на лицензионном контенте Adobe Stock, самый безопасный вариант для коммерции.

4⃣ Leonardo AI
150 Fast-токенов в день, сброс каждые 24 часа, без переноса на завтра.

Стандартная генерация стоит 2-4 токена, то есть выходит примерно 37-75 картинок в день. Стандарт – 1024, но есть апскейл и куча дообученных моделей.

5⃣ Google Gemini
Лимит с нюансом. Бесплатно в приложении около 20 картинок в день на Nano Banana 2 в разрешении до 1K.

А вот Nano Banana Pro (платная модель) на фри-тарифе ограничен примерно 2 картинками в день.

6⃣ ChatGPT Image
GPT Image 2 поддерживает разрешение до 2K, но лимит жёсткий: около 2-3 картинок в окно 24 часа. Зато удобно итерировать прямо в чате.

Если что-то не работает – идём в чат и пытаемся разобраться вместе

Сохраните, чтобы не потерять 📌

❤️ – нужно больше инструкций
Please open Telegram to view this post
VIEW IN TELEGRAM
316❤‍🔥4🔥4