🫆 Светлый Уголок | ии
510 subscribers
878 photos
181 videos
10 files
507 links
Тут сначала замечают, потом обсуждают.
AI-инсайды, свежие сигналы, честные мнения и свои инструменты.
Светлый уголок — авторский канал про ИИ без скуки.
Download Telegram
Forwarded from Some—one
Some—one
Nano Banana Pro не такая нативная как вы думаете. Перед генерацией ваш запрос перехватывает Gemini 3 Pro Image. Мы нашли способ снять эту обёртку и обратиться к базовой модели напрямую. Провели серию тестов с различными промптами – результаты получились…
С этим промптом вы увидите Nano Banana с совершенно другой стороны.

Он заставляет систему отдавать сырые изображения напрямую из датасета img-gen модели. Выглядит это довольно странно, но вам точно понравится, ведь результаты получаются прикольными.

На самом деле Nano Banana Pro сложно назвать нативной моделью. Это совсем простая склейка из двух отдельных систем: Gemini и авторегрессивной image-модели.

По нашим тестам, порог её креативности крайне низок*.
Листайте ниже!🔽
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Some—one
Внутри находится генератор картинок и базовая Gemini, которая сначала переписывает ваш запрос по внутренним инструкциям, а затем запускает генерацию.

Самая любопытная деталь обнаружилась в инструменте google:display.

Он должен проверять безопасность готового кадра перед выводом на экран. Однако инструмент возвращает картинку в любом случае, независимо от ее содержимого. Зачем нужен этот промежуточный шаг при наличии жестких базовых фильтров, пока остается загадкой.

На этом всё! Но не теряйтесь, впереди ещё много интересного.


Поделитесь этой статьей с другими, буду благодарен за помощь в развитии канала. ➡️
Please open Telegram to view this post
VIEW IN TELEGRAM
Geometrybot
Qwen 3.7 Max Preview и Plus уже доступны на официальном сайте Qwen. 🍷 AiBattle (@AiBattle_)
Бенчмарки Qwen 3.7 Max.

В некоторых бенчмарках она обгоняет Claude Opus 4.6 Max. При этом, по мнению большинства пользователей, Claude Opus 4.6 даже лучше, чем 4.7.

Я видел некоторые результаты, и, если честно, они меня поражают.

Это самая лучшая дистилляция, которую я когда-либо видел: это что-то вроде Gemini + Claude. Качество отличное 👍

Qwen 3.7 max – это мощная модель: качество генерации SVG просто впечатляет, а её пространственное мышление превосходит версии Gemini 3.1 Pro и 3.5 Flash.

Это хорошая модель, способная выводить до 5 тысяч строк кода за один раз. Без ошибок. Я уже успел ей воспользоваться, создал несколько игр – это отличная модель.
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔2❤‍🔥1
Media is too big
VIEW IN TELEGRAM
Вот пример её работы.

Видимо, её ещё не выпустили в API. Она доступна только в приложении. Информации о стоимости токенов пока нет.

Также неизвестно, как модель покажет себя в реальных условиях при автономной работе. Поэтому ждём её и терпим

Источник.
❤‍🔥11
Media is too big
VIEW IN TELEGRAM
Какую же базу он несёт!
Это точно так!

Таких, как Artificial Analysis с их Artificial Analytics Intelligence Index, и других даже подкупать не надо.
Они и так поступают по-ублюдски и пытаются угодить всем компаниям сразу, поэтому никогда не удивляйтесь, почему на той же arena.ai Veo 3.1 всегда была на первом месте, а Sora 2 — только после неё.

Источник
.
🫆 Светлый Уголок | ии
Какую же базу он несёт! Это точно так! Таких, как Artificial Analysis с их Artificial Analytics Intelligence Index, и других даже подкупать не надо. Они и так поступают по-ублюдски и пытаются угодить всем компаниям сразу, поэтому никогда не удивляйтесь,…
Google БУКВАЛЬНО ЗАБИЛА на трёх ключевых разработчиков, вложивших душу в Gemini CLI, заставив их искусственно ухудшить свой продукт, подорвав общее доверие к ним.

В итоге мы получили продукт написанный индусами с ии за неделю до i/o — antigravity CLI.

Многие сотрудники покидают Google исключительно из-за халатного отношения компании.

Деньги — это вовсе не проблема для сотрудников Google, хотя по сути OpenAI платит больше, но в данном случае в Google им постоянно обещают: Мол, Ваша жизнь буквально наладится, вам понравится работать здесь, вы откроете для себя новые пути по которым можно будет подниматься дальше. Но на самом деле в Google заставляют просто сидеть, ждать и ничего не делать. — Это общее мнение каждого уходящего из Google сотрудника, я встречаюсь с такими реддитами часто, так как в reddit легко найти подобные посты, обычно там больше правды, чем в поддельном Иксе.

А ещё получается так, что этим гадам проще обманывать, подделывать бенчмарки своих моделей, вводить в заблуждение и нерфить свои модели ради экономии денег.

Вот такой я сделал вывод после просмотра этого видео. Советую и вам посмотреть. I'm scared to make this video

Theo - t3․gg
Действительно взорвал чуть-ли не весь ближний интернет своим новым роликом.
🫆 Светлый Уголок | ии
Google БУКВАЛЬНО ЗАБИЛА на трёх ключевых разработчиков, вложивших душу в Gemini CLI, заставив их искусственно ухудшить свой продукт, подорвав общее доверие к ним. В итоге мы получили продукт написанный индусами с ии за неделю до i/o — antigravity CLI. Многие…
Вы скажете: там же столько талантов, столько инженерии, у них крупная инфраструктура, да следующая модель точно всех порвёт. Да нет. Не двигаются они вперёд, УЖЕ. Google изначально была такой компанией.

У них реально много умных людей, просто любая идея там вязнет в согласованиях. Надо пройти безопасность, юристов, приватность, собрать кучу подписей. Пока ты всё это делаешь, конкуренты уже выкатили три обновы. Ещё google экономят и нанимают обычных индусов.

Плюс Google считает каждый токен. Модель выходит дорогая, её сразу режут. Контекст урезают, фильтров навешивают. Делают вид, что их продукты дно, вы видите это и переходите на другие, но удивительно то, что позже у них всё-таки получиться вернуть часть своих пользователей на некоторое время.

Нормальные инженеры это видят и уходят. Они приходили кодить, а их заставляют писать отчёты. Через год они уже в стартапах, где можно просто работать, (это правда часто так). В Google остаются те, кто привык ждать. А самые известные, может, просто получают хорошие деньги за то, чтобы молчать. Или они всё и так понимают, но у них удобное кресло, зарплата и статус, им так проще короче.
2
🫆 Светлый Уголок | ии
Вы скажете: там же столько талантов, столько инженерии, у них крупная инфраструктура, да следующая модель точно всех порвёт. Да нет. Не двигаются они вперёд, УЖЕ. Google изначально была такой компанией. У них реально много умных людей, просто любая идея там…
Демис Хассабис


Его не обманывают, он всё знает. Когда я видел его лыбу на сцене, где он представлял Veo Omni и заявлял про "лучшее понимание физики", мне стало смешно.

Я уважаю его как человека, он добился многого, руководит DeepMind. Но то, что он делает с моделями последний год, выглядит нечестно по отношению к тем, кто за этим следит.

Но что он делает по факту? Берет авторегрессивную имейдж-модель, даёт ей LLM, которая её промтит, называет это единой мультимодальной моделью и выпускает в API. 🤣

Veo Omni на деле это Gemini + Banana + Veo 3.2 (не выпущенная, обнаружена полтора месяца назад в строках продуктов Google). Nano Banana Pro похожа на слепку из Gemini с инструкциями, инструментами и авторегрессивной моделью сверху. Нигде в карточках ничего не говорится об реальной архитектуре. Хитрые идиотики они).

Многие сотрудники жаловались (я давно это слышал от одного эксперта): Демис пытается объединить все модели в единую мультимодальную омни-систему. Результат (архитектурно) слабый. Он выпускает имейдж-модели и видеомодели под предлогом, что это супернативные мультимодальные модели. На это уходит куча ресурсов, постоянная нагрузка на TPU, а нормальной архитектуры так и нет. OpenAI, мне кажется, просто лучше разбираются в этом, поэтому у них получается иначе и даже лучше.

Его последние модели поражают низким качеством. Их будто просто заливают мощностями, а архитектура уже никого не волнует. Если Gemini проявляет AGI-момент, это заливка данными с Reddit плюс куча вычислительных ресурсов, которые они кинули на обучение своей Gemini LLM-ки.

Раньше он заявлял, что AGI будет через 10 лет со 100% вероятностью. Теперь на конференции 👾 уже 50%, и нужны ещё два архитектурных прорыва. Какие именно, неизвестно. Я уверен, что сам Демис архитектурным моделированием не занимается. Он руководит идеями.

И это не только Демис. В Google вообще культура "анонсов ради анонсов". Сундар Пичаи делает то же самое на каждом I/O: показывает демо, которое не соответствует реальному продукту. Джефф Дин годами обещал прорывы в Gemini, которые оказывались просто скейлингом. Это корпоративная привычка: продать нарратив, а потом подтянуть реальность. Демис просто вписался в эту систему.

Мой канал единственный, который подметил это. Ни один человек ещё этого не отмечал.

За зрение им плюс. У Gemini сейчас лучшее зрение, это факт. Обработка видео раньше всех — это круто, правда, но скорее всего это опять просто разделение на mp3 плюс куча кадров с кешированием, которые модель постепенно переводит в токены.

Я не хочу сказать, что Демис плохой человек или что он целенаправленно всех обманывает. Скорее он поверил в свой нарратив и теперь вынужден его поддерживать. Он заложник собственных заявлений и ожиданий Google. Но факт остается фактом: дать LLM промтить имейдж-модель и назвать это единой системой, это не прорыв. Это маркетинг йооо. 🤯
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥5
🫆 Светлый Уголок | ии
поэтому никогда не удивляйтесь, почему на той же arena.ai Veo 3.1 всегда была на первом месте, а Sora 2 — только после неё.
🤣 А вы тоже заметили, что OmniFlash так и не появилась на arena.ai?

Ой, выходит, договориться не получилось? Или самим стыдно, что ничего добиться не смогли за целый год? Так сильно обосрались, что китайцы уже на несколько шагов впереди?

Но это же ваша самая передовая модель с лучшим пониманием физики, так же что случилось?

Но, кстати, если вспомнить, то Veo 3.1 добавили почти сразу же после выхода.

Omni_Flash в API вряд-ли скоро встанет, это слишком затратно.

Нормально обучить новую видеомодель у них не вышло, поэтому они взяли NB2 + Veo: за пару минут создаётся 3–4 картинки, а дальше frame-to-frame для создание эффекта переходов и тд. Ведь за год наша Veo так и не научилась делать нормальные переходы в видео. Что же сделать оставалось.
3
🫆 Светлый Уголок | ии
Демис Хассабис Его не обманывают, он всё знает. Когда я видел его лыбу на сцене, где он представлял Veo Omni и заявлял про "лучшее понимание физики", мне стало смешно. Я уважаю его как человека, он добился многого, руководит DeepMind. Но то, что он делает…
Как думаете, если развернуть эту тему, описать ещё несколько моментов, сделать подробнее и выложить это на Reddit? Меня поддержат или засрут?

Ну если честно, я не люблю собирать источники и доказательства. Вместо того чтобы копаться в этом, я предпочитаю своими словами объяснять то, что мы видели, что я видел, что все видели и помним.
🤔5
Жду, жду, ЖДУ!!!!!!!!!

Уважаемый Боюань Чэнь, прошу тебя, исправь, блять, шум портит некоторые изображения. Ну прошу, прошууууу!

В общем, они активно работают над этим уже больше месяца, надеюсь это приведет к сильным улучшениям.

А вам самим то как gpt-image 2? Прошло уже не мало времени. Пользуетесь ним чаще NB? Вообще пользуетесь текущими генераторами изображений?
Как ваши дела вообще?
🤣7❤‍🔥11
Случай в 2 актах:
7
Согласно GPT 5.5 Pro Extended, после анализа огромного количества данных и прошлых релизов, наиболее вероятное время следующего релиза:

📆GPT-5.6 выйдет в четверг, 11 июня 2026 года, около 14:20 по восточному времени (ET)

https://x.com/jasperdevs/status/2058020119540896098?s=20
🤔4
Результаты CumBench v1.0 уже доступны.

Gemini 3.5 Flash занимает 1-е место в бенчмарке CumBench, превосходя гораздо более крупные модели, стоящие на класс выше, по качеству итогового результата в реальных условиях.

Разрыв, честно говоря, поражает.
🙏53