🫆 Светлый Уголок | ии
503 subscribers
874 photos
177 videos
10 files
504 links
Тут сначала замечают, потом обсуждают.
AI-инсайды, свежие сигналы, честные мнения и свои инструменты.
Светлый уголок — авторский канал про ИИ без скуки.
Download Telegram
🫆 Светлый Уголок | ии
Вы скажете: там же столько талантов, столько инженерии, у них крупная инфраструктура, да следующая модель точно всех порвёт. Да нет. Не двигаются они вперёд, УЖЕ. Google изначально была такой компанией. У них реально много умных людей, просто любая идея там…
Демис Хассабис


Его не обманывают, он всё знает. Когда я видел его лыбу на сцене, где он представлял Veo Omni и заявлял про "лучшее понимание физики", мне стало смешно.

Я уважаю его как человека, он добился многого, руководит DeepMind. Но то, что он делает с моделями последний год, выглядит нечестно по отношению к тем, кто за этим следит.

Но что он делает по факту? Берет авторегрессивную имейдж-модель, даёт ей LLM, которая её промтит, называет это единой мультимодальной моделью и выпускает в API. 🤣

Veo Omni на деле это Gemini + Banana + Veo 3.2 (не выпущенная, обнаружена полтора месяца назад в строках продуктов Google). Nano Banana Pro похожа на слепку из Gemini с инструкциями, инструментами и авторегрессивной моделью сверху. Нигде в карточках ничего не говорится об реальной архитектуре. Хитрые идиотики они).

Многие сотрудники жаловались (я давно это слышал от одного эксперта): Демис пытается объединить все модели в единую мультимодальную омни-систему. Результат (архитектурно) слабый. Он выпускает имейдж-модели и видеомодели под предлогом, что это супернативные мультимодальные модели. На это уходит куча ресурсов, постоянная нагрузка на TPU, а нормальной архитектуры так и нет. OpenAI, мне кажется, просто лучше разбираются в этом, поэтому у них получается иначе и даже лучше.

Его последние модели поражают низким качеством. Их будто просто заливают мощностями, а архитектура уже никого не волнует. Если Gemini проявляет AGI-момент, это заливка данными с Reddit плюс куча вычислительных ресурсов, которые они кинули на обучение своей Gemini LLM-ки.

Раньше он заявлял, что AGI будет через 10 лет со 100% вероятностью. Теперь на конференции 👾 уже 50%, и нужны ещё два архитектурных прорыва. Какие именно, неизвестно. Я уверен, что сам Демис архитектурным моделированием не занимается. Он руководит идеями.

И это не только Демис. В Google вообще культура "анонсов ради анонсов". Сундар Пичаи делает то же самое на каждом I/O: показывает демо, которое не соответствует реальному продукту. Джефф Дин годами обещал прорывы в Gemini, которые оказывались просто скейлингом. Это корпоративная привычка: продать нарратив, а потом подтянуть реальность. Демис просто вписался в эту систему.

Мой канал единственный, который подметил это. Ни один человек ещё этого не отмечал.

За зрение им плюс. У Gemini сейчас лучшее зрение, это факт. Обработка видео раньше всех — это круто, правда, но скорее всего это опять просто разделение на mp3 плюс куча кадров с кешированием, которые модель постепенно переводит в токены.

Я не хочу сказать, что Демис плохой человек или что он целенаправленно всех обманывает. Скорее он поверил в свой нарратив и теперь вынужден его поддерживать. Он заложник собственных заявлений и ожиданий Google. Но факт остается фактом: дать LLM промтить имейдж-модель и назвать это единой системой, это не прорыв. Это маркетинг йооо. 🤯
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥5
🫆 Светлый Уголок | ии
поэтому никогда не удивляйтесь, почему на той же arena.ai Veo 3.1 всегда была на первом месте, а Sora 2 — только после неё.
🤣 А вы тоже заметили, что OmniFlash так и не появилась на arena.ai?

Ой, выходит, договориться не получилось? Или самим стыдно, что ничего добиться не смогли за целый год? Так сильно обосрались, что китайцы уже на несколько шагов впереди?

Но это же ваша самая передовая модель с лучшим пониманием физики, так же что случилось?

Но, кстати, если вспомнить, то Veo 3.1 добавили почти сразу же после выхода.

Omni_Flash в API вряд-ли скоро встанет, это слишком затратно.

Нормально обучить новую видеомодель у них не вышло, поэтому они взяли NB2 + Veo: за пару минут создаётся 3–4 картинки, а дальше frame-to-frame для создание эффекта переходов и тд. Ведь за год наша Veo так и не научилась делать нормальные переходы в видео. Что же сделать оставалось.
3
🫆 Светлый Уголок | ии
Демис Хассабис Его не обманывают, он всё знает. Когда я видел его лыбу на сцене, где он представлял Veo Omni и заявлял про "лучшее понимание физики", мне стало смешно. Я уважаю его как человека, он добился многого, руководит DeepMind. Но то, что он делает…
Как думаете, если развернуть эту тему, описать ещё несколько моментов, сделать подробнее и выложить это на Reddit? Меня поддержат или засрут?

Ну если честно, я не люблю собирать источники и доказательства. Вместо того чтобы копаться в этом, я предпочитаю своими словами объяснять то, что мы видели, что я видел, что все видели и помним.
🤔5
Жду, жду, ЖДУ!!!!!!!!!

Уважаемый Боюань Чэнь, прошу тебя, исправь, блять, шум портит некоторые изображения. Ну прошу, прошууууу!

В общем, они активно работают над этим уже больше месяца, надеюсь это приведет к сильным улучшениям.

А вам самим то как gpt-image 2? Прошло уже не мало времени. Пользуетесь ним чаще NB? Вообще пользуетесь текущими генераторами изображений?
Как ваши дела вообще?
🤣7❤‍🔥11
Случай в 2 актах:
7
Согласно GPT 5.5 Pro Extended, после анализа огромного количества данных и прошлых релизов, наиболее вероятное время следующего релиза:

📆GPT-5.6 выйдет в четверг, 11 июня 2026 года, около 14:20 по восточному времени (ET)

https://x.com/jasperdevs/status/2058020119540896098?s=20
🤔4
Результаты CumBench v1.0 уже доступны.

Gemini 3.5 Flash занимает 1-е место в бенчмарке CumBench, превосходя гораздо более крупные модели, стоящие на класс выше, по качеству итогового результата в реальных условиях.

Разрыв, честно говоря, поражает.
🙏53
Обнаружена новая модель от OpenAI — iris-alpha.

Это Text2Text-модель, то есть, настало время новой модели GPT, и возможно, это 5.6.

Сообщает об этом инсайдер leo из X. Ему кстати можно верить, потому что у него реально есть доступ к ранним названиям моделей OpenAI.

Источник.
❤‍🔥1
🫆 Светлый Уголок | ии
Жду, жду, ЖДУ!!!!!!!!! Уважаемый Боюань Чэнь, прошу тебя, исправь, блять, шум портит некоторые изображения. Ну прошу, прошууууу! В общем, они активно работают над этим уже больше месяца, надеюсь это приведет к сильным улучшениям. А вам самим то как gpt…
Понятно. Они решили незаметно обновлять GPT Image 2, исправляя все её проблемы.

Но хочу вас заверить, что эти проблемы всё ещё часто встречаются.

И всё равно я бы не стал отменять их старания: если бы им выделили новый хороший бюджет на исправление, они бы подготовили GPT Image 2.5 за один месяц.
❤‍🔥1
claude-opus-4.8
❤‍🔥7
Да, это возможно. Кстати, Anthropic не стремятся выпускать линейку-5.

Они считают, что должны решить проблему с безопасностью Claude Mythos. Именно поэтому мы, вероятно, увидим не только предстоящий Claude Opus 4.8 в этом месяце, но и 4.9 потом. Они хотят сделать что-то приближенное к Mythos.

Anthropic, ваши модели всё ещё прекрасны, но дело не в моделях, как мне кажется, дело в доступности вашего продукта и в вашей политике. Пора бы вам проснуться и увидеть, что больше половины перешло в Codex.

Источник насчет claude-opus-4.8 тут. А, эм. Если что ему можно верить, claude-opus-4.8 светилась в бекенде vertex ещё месяц назад, просто об этом никто не говорил.
43
Blue crab - king crab - snow crab? 🦀🦀🦀
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🙏4