OpenAI только что подписала сделку с Cerebras на 750 МВт.
Это значит:
Следующий ChatGPT (GPT-6-7) будет отвечать гораздо быстрее, это, считай, как Реал-тайм reasoning, а ещё потом и голос, и агенты.
До 15–20× ниже задержка по сравнению с обычными NVIDIA-системами.
Значит, что 90-100 TPS > 190-250 а то и 300-400 TPS. Будет большой прирост в скорости генерации текста, изображений, видео и тд.
А ещё, это значит, что уже тогда, можно будет нормально юзать. Лично для меня невыносимо терпеть 70-90 TPS у CHAT GPT 5.2 pro.
Источник
Это значит:
Следующий ChatGPT (GPT-6-7) будет отвечать гораздо быстрее, это, считай, как Реал-тайм reasoning, а ещё потом и голос, и агенты.
До 15–20× ниже задержка по сравнению с обычными NVIDIA-системами.
Sam Altman инвестировал в Cerebras ещё годы назад – и вот оно, взорвалось.
Значит, что 90-100 TPS > 190-250 а то и 300-400 TPS. Будет большой прирост в скорости генерации текста, изображений, видео и тд.
А ещё, это значит, что уже тогда, можно будет нормально юзать. Лично для меня невыносимо терпеть 70-90 TPS у CHAT GPT 5.2 pro.
Источник
🌲 Новая Gemini 3.5 Flash Image (она же NANO BANANA V3)
P.S. — Выяснилось, что это просто внутренняя модель для сотрудников Google. На данный момент никакой информации о Nano banana v3 нет.
Это уровень выше Pro! Хотя мелкие огрехи в лицах и деталях текста всё еще встречаются (если очень внимательно искать), в целом всё круто. Текст стал намного четче, генерация объектов — стабильнее, а дизайн интерфейсов просто на высоте.
Оценивайте примеры в комментариях! 👇
P.S. — Выяснилось, что это просто внутренняя модель для сотрудников Google. На данный момент никакой информации о Nano banana v3 нет.
Это уровень выше Pro! Хотя мелкие огрехи в лицах и деталях текста всё еще встречаются (если очень внимательно искать), в целом всё круто. Текст стал намного четче, генерация объектов — стабильнее, а дизайн интерфейсов просто на высоте.
Оценивайте примеры в комментариях! 👇
🧐 Я вот честно не знаю, что ожидать от нейронок?...
Когда я ждал ту самую Gemini 3 Pro, я прям люто ждал её: и летом, и весной, и зимой. И всё же она вышла! И всё же потом, через пару недель появились конкуренты.
Я так и не сказал, что именно хотел донести.
Знаете, когда я тестировал модель в октябре, я кайфовал от дизайна Gemini 3 Pro. Я думал: «Вот оно — то, чего не хватает другим нейронкам». Это было круто. По сравнению с моделями до выхода 3 Pro, дизайн у них был максимально шаблонный. Сейчас стало лучше, прогресс налицо, но снова и снова хочется большего. Не удивляют меня эти модели: что GPT 5.2, что Claude Opus, что Gemini 3 Pro.
Теперь видно, что прогресс большой, но всё ещё не идеал. Идеал я уже выстроил у себя в голове. Например, если я хочу отыграть РП с нейронкой, то она должна обдумывать каждый шаг персонажей, каждое действие; делать это настолько реалистично, оригинально, неповторимо и непревзойденно, насколько это возможно. И этого всё ещё нет даже в Gemini 3 Pro. Хотя у Google есть модель, которая, по словам одногоX-ловека , сильнее, чем GPT 5.2 (x-High) — думает глубже, осознает свои действия, и при этом не по 10–30 минут.
А ещё, возьмем, например, HTML-игру. Вот что должна делать нейронка с первого раза? Я думал и думал об этом, и понял: чтобы назвать нейронку «не говном», она должна превосходить человека во многом. И первое — это планирование того, что она будет создавать. Даже GPT 5.2 xHigh — это всё ещё не тот глубокий уровень. Это не очень.
Так про что я? Вот взять Air Combat.
Что должно быть идеальным и), что должна уметь нейронка: максимально продуманный код наперёд, токен за токеном модель должна понимать, что она делает. Дизайн, постабработка, SVG, моделирование, рисование — всё на высшем уровне. Я считаю, она должна создавать идеальный дизайн: проработанные самолётики, UX, логика, боёвка. Каждая кнопка — не шум, а действительно что-то важное; то, что при нажатии имеет вес или функцию. Это должно быть идеально, а этого нет...
Что ж, ждём середины этого года. Думаю, станет лучше, но это всё равно будет не тот уровень.
А что думаете вы?
Когда я ждал ту самую Gemini 3 Pro, я прям люто ждал её: и летом, и весной, и зимой. И всё же она вышла! И всё же потом, через пару недель появились конкуренты.
Здорово, что все стали сразу догонять Google. Это, пожалуй, был самый успешный конец года.
Я так и не сказал, что именно хотел донести.
Знаете, когда я тестировал модель в октябре, я кайфовал от дизайна Gemini 3 Pro. Я думал: «Вот оно — то, чего не хватает другим нейронкам». Это было круто. По сравнению с моделями до выхода 3 Pro, дизайн у них был максимально шаблонный. Сейчас стало лучше, прогресс налицо, но снова и снова хочется большего. Не удивляют меня эти модели: что GPT 5.2, что Claude Opus, что Gemini 3 Pro.
Теперь видно, что прогресс большой, но всё ещё не идеал. Идеал я уже выстроил у себя в голове. Например, если я хочу отыграть РП с нейронкой, то она должна обдумывать каждый шаг персонажей, каждое действие; делать это настолько реалистично, оригинально, неповторимо и непревзойденно, насколько это возможно. И этого всё ещё нет даже в Gemini 3 Pro. Хотя у Google есть модель, которая, по словам одного
А ещё, возьмем, например, HTML-игру. Вот что должна делать нейронка с первого раза? Я думал и думал об этом, и понял: чтобы назвать нейронку «не говном», она должна превосходить человека во многом. И первое — это планирование того, что она будет создавать. Даже GPT 5.2 xHigh — это всё ещё не тот глубокий уровень. Это не очень.
Так про что я? Вот взять Air Combat.
Что должно быть идеальным и), что должна уметь нейронка: максимально продуманный код наперёд, токен за токеном модель должна понимать, что она делает. Дизайн, постабработка, SVG, моделирование, рисование — всё на высшем уровне. Я считаю, она должна создавать идеальный дизайн: проработанные самолётики, UX, логика, боёвка. Каждая кнопка — не шум, а действительно что-то важное; то, что при нажатии имеет вес или функцию. Это должно быть идеально, а этого нет...
Что ж, ждём середины этого года. Думаю, станет лучше, но это всё равно будет не тот уровень.
А что думаете вы?
👍5
Светлый Уголок | ии
OpenAI только что подписала сделку с Cerebras на 750 МВт. Это значит: Следующий ChatGPT (GPT-6-7) будет отвечать гораздо быстрее, это, считай, как Реал-тайм reasoning, а ещё потом и голос, и агенты. До 15–20× ниже задержка по сравнению с обычными NVIDIA…
Сделка OpenAI с Cerebras прошла успешно. А вот пример того, насколько сильно может вырасти скорость.
Ожидаю, что следующие модели будут работать на скоростях ~ 140-200 TPS.
Вот такой вот разгон имеют некоторые модели, преданные в руки Cerebras:
Ожидаю, что следующие модели будут работать на скоростях ~ 140-200 TPS.
Вот такой вот разгон имеют некоторые модели, преданные в руки Cerebras:
👍3
🐇 Новая Gemini "Snowbunny" просто уничтожает конкурентов в бенчмарке "Heiroglyph Benchmark Results".
Перед вами результаты теста новой контрольной точки Gemini. На удивление она набирает значительно больше, чем сама Gemini 3 Pro, Lithiumflow и даже GPT-5.
Что это значит? Snowbunny на голову выше всех существующих моделей в латеральном мышлении. Она находит скрытые логические связи там, где другие ИИ пасуют.
Этот бенчмарк пользовательский и неофициальный.
Перед вами результаты теста новой контрольной точки Gemini. На удивление она набирает значительно больше, чем сама Gemini 3 Pro, Lithiumflow и даже GPT-5.
Что это значит? Snowbunny на голову выше всех существующих моделей в латеральном мышлении. Она находит скрытые логические связи там, где другие ИИ пасуют.
Этот бенчмарк пользовательский и неофициальный.
👍2
Пример видео от модели siren.
8 секунд видео, не 6, как у grok. В любом случае это не veo 3.2. Качество здесь заметно хуже.
8 секунд видео, не 6, как у grok. В любом случае это не veo 3.2. Качество здесь заметно хуже.
Google планирует выпустить новую версию VEO – 3.2. И скорее всего это произойдет уже в этом месяце!
Я проверил, и да, всё верно, в коде google flow уже существует данный нейминг новой модели Veo.
Также стоит прояснить ситуацию с моделью Siren на LM Arena. Мои предыдущие догадки не подтвердились: вероятнее всего, это Grok Imagine, готовящийся к выходу в API.
Источник
#Новости
Я проверил, и да, всё верно, в коде google flow уже существует данный нейминг новой модели Veo.
Также стоит прояснить ситуацию с моделью Siren на LM Arena. Мои предыдущие догадки не подтвердились: вероятнее всего, это Grok Imagine, готовящийся к выходу в API.
Источник
#Новости
Светлый Уголок | ии
Google планирует выпустить новую версию VEO – 3.2. И скорее всего это произойдет уже в этом месяце! Я проверил, и да, всё верно, в коде google flow уже существует данный нейминг новой модели Veo. Также стоит прояснить ситуацию с моделью Siren на LM Arena.…
This media is not supported in your browser
VIEW IN TELEGRAM
Генерация предварительной версии Veo 3.2.
На данный момент я не могу подтвердить, что это оригинальная Veo 3.2
👀 DeepSeek R2 или V4 на подходе!
Такое обычно делают за 1–3 дня до релиза.
Плюс сегодня ровно год с выхода R1 — идеальный тайминг для выхода чего-то грандиозного.
#Новости
В репозитории FlashMLA (ядра для V3/V3.2) добавили поддержку MODEL1 как отдельной модели.
Ключевые изменения:
KV-cache stride: 576B (против 656B у V3.2) – это может означать, что архитектуру хорошо улучшили.
Такое обычно делают за 1–3 дня до релиза.
Плюс сегодня ровно год с выхода R1 — идеальный тайминг для выхода чего-то грандиозного.
#Новости
❤🔥1
Светлый Уголок | ии
🐇 Новая Gemini "Snowbunny" просто уничтожает конкурентов в бенчмарке "Heiroglyph Benchmark Results". Перед вами результаты теста новой контрольной точки Gemini. На удивление она набирает значительно больше, чем сама Gemini 3 Pro, Lithiumflow и даже GPT-5.…
Audio
Несколько исполнительных треков от Gemini "Snowbunny"
#Щитпост
#Щитпост
Google признает: Главный тормоз ИИ — это не отсутствие чипов. Проблема в энергосетях.
Google признали очень показательную вещь:
В некоторых регионах ожидание подключения растягивается на 10–12 лет. Представьте, один только этап «исследования возможности подключения» может занимать годы.
Чипы — проблему почти решили.
GPU можно купить. Да, это конские бюджеты, но это решаемый вопрос денег.
Электричество — тоже решаемо.
BigTech (Google, Microsoft, Amazon) уже вовсю заходит в атомку, строит свою генерацию и подписывает контракты на десятилетия вперёд.
Grid connection — Линии перегружены, а очереди на исследования и разрешения расписаны на десятилетия вперёд.
Тот, кто быстрее всех решит проблему с сетями, и будет диктовать правила в гонке.
Кстати, у Google сейчас большие проблемы с этим. Больше чем у OAI.
Источник
#Новости
Google признали очень показательную вещь:
Сейчас самое сложное в запуске новых дата-центров — не контракт на энергию подписать, а физически подключиться к магистральной сети.
В некоторых регионах ожидание подключения растягивается на 10–12 лет. Представьте, один только этап «исследования возможности подключения» может занимать годы.
Чипы — проблему почти решили.
GPU можно купить. Да, это конские бюджеты, но это решаемый вопрос денег.
Электричество — тоже решаемо.
BigTech (Google, Microsoft, Amazon) уже вовсю заходит в атомку, строит свою генерацию и подписывает контракты на десятилетия вперёд.
Grid connection — Линии перегружены, а очереди на исследования и разрешения расписаны на десятилетия вперёд.
Тот, кто быстрее всех решит проблему с сетями, и будет диктовать правила в гонке.
Кстати, у Google сейчас большие проблемы с этим. Больше чем у OAI.
Источник
#Новости