Светлый Уголок | ии
🚧 У Google сейчас серьёзные проблемы с мощностями. Они явно не успели подготовить инфраструктуру к тем нагрузкам, которые существуют сегодня. Только представьте, насколько тяжеловесна модель NB PRO. Это реально тяжёлая модель: огромный датасет изображений…
⚡️ DeepMind: всё железо на новые модели
В Google
Вот оно как. Теперь ясно почему. По сообщениям источников, приоритет отдан новым моделям, что вызвало дефицит ресурсов для текущей инфраструктуры.
Что происходит:
— Резко сокращены мощности для «некритичных» операций: отладки серверов и работы с текущими
— Инженерам поручили компенсировать нехватку железа через глубокую оптимизацию кода.
— Команда
Ситуация указывает на предельную нагрузку на вычислительную базу Google. В условиях гонки нейросетей мощностей не хватает даже гигантам.
#Новости
В Google
DeepMind произошло масштабное перераспределение мощностей ради обучения нейронок следующего поколения. Вот оно как. Теперь ясно почему. По сообщениям источников, приоритет отдан новым моделям, что вызвало дефицит ресурсов для текущей инфраструктуры.
Что происходит:
— Резко сокращены мощности для «некритичных» операций: отладки серверов и работы с текущими
LLM.— Инженерам поручили компенсировать нехватку железа через глубокую оптимизацию кода.
— Команда
DeepMind также помогает Anthropic разгребать технические проблемы с их TPU.Ограничение ресурсов осложнило даже базовую работу с железом внутри компании.
Ситуация указывает на предельную нагрузку на вычислительную базу Google. В условиях гонки нейросетей мощностей не хватает даже гигантам.
#Новости
❤🔥2
Ещё одна проблема почему Gemini 3 Pro теряет контекст. Спойлер: Google экономит. 🪙
Во-первых, KV Cache и его дикое сжатие. Кэш памяти в трансформерах жрет ресурсы линейно. Чтобы серверы не ложились, Google, судя по всему, перешла на INT2-квантование кэша. То есть данные сжимаются до 2 бит. В память влезает больше, но точность страдает фатально — отсюда и забытые куски кода или перепутанные цифры. Детали просто "мылятся" при сжатии.
Во-вторых, она реально не читает весь ваш текст. Используется механизм маршрутизации внимания. Модель сканирует контекст и выбирает, какие токены обрабатывать, а какие — пропустить, чтобы сэкономить вычислительный бюджет. Если алгоритм посчитал кусок вашего промпта "шумом", модель его физически не увидит при ответе.
Хорошая новость в том, что это, вероятно, временно? Не знаю. Этой проблеме уже 2 года. Все модели Gemini получают большой урон от этого. Но в любом случае, Google готовит архитектуру TITANS и систему MIRAS — это переход к нейронной долгосрочной памяти.
#Мысли
Автор — @Geometry90
Многие замечали, что после 10-20к токенов Gemini превращается в тыкву: забывает начало диалога, выдумывает факты и теряет нить. Я покопался в доках и профильных тредах, и, кажется, проблема не в "глюках", а в сознательной (и довольно жесткой) оптимизации.Тут работают два фактора:
Во-первых, KV Cache и его дикое сжатие. Кэш памяти в трансформерах жрет ресурсы линейно. Чтобы серверы не ложились, Google, судя по всему, перешла на INT2-квантование кэша. То есть данные сжимаются до 2 бит. В память влезает больше, но точность страдает фатально — отсюда и забытые куски кода или перепутанные цифры. Детали просто "мылятся" при сжатии.
Во-вторых, она реально не читает весь ваш текст. Используется механизм маршрутизации внимания. Модель сканирует контекст и выбирает, какие токены обрабатывать, а какие — пропустить, чтобы сэкономить вычислительный бюджет. Если алгоритм посчитал кусок вашего промпта "шумом", модель его физически не увидит при ответе.
Хорошая новость в том, что это, вероятно, временно? Не знаю. Этой проблеме уже 2 года. Все модели Gemini получают большой урон от этого. Но в любом случае, Google готовит архитектуру TITANS и систему MIRAS — это переход к нейронной долгосрочной памяти.
В общем, сейчас такое время, где Google пытается сэкономить на TPU. Ждем Gemini 3.5 и новой архитектуры, там это должны пофиксить. Чего ждать дальше не знаю
#Мысли
Автор — @Geometry90
🤔3
В ближайшее время выйдет много всего интересного!
Делюсь примерными сроками: они почти точные, хотя всегда стоит оставлять долю сомнения в источниках.
Делюсь примерными сроками: они почти точные, хотя всегда стоит оставлять долю сомнения в источниках.
Grok 4.20 — на этой неделе. Но разработчики могут снова замолчать и подвести всех, как это часто бывает. Все уже видели каким будет Grok 4.20. ТАК И ПРОИЗОШЛО БЛЯТЬ ПЕРЕНЕСЛИ ДО СЕРЕДИНЫ ФЕВРАЛЯ! ОТЛИЧНО НАХ! 🥳ChatGPT 5.3 — ставлю, что он станет лучше во всех аспектах: станет живее, а фронтенд сильно подтянут. Релиз будет скоро, ждём в течение двух недель (конец января — начало февраля).Claude 4.7 Sonnet — он должен быть во всём лучше Opus: дешевле, быстрее и круче. Срок — февраль.Gemini 3 Pro GA — особых надежд на них не питаю. Версия GA не стала толком лучше в тех аспектах, где сейчас лидируют Claude и ChatGPT (я про агентность и галлюцинации). Судя по всему, они не стремятся исправлять это и в Gemini 3.5. Дата — середина февраля.DeepSeek R2 и V4 — я просто верю в них. Ребята должны сделать что-то классное. Судя по их статьям и фактам, они много работали, так что фраза «релиз будет крутым» звучит вполне оправданно. Выход ожидается до 17 февраля.Вот так: у каждой компании и каждой модели свои причуды и своя история. Ждём.
X (formerly Twitter)
Chetaslua (@chetaslua) on X
So our team are working to get latest and finest information before anyone .\
> Sonnet
> Gemini 3.0 pro GA
> GPT 5.3
one good news < sonnet will be better , cheaper and faster than opus 4.5 > i mean in every criteria
follow @legit_api @Liam06972452…
> Sonnet
> Gemini 3.0 pro GA
> GPT 5.3
one good news < sonnet will be better , cheaper and faster than opus 4.5 > i mean in every criteria
follow @legit_api @Liam06972452…
❤🔥4
Google купил CSM: 3D в Gemini?
Google тихо поглотил стартап
Что это значит прямо сейчас:
— Google забрал себе топовую технологию 2D → 3D.
— Пока публичных фич нет, сделку провели без лишнего шума.
— В
После интеграции CSM из текста или фото можно будет получать не просто картинку, а готовую 3D-модель, которую можно скачать и сразу юзать.
Кстати, это лишь часть недели: ещё была лицензия от
Источник:
#Новости #Инсайд
Google тихо поглотил стартап
Common Sense Machines (CSM). Это небольшая команда из ~12 крутых спецов, которые делают одну из лучших технологий превращения 2D-картинок в полноценные 3D-модели.Что это значит прямо сейчас:
— Google забрал себе топовую технологию 2D → 3D.
— Пока публичных фич нет, сделку провели без лишнего шума.
— В
Gemini добавят генерацию 3D нативно. Скорее всего, это случится уже в следующих Nano Banana.После интеграции CSM из текста или фото можно будет получать не просто картинку, а готовую 3D-модель, которую можно скачать и сразу юзать.
От себя:
Думаю, увидим это в 2026 году или даже на Google I/O в мае в обновлениях Gemini app / AI Studio. Google обычно очень быстро внедряет такие штуки.
Кстати, это лишь часть недели: ещё была лицензия от
Hume AI (эмоциональный голос). Об этом напишу позже.Источник:
#Новости #Инсайд
❤🔥4👍1
🐰 Клон Windows XP за один промпт
Gemini
Прикольно? Прикольно.
Это сильное улучшение по сравнению с
Выкатят ли её в таком виде в GA — большой вопрос. Мы знаем любовь Google всё резать ради экономии ресурсов.
И кстати,
#Новости #Инсайд
Gemini
Snowbunny собрала интерфейс старой винды всего по одному запросу.Прикольно? Прикольно.
Это сильное улучшение по сравнению с
Gemini 3 pro — она такого не может.Выкатят ли её в таком виде в GA — большой вопрос. Мы знаем любовь Google всё резать ради экономии ресурсов.
И кстати,
Snowbunny уже понерфили, но даже так она крутая.#Новости #Инсайд
Светлый Уголок | ии
Grok в X генерит 183 млн картинок
Как это? 🤣 Ладно, ладно.
Статистика в день:
—
—
#Щитпост
Как это? 🤣 Ладно, ладно.
Grok интегрировали в X. Разница в цифрах обусловлена его распространением среди юзеров и бесшовной интеграцией.
Статистика в день:
—
Grok: около 183 млн изображений—
Nano Banana Pro: ~19 млн (1 млрд за 53 дня)#Щитпост
🤔1
Altman зовёт AI-разработчиков на town hall OpenAI
OpenAI проводит сбор отзывов перед релизом инструментов нового поколения. Тестирование проходит в экспериментальном формате, а результаты обсуждения будут опубликованы в открытом доступе.
Перевод:
Трансляция будет на YouTube 27 января 2026, 03:00 МСК если кому интересно
Ждёте новостей насчёт Gpt 5.3?
#Новости
OpenAI проводит сбор отзывов перед релизом инструментов нового поколения. Тестирование проходит в экспериментальном формате, а результаты обсуждения будут опубликованы в открытом доступе.
Перевод:
Завтра мы проведём town hall для AI-билдеров в OpenAI. Мы хотим фидбек, потому что начинаем создавать новое поколение инструментов.
Трансляция будет на YouTube 27 января 2026, 03:00 МСК если кому интересно
Ждёте новостей насчёт Gpt 5.3?
#Новости
Сколько всего в голове, столько идей. Признаю честно: я СДВГшник, и работать мне вправду трудно.
Концентрация плохая. По сравнению с детством стало лучше, но в работе мешает. Зато есть плюсы — продуктивность и идеи. Когда работаешь над чем-то одним, мозг на ходу генерирует кучу других мыслей.
В общем, хочу сейчас выпустить 2 проекта. Один — совсем скоро. Над другим еще не начинал, но уверен, что сделаю первую альфу за 1 неделю и испытаю.
Трудно бывает. Особенно когда писал сейчас промпт для ИИ, и резко пришло в голову написать всё это сюда. 👐
#Щитпост
Подписаться: t.me/Geometry90
Концентрация плохая. По сравнению с детством стало лучше, но в работе мешает. Зато есть плюсы — продуктивность и идеи. Когда работаешь над чем-то одним, мозг на ходу генерирует кучу других мыслей.
В общем, хочу сейчас выпустить 2 проекта. Один — совсем скоро. Над другим еще не начинал, но уверен, что сделаю первую альфу за 1 неделю и испытаю.
Трудно бывает. Особенно когда писал сейчас промпт для ИИ, и резко пришло в голову написать всё это сюда. 👐
#Щитпост
Подписаться: t.me/Geometry90
❤🔥4
Kimi k2.5 вышел?
На официальном сайте Kimi уже называется k2.5. Пошли посты — действительно релиз. Бенчмарков пока нет, но всё равно интересно.
Что по первым тестам:
Отличный
Отличная в тексте
Видимо теперь SOTA.
Источник: https://www.kimi.com/
#Новости
Подписаться: t.me/Geometry90
На официальном сайте Kimi уже называется k2.5. Пошли посты — действительно релиз. Бенчмарков пока нет, но всё равно интересно.
Что по первым тестам:
Веб-дизайнОтличный
КреативностьОтличная в тексте
СтатусВидимо теперь SOTA.
Источник: https://www.kimi.com/
#Новости
Подписаться: t.me/Geometry90
❤🔥3👍1
Kimi k2.5: Новая SOTA из Китая?
Вышли официальные бенчмарки
— Модель официально стала лидером в визуальных задачах и агентских бенчмарках. Но делает ошибок больше чем Gemini 3 pro и claude 4.5 opus. Позади остались и
— В задачах агентов (браузер) выбили 74.9%. Это ощутимо больше, чем у
— Появился вижен, вроде, он очень крутой.
От себя: Это большая разница с
Зато в письме модель хороша, хотя в стихах всё ещё хуже
Это очень достойная модель и её снова расхайпят как лучшую open-source SOTA для кодинга.
Конкуренция — это всегда хорошо. Ждём тестов в реальных задачах.
#Новости
Вышли официальные бенчмарки
Kimi k2.5. Не сказать, что она всех нагнула, но цифры крепкие.— Модель официально стала лидером в визуальных задачах и агентских бенчмарках. Но делает ошибок больше чем Gemini 3 pro и claude 4.5 opus. Позади остались и
GPT-5.2, и Claude sonnet 4.5 в визуальных стилях.— В задачах агентов (браузер) выбили 74.9%. Это ощутимо больше, чем у
GPT-5.2.— Появился вижен, вроде, он очень крутой.
От себя: Это большая разница с
Kimi k2, но логикой всё не так однозначно. Видимо, HLE измеряют неправильно или результаты просто докручивают. Лично у меня в thinking mode модель прошла только 7 тестов в logic SH bench. Логика у неё есть, но слабее, чем у Opus 4. Зато в письме модель хороша, хотя в стихах всё ещё хуже
Qwen 3. Креативность в текстах у неё как у Claude 4.5 Opus.Это очень достойная модель и её снова расхайпят как лучшую open-source SOTA для кодинга.
Конкуренция — это всегда хорошо. Ждём тестов в реальных задачах.
#Новости
❤🔥2👍1
Долго готовил один проект ⚖️
Это не "очередная идея", а глубоко проработанная юридическая платформа (и не только). Сейчас я на этапе финализации пре-альфы и совсем скоро объявлю сбор команды!
Проект носит кодовое название IAB. Уверен, среди вас есть те, кто захочет стать частью этой истории.
Ждите пост с подробностями в ближайшее время. Обещаю, будет мощно! 🦾
#Новости
Подписаться: t.me/Geometry90
Это не "очередная идея", а глубоко проработанная юридическая платформа (и не только). Сейчас я на этапе финализации пре-альфы и совсем скоро объявлю сбор команды!
Проект носит кодовое название IAB. Уверен, среди вас есть те, кто захочет стать частью этой истории.
Ждите пост с подробностями в ближайшее время. Обещаю, будет мощно! 🦾
#Новости
Подписаться: t.me/Geometry90
👍8❤🔥1
🎬 DeepMind показали короткометражку на Sundance
Google DeepMind создали фильм "Dear Upstairs Neighbors" через Veo и Imagen 3 вместе с ветеранами Pixar (~45 человек).
Процесс:
Модели натренировали на оригинальных артах для сохранения стиля.
Veo стилизовал черновики аниматоров строго по таймингу.
Правка части кадра без перегенерации всей сцены.
Разгон до 4K через Veo.
Саундтрек написала модель Lyria (возможно 2 или 3 версия). Это не ИИ сделал всё сам, а инструмент в руках профи. Ждем VEO 3.2 и доступ к этим фичам.
Источник: https://blog.google/innovation-and-ai/models-and-research/google-deepmind/dear-upstairs-neighbors/
Видео: https://www.youtube.com/watch?v=eCk5VFKKz08
#Новости
Подписаться: t.me/Geometry90
Google DeepMind создали фильм "Dear Upstairs Neighbors" через Veo и Imagen 3 вместе с ветеранами Pixar (~45 человек).
Процесс:
ДообучениеМодели натренировали на оригинальных артах для сохранения стиля.
Video-to-videoVeo стилизовал черновики аниматоров строго по таймингу.
Локальное редактированиеПравка части кадра без перегенерации всей сцены.
АпскейлРазгон до 4K через Veo.
Саундтрек написала модель Lyria (возможно 2 или 3 версия). Это не ИИ сделал всё сам, а инструмент в руках профи. Ждем VEO 3.2 и доступ к этим фичам.
Источник: https://blog.google/innovation-and-ai/models-and-research/google-deepmind/dear-upstairs-neighbors/
Видео: https://www.youtube.com/watch?v=eCk5VFKKz08
#Новости
Подписаться: t.me/Geometry90
🤯3
Есть мааааленький шанс, что Google выпустит Gemini 3 pro (GA) или Nano Banana Flash на этой неделе
А может это Gemma 4?
Всё благодаря намёкам от сотрудников Google.
#Инсайд
Подписаться: t.me/Geometry90
А может это Gemma 4?
Всё благодаря намёкам от сотрудников Google.
#Инсайд
Подписаться: t.me/Geometry90
Gemini 3 TTS уже близко
Testing Catalog опубликовал пост с новой функцией клонирования голоса.
Не думаю, что текущая 2.5 потянет такую систему. Уверен, что Gemini 3 Flash уже доступна. Есть еще пара факторов: раньше я упоминал источник, который подтвердил, что Google готовит крупное обновление для Gemini Live. Это значит полноценный переход на Gemini 3.
Я думаю что:
Gemini 3 native audio (live) уже вовсю внедряется в продукты Google.
Это произойдет очень быстро. Вероятно, в следующем месяце (ну через пару дней) мы увидим этого монстра.
#Инсайд
Подписаться: t.me/Geometry90
Testing Catalog опубликовал пост с новой функцией клонирования голоса.
Не думаю, что текущая 2.5 потянет такую систему. Уверен, что Gemini 3 Flash уже доступна. Есть еще пара факторов: раньше я упоминал источник, который подтвердил, что Google готовит крупное обновление для Gemini Live. Это значит полноценный переход на Gemini 3.
Я думаю что:
Gemini 3 native audio (live) уже вовсю внедряется в продукты Google.
Это произойдет очень быстро. Вероятно, в следующем месяце (ну через пару дней) мы увидим этого монстра.
#Инсайд
Подписаться: t.me/Geometry90
👍1