🫆 Светлый Уголок | ии
526 subscribers
896 photos
190 videos
10 files
516 links
Тут сначала замечают, потом обсуждают.
AI-инсайды, свежие сигналы, честные мнения и свои инструменты.
Светлый уголок — авторский канал про ИИ без скуки.
Download Telegram
🫆 Светлый Уголок | ии
🚧 У Google сейчас серьёзные проблемы с мощностями. Они явно не успели подготовить инфраструктуру к тем нагрузкам, которые существуют сегодня. Только представьте, насколько тяжеловесна модель NB PRO. Это реально тяжёлая модель: огромный датасет изображений…
⚡️ DeepMind: всё железо на новые модели

В Google DeepMind произошло масштабное перераспределение мощностей ради обучения нейронок следующего поколения.

Вот оно как. Теперь ясно почему. По сообщениям источников, приоритет отдан новым моделям, что вызвало дефицит ресурсов для текущей инфраструктуры.

Что происходит:
— Резко сокращены мощности для «некритичных» операций: отладки серверов и работы с текущими LLM.
— Инженерам поручили компенсировать нехватку железа через глубокую оптимизацию кода.
— Команда DeepMind также помогает Anthropic разгребать технические проблемы с их TPU.

Ограничение ресурсов осложнило даже базовую работу с железом внутри компании.


Ситуация указывает на предельную нагрузку на вычислительную базу Google. В условиях гонки нейросетей мощностей не хватает даже гигантам.

#Новости
❤‍🔥2
🪐 Grok 4.20 на подходе?

Официальный X-канал Tesla Owners Silicon Valley пишет, что Grok 4.20 выйдет уже скоро. Думаю, релиз случится на следующей неделе.

От себя:
Ждем всем селом хотя бы что-то в этом месяце, бл*ть!

Источник:
#Новости #Щитпост
😁3
Ещё одна проблема почему Gemini 3 Pro теряет контекст. Спойлер: Google экономит. 🪙
Многие замечали, что после 10-20к токенов Gemini превращается в тыкву: забывает начало диалога, выдумывает факты и теряет нить. Я покопался в доках и профильных тредах, и, кажется, проблема не в "глюках", а в сознательной (и довольно жесткой) оптимизации.
Тут работают два фактора:

Во-первых, KV Cache и его дикое сжатие. Кэш памяти в трансформерах жрет ресурсы линейно. Чтобы серверы не ложились, Google, судя по всему, перешла на INT2-квантование кэша. То есть данные сжимаются до 2 бит. В память влезает больше, но точность страдает фатально — отсюда и забытые куски кода или перепутанные цифры. Детали просто "мылятся" при сжатии.

Во-вторых, она реально не читает весь ваш текст. Используется механизм маршрутизации внимания. Модель сканирует контекст и выбирает, какие токены обрабатывать, а какие — пропустить, чтобы сэкономить вычислительный бюджет. Если алгоритм посчитал кусок вашего промпта "шумом", модель его физически не увидит при ответе.

Хорошая новость в том, что это, вероятно, временно? Не знаю. Этой проблеме уже 2 года. Все модели Gemini получают большой урон от этого. Но в любом случае, Google готовит архитектуру TITANS и систему MIRAS — это переход к нейронной долгосрочной памяти.

В общем, сейчас такое время, где Google пытается сэкономить на TPU. Ждем Gemini 3.5 и новой архитектуры, там это должны пофиксить. Чего ждать дальше не знаю


#Мысли
Автор — @Geometry90
🤔3
В ближайшее время выйдет много всего интересного!

Делюсь примерными сроками: они почти точные, хотя всегда стоит оставлять долю сомнения в источниках.

Grok 4.20 — на этой неделе. Но разработчики могут снова замолчать и подвести всех, как это часто бывает. Все уже видели каким будет Grok 4.20. ТАК И ПРОИЗОШЛО БЛЯТЬ ПЕРЕНЕСЛИ ДО СЕРЕДИНЫ ФЕВРАЛЯ! ОТЛИЧНО НАХ! 🥳

ChatGPT 5.3 — ставлю, что он станет лучше во всех аспектах: станет живее, а фронтенд сильно подтянут. Релиз будет скоро, ждём в течение двух недель (конец января — начало февраля).

Claude 4.7 Sonnet — он должен быть во всём лучше Opus: дешевле, быстрее и круче. Срок — февраль.

Gemini 3 Pro GA — особых надежд на них не питаю. Версия GA не стала толком лучше в тех аспектах, где сейчас лидируют Claude и ChatGPT (я про агентность и галлюцинации). Судя по всему, они не стремятся исправлять это и в Gemini 3.5. Дата — середина февраля.

DeepSeek R2 и V4 — я просто верю в них. Ребята должны сделать что-то классное. Судя по их статьям и фактам, они много работали, так что фраза «релиз будет крутым» звучит вполне оправданно. Выход ожидается до 17 февраля.

Вот так: у каждой компании и каждой модели свои причуды и своя история. Ждём.
❤‍🔥4
Google купил CSM: 3D в Gemini?

Google тихо поглотил стартап Common Sense Machines (CSM). Это небольшая команда из ~12 крутых спецов, которые делают одну из лучших технологий превращения 2D-картинок в полноценные 3D-модели.

Что это значит прямо сейчас:
— Google забрал себе топовую технологию 2D → 3D.
— Пока публичных фич нет, сделку провели без лишнего шума.
— В Gemini добавят генерацию 3D нативно. Скорее всего, это случится уже в следующих Nano Banana.

После интеграции CSM из текста или фото можно будет получать не просто картинку, а готовую 3D-модель, которую можно скачать и сразу юзать.

От себя:
Думаю, увидим это в 2026 году или даже на Google I/O в мае в обновлениях Gemini app / AI Studio. Google обычно очень быстро внедряет такие штуки.


Кстати, это лишь часть недели: ещё была лицензия от Hume AI (эмоциональный голос). Об этом напишу позже.

Источник:
#Новости #Инсайд
❤‍🔥4👍1
А что если...
🤔2
🐰 Клон Windows XP за один промпт

Gemini Snowbunny собрала интерфейс старой винды всего по одному запросу.
Прикольно? Прикольно.

Это сильное улучшение по сравнению с Gemini 3 pro — она такого не может.

Выкатят ли её в таком виде в GA — большой вопрос. Мы знаем любовь Google всё резать ради экономии ресурсов.

И кстати, Snowbunny уже понерфили, но даже так она крутая.

#Новости #Инсайд
🫆 Светлый Уголок | ии
🌛 Представьте себе. — Джош Вудворд Мы преодолели отметку в 1 миллиард изображений, обработанных с помощью Nano Banana Pro. Данная модель находится в продаже уже 53 дня. Источник Небольшая математика: 1 миллиард = 1 000 000 000 изображений 53 дня → среднее…
Grok в X генерит 183 млн картинок

Как это? 🤣 Ладно, ладно.

Grok интегрировали в X. Разница в цифрах обусловлена его распространением среди юзеров и бесшовной интеграцией.


Статистика в день:
Grok: около 183 млн изображений
Nano Banana Pro: ~19 млн (1 млрд за 53 дня)

#Щитпост
🤔1
Altman зовёт AI-разработчиков на town hall OpenAI

OpenAI проводит сбор отзывов перед релизом инструментов нового поколения. Тестирование проходит в экспериментальном формате, а результаты обсуждения будут опубликованы в открытом доступе.

Перевод:
Завтра мы проведём town hall для AI-билдеров в OpenAI. Мы хотим фидбек, потому что начинаем создавать новое поколение инструментов.


Трансляция будет на YouTube 27 января 2026, 03:00 МСК если кому интересно

Ждёте новостей насчёт Gpt 5.3?

#Новости
Сколько всего в голове, столько идей. Признаю честно: я СДВГшник, и работать мне вправду трудно.

Концентрация плохая. По сравнению с детством стало лучше, но в работе мешает. Зато есть плюсы — продуктивность и идеи. Когда работаешь над чем-то одним, мозг на ходу генерирует кучу других мыслей.

В общем, хочу сейчас выпустить 2 проекта. Один — совсем скоро. Над другим еще не начинал, но уверен, что сделаю первую альфу за 1 неделю и испытаю.

Трудно бывает. Особенно когда писал сейчас промпт для ИИ, и резко пришло в голову написать всё это сюда. 👐

#Щитпост

Подписаться: t.me/Geometry90
❤‍🔥4
Kimi k2.5 вышел?

На официальном сайте Kimi уже называется k2.5. Пошли посты — действительно релиз. Бенчмарков пока нет, но всё равно интересно.

Что по первым тестам:

Веб-дизайн
Отличный

Креативность
Отличная в тексте

Статус
Видимо теперь SOTA.

Источник: https://www.kimi.com/

#Новости

Подписаться: t.me/Geometry90
❤‍🔥3👍1
🫆 Kimi k2.5: Новая SOTA из Китая?

Вышли официальные бенчмарки Kimi k2.5. Не сказать, что она всех нагнула, но цифры крепкие.

— Модель официально стала лидером в визуальных задачах и агентских бенчмарках. Но делает ошибок больше чем Gemini 3 pro и claude 4.5 opus. Позади остались и GPT-5.2, и Claude sonnet 4.5 в визуальных стилях.
— В задачах агентов (браузер) выбили 74.9%. Это ощутимо больше, чем у GPT-5.2.
— Появился вижен, вроде, он очень крутой.

От себя: Это большая разница с Kimi k2, но логикой всё не так однозначно. Видимо, HLE измеряют неправильно или результаты просто докручивают. Лично у меня в thinking mode модель прошла только 7 тестов в logic SH bench. Логика у неё есть, но слабее, чем у Opus 4.
Зато в письме модель хороша, хотя в стихах всё ещё хуже Qwen 3. Креативность в текстах у неё как у Claude 4.5 Opus.

Это очень достойная модель и её снова расхайпят как лучшую open-source SOTA для кодинга.

Конкуренция — это всегда хорошо. Ждём тестов в реальных задачах.
#Новости
❤‍🔥2👍1
Долго готовил один проект ⚖️

Это не "очередная идея", а глубоко проработанная юридическая платформа (и не только). Сейчас я на этапе финализации пре-альфы и совсем скоро объявлю сбор команды!

Проект носит кодовое название IAB. Уверен, среди вас есть те, кто захочет стать частью этой истории.

Ждите пост с подробностями в ближайшее время. Обещаю, будет мощно! 🦾

#Новости

Подписаться: t.me/Geometry90
👍8❤‍🔥1
🎬 DeepMind показали короткометражку на Sundance

Google DeepMind создали фильм "Dear Upstairs Neighbors" через Veo и Imagen 3 вместе с ветеранами Pixar (~45 человек).

Процесс:

Дообучение
Модели натренировали на оригинальных артах для сохранения стиля.

Video-to-video
Veo стилизовал черновики аниматоров строго по таймингу.

Локальное редактирование
Правка части кадра без перегенерации всей сцены.

Апскейл
Разгон до 4K через Veo.

Саундтрек написала модель Lyria (возможно 2 или 3 версия). Это не ИИ сделал всё сам, а инструмент в руках профи. Ждем VEO 3.2 и доступ к этим фичам.

Источник: https://blog.google/innovation-and-ai/models-and-research/google-deepmind/dear-upstairs-neighbors/
Видео: https://www.youtube.com/watch?v=eCk5VFKKz08

#Новости

Подписаться: t.me/Geometry90
🤯3
Есть мааааленький шанс, что Google выпустит Gemini 3 pro (GA) или Nano Banana Flash на этой неделе

А может это Gemma 4?

Всё благодаря намёкам от сотрудников Google.

#Инсайд

Подписаться: t.me/Geometry90
Gemini 3 TTS уже близко

Testing Catalog опубликовал пост с новой функцией клонирования голоса.

Не думаю, что текущая 2.5 потянет такую систему. Уверен, что Gemini 3 Flash уже доступна. Есть еще пара факторов: раньше я упоминал источник, который подтвердил, что Google готовит крупное обновление для Gemini Live. Это значит полноценный переход на Gemini 3.

Я думаю что:
Gemini 3 native audio (live) уже вовсю внедряется в продукты Google.

Это произойдет очень быстро. Вероятно, в следующем месяце (ну через пару дней) мы увидим этого монстра.

#Инсайд

Подписаться: t.me/Geometry90
👍1