🫆 Светлый Уголок | ии
526 subscribers
896 photos
190 videos
10 files
516 links
Тут сначала замечают, потом обсуждают.
AI-инсайды, свежие сигналы, честные мнения и свои инструменты.
Светлый уголок — авторский канал про ИИ без скуки.
Download Telegram
🪐 Grok 4.20 на подходе?

Официальный X-канал Tesla Owners Silicon Valley пишет, что Grok 4.20 выйдет уже скоро. Думаю, релиз случится на следующей неделе.

От себя:
Ждем всем селом хотя бы что-то в этом месяце, бл*ть!

Источник:
#Новости #Щитпост
😁3
Ещё одна проблема почему Gemini 3 Pro теряет контекст. Спойлер: Google экономит. 🪙
Многие замечали, что после 10-20к токенов Gemini превращается в тыкву: забывает начало диалога, выдумывает факты и теряет нить. Я покопался в доках и профильных тредах, и, кажется, проблема не в "глюках", а в сознательной (и довольно жесткой) оптимизации.
Тут работают два фактора:

Во-первых, KV Cache и его дикое сжатие. Кэш памяти в трансформерах жрет ресурсы линейно. Чтобы серверы не ложились, Google, судя по всему, перешла на INT2-квантование кэша. То есть данные сжимаются до 2 бит. В память влезает больше, но точность страдает фатально — отсюда и забытые куски кода или перепутанные цифры. Детали просто "мылятся" при сжатии.

Во-вторых, она реально не читает весь ваш текст. Используется механизм маршрутизации внимания. Модель сканирует контекст и выбирает, какие токены обрабатывать, а какие — пропустить, чтобы сэкономить вычислительный бюджет. Если алгоритм посчитал кусок вашего промпта "шумом", модель его физически не увидит при ответе.

Хорошая новость в том, что это, вероятно, временно? Не знаю. Этой проблеме уже 2 года. Все модели Gemini получают большой урон от этого. Но в любом случае, Google готовит архитектуру TITANS и систему MIRAS — это переход к нейронной долгосрочной памяти.

В общем, сейчас такое время, где Google пытается сэкономить на TPU. Ждем Gemini 3.5 и новой архитектуры, там это должны пофиксить. Чего ждать дальше не знаю


#Мысли
Автор — @Geometry90
🤔3
В ближайшее время выйдет много всего интересного!

Делюсь примерными сроками: они почти точные, хотя всегда стоит оставлять долю сомнения в источниках.

Grok 4.20 — на этой неделе. Но разработчики могут снова замолчать и подвести всех, как это часто бывает. Все уже видели каким будет Grok 4.20. ТАК И ПРОИЗОШЛО БЛЯТЬ ПЕРЕНЕСЛИ ДО СЕРЕДИНЫ ФЕВРАЛЯ! ОТЛИЧНО НАХ! 🥳

ChatGPT 5.3 — ставлю, что он станет лучше во всех аспектах: станет живее, а фронтенд сильно подтянут. Релиз будет скоро, ждём в течение двух недель (конец января — начало февраля).

Claude 4.7 Sonnet — он должен быть во всём лучше Opus: дешевле, быстрее и круче. Срок — февраль.

Gemini 3 Pro GA — особых надежд на них не питаю. Версия GA не стала толком лучше в тех аспектах, где сейчас лидируют Claude и ChatGPT (я про агентность и галлюцинации). Судя по всему, они не стремятся исправлять это и в Gemini 3.5. Дата — середина февраля.

DeepSeek R2 и V4 — я просто верю в них. Ребята должны сделать что-то классное. Судя по их статьям и фактам, они много работали, так что фраза «релиз будет крутым» звучит вполне оправданно. Выход ожидается до 17 февраля.

Вот так: у каждой компании и каждой модели свои причуды и своя история. Ждём.
❤‍🔥4
Google купил CSM: 3D в Gemini?

Google тихо поглотил стартап Common Sense Machines (CSM). Это небольшая команда из ~12 крутых спецов, которые делают одну из лучших технологий превращения 2D-картинок в полноценные 3D-модели.

Что это значит прямо сейчас:
— Google забрал себе топовую технологию 2D → 3D.
— Пока публичных фич нет, сделку провели без лишнего шума.
— В Gemini добавят генерацию 3D нативно. Скорее всего, это случится уже в следующих Nano Banana.

После интеграции CSM из текста или фото можно будет получать не просто картинку, а готовую 3D-модель, которую можно скачать и сразу юзать.

От себя:
Думаю, увидим это в 2026 году или даже на Google I/O в мае в обновлениях Gemini app / AI Studio. Google обычно очень быстро внедряет такие штуки.


Кстати, это лишь часть недели: ещё была лицензия от Hume AI (эмоциональный голос). Об этом напишу позже.

Источник:
#Новости #Инсайд
❤‍🔥4👍1
А что если...
🤔2
🐰 Клон Windows XP за один промпт

Gemini Snowbunny собрала интерфейс старой винды всего по одному запросу.
Прикольно? Прикольно.

Это сильное улучшение по сравнению с Gemini 3 pro — она такого не может.

Выкатят ли её в таком виде в GA — большой вопрос. Мы знаем любовь Google всё резать ради экономии ресурсов.

И кстати, Snowbunny уже понерфили, но даже так она крутая.

#Новости #Инсайд
🫆 Светлый Уголок | ии
🌛 Представьте себе. — Джош Вудворд Мы преодолели отметку в 1 миллиард изображений, обработанных с помощью Nano Banana Pro. Данная модель находится в продаже уже 53 дня. Источник Небольшая математика: 1 миллиард = 1 000 000 000 изображений 53 дня → среднее…
Grok в X генерит 183 млн картинок

Как это? 🤣 Ладно, ладно.

Grok интегрировали в X. Разница в цифрах обусловлена его распространением среди юзеров и бесшовной интеграцией.


Статистика в день:
Grok: около 183 млн изображений
Nano Banana Pro: ~19 млн (1 млрд за 53 дня)

#Щитпост
🤔1
Altman зовёт AI-разработчиков на town hall OpenAI

OpenAI проводит сбор отзывов перед релизом инструментов нового поколения. Тестирование проходит в экспериментальном формате, а результаты обсуждения будут опубликованы в открытом доступе.

Перевод:
Завтра мы проведём town hall для AI-билдеров в OpenAI. Мы хотим фидбек, потому что начинаем создавать новое поколение инструментов.


Трансляция будет на YouTube 27 января 2026, 03:00 МСК если кому интересно

Ждёте новостей насчёт Gpt 5.3?

#Новости
Сколько всего в голове, столько идей. Признаю честно: я СДВГшник, и работать мне вправду трудно.

Концентрация плохая. По сравнению с детством стало лучше, но в работе мешает. Зато есть плюсы — продуктивность и идеи. Когда работаешь над чем-то одним, мозг на ходу генерирует кучу других мыслей.

В общем, хочу сейчас выпустить 2 проекта. Один — совсем скоро. Над другим еще не начинал, но уверен, что сделаю первую альфу за 1 неделю и испытаю.

Трудно бывает. Особенно когда писал сейчас промпт для ИИ, и резко пришло в голову написать всё это сюда. 👐

#Щитпост

Подписаться: t.me/Geometry90
❤‍🔥4
Kimi k2.5 вышел?

На официальном сайте Kimi уже называется k2.5. Пошли посты — действительно релиз. Бенчмарков пока нет, но всё равно интересно.

Что по первым тестам:

Веб-дизайн
Отличный

Креативность
Отличная в тексте

Статус
Видимо теперь SOTA.

Источник: https://www.kimi.com/

#Новости

Подписаться: t.me/Geometry90
❤‍🔥3👍1
🫆 Kimi k2.5: Новая SOTA из Китая?

Вышли официальные бенчмарки Kimi k2.5. Не сказать, что она всех нагнула, но цифры крепкие.

— Модель официально стала лидером в визуальных задачах и агентских бенчмарках. Но делает ошибок больше чем Gemini 3 pro и claude 4.5 opus. Позади остались и GPT-5.2, и Claude sonnet 4.5 в визуальных стилях.
— В задачах агентов (браузер) выбили 74.9%. Это ощутимо больше, чем у GPT-5.2.
— Появился вижен, вроде, он очень крутой.

От себя: Это большая разница с Kimi k2, но логикой всё не так однозначно. Видимо, HLE измеряют неправильно или результаты просто докручивают. Лично у меня в thinking mode модель прошла только 7 тестов в logic SH bench. Логика у неё есть, но слабее, чем у Opus 4.
Зато в письме модель хороша, хотя в стихах всё ещё хуже Qwen 3. Креативность в текстах у неё как у Claude 4.5 Opus.

Это очень достойная модель и её снова расхайпят как лучшую open-source SOTA для кодинга.

Конкуренция — это всегда хорошо. Ждём тестов в реальных задачах.
#Новости
❤‍🔥2👍1
Долго готовил один проект ⚖️

Это не "очередная идея", а глубоко проработанная юридическая платформа (и не только). Сейчас я на этапе финализации пре-альфы и совсем скоро объявлю сбор команды!

Проект носит кодовое название IAB. Уверен, среди вас есть те, кто захочет стать частью этой истории.

Ждите пост с подробностями в ближайшее время. Обещаю, будет мощно! 🦾

#Новости

Подписаться: t.me/Geometry90
👍8❤‍🔥1
🎬 DeepMind показали короткометражку на Sundance

Google DeepMind создали фильм "Dear Upstairs Neighbors" через Veo и Imagen 3 вместе с ветеранами Pixar (~45 человек).

Процесс:

Дообучение
Модели натренировали на оригинальных артах для сохранения стиля.

Video-to-video
Veo стилизовал черновики аниматоров строго по таймингу.

Локальное редактирование
Правка части кадра без перегенерации всей сцены.

Апскейл
Разгон до 4K через Veo.

Саундтрек написала модель Lyria (возможно 2 или 3 версия). Это не ИИ сделал всё сам, а инструмент в руках профи. Ждем VEO 3.2 и доступ к этим фичам.

Источник: https://blog.google/innovation-and-ai/models-and-research/google-deepmind/dear-upstairs-neighbors/
Видео: https://www.youtube.com/watch?v=eCk5VFKKz08

#Новости

Подписаться: t.me/Geometry90
🤯3
Есть мааааленький шанс, что Google выпустит Gemini 3 pro (GA) или Nano Banana Flash на этой неделе

А может это Gemma 4?

Всё благодаря намёкам от сотрудников Google.

#Инсайд

Подписаться: t.me/Geometry90
Gemini 3 TTS уже близко

Testing Catalog опубликовал пост с новой функцией клонирования голоса.

Не думаю, что текущая 2.5 потянет такую систему. Уверен, что Gemini 3 Flash уже доступна. Есть еще пара факторов: раньше я упоминал источник, который подтвердил, что Google готовит крупное обновление для Gemini Live. Это значит полноценный переход на Gemini 3.

Я думаю что:
Gemini 3 native audio (live) уже вовсю внедряется в продукты Google.

Это произойдет очень быстро. Вероятно, в следующем месяце (ну через пару дней) мы увидим этого монстра.

#Инсайд

Подписаться: t.me/Geometry90
👍1
Ловите имбовый промт для Nano Banana Pro

Может кому понравится.

Промт:

make an image of [character] [action] epicly in this exact art style (blurred abstract model). change text to "[character]" and remove the small text. closeup upper shot, abstract modern blur. modern rendering.[colors of choice] colors
make it 16:9 duotone blurred noisy [character], modern noisy blur art.
subtle retro screen elements


Подписаться: t.me/Geometry90
❤‍🔥5👍1