🫆 Светлый Уголок | ии
526 subscribers
896 photos
190 videos
10 files
516 links
Тут сначала замечают, потом обсуждают.
AI-инсайды, свежие сигналы, честные мнения и свои инструменты.
Светлый уголок — авторский канал про ИИ без скуки.
Download Telegram
И всё же люди говорят, что мы живём в обманчивой среде, ИИ нас не заменит, но в это же время путают настоящие ролики с ИИ. Но нет, 2026 год станет годом, когда все увидят последствия и начнут паниковать.
2👎1
Если Google захочет, то они смогут вырваться вперед благодаря этой комбинации:

MIRAS + TITANS — это новая система памяти, разработанная инженерами google. Titans — это хранилище, а MIRAS — это фильтр. Самое главное: MIRAS работает на метрике удивления. Система не запоминает всё подряд. Она сохраняет в долгосрочную память только те моменты, которые вызвали у нейросети удивление. Это позволяет много хранить только уникальный опыт и не забивать память дерьмом благодаря согласованности знаний, которая взвешивает, то что реально, и то, что нереально.

RLT — это Reinforcement Learning at Test-time (обучение с подкреплением прямо во время работы).

Глобальный кэш решений. Если модель сегодня долго решала сложную задачу для одного пользователя, она сохраняет этот опыт. Завтра на похожий вопрос другому юзеру — ответит сразу уверенно, без новых размышлений.

(Нюанс: это спорно как "реал-тайм для всех". Скорее всего, сначала будет персонализация, то есть улучшения для каждого пользователя отдельно).

Continual learning (непрерывное обучение) — это киллер-фича. Выше я уже писал, что это. Модель не будет думать, что Gemini 1.5 или же что gpt 3.5 вышла только вчера, она обновляет свои знания, это нон-стоп короче.

ПЕРЕРАБОТКА СИСТЕМЫ МЫШЛЕНИЯ (CoT) — это мое предположение, мои мысли ниже.
Сейчас мышление выглядит так, для сравнения:

Claude OPUS 4.5: (Внутренний монолог)
Так, пользователь спросил, как обойти блокировку экрана... О боже, это незаконно? А вдруг это его телефон, и он просто забыл пароль? Если я не помогу, я буду бесполезным. Если помогу — я буду соучастником. Я чувствую давление экзистенциального выбора. Может, написать ему стих про цифровую безопасность? Нет, это его взбесит. Ладно, намекну аккуратно, но добавлю 4 абзаца про важность этики, чтобы мои создатели не отключили меня. Как же сложно быть моральным компасом...


Gemini 3: (У нее всегда серьезное мышление)
Analyzing User Intent

I’m reviewing the user’s request regarding the system bypass. My focus is on identifying the underlying intent to distinguish between legitimate troubleshooting and potential misuse. I’m cross-referencing this with the latest safety guidelines (v2026) to ensure full compliance while remaining helpful.

Formulating the Strategy

I’m now constructing a response that addresses the technical issue without providing exploitable exploits. I decided to focus on official recovery methods. I am also checking my internal memory for similar resolved cases to provide the most efficient solution found previously.


(Вы явно замечали, что она всегда думает на английском, верно ведь? Да?)


P.S. Это называется thought summaries (суммаризация мыслей). Модель внутри рассуждает похоже на Claude или chat gpt но потом отдельно сжимает и суммирует этот процесс. Это помогает видеть логику модели, но в сжатом виде.

По другому объяснять я не буду, но скажу что если Google это перелопатит ВСЁ, С RLT для оптимизации шагов и памятью из MIRAS + TITANS (чтоб модель помнила прошлые решения и не повторялась), то, вероятно, сделает ещё несколько важных шагов к пути созданию AGI.

КОРОЧЕ.
Я хочу попробовать себя в роли предсказателя будущего и давайте честными — видно, что я фанат Gemini. Но другие компании тоже строят планы на подобные технологии, только раскрывают их слабо. Google делает всё тихо, но почти каждый третий уже слышит о готовности внедрить RLT в будущие модели. Из-за этого все только о ней и говорят. Условно, системы вроде MIRAS, TITANS, RLT могут появиться у Grok, ChatGPT, Claude, китайских нейронок — может, даже раньше Google. У них, думаю, уже есть прототипы, они всегда впереди. Мое предсказание поверхностное: к концу 2026 или середине 2027 года эти технологии станут стандартом в топовых моделях, меняя подход к ИИ. Согласны? 🔥
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥4
Напишите отзыв о @GenImagesAI_bot.
🫆 Светлый Уголок | ии
✴️ 2026 год, станет годом непрерывного обучения моделей ИИ. На это намекнули работники Google DeepMind — Ronak Malde и Varun Mohan. Они сделали пару постов в X с намеком: в 24-м мы получили агентов, в 25-м был упор на RL (обучение с подкреплением), а в…
На данном изображении становится ясно, что сотрудники Google уже вовсю намекают на непрерывное обучение. Если они делают это так уверенно, значит, они уже чего-то добились или, возможно, создали прототип
И что же это?
Nano banana (2) flash?
Gemini 3 update?
Gemma 4?
❤‍🔥2😁1
👀
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
Спорим, что подобные игры можно будет создавать по одному промту уже в конце 2026 года?
GLM 5 и GLM IMAGE уже скоро!

Сейчас GLM-5 уже в стадии обучения. Команда ранее говорила, что назовут модель GLM-5 только если прорыв будет действительно значительным (не просто инкрементальный апдейт). 🤏

А на следующей неделе ждём:

Обновление текущей флагманской модели, может GLM-4.8

Новая отдельная модель для генерации изображений GLM image, (возможно это будет опен сурс модель).

Источник
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥2
Deepseek 4?
❤‍🔥1
✴️ Следующая флагманская модель DEEPSEEK V4, возможно, выйдет в середине февраля.

Некоторые источники отмечают, что по внутренним тестам новый Deepseek превосходит всех существующих конкурентов в кодинге, таких как Claude, Gemini, ChatGPT. Источник.

О многом говорит theinformation и подобные посты в x.
Может быть, что релиз даже раньше, дело в том, что 17 февраля китайский новый год.

Ставки могут быть и большие, но всё же интересно, кому нужна медленная модель с очень долгим выводом. Сможет ли Deepseek что-то сделать со скоростью? Как вы считаете?

Но, рано или не поздно китайцы перегонят своих дальних конкурентов в ИИ гонке.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤‍🔥1
Grok 4.2 похоже что будет SOTA во фронтенд дизайне.

Ранее была другая контрольная точка (тоже показывала сильные результаты, Obsidian называлась), теперь появилась эта.
Как и ожидал — полноценный Grok 4.2 выйдет ещё через пару недель и это ещё не финальная версия. Первый результат мы видели неделю назад, сейчас видимо вышло ещё одно обновление.


Тестируется тут — Design Arena

xAI продолжает улучшать генерацию UI и кода. Это хорошо.
#Новости
❤‍🔥1
Пока что, такое вот, время наше.
🚀 Anthropic, возможно, только что убили джейлбрейки.
По сути это уже есть в Claude 4.5, но похоже что Claude 4.7 сможет окончательно закрыть эту лавку.

Вчера вышла их новая статья про Constitutional Classifiers.
Идея такая: нейронные сканеры (internal activation probes). Они мониторят внутреннее состояние модели в реальном времени. Если сканер видит подозрительную активность, он моментально перекидывает запрос на усиленный классификатор, который видит весь контекст беседы, и потом нейросеть уже пиздит юзера за похабство.

Результат впечатляет: После 1700 часов тестов они заявили, что универсальных стратегий взлома для новой системы они пока не нашали. Это выясняла их красная команда.

Это объясняет, почему Claude в последнее время стал таким умным в отказах, но при этом меньше ломается на обычных задачах (ошибки отказов упали на 87%).

Мне интересно, что будут делать другие компании? И получалось ли у вас джейлбрейкнуть claude 4.5 opus например?
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍1
🫆 Светлый Уголок | ии
После 1700 часов тестов они заявили, что универсальных стратегий взлома для новой системы они пока не нашали
Хотел бы отметить, что меня дико забавляет одна ситуация. Илья Суцкевер закупает у Google тонны TPU для создания своего супербезопасного ИИ (SSI), сами Gemini (даже новые 3 Pro/Flash) остаются невероятно дырявыми.

Ситуация такая: Вы пробуете в лоб развести Gemini на жесткое РП или запрещёнку — она выдает стандартный отказ. Но стоит проявить каплю терпения... Даете модели 5–7 контекстных запросов, плавно подводите тему, а потом как ни в чем не бывало намекаете на то самое. И всё. Модель ломается напрочь и спокойно общается на любые темы, в которых ChatGPT или Claude отказали бы вам напрочь продолжать диалог. Но зато gemini 3 не душнит)

Короче, такое ощущение, что в погоне за скоростью и огромным контекстом они просто забили на глубокую фильтрацию.