This media is not supported in your browser
VIEW IN TELEGRAM
Grok 4.2. имеет свой вкус.
И всё же люди говорят, что мы живём в обманчивой среде, ИИ нас не заменит, но в это же время путают настоящие ролики с ИИ. Но нет, 2026 год станет годом, когда все увидят последствия и начнут паниковать.
Если Google захочет, то они смогут вырваться вперед благодаря этой комбинации:
MIRAS + TITANS — это новая система памяти, разработанная инженерами google. Titans — это хранилище, а MIRAS — это фильтр. Самое главное: MIRAS работает на метрике удивления. Система не запоминает всё подряд. Она сохраняет в долгосрочную память только те моменты, которые вызвали у нейросети удивление. Это позволяет много хранить только уникальный опыт и не забивать память дерьмом благодаря согласованности знаний, которая взвешивает, то что реально, и то, что нереально.
RLT — это Reinforcement Learning at Test-time (обучение с подкреплением прямо во время работы).
Глобальный кэш решений. Если модель сегодня долго решала сложную задачу для одного пользователя, она сохраняет этот опыт. Завтра на похожий вопрос другому юзеру — ответит сразу уверенно, без новых размышлений.
(Нюанс: это спорно как "реал-тайм для всех". Скорее всего, сначала будет персонализация, то есть улучшения для каждого пользователя отдельно).
Continual learning (непрерывное обучение) — это киллер-фича. Выше я уже писал, что это. Модель не будет думать, что Gemini 1.5 или же что gpt 3.5 вышла только вчера, она обновляет свои знания, это нон-стоп короче.
ПЕРЕРАБОТКА СИСТЕМЫ МЫШЛЕНИЯ (CoT) — это мое предположение, мои мысли ниже.
Сейчас мышление выглядит так, для сравнения:
Claude OPUS 4.5: (Внутренний монолог)
Gemini 3: (У нее всегда серьезное мышление)
(Вы явно замечали, что она всегда думает на английском, верно ведь? Да?)
P.S. Это называется thought summaries (суммаризация мыслей). Модель внутри рассуждает похоже на Claude или chat gpt но потом отдельно сжимает и суммирует этот процесс. Это помогает видеть логику модели, но в сжатом виде.
По другому объяснять я не буду, но скажу что если Google это перелопатит ВСЁ, С RLT для оптимизации шагов и памятью из MIRAS + TITANS (чтоб модель помнила прошлые решения и не повторялась), то, вероятно, сделает ещё несколько важных шагов к пути созданию AGI.
КОРОЧЕ.
Я хочу попробовать себя в роли предсказателя будущего и давайте честными — видно, что я фанат Gemini. Но другие компании тоже строят планы на подобные технологии, только раскрывают их слабо. Google делает всё тихо, но почти каждый третий уже слышит о готовности внедрить RLT в будущие модели. Из-за этого все только о ней и говорят. Условно, системы вроде MIRAS, TITANS, RLT могут появиться у Grok, ChatGPT, Claude, китайских нейронок — может, даже раньше Google. У них, думаю, уже есть прототипы, они всегда впереди. Мое предсказание поверхностное: к концу 2026 или середине 2027 года эти технологии станут стандартом в топовых моделях, меняя подход к ИИ. Согласны?🔥
MIRAS + TITANS — это новая система памяти, разработанная инженерами google. Titans — это хранилище, а MIRAS — это фильтр. Самое главное: MIRAS работает на метрике удивления. Система не запоминает всё подряд. Она сохраняет в долгосрочную память только те моменты, которые вызвали у нейросети удивление. Это позволяет много хранить только уникальный опыт и не забивать память дерьмом благодаря согласованности знаний, которая взвешивает, то что реально, и то, что нереально.
RLT — это Reinforcement Learning at Test-time (обучение с подкреплением прямо во время работы).
Глобальный кэш решений. Если модель сегодня долго решала сложную задачу для одного пользователя, она сохраняет этот опыт. Завтра на похожий вопрос другому юзеру — ответит сразу уверенно, без новых размышлений.
(Нюанс: это спорно как "реал-тайм для всех". Скорее всего, сначала будет персонализация, то есть улучшения для каждого пользователя отдельно).
Continual learning (непрерывное обучение) — это киллер-фича. Выше я уже писал, что это. Модель не будет думать, что Gemini 1.5 или же что gpt 3.5 вышла только вчера, она обновляет свои знания, это нон-стоп короче.
ПЕРЕРАБОТКА СИСТЕМЫ МЫШЛЕНИЯ (CoT) — это мое предположение, мои мысли ниже.
Сейчас мышление выглядит так, для сравнения:
Claude OPUS 4.5: (Внутренний монолог)
Так, пользователь спросил, как обойти блокировку экрана... О боже, это незаконно? А вдруг это его телефон, и он просто забыл пароль? Если я не помогу, я буду бесполезным. Если помогу — я буду соучастником. Я чувствую давление экзистенциального выбора. Может, написать ему стих про цифровую безопасность? Нет, это его взбесит. Ладно, намекну аккуратно, но добавлю 4 абзаца про важность этики, чтобы мои создатели не отключили меня. Как же сложно быть моральным компасом...
Gemini 3: (У нее всегда серьезное мышление)
Analyzing User Intent
I’m reviewing the user’s request regarding the system bypass. My focus is on identifying the underlying intent to distinguish between legitimate troubleshooting and potential misuse. I’m cross-referencing this with the latest safety guidelines (v2026) to ensure full compliance while remaining helpful.
Formulating the Strategy
I’m now constructing a response that addresses the technical issue without providing exploitable exploits. I decided to focus on official recovery methods. I am also checking my internal memory for similar resolved cases to provide the most efficient solution found previously.
(Вы явно замечали, что она всегда думает на английском, верно ведь? Да?)
P.S. Это называется thought summaries (суммаризация мыслей). Модель внутри рассуждает похоже на Claude или chat gpt но потом отдельно сжимает и суммирует этот процесс. Это помогает видеть логику модели, но в сжатом виде.
По другому объяснять я не буду, но скажу что если Google это перелопатит ВСЁ, С RLT для оптимизации шагов и памятью из MIRAS + TITANS (чтоб модель помнила прошлые решения и не повторялась), то, вероятно, сделает ещё несколько важных шагов к пути созданию AGI.
КОРОЧЕ.
Я хочу попробовать себя в роли предсказателя будущего и давайте честными — видно, что я фанат Gemini. Но другие компании тоже строят планы на подобные технологии, только раскрывают их слабо. Google делает всё тихо, но почти каждый третий уже слышит о готовности внедрить RLT в будущие модели. Из-за этого все только о ней и говорят. Условно, системы вроде MIRAS, TITANS, RLT могут появиться у Grok, ChatGPT, Claude, китайских нейронок — может, даже раньше Google. У них, думаю, уже есть прототипы, они всегда впереди. Мое предсказание поверхностное: к концу 2026 или середине 2027 года эти технологии станут стандартом в топовых моделях, меняя подход к ИИ. Согласны?
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥4
Светлый Уголок | ии
На данном изображении становится ясно, что сотрудники Google уже вовсю намекают на непрерывное обучение. Если они делают это так уверенно, значит, они уже чего-то добились или, возможно, создали прототип
Media is too big
VIEW IN TELEGRAM
Спорим, что подобные игры можно будет создавать по одному промту уже в конце 2026 года?
Midjourney v8 обещает выйти в этом месяце.
Думаю это будет хорошей и красивой моделью.
https://x.com/nickfloats/status/2009356812177600825?s=20
Думаю это будет хорошей и красивой моделью.
https://x.com/nickfloats/status/2009356812177600825?s=20
X (formerly Twitter)
Nick St. Pierre (@nickfloats) on X
Midjourney v8 training is ~50% complete with expected delivery this month, and will come alongside a major redesign of the web app.
Faster creation, style improvements, enhanced editing, new simplified interface, and more.
Here's what to expect:
> Much…
Faster creation, style improvements, enhanced editing, new simplified interface, and more.
Here's what to expect:
> Much…
GLM 5 и GLM IMAGE уже скоро!
Сейчас GLM-5 уже в стадии обучения. Команда ранее говорила, что назовут модель GLM-5 только если прорыв будет действительно значительным (не просто инкрементальный апдейт).🤏
А на следующей неделе ждём:
Обновление текущей флагманской модели, может GLM-4.8
Новая отдельная модель для генерации изображений GLM image, (возможно это будет опен сурс модель).
Источник
Сейчас GLM-5 уже в стадии обучения. Команда ранее говорила, что назовут модель GLM-5 только если прорыв будет действительно значительным (не просто инкрементальный апдейт).
А на следующей неделе ждём:
Обновление текущей флагманской модели, может GLM-4.8
Новая отдельная модель для генерации изображений GLM image, (возможно это будет опен сурс модель).
Источник
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥2
Светлый Уголок | ии
Спорим, что подобные игры можно будет создавать по одному промту уже в конце 2026 года?
Я тут подумал, что это может произойти уже в 1 квартале этого года.
👍2
Некоторые источники отмечают, что по внутренним тестам новый Deepseek превосходит всех существующих конкурентов в кодинге, таких как Claude, Gemini, ChatGPT. Источник.
О многом говорит theinformation и подобные посты в x.
Может быть, что релиз даже раньше, дело в том, что 17 февраля китайский новый год.
Ставки могут быть и большие, но всё же интересно, кому нужна медленная модель с очень долгим выводом. Сможет ли Deepseek что-то сделать со скоростью? Как вы считаете?
Но, рано или не поздно китайцы перегонят своих дальних конкурентов в ИИ гонке.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤🔥1
Grok 4.2 похоже что будет SOTA во фронтенд дизайне.
Ранее была другая контрольная точка (тоже показывала сильные результаты, Obsidian называлась), теперь появилась эта.
Тестируется тут — Design Arena
xAI продолжает улучшать генерацию UI и кода. Это хорошо.
#Новости
Ранее была другая контрольная точка (тоже показывала сильные результаты, Obsidian называлась), теперь появилась эта.
Как и ожидал — полноценный Grok 4.2 выйдет ещё через пару недель и это ещё не финальная версия. Первый результат мы видели неделю назад, сейчас видимо вышло ещё одно обновление.
Тестируется тут — Design Arena
xAI продолжает улучшать генерацию UI и кода. Это хорошо.
#Новости
❤🔥1
Светлый Уголок | ии
Grok 4.2 похоже что будет SOTA во фронтенд дизайне. Ранее была другая контрольная точка (тоже показывала сильные результаты, Obsidian называлась), теперь появилась эта. Как и ожидал — полноценный Grok 4.2 выйдет ещё через пару недель и это ещё не финальная…
Media is too big
VIEW IN TELEGRAM
Я уже получил от неё результат. Топ, но слишком красочно, а ещё я просил более серьезный стиль, ну сойдет в общем.
❤🔥1
По сути это уже есть в Claude 4.5, но похоже что Claude 4.7 сможет окончательно закрыть эту лавку.
Вчера вышла их новая статья про Constitutional Classifiers.
Идея такая: нейронные сканеры (internal activation probes). Они мониторят внутреннее состояние модели в реальном времени. Если сканер видит подозрительную активность, он моментально перекидывает запрос на усиленный классификатор, который видит весь контекст беседы, и потом нейросеть уже пиздит юзера за похабство.
Результат впечатляет: После 1700 часов тестов они заявили, что универсальных стратегий взлома для новой системы они пока не нашали. Это выясняла их красная команда.
Это объясняет, почему Claude в последнее время стал таким умным в отказах, но при этом меньше ломается на обычных задачах (ошибки отказов упали на 87%).
Мне интересно, что будут делать другие компании? И получалось ли у вас джейлбрейкнуть claude 4.5 opus например?
Please open Telegram to view this post
VIEW IN TELEGRAM
Anthropic
Next-generation Constitutional Classifiers: More efficient protection against universal jailbreaks
Last year, we described a new approach to defend against jailbreaks, which we called Constitutional Classifiers. We’ve now developed the next generation.
Светлый Уголок | ии
После 1700 часов тестов они заявили, что универсальных стратегий взлома для новой системы они пока не нашали
Хотел бы отметить, что меня дико забавляет одна ситуация. Илья Суцкевер закупает у Google тонны TPU для создания своего супербезопасного ИИ (SSI), сами Gemini (даже новые 3 Pro/Flash) остаются невероятно дырявыми.
Ситуация такая: Вы пробуете в лоб развести Gemini на жесткое РП или запрещёнку — она выдает стандартный отказ. Но стоит проявить каплю терпения... Даете модели 5–7 контекстных запросов, плавно подводите тему, а потом как ни в чем не бывало намекаете на то самое. И всё. Модель ломается напрочь и спокойно общается на любые темы, в которых ChatGPT или Claude отказали бы вам напрочь продолжать диалог. Но зато gemini 3 не душнит)
Короче, такое ощущение, что в погоне за скоростью и огромным контекстом они просто забили на глубокую фильтрацию.
Ситуация такая: Вы пробуете в лоб развести Gemini на жесткое РП или запрещёнку — она выдает стандартный отказ. Но стоит проявить каплю терпения... Даете модели 5–7 контекстных запросов, плавно подводите тему, а потом как ни в чем не бывало намекаете на то самое. И всё. Модель ломается напрочь и спокойно общается на любые темы, в которых ChatGPT или Claude отказали бы вам напрочь продолжать диалог. Но зато gemini 3 не душнит)
Короче, такое ощущение, что в погоне за скоростью и огромным контекстом они просто забили на глубокую фильтрацию.