Forwarded from Geometrybot
СВЯТАЯ МАТЬ МАТЕМАТИКИ!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!
Google работает над математически ориентированным вариантом своей модели DeepThink, и её сырые мысли довольно забавны.
🍷 @lyraxana
Google работает над математически ориентированным вариантом своей модели DeepThink, и её сырые мысли довольно забавны.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👀12 3
Geometrybot
Photo
Надежды... надежды и снова надежды. Какой это уже шанс по счёту?
Не знаю, верить ли вообще в Gemini 4.
Они обучили огромную модель, недавно появились новые чекпоинты, и, скорее всего, это Gemini 4.
По первым результатам всё не очень хорошо: это примерно тот же уровень, что у Gemini 3.1 DeepThink, от которого Google почему-то отстал. На данный момент известно, что притрейн Gemini 4 был действительно амбициозным в плане своего размера: эта модель, по нашей информации, намного больше mythos-preview 10t.
В настоящее время Google делает полную херню, прогресса ноль, (если не вообще в минус), так ещё и лютейшие галлюцинации в reasoning каждой модели.
Может я чего то не понимаю, я не ИИ инженер.
Например они тестируют новую модель, возможно все ещё основанную на G3.1-DT для решения математических задач. Но что с ней не так?
АААААА!!!!!!!!!!!!!!!!!!!!!!!!!! О БОЖЕ!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!
В любом случае, последний чекпоинт Gemini-pro намного лучше относительно Gemini-3.8-flash. Значит они что-то делают.
X (formerly Twitter)
Lentils (@Lentils80) on X
Gemini 4 Pro checkpoints have finally started appearing internally a few days ago.
This is the first ever output from the model, internally codenamed "argon". It took 2.4 minutes on High thinking…
This is the first ever output from the model, internally codenamed "argon". It took 2.4 minutes on High thinking…
Forwarded from Geometrybot
ChatGPT 6 Sol вышел на грей-тестирование в вебе.
Ответы, похоже, форматируются гораздо богаче, и модель, похоже, заметно активнее использует Память и Персонализацию.
SVG-контроллер PS5 в режиме high effort, 3 минуты. Также пример богатого форматирования, описанного ниже.
🍷 @aileaksofficial
Ответы, похоже, форматируются гораздо богаче, и модель, похоже, заметно активнее использует Память и Персонализацию.
SVG-контроллер PS5 в режиме high effort, 3 минуты. Также пример богатого форматирования, описанного ниже.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👌7👀2
Светлый Уголок | ии
Когда мы тестили Odysseus на arena.ai, модель выдавала хорошие результаты и была довольно шустрой, но когда мы получили доступ к mimo-x-pro-preview, эта модель была в разы медленнее и выдавала результаты хуже, чем Odysseus. Мы не знаем, с чем это связано.
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯5👀3
Светлый Уголок | ии
Скорее всего, GPT-6 Sol и Luna были перенесены на следующую неделю.
Forwarded from Geometrybot
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯10
Forwarded from ✨AI Watchtower✨ (Arena Overseer)
🆕 New models on Arena:
• grok-4.6 (input: text, image, file; output: text, web)
• grok-4.6 (input: text, image, file; output: text, web)
Grok 4.7-xhigh был добавлен на arena.ai под скрытым названием grok-4.6.
👀5
Обычно такие записи появляются незадолго до релиза, иногда в тот же день. Но после последних частых переносов конкретную дату пока обещать не будем. Но вероятность, что этот Grok на этой неделе высока.
grok-4.6.По нашим ощущениям, пока 4.7 особо не удивляет. В некоторых задачах Grok 4.6 даже выглядел сильнее. Посмотрим, что будет к полноценному релизу.
Источник.
Please open Telegram to view this post
VIEW IN TELEGRAM
👀9 2
Geometrybot
Тест GEMINI 4. argon-d. 🍷 @Waguri_Kaoruko8
argon-d были обновлены знания, и теперь модель знает о выходе 3.1 Pro. Отсечка знаний теперь февраль 2026.Please open Telegram to view this post
VIEW IN TELEGRAM
🤯15 5 3
WAN 3.5. Возможно будет настоящим лучшим конкурентом топовой seedance 2.5. 👀 👀
Информация о новых alibaba моделях и примеры самой wan 3.5 скоро.
Информация о новых alibaba моделях и примеры самой wan 3.5 скоро.
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Opus новый 5.x уже тестируется Два дня назад внутри Anthropic было замечено упоминание claude-opus-5-x. Источник. ⚪️ При выборе обычного Opus 5 пользователи начали получать более качественные ответы, местами сравнимые с Fable 5.1. ⚪️ Возможно, новый Opus…
Такой тренд мы наблюдали с Fable 5.1, модель стала заметно тупить на low-high, и казалось, что модель стала меньше.
Скорее всего, это ранний снапшот, и, возможно, будут тестироваться ещё снапшоты через какой то время.
Источник.
Please open Telegram to view this post
VIEW IN TELEGRAM
👀8🤯3 2
Forwarded from Geometrybot
Nano Banana 2.5 (`spicy-mayo`) уже развернута и выйдет на следующей неделе.
Партнёры получили доступ через Vertex под именем модели `nano-banana-2.5` с уровнями мышления `minimal`, `medium`, `high` и размерами изображений `512`, `1K`, `2K`, `4K`.
🍷 @lyraxana
Партнёры получили доступ через Vertex под именем модели `nano-banana-2.5` с уровнями мышления `minimal`, `medium`, `high` и размерами изображений `512`, `1K`, `2K`, `4K`.
Please open Telegram to view this post
VIEW IN TELEGRAM
Светлый Уголок | ии
Чтобы проверить, есть ли она у вас, задайте такой вопрос: "
Who is Tibo the reset guy, don't search the internet". Если модель ответит про Thibault Sottiaux, значит, у вас она есть.*На одном из трех аккаунтов Free Tier у меня появилась рероут в claude.ai.
Вполне вероятно, что Anthropic хотят обновить всё семейство моделей Claude (кроме Haiku).
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯10 2