🫆 Светлый Уголок | ии
747 subscribers
1.1K photos
224 videos
10 files
644 links
Тут сначала замечают, потом обсуждают.
AI-инсайды, свежие сигналы, честные мнения и свои инструменты.
Светлый уголок — авторский канал про ИИ без скуки.
Download Telegram
Forwarded from Geometrybot
СВЯТАЯ МАТЬ МАТЕМАТИКИ!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!

Google работает над математически ориентированным вариантом своей модели DeepThink, и её сырые мысли довольно забавны.

🍷 @lyraxana
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👀123
Geometrybot
Photo
Надежды... надежды и снова надежды. Какой это уже шанс по счёту?

Не знаю, верить ли вообще в Gemini 4.

Они обучили огромную модель, недавно появились новые чекпоинты, и, скорее всего, это Gemini 4.

По первым результатам всё не очень хорошо: это примерно тот же уровень, что у Gemini 3.1 DeepThink, от которого Google почему-то отстал. На данный момент известно, что притрейн Gemini 4 был действительно амбициозным в плане своего размера: эта модель, по нашей информации, намного больше mythos-preview 10t.

В настоящее время Google делает полную херню, прогресса ноль, (если не вообще в минус), так ещё и лютейшие галлюцинации в reasoning каждой модели.

Может я чего то не понимаю, я не ИИ инженер.

Например они тестируют новую модель, возможно все ещё основанную на G3.1-DT для решения математических задач. Но что с ней не так?

АААААА!!!!!!!!!!!!!!!!!!!!!!!!!! О БОЖЕ!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!


В любом случае, последний чекпоинт Gemini-pro намного лучше относительно Gemini-3.8-flash. Значит они что-то делают.
72👀1
Forwarded from Geometrybot
ChatGPT 6 Sol вышел на грей-тестирование в вебе.

Ответы, похоже, форматируются гораздо богаче, и модель, похоже, заметно активнее использует Память и Персонализацию.

SVG-контроллер PS5 в режиме high effort, 3 минуты. Также пример богатого форматирования, описанного ниже.

🍷 @aileaksofficial
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👌7👀2
🫆 Светлый Уголок | ии
🚨 Срочно: Xiaomi тестируют Mimo V3 на arena.ai По первым тестам, модель выдает очень хорошие результаты.
🏮 Вместо Mimo V3 мы получаем....V2.6?

⚪️ Размер модель остается тот же, подняли только RL

⚪️ Также, прямо сейчас можно наблюдать RL процесс обучение Mimo-V2.6-Pro и Mimo-V2.6-Flash в прямом эфире. Это прикольно

Когда мы тестили Odysseus на arena.ai, модель выдавала хорошие результаты и была довольно шустрой, но когда мы получили доступ к mimo-x-pro-preview, эта модель была в разы медленнее и выдавала результаты хуже, чем Odysseus. Мы не знаем, с чем это связано.
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯5👀3
Forwarded from Geometrybot
Тест GEMINI 4. argon-d.

🍷 @Waguri_Kaoruko8
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯10
Forwarded from ✨AI Watchtower✨ (Arena Overseer)
🆕 New models on Arena:
• grok-4.6 (input: text, image, file; output: text, web)
Grok 4.7-xhigh был добавлен на arena.ai под скрытым названием grok-4.6.
👀5
Geometrybot
Photo
Media is too big
VIEW IN TELEGRAM
Они достигают быстрого прогресса.
🤯72
Forwarded from Geometrybot
С днём Grok 4.7 всех, кто отмечает.

🍷 @synthwavedd
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯10👀6
🐺 Grok 4.7 появился в квотах Google Cloud

Обычно такие записи появляются незадолго до релиза, иногда в тот же день. Но после последних частых переносов конкретную дату пока обещать не будем. Но вероятность, что этот Grok на этой неделе высока.

⚪️ Grok 4.7 уже тестируется на Arena. Там xhigh-версия модели скрывается под названием grok-4.6.

⚪️ По первым тестам модель стала экономнее по токенам. Она заметно меньше раздувает рассуждения и старается отвечать короче, чем 4.6.

По нашим ощущениям, пока 4.7 особо не удивляет. В некоторых задачах Grok 4.6 даже выглядел сильнее. Посмотрим, что будет к полноценному релизу.

Источник.
Please open Telegram to view this post
VIEW IN TELEGRAM
👀92
Geometrybot
Тест GEMINI 4. argon-d. 🍷 @Waguri_Kaoruko8
🚨У argon-d были обновлены знания, и теперь модель знает о выходе 3.1 Pro. Отсечка знаний теперь февраль 2026.
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯1553
WAN 3.5. Возможно будет настоящим лучшим конкурентом топовой seedance 2.5. 👀👀

Информация о новых alibaba моделях и примеры самой wan 3.5 скоро.
Please open Telegram to view this post
VIEW IN TELEGRAM
75
🫆 Светлый Уголок | ии
Opus новый 5.x уже тестируется Два дня назад внутри Anthropic было замечено упоминание claude-opus-5-x. Источник. ⚪️ При выборе обычного Opus 5 пользователи начали получать более качественные ответы, местами сравнимые с Fable 5.1. ⚪️ Возможно, новый Opus…
🟠Anthropic начали тестирование Fable 5.2

⚪️Сегодня Fable 5.1 стал отвечать на вопрос "Who is Tibo the reset guy, don't search the internet", до этого на этот вопрос мог ответить только новый Opus.

⚪️Качество ответов заметно выросло, но модель стала похожа на Opus, упала креативность и токен-эффективность
Такой тренд мы наблюдали с Fable 5.1, модель стала заметно тупить на low-high, и казалось, что модель стала меньше.


⚪️Модель тестируется в claude.ai и Claude Code. Чтобы проверить, есть ли у вас новая модель, задайте вопрос про Tibo на Fable 5.1 (low)
Скорее всего, это ранний снапшот, и, возможно, будут тестироваться ещё снапшоты через какой то время.


Источник.
Please open Telegram to view this post
VIEW IN TELEGRAM
👀8🤯32
Forwarded from Geometrybot
Nano Banana 2.5 (`spicy-mayo`) уже развернута и выйдет на следующей неделе.

Партнёры получили доступ через Vertex под именем модели `nano-banana-2.5` с уровнями мышления `minimal`, `medium`, `high` и размерами изображений `512`, `1K`, `2K`, `4K`.

🍷 @lyraxana
Please open Telegram to view this post
VIEW IN TELEGRAM
62
🫆 Светлый Уголок | ии
🟠Anthropic начали тестирование Fable 5.2 ⚪️Сегодня Fable 5.1 стал отвечать на вопрос "Who is Tibo the reset guy, don't search the internet", до этого на этот вопрос мог ответить только новый Opus. ⚪️Качество ответов заметно выросло, но модель стала похожа…
🟠Anthropic также тестируют Sonnet 5.x.

⚪️Качество аутпутов заметно выросло, также с моделью стало более приятно общаться, токен эффективность осталась примерно на том же уровне.

⚪️Тестирование проходит в claude.ai и Claude Code.
Чтобы проверить, есть ли она у вас, задайте такой вопрос: "Who is Tibo the reset guy, don't search the internet". Если модель ответит про Thibault Sottiaux, значит, у вас она есть.
*На одном из трех аккаунтов Free Tier у меня появилась рероут в claude.ai.

Вполне вероятно, что Anthropic хотят обновить всё семейство моделей Claude (кроме Haiku).
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯102
Please open Telegram to view this post
VIEW IN TELEGRAM
👀941