🫆 Светлый Уголок | ии
539 subscribers
911 photos
191 videos
10 files
529 links
Тут сначала замечают, потом обсуждают.
AI-инсайды, свежие сигналы, честные мнения и свои инструменты.
Светлый уголок — авторский канал про ИИ без скуки.
Download Telegram
Сравнение производительности Claude Opus 4.8 и Claude Opus 5. Voxelbench.ai.

Разрыв на самом деле очень колоссальный.

Завтра мы объясним, почему Opus 5 в некоторых случаях лучше Fable-5.
🤯135
🟠 Opus 5 был только что добавлен в Claude Code.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
10
🫆 Светлый Уголок | ии
🟠 Opus 5 был только что добавлен в Claude Code.
Цена осталось такой же, отсечку знаний обновили до мая 2026.
9🤯3
🟠Claude Opus 5 вышел!

Ссылка на блог: https://www.anthropic.com/news/claude-opus-5
Please open Telegram to view this post
VIEW IN TELEGRAM
83
🟠 Anthropic выпустила Claude Opus 5.

Модель почти уровня Fable 5 за половину цены. Уже доступна на всех платформах, в Claude Max теперь стоит по умолчанию.

⚪️ Первое место в Intelligence Index: 61 балл. Выше Fable 5 с её 60 и GPT-5.6 Sol с 59.

⚪️ До пика Fable 5 на CursorBench не хватило 0.5%, при вдвое меньшей цене за задачу.

⚪️ На ARC-AGI 3 выбила 30.16%. Прошлый рекорд лидерборда 7.78% у GPT-5.6 Sol, у Opus 4.8 было 1.52%.

⚪️ На OSWorld 2.0 (управление компьютером) 70.57%. Выше лучшего результата Fable 5, при трети его цены.

⚪️ Результаты уровня 4.8 на максималках выдаёт на low. На DeepSWE это 57.7% против 59%, но в 7 раз дешевле за задачу.

* При этом по нашим тестам жор токенов у него почти такой же, как у Fable 5, местами даже выше.

⚪️ Подтянули науку. В химии и задачах по белкам заметно сильнее 4.8, по белкам обошла даже Mythos 5. Заблокированные на Fable 5 биозапросы теперь роутятся на Opus 5.

⚪️ Базу знаний обновили до мая 2026. У прошлых моделей, начиная с Opus 4.7 и даже у Fable 5, был январь 2026.

Карточка модели
Цена: $5 / $25 за 1M
Контекст: 976k

❗️ Примечание: при странных запросах про кибербез отроутит на Opus 4.8, хотя классификаторы срабатывают на 85% реже, чем у Fable 5. Есть Fast-режим: в 2.5 раза быстрее и вдвое дороже.

Похоже, Anthropic зашевелилась после Kimi K3: мы узнали, что после чекпоинта Honeycomb они прогнали ещё новее.

Судя по всему, старый чекпоинт дообучили новым RL и освежили знания, отсюда и май 2026 в катоффе. Скорее всего они расчищают дорогу перед Fable 5.1.

По нашим тестам Opus 5 местами превосходит Fable 5 в задачах с визуальными инпутами. Модель гораздо лучше предшественника.

Спасибо @uiduqwer за видики.


Источник.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
9