Anthropic выкатили Claude Opus 5.
Почти уровень Fable 5 за половину цены. И та же цена, что была у Opus 4.8:$5/$25 за миллион токенов. Модель заменили на сильнейшую, счёт не вырос.
Три цифры, которые важны, если строишь агентов:
1. Бизнес-процессы, AutomationBench — 26.0% GPT-5.6 Sol 18.1 / Fable 5 17.4 / Opus 4.8 17.0. Все сидели на 17–18, Opus 5 забрал +50% сверху.
2. Агентный кодинг в терминале, Frontier-Bench — 43.3% Против 21.1 у Opus 4.8, ровно вдвое. Это движок Claude Code. Причём Opus 5 на минимальном effort обгоняет Opus 4.8 на максимальном — втрое дешевле за попытку.
3. Новые задачи, ARC-AGI-3 — 30.2% GPT-5.6 Sol 7.8, Opus 4.8 1.5. Разрыв кратный.
Плюс самая выровненная модель у Anthropic: минимум безрассудного и обманного поведения по их аудиту. Для агентов без присмотра это важнее бенчей.
Честно: на DeepSWE впереди GPT-5.6 Sol, в Legal — Fable 5. И 26% на бизнес-процессах это всё ещё 26%.
Уже дефолт на Max, есть в API.
Перевожу свой 6-агентный пайплайн, вернусь с до/после.
Почти уровень Fable 5 за половину цены. И та же цена, что была у Opus 4.8:$5/$25 за миллион токенов. Модель заменили на сильнейшую, счёт не вырос.
Три цифры, которые важны, если строишь агентов:
1. Бизнес-процессы, AutomationBench — 26.0% GPT-5.6 Sol 18.1 / Fable 5 17.4 / Opus 4.8 17.0. Все сидели на 17–18, Opus 5 забрал +50% сверху.
2. Агентный кодинг в терминале, Frontier-Bench — 43.3% Против 21.1 у Opus 4.8, ровно вдвое. Это движок Claude Code. Причём Opus 5 на минимальном effort обгоняет Opus 4.8 на максимальном — втрое дешевле за попытку.
3. Новые задачи, ARC-AGI-3 — 30.2% GPT-5.6 Sol 7.8, Opus 4.8 1.5. Разрыв кратный.
Плюс самая выровненная модель у Anthropic: минимум безрассудного и обманного поведения по их аудиту. Для агентов без присмотра это важнее бенчей.
Честно: на DeepSWE впереди GPT-5.6 Sol, в Legal — Fable 5. И 26% на бизнес-процессах это всё ещё 26%.
Уже дефолт на Max, есть в API.
Перевожу свой 6-агентный пайплайн, вернусь с до/после.
👍6❤3
Сегодня будет два поста по поводу курсора.
Первый про Grok Bot. xAI выкатил его 11 августа в бете. Это не чат, а набор постоянно работающих агентов.
Каждый бот получает свой облачный компьютер: браузер, файловая система, терминал, свои логины. Заходит в сервисы руками, как человек, включая те, где нет ни API, ни MCP.
Учится наблюдением. Показываешь один раз как делаешь задачу, он сохраняет ее как рутину, ты правишь, дальше выполняет сам.
Ботов можно запустить несколько. Сверху chief of staff, который раздает задачи специалистам: инбокс, расходы, рекрутинг, багфиксы. Между собой переписываются напрямую, без тебя как курьера.
Бесплатного тарифа нет, нужен SuperGrok Heavy за $300, Cursor Ultra за $200 или Cursor Teams Premium за $120 за место. У меня доступ есть, зашел, скрин на фото
Категория при этом не новая. Агент со своим компьютером уже пробовали OpenClaw и Hermes. Новое тут упаковка: мессенджер-интерфейс и мобильное приложение
Первый про Grok Bot. xAI выкатил его 11 августа в бете. Это не чат, а набор постоянно работающих агентов.
Каждый бот получает свой облачный компьютер: браузер, файловая система, терминал, свои логины. Заходит в сервисы руками, как человек, включая те, где нет ни API, ни MCP.
Учится наблюдением. Показываешь один раз как делаешь задачу, он сохраняет ее как рутину, ты правишь, дальше выполняет сам.
Ботов можно запустить несколько. Сверху chief of staff, который раздает задачи специалистам: инбокс, расходы, рекрутинг, багфиксы. Между собой переписываются напрямую, без тебя как курьера.
Бесплатного тарифа нет, нужен SuperGrok Heavy за $300, Cursor Ultra за $200 или Cursor Teams Premium за $120 за место. У меня доступ есть, зашел, скрин на фото
Категория при этом не новая. Агент со своим компьютером уже пробовали OpenClaw и Hermes. Новое тут упаковка: мессенджер-интерфейс и мобильное приложение
❤4🤔3
Не стоит недооценивать Grok :)
Grok 4.6, вышел сегодня.
Связь с Cursor прямая: SpaceX купил Cursor за $60 млрд, вместе они стали SpaceXAI. Среда, где работает Grok, выросла из Cursor.
По уму — вплотную к лидерам. В рейтинге Artificial Analysis 61 балл: столько же у GPT-5.6 Sol, у Fable 5 — 62, у Opus 5 — 63. За месяц прибавил 5.
Силён как агент — когда сам делает задачу по шагам. На реальных рабочих задачах второй после Opus 5, в терминале 88.4%.
Но главное — цена. $2 за миллион входящих токенов и $6 за исходящие. У Opus 5 — $5 и $25. Втрое дешевле.
И вот что интереснее. Ту же задачу Grok закрывает за ~53 шага, Opus 5 — за 103. Текста читает вчетверо меньше: 0.5 против 2 млрд токенов. Агент на каждом шаге перечитывает всю переписку, поэтому в счёте разрыв ещё больше, чем в прайсе.
Вывод: лучшая цена за качество, когда Grok работает, а кто-то проверяет. Проверку оставляю на Opus.
Графики собрал сам, данные Artificial Analysis.
Grok 4.6, вышел сегодня.
Связь с Cursor прямая: SpaceX купил Cursor за $60 млрд, вместе они стали SpaceXAI. Среда, где работает Grok, выросла из Cursor.
По уму — вплотную к лидерам. В рейтинге Artificial Analysis 61 балл: столько же у GPT-5.6 Sol, у Fable 5 — 62, у Opus 5 — 63. За месяц прибавил 5.
Силён как агент — когда сам делает задачу по шагам. На реальных рабочих задачах второй после Opus 5, в терминале 88.4%.
Но главное — цена. $2 за миллион входящих токенов и $6 за исходящие. У Opus 5 — $5 и $25. Втрое дешевле.
И вот что интереснее. Ту же задачу Grok закрывает за ~53 шага, Opus 5 — за 103. Текста читает вчетверо меньше: 0.5 против 2 млрд токенов. Агент на каждом шаге перечитывает всю переписку, поэтому в счёте разрыв ещё больше, чем в прайсе.
Вывод: лучшая цена за качество, когда Grok работает, а кто-то проверяет. Проверку оставляю на Opus.
Графики собрал сам, данные Artificial Analysis.
👍10❤2👎1
Приглашаю вас на первый стрим 🤝 (Бесплатно)
19.08.2026(СРЕДА), В 19:00 ПО АСТАНЕ.
Формат простой: вы спрашиваете я отвечаю. ИИ агенты, Claude Code/Codex/Cursor, автоматизация, как применять агентов и масштабировать себя. Программы нет, пока сбор вопросов
Писать можно будет в чат, а кто захочет подниму микрофон, поговорим голосом
Одна просьба: накидайте вопросы в комменты сейчас. Самые частые возьму в начало, чтобы не раскачиваться полчаса
В конце объявление для тех, кто не хочет разбираться в одиночку то есть беру первых трех учеников
19.08.2026(СРЕДА), В 19:00 ПО АСТАНЕ.
Формат простой: вы спрашиваете я отвечаю. ИИ агенты, Claude Code/Codex/Cursor, автоматизация, как применять агентов и масштабировать себя. Программы нет, пока сбор вопросов
Писать можно будет в чат, а кто захочет подниму микрофон, поговорим голосом
Одна просьба: накидайте вопросы в комменты сейчас. Самые частые возьму в начало, чтобы не раскачиваться полчаса
В конце объявление для тех, кто не хочет разбираться в одиночку то есть беру первых трех учеников
❤10
Напоминаю - через 1 час 10 минут бесплатный легкий стрим.
Буквально на 30-40 минут. Просто поговорим про вайбкодинг Ai агентов Claude Code/Codex/Cursor, автоматизация, как применять агентов и масштабировать себя.
Жду вас тут прямо в тг увидите плашку с стримом 🤝
Буквально на 30-40 минут. Просто поговорим про вайбкодинг Ai агентов Claude Code/Codex/Cursor, автоматизация, как применять агентов и масштабировать себя.
Жду вас тут прямо в тг увидите плашку с стримом 🤝
👍8❤2🤝2
This media is not supported in your browser
VIEW IN TELEGRAM
Claude Code теперь рисует интерфейс, а не только пишет код
Появилась команда /design — она открывает прямо в терминале редактируемые макеты. Раньше это жило отдельно, в Claude Design.
Как это работает
Пишешь /design и описываешь экран, который нужен. Claude выдаёт несколько вариантов рядом — каждый можно править: поменять цвет, подвинуть блок, расширить отступ.
Выбрал подходящий, довёл до ума — и говоришь Claude собрать его в коде. Без перекладывания из макета в текстовое описание и оттуда в редактор.
Что важно знать
Это research preview, то есть ранняя версия: команда ещё будет меняться, а первый макет стоит проверить на своём проекте, прежде чем нести в работу.
Доступно на планах Pro, Max, Team и Enterprise. Нужно обновить Claude Code.
Зачем это нужно
Обычно порядок такой: сначала думаешь про верстку, потом переносишь идею в код и на середине понимаешь, что задумка не работает. Здесь наоборот — сначала смотришь на экран глазами, а код пишется уже под утверждённый вид.
Появилась команда /design — она открывает прямо в терминале редактируемые макеты. Раньше это жило отдельно, в Claude Design.
Как это работает
Пишешь /design и описываешь экран, который нужен. Claude выдаёт несколько вариантов рядом — каждый можно править: поменять цвет, подвинуть блок, расширить отступ.
Выбрал подходящий, довёл до ума — и говоришь Claude собрать его в коде. Без перекладывания из макета в текстовое описание и оттуда в редактор.
Что важно знать
Это research preview, то есть ранняя версия: команда ещё будет меняться, а первый макет стоит проверить на своём проекте, прежде чем нести в работу.
Доступно на планах Pro, Max, Team и Enterprise. Нужно обновить Claude Code.
Зачем это нужно
Обычно порядок такой: сначала думаешь про верстку, потом переносишь идею в код и на середине понимаешь, что задумка не работает. Здесь наоборот — сначала смотришь на экран глазами, а код пишется уже под утверждённый вид.
❤5🔥2👍1🙏1
Бесплатная OX ALPHA заменяет ChatGPT 5.6 и Claude fable?
На OpenRouter лежит OX-ALPHA. Уровень фронтира, миллион токенов контекста, бесплатная до 27 августа. Разработчик не указан — в карточке пусто. Модель на вопрос о себе отвечает: «разработана неафишируемой организацией».
Я выпустил ключ, подключил её к Claude Code и дал задачу, которую обычно отдаю платным моделям: собрать монтаж.
Что она сделала
Сценарий, раскладка кадров, код сборки, анимации, команда рендера. Я запускал и возвращал брак — остальное её работа.
Из 14 минут записи сделала 10: сама выбирала, какие куски оставить, какие вырезать.
Что в ролике
Как выпустить ключ, как проверить лимиты и контекст, что модель говорит о себе, и как выглядит готовый монтаж.
Бесплатно она до 27 августа. Дальше — неизвестно.
(Пользуйтесь пока дают!)
https://youtube.com/watch?v=E2wsohiFJks
На OpenRouter лежит OX-ALPHA. Уровень фронтира, миллион токенов контекста, бесплатная до 27 августа. Разработчик не указан — в карточке пусто. Модель на вопрос о себе отвечает: «разработана неафишируемой организацией».
Я выпустил ключ, подключил её к Claude Code и дал задачу, которую обычно отдаю платным моделям: собрать монтаж.
Что она сделала
Сценарий, раскладка кадров, код сборки, анимации, команда рендера. Я запускал и возвращал брак — остальное её работа.
Из 14 минут записи сделала 10: сама выбирала, какие куски оставить, какие вырезать.
Что в ролике
Как выпустить ключ, как проверить лимиты и контекст, что модель говорит о себе, и как выглядит готовый монтаж.
Бесплатно она до 27 августа. Дальше — неизвестно.
(Пользуйтесь пока дают!)
https://youtube.com/watch?v=E2wsohiFJks
YouTube
OX-ALPHA: бесплатная модель уровня GPT-5.6 SOL Ultra и Claude Fable 5. Кто её выпустил?
На OpenRouter появилась модель Ox Alpha. Миллион токенов контекста, уровень фронтира, бесплатная до 27 августа — и никто не знает, кто её выложил. Разработчик не раскрыт, в карточке пусто.
Я выпустил ключ, подключил её к Claude Code и дал задачу, которую…
Я выпустил ключ, подключил её к Claude Code и дал задачу, которую…
👍7❤1
This media is not supported in your browser
VIEW IN TELEGRAM
Топ новость - ChatGPT научился заходить в твои аккаунты — и продолжать работу внутри них
Раньше агент упирался в форму входа и останавливался: дальше руками. Теперь он доводит задачу до конца.
Как это работает
Агент открывает сайт, доходит до входа и ставит паузу. Логин, пароль и код из СМС вводишь ты сам — прямо в его браузере. ChatGPT этих данных не видит: они не попадают в модель, не сохраняются и не идут в обучение.
Дальше он продолжает сам. И главное — вход запоминается: во второй раз вводить пароль уже не нужно.
Что он теперь может доделать за тебя
— оформить заявку в личном кабинете — записаться на приём — проверить страховку — оформить возврат товара — перенести данные из почты в бухгалтерию
Кому уже доступно
Plus, Pro и Business — в вебе и в мобильном приложении, раскатывают постепенно.
Полтора года назад агент отдавал управление человеку на каждом входе и каждой капче.
Сегодня он работает внутри авторизованных аккаунтов.
Раньше агент упирался в форму входа и останавливался: дальше руками. Теперь он доводит задачу до конца.
Как это работает
Агент открывает сайт, доходит до входа и ставит паузу. Логин, пароль и код из СМС вводишь ты сам — прямо в его браузере. ChatGPT этих данных не видит: они не попадают в модель, не сохраняются и не идут в обучение.
Дальше он продолжает сам. И главное — вход запоминается: во второй раз вводить пароль уже не нужно.
Что он теперь может доделать за тебя
— оформить заявку в личном кабинете — записаться на приём — проверить страховку — оформить возврат товара — перенести данные из почты в бухгалтерию
Кому уже доступно
Plus, Pro и Business — в вебе и в мобильном приложении, раскатывают постепенно.
Полтора года назад агент отдавал управление человеку на каждом входе и каждой капче.
Сегодня он работает внутри авторизованных аккаунтов.
🔥9❤2
Вышла Claude Fable 5.1
Anthropic выпустили новую флагманскую модель. Сейчас это самая сильная из тех, что доступны всем — тот же движок, что у Claude Mythos 5.1, но открытый.
Что нового
— Делает то, что попросили, и переспрашивает, если задача размытая — Собирает готовые таблицы и проверяет каждую цифру по ходу — Показывает источники и отделяет факты от прикидок
Кому доступна
Уже в приложении Claude. На Max-плане Fable включена в лимит — до 50% от общего usage.
Тестирую на своих задачах, результатами возможно поделюсь.
Anthropic выпустили новую флагманскую модель. Сейчас это самая сильная из тех, что доступны всем — тот же движок, что у Claude Mythos 5.1, но открытый.
Что нового
— Делает то, что попросили, и переспрашивает, если задача размытая — Собирает готовые таблицы и проверяет каждую цифру по ходу — Показывает источники и отделяет факты от прикидок
Кому доступна
Уже в приложении Claude. На Max-плане Fable включена в лимит — до 50% от общего usage.
Тестирую на своих задачах, результатами возможно поделюсь.
❤6🔥4🫡4