claude dev - инструменты по claude code, gpt (вайб-кодинг)
Claude Fable 5.1 и Mythos 5.1 выпустили. Fable заметно прокачали в программировании, научных исследованиях и долгих агентных задачах — по новым тестам модель обходит предыдущую версию и основных конкурентов. Она уже доступна в Claude, Claude Code, API и облачных…
Главный фокус апдейта - не просто более умные ответы, а автономная работа модели.
Что прокачали:
• заметно улучшили работу с кодом и управлением компьютером;
• модель способна самостоятельно выполнять сложные задачи часами;
• в некоторых сценариях расход токенов снизился на 30–60%;
• чтение кэша стало дешевле на 75% - $0.25 за 1 млн токенов;
• стандартные нагрузки подешевели примерно на 25%, агентские - до 45%;
• количество ошибочных safety-отказов сократилось на 60%;
• улучшились глубокий ресерч и работа с многоэтапными задачами.
По сути, Claude постепенно превращается из чат-бота в полноценного агента.
Теперь сценарий может выглядеть примерно так:
При этом для простых запросов преимущества новой версии будут не такими заметными - её сильная сторона именно длинные и сложные задачи.
Fable 5.1 против Fable 5:
• Terminal-Bench: 42% → 55.8%
• Результаты в ресерче: ~25% → 52.6%
• Кэш: −75% по стоимости
• Обычные сценарии: примерно −25%
• Агентские задачи: до −45%
• Ложные safety-отказы: −60%
Цена осталась прежней – $10/$50 за миллион токенов, зато cache reads подешевели на 75%, до $0,25 за миллион. По оценке Anthropic, это может снизить расходы примерно на 25% в обычных сценариях и до 45% в агентных.
Что прокачали:
• заметно улучшили работу с кодом и управлением компьютером;
• модель способна самостоятельно выполнять сложные задачи часами;
• в некоторых сценариях расход токенов снизился на 30–60%;
• чтение кэша стало дешевле на 75% - $0.25 за 1 млн токенов;
• стандартные нагрузки подешевели примерно на 25%, агентские - до 45%;
• количество ошибочных safety-отказов сократилось на 60%;
• улучшились глубокий ресерч и работа с многоэтапными задачами.
По сути, Claude постепенно превращается из чат-бота в полноценного агента.
Теперь сценарий может выглядеть примерно так:
Получить задачу → разобраться → найти проблему → внести изменения → проверить результат → продолжить работу.
При этом для простых запросов преимущества новой версии будут не такими заметными - её сильная сторона именно длинные и сложные задачи.
Fable 5.1 против Fable 5:
• Terminal-Bench: 42% → 55.8%
• Результаты в ресерче: ~25% → 52.6%
• Кэш: −75% по стоимости
• Обычные сценарии: примерно −25%
• Агентские задачи: до −45%
• Ложные safety-отказы: −60%
Цена осталась прежней – $10/$50 за миллион токенов, зато cache reads подешевели на 75%, до $0,25 за миллион. По оценке Anthropic, это может снизить расходы примерно на 25% в обычных сценариях и до 45% в агентных.
Обновлённый Qwen3.8-Max.
Qwen3.8-Max-0902 — монстр на 2,4 трлн параметров.
Qwen3.8-Max-0902 получила контекст на 1 млн токенов и серьёзные улучшения в программировании, исследованиях и длинных многоэтапных задачах.
Она сразу заняла первое место в общем рейтинге Code Arena: WebDev с результатом 1691 балл.
Она опережает Claude Opus 5 Max на 3 балла, Kimi K3 Max — на 17 баллов, а предыдущую Qwen3.8-Max — на 22 балла.
При средней цене около $5 за 1 млн токенов Qwen3.8-Max-0902 также заняла лучшую позицию на границе Парето — то есть сейчас это один из самых сильных вариантов по соотношению качества и стоимости, именно в веб-разработке.
Модель уже доступна через API в QwenCloud.
вход — $2 за 1 млн токенов
выход — $6
явное попадание в кэш — $0,17
неявное попадание в кэш — $0,25
Qwen3.8-Max-0902 — монстр на 2,4 трлн параметров.
Qwen3.8-Max-0902 получила контекст на 1 млн токенов и серьёзные улучшения в программировании, исследованиях и длинных многоэтапных задачах.
Она сразу заняла первое место в общем рейтинге Code Arena: WebDev с результатом 1691 балл.
Она опережает Claude Opus 5 Max на 3 балла, Kimi K3 Max — на 17 баллов, а предыдущую Qwen3.8-Max — на 22 балла.
При средней цене около $5 за 1 млн токенов Qwen3.8-Max-0902 также заняла лучшую позицию на границе Парето — то есть сейчас это один из самых сильных вариантов по соотношению качества и стоимости, именно в веб-разработке.
Модель уже доступна через API в QwenCloud.
вход — $2 за 1 млн токенов
выход — $6
явное попадание в кэш — $0,17
неявное попадание в кэш — $0,25
GPT-6 ASTRA УЖЕ ГОТОВЯТ К ЗАПУСКУ
Responses API теперь возвращает для gpt-6-astra ошибку 404 Not Found, тогда как случайные или реально несуществующие названия моделей получают 400.
При этом тот же 404 возвращается для GPT-5.6 Cyber, про существование которой мы уже знаем.
Похожая странность была и в API Bedrock — именно по ней Fable 5.1 обнаружили за день до релиза.
Responses API теперь возвращает для gpt-6-astra ошибку 404 Not Found, тогда как случайные или реально несуществующие названия моделей получают 400.
При этом тот же 404 возвращается для GPT-5.6 Cyber, про существование которой мы уже знаем.
Похожая странность была и в API Bedrock — именно по ней Fable 5.1 обнаружили за день до релиза.
claude dev - инструменты по claude code, gpt (вайб-кодинг)
GPT-6 ASTRA УЖЕ ГОТОВЯТ К ЗАПУСКУ Responses API теперь возвращает для gpt-6-astra ошибку 404 Not Found, тогда как случайные или реально несуществующие названия моделей получают 400. При этом тот же 404 возвращается для GPT-5.6 Cyber, про существование которой…
Почему от того же GPT почти ничего не ждём
Первое — это очень глупая версия 5.6, в последнее время стала намного дольше думать и в некоторых моментах особенно стала тупеть, перед выходом новой модели это началось.
Второе — во фронтенде GPT и вправду хорош, но в бэкенде с ним работать уже тяжелее и ошибок больше
И в целом, в апках модели +- одинаково туповаты (Claude и GPT)
Но когда ставишь тот же Claude в терминал и отправляешься работать, скорость работы и количество ошибок говорят о том, что модель самая хорошая и с неё пока перепрыгивать никуда не хочется.
Когда как в апках модели жрут токены и в целом, GPT очень прожорлив.
Но ещё один момент, что если ты новичок, то GPT отличный старт, ты видишь как агенты там работают и выглядит всё понятнее, но в будущем лучше перепрыгивать на Claude или использовать связку из двух моделей + Китайских
Первое — это очень глупая версия 5.6, в последнее время стала намного дольше думать и в некоторых моментах особенно стала тупеть, перед выходом новой модели это началось.
Второе — во фронтенде GPT и вправду хорош, но в бэкенде с ним работать уже тяжелее и ошибок больше
И в целом, в апках модели +- одинаково туповаты (Claude и GPT)
Но когда ставишь тот же Claude в терминал и отправляешься работать, скорость работы и количество ошибок говорят о том, что модель самая хорошая и с неё пока перепрыгивать никуда не хочется.
Когда как в апках модели жрут токены и в целом, GPT очень прожорлив.
Но ещё один момент, что если ты новичок, то GPT отличный старт, ты видишь как агенты там работают и выглядит всё понятнее, но в будущем лучше перепрыгивать на Claude или использовать связку из двух моделей + Китайских
This media is not supported in your browser
VIEW IN TELEGRAM
Codex восстановил игру Red Alert 2 по одному EXE-файлу.
Исходный код игры никогда не публиковался и, как считается, был утерян. Но вайбкодера это не остановило — он поставил Codex цель восстановить Red Alert 2: Yuri’s Revenge и заставить её нативно работать на iOS и macOS.
Codex на GPT-5.6 Sol работал над этим 26 дней, проанализировал EXE-файл и фактически заново собрал всю игру.
Итог — 624 тысячи строк C++.
Исходный код игры никогда не публиковался и, как считается, был утерян. Но вайбкодера это не остановило — он поставил Codex цель восстановить Red Alert 2: Yuri’s Revenge и заставить её нативно работать на iOS и macOS.
Codex на GPT-5.6 Sol работал над этим 26 дней, проанализировал EXE-файл и фактически заново собрал всю игру.
Итог — 624 тысячи строк C++.
Fable 5.1 Max от Anthropic заняла первое место
В Code Arena: WebDev с результатом 1765 баллов — отрыв от всех остальных сразу на 77 баллов.
Это огромный скачок по сравнению с Fable 5 Max, которая сейчас занимает 8-е место с 1628 баллами.
Fable 5.1 Max опережает Qwen 3.8 Max 0902 на втором месте на 77 баллов, а Opus 5 Max на третьем — на 78 баллов.
При результате 1765 баллов и средней цене $40 за миллион токенов модель также заметно сдвигает границу Парето в дорогом сегменте, поднимая планку производительности намного выше.
В Code Arena: WebDev с результатом 1765 баллов — отрыв от всех остальных сразу на 77 баллов.
Это огромный скачок по сравнению с Fable 5 Max, которая сейчас занимает 8-е место с 1628 баллами.
Fable 5.1 Max опережает Qwen 3.8 Max 0902 на втором месте на 77 баллов, а Opus 5 Max на третьем — на 78 баллов.
При результате 1765 баллов и средней цене $40 за миллион токенов модель также заметно сдвигает границу Парето в дорогом сегменте, поднимая планку производительности намного выше.
НОВЫЙ GPT УЖЕ ВЫШЕЛ!
OpenAI официально представили GPT‑6 Astra. Это универсальный компьютерный агент, способный работать в браузере и приложениях, писать и запускать код, управлять документами, таблицами, CAD и 3D-сценами. Слоган компании соответствующий: «Всё, что вы можете сделать на компьютере, Astra может сделать за вас быстрее»
Бенчмарки мощные. Astra набрала 98,6% на ARC-AGI-3 против 30,2% у Opus 5, 97,6% на FrontierMath против 87,8% у Fable 5.1, 41,4% на AutomationBench против 31,4% и 95,9% на BenchCAD против 84,3%. В кодинге отрыва уже нет. Результат на DeepSWE составляет 74,1%, что примерно соответствует уровню других лидеров. При этом ARC запускали со специальной агентной системой, а большинство тестов проводили на максимальном reasoning.
Грег Брокман заявил, что лично считает AGI уже достигнутым, хотя официальной позицией OpenAI это не назвал. Брифинг он закончил словами: «Добро пожаловать в эпоху AGI»
Сейчас Astra доступна отдельным организациям через Daybreak. В ближайшие дни модель появится в ChatGPT у подписчиков Plus, Pro, Business и Enterprise, а также в Codex, API и AWS. Astra Pro получат пользователи Pro, Business и Enterprise. Цена API обычной Astra составит $10 за миллион входных и $50 за миллион выходных токенов. Доступ для Free и Go пока не анонсирован.
Мнение других авторов:
Она нормально коротко общается, больше никакого слопа в ответах на три экрана
Она понимает, то, как будет выглядеть сцена, пока она ее кодит – я не знаю как это объяснить, но люди так не умеют – пока она пишет код, еще до того как она его запустит, она ЗНАЕТ как он будет выглядеть – возникает странное чувство, что у тебя тут мозг инопланетянина подключен, который по другому думает пока делает вещи
OpenAI официально представили GPT‑6 Astra. Это универсальный компьютерный агент, способный работать в браузере и приложениях, писать и запускать код, управлять документами, таблицами, CAD и 3D-сценами. Слоган компании соответствующий: «Всё, что вы можете сделать на компьютере, Astra может сделать за вас быстрее»
Бенчмарки мощные. Astra набрала 98,6% на ARC-AGI-3 против 30,2% у Opus 5, 97,6% на FrontierMath против 87,8% у Fable 5.1, 41,4% на AutomationBench против 31,4% и 95,9% на BenchCAD против 84,3%. В кодинге отрыва уже нет. Результат на DeepSWE составляет 74,1%, что примерно соответствует уровню других лидеров. При этом ARC запускали со специальной агентной системой, а большинство тестов проводили на максимальном reasoning.
Грег Брокман заявил, что лично считает AGI уже достигнутым, хотя официальной позицией OpenAI это не назвал. Брифинг он закончил словами: «Добро пожаловать в эпоху AGI»
Сейчас Astra доступна отдельным организациям через Daybreak. В ближайшие дни модель появится в ChatGPT у подписчиков Plus, Pro, Business и Enterprise, а также в Codex, API и AWS. Astra Pro получат пользователи Pro, Business и Enterprise. Цена API обычной Astra составит $10 за миллион входных и $50 за миллион выходных токенов. Доступ для Free и Go пока не анонсирован.
Мнение других авторов:
Она нормально коротко общается, больше никакого слопа в ответах на три экрана
Она понимает, то, как будет выглядеть сцена, пока она ее кодит – я не знаю как это объяснить, но люди так не умеют – пока она пишет код, еще до того как она его запустит, она ЗНАЕТ как он будет выглядеть – возникает странное чувство, что у тебя тут мозг инопланетянина подключен, который по другому думает пока делает вещи
This media is not supported in your browser
VIEW IN TELEGRAM
GPT-6 Astra моделирует дом в Blender и превращает его в сцену в Unreal Engine 5, по которой можно ходить, помогая дизайнерам и клиентам изучить планировку и ощутить пространство до того, как дом будет построен:
У GPT-6 Astra будут очень жесткие лимиты на релизе: сначала ее выдадут только Pro-подписчикам.
На тарифах за $100 дадут отправлять 50 запросов в неделю. Подписка за $200 даст 200 сообщений в неделю. Лимит общий с GPT-5.6 Sol Pro.
Владельцам тарифов Plus модель будет доступна только через Codex.
На тарифах за $100 дадут отправлять 50 запросов в неделю. Подписка за $200 даст 200 сообщений в неделю. Лимит общий с GPT-5.6 Sol Pro.
Владельцам тарифов Plus модель будет доступна только через Codex.
GPT-6 начали раскатывать в Codex и ChatGPT. Первыми доступ получили Pro-юзеры.
Также появился официальный гайд по промтингу новой модели — забираем здесь и наслаждаемся.
Также появился официальный гайд по промтингу новой модели — забираем здесь и наслаждаемся.
claude dev - инструменты по claude code, gpt (вайб-кодинг)
GPT-6 начали раскатывать в Codex и ChatGPT. Первыми доступ получили Pro-юзеры. Также появился официальный гайд по промтингу новой модели — забираем здесь и наслаждаемся.
OpenAI обновила лимиты GPT‑6 Astra в Work и Codex. Теперь в документации указаны примерно 5–45 сообщений за 5 часов для Plus, 25–225 для Pro за $100 и 100–900 для Pro за $200. То есть увеличили заявленные лимиты Astra в Codex и Work примерно на 50%
Экономим токены в Codex
Обязательно включите эту настройку.
В
Это включит оконный режим заметок + поиска по контексту, заменив традиционное сжатие.
Он экономит больше токенов и работает лучше.
Через несколько недель эта настройка должна стать стандартной для Astra.
Обязательно включите эту настройку.
В
~/.codex/config.toml добавьте:[features.context_management]
experimental_mode = true
Это включит оконный режим заметок + поиска по контексту, заменив традиционное сжатие.
Он экономит больше токенов и работает лучше.
Через несколько недель эта настройка должна стать стандартной для Astra.
claude dev - инструменты по claude code, gpt (вайб-кодинг)
200000$ ЗА НЕДЕЛЮ НА ОДНОМ САЙТЕ.. Вайбкодить можно что угодно и прямо сейчас реализуются сотни идей прямо в терминале и выкатываются на рынок, но куда важнее сила продвижения. И вот используя X (Twitter) парень завайбкодил сайт на котором нет ничего, кроме…
А вот и реализация этого в СНГ
Один из инфлов снял ролик в социальные сети как платно размещает рекламу на своём ноутбуке и получил неплохое количество офферов.
Но получилось бы это далеко не у каждого, ибо..
— У него была аудитория
— Качество роликов неплохое
— Реализация идеи тоже отличная
Кейс скопирован очень успешно на 13.000$
Один из инфлов снял ролик в социальные сети как платно размещает рекламу на своём ноутбуке и получил неплохое количество офферов.
Но получилось бы это далеко не у каждого, ибо..
— У него была аудитория
— Качество роликов неплохое
— Реализация идеи тоже отличная
Кейс скопирован очень успешно на 13.000$