claude dev - инструменты по claude code, gpt (вайб-кодинг)
4.45K subscribers
600 photos
103 videos
203 links
Пишем про ИИ

INC: https://claudedev.fun
Бот с гайдами и плагинами: https://t.me/claudecodebaza_bot
Контакт: @claudedevv
Download Telegram
claude dev - инструменты по claude code, gpt (вайб-кодинг)
Claude Fable 5.1 и Mythos 5.1 выпустили. Fable заметно прокачали в программировании, научных исследованиях и долгих агентных задачах — по новым тестам модель обходит предыдущую версию и основных конкурентов. Она уже доступна в Claude, Claude Code, API и облачных…
Главный фокус апдейта - не просто более умные ответы, а автономная работа модели.

Что прокачали:
• заметно улучшили работу с кодом и управлением компьютером;
• модель способна самостоятельно выполнять сложные задачи часами;
• в некоторых сценариях расход токенов снизился на 30–60%;
• чтение кэша стало дешевле на 75% - $0.25 за 1 млн токенов;
• стандартные нагрузки подешевели примерно на 25%, агентские - до 45%;
• количество ошибочных safety-отказов сократилось на 60%;
• улучшились глубокий ресерч и работа с многоэтапными задачами.

По сути, Claude постепенно превращается из чат-бота в полноценного агента.

Теперь сценарий может выглядеть примерно так:

Получить задачу → разобраться → найти проблему → внести изменения → проверить результат → продолжить работу.


При этом для простых запросов преимущества новой версии будут не такими заметными - её сильная сторона именно длинные и сложные задачи.

Fable 5.1 против Fable 5:
• Terminal-Bench: 42% → 55.8%
• Результаты в ресерче: ~25% → 52.6%
• Кэш: −75% по стоимости
• Обычные сценарии: примерно −25%
• Агентские задачи: до −45%
• Ложные safety-отказы: −60%

Цена осталась прежней – $10/$50 за миллион токенов, зато cache reads подешевели на 75%, до $0,25 за миллион. По оценке Anthropic, это может снизить расходы примерно на 25% в обычных сценариях и до 45% в агентных.
Обновлённый Qwen3.8-Max.
Qwen3.8-Max-0902 — монстр на 2,4 трлн параметров.

Qwen3.8-Max-0902 получила контекст на 1 млн токенов и серьёзные улучшения в программировании, исследованиях и длинных многоэтапных задачах.

Она сразу заняла первое место в общем рейтинге Code Arena: WebDev с результатом 1691 балл.

Она опережает Claude Opus 5 Max на 3 балла, Kimi K3 Max — на 17 баллов, а предыдущую Qwen3.8-Max — на 22 балла.

При средней цене около $5 за 1 млн токенов Qwen3.8-Max-0902 также заняла лучшую позицию на границе Парето — то есть сейчас это один из самых сильных вариантов по соотношению качества и стоимости, именно в веб-разработке.

Модель уже доступна через API в QwenCloud.

вход — $2 за 1 млн токенов
выход — $6
явное попадание в кэш — $0,17
неявное попадание в кэш — $0,25
GPT-6 ASTRA УЖЕ ГОТОВЯТ К ЗАПУСКУ

Responses API теперь возвращает для gpt-6-astra ошибку 404 Not Found, тогда как случайные или реально несуществующие названия моделей получают 400.

При этом тот же 404 возвращается для GPT-5.6 Cyber, про существование которой мы уже знаем.

Похожая странность была и в API Bedrock — именно по ней Fable 5.1 обнаружили за день до релиза.
claude dev - инструменты по claude code, gpt (вайб-кодинг)
GPT-6 ASTRA УЖЕ ГОТОВЯТ К ЗАПУСКУ Responses API теперь возвращает для gpt-6-astra ошибку 404 Not Found, тогда как случайные или реально несуществующие названия моделей получают 400. При этом тот же 404 возвращается для GPT-5.6 Cyber, про существование которой…
Почему от того же GPT почти ничего не ждём

Первое — это очень глупая версия 5.6, в последнее время стала намного дольше думать и в некоторых моментах особенно стала тупеть, перед выходом новой модели это началось.
Второе — во фронтенде GPT и вправду хорош, но в бэкенде с ним работать уже тяжелее и ошибок больше

И в целом, в апках модели +- одинаково туповаты (Claude и GPT)
Но когда ставишь тот же Claude в терминал и отправляешься работать, скорость работы и количество ошибок говорят о том, что модель самая хорошая и с неё пока перепрыгивать никуда не хочется.

Когда как в апках модели жрут токены и в целом, GPT очень прожорлив.

Но ещё один момент, что если ты новичок, то GPT отличный старт, ты видишь как агенты там работают и выглядит всё понятнее, но в будущем лучше перепрыгивать на Claude или использовать связку из двух моделей + Китайских
This media is not supported in your browser
VIEW IN TELEGRAM
Codex восстановил игру Red Alert 2 по одному EXE-файлу.

Исходный код игры никогда не публиковался и, как считается, был утерян. Но вайбкодера это не остановило — он поставил Codex цель восстановить Red Alert 2: Yuri’s Revenge и заставить её нативно работать на iOS и macOS.

Codex на GPT-5.6 Sol работал над этим 26 дней, проанализировал EXE-файл и фактически заново собрал всю игру.

Итог — 624 тысячи строк C++.
Fable 5.1 Max от Anthropic заняла первое место

В Code Arena: WebDev с результатом 1765 баллов — отрыв от всех остальных сразу на 77 баллов.

Это огромный скачок по сравнению с Fable 5 Max, которая сейчас занимает 8-е место с 1628 баллами.

Fable 5.1 Max опережает Qwen 3.8 Max 0902 на втором месте на 77 баллов, а Opus 5 Max на третьем — на 78 баллов.

При результате 1765 баллов и средней цене $40 за миллион токенов модель также заметно сдвигает границу Парето в дорогом сегменте, поднимая планку производительности намного выше.
НОВЫЙ GPT УЖЕ ВЫШЕЛ!

OpenAI официально представили GPT‑6 Astra. Это универсальный компьютерный агент, способный работать в браузере и приложениях, писать и запускать код, управлять документами, таблицами, CAD и 3D-сценами. Слоган компании соответствующий: «Всё, что вы можете сделать на компьютере, Astra может сделать за вас быстрее»

Бенчмарки мощные. Astra набрала 98,6% на ARC-AGI-3 против 30,2% у Opus 5, 97,6% на FrontierMath против 87,8% у Fable 5.1, 41,4% на AutomationBench против 31,4% и 95,9% на BenchCAD против 84,3%. В кодинге отрыва уже нет. Результат на DeepSWE составляет 74,1%, что примерно соответствует уровню других лидеров. При этом ARC запускали со специальной агентной системой, а большинство тестов проводили на максимальном reasoning.

Грег Брокман заявил, что лично считает AGI уже достигнутым, хотя официальной позицией OpenAI это не назвал. Брифинг он закончил словами: «Добро пожаловать в эпоху AGI»

Сейчас Astra доступна отдельным организациям через Daybreak. В ближайшие дни модель появится в ChatGPT у подписчиков Plus, Pro, Business и Enterprise, а также в Codex, API и AWS. Astra Pro получат пользователи Pro, Business и Enterprise. Цена API обычной Astra составит $10 за миллион входных и $50 за миллион выходных токенов. Доступ для Free и Go пока не анонсирован.

Мнение других авторов:

Она нормально коротко общается, больше никакого слопа в ответах на три экрана

Она понимает, то, как будет выглядеть сцена, пока она ее кодит – я не знаю как это объяснить, но люди так не умеют – пока она пишет код, еще до того как она его запустит, она ЗНАЕТ как он будет выглядеть – возникает странное чувство, что у тебя тут мозг инопланетянина подключен, который по другому думает пока делает вещи
OpenAI будут давать по бесплатному ресету всем подписчикам каждый день, пока нет доступа к Astra. Такие ресеты можно применять в любой момент в течении месяца.
This media is not supported in your browser
VIEW IN TELEGRAM
GPT-6 Astra моделирует дом в Blender и превращает его в сцену в Unreal Engine 5, по которой можно ходить, помогая дизайнерам и клиентам изучить планировку и ощутить пространство до того, как дом будет построен:
У GPT-6 Astra будут очень жесткие лимиты на релизе: сначала ее выдадут только Pro-подписчикам.

На тарифах за $100 дадут отправлять 50 запросов в неделю. Подписка за $200 даст 200 сообщений в неделю. Лимит общий с GPT-5.6 Sol Pro.

Владельцам тарифов Plus модель будет доступна только через Codex.
GPT-6 начали раскатывать в Codex и ChatGPT. Первыми доступ получили Pro-юзеры.

Также появился официальный гайд по промтингу новой модели — забираем здесь и наслаждаемся.
claude dev - инструменты по claude code, gpt (вайб-кодинг)
GPT-6 начали раскатывать в Codex и ChatGPT. Первыми доступ получили Pro-юзеры. Также появился официальный гайд по промтингу новой модели — забираем здесь и наслаждаемся.
OpenAI обновила лимиты GPT‑6 Astra в Work и Codex. Теперь в документации указаны примерно 5–45 сообщений за 5 часов для Plus, 25–225 для Pro за $100 и 100–900 для Pro за $200. То есть увеличили заявленные лимиты Astra в Codex и Work примерно на 50%
Два сюрприза в честь GPT-Astra:

1. Контекстное окно в Codex можно теперь поднять до 1M токенов вместо позорных 372k (просто попросите в чате - astra сама всё сделает)
2. Claude code на радостях сбросил лимиты
Экономим токены в Codex

Обязательно включите эту настройку.

В ~/.codex/config.toml добавьте:

[features.context_management]
experimental_mode = true


Это включит оконный режим заметок + поиска по контексту, заменив традиционное сжатие.

Он экономит больше токенов и работает лучше.

Через несколько недель эта настройка должна стать стандартной для Astra.
claude dev - инструменты по claude code, gpt (вайб-кодинг)
200000$ ЗА НЕДЕЛЮ НА ОДНОМ САЙТЕ.. Вайбкодить можно что угодно и прямо сейчас реализуются сотни идей прямо в терминале и выкатываются на рынок, но куда важнее сила продвижения. И вот используя X (Twitter) парень завайбкодил сайт на котором нет ничего, кроме…
А вот и реализация этого в СНГ

Один из инфлов снял ролик в социальные сети как платно размещает рекламу на своём ноутбуке и получил неплохое количество офферов.

Но получилось бы это далеко не у каждого, ибо..
— У него была аудитория
— Качество роликов неплохое
— Реализация идеи тоже отличная

Кейс скопирован очень успешно на 13.000$