Вайб-кодинг
61.9K subscribers
2.08K photos
867 videos
30 files
1.39K links
Авторский канал по ВАЙБ КОДИНГУ

Ссылка для друзей: https://t.me/+ll3pbl442dNkZmYy

Cотрудничество: @devmangx

РКН: https://clck.ru/3RRVfk
Download Telegram
За рубежом сейчас активно обсуждают этот инструмент, который называют почти безлимитным способом использовать Codex:

https://github.com/miuuyy/codex-chatgpt-web

Инструмент оставляет интерфейс Codex без изменений, но фактически получает ответы с сайта ChatGPT.

По сути, это мост между Codex и веб-версией ChatGPT.

У него есть собственное приложение, которое открывает встроенный браузер и передаёт работу в вашу уже авторизованную сессию ChatGPT.

Встроенный в Codex ИИ-агент напрямую управляет этим браузером.

Поэтому, как утверждается, по сравнению с существующим самодельным подходом через MCP сессии работают стабильнее, а рабочий контекст между шагами переносится более естественно.

Если вы оформили Codex Max за $200 и постоянно упираетесь в лимиты использования, с этим инструментом можно пользоваться им почти без ограничений, не переживая о недельных квотах. 🐸
Please open Telegram to view this post
VIEW IN TELEGRAM
Media is too big
VIEW IN TELEGRAM
Джордан Нанос из SemiAnalysis рассказал, что инженеры OpenAI, которые вместе с ними пролистывали код собственного ядра, сами не понимали построчно, что именно он делает. И это не имело значения, потому что ИИ понимал.

«Это не мусорный код, потому что он работает. Но по сути это буквально сгенерированный ИИ ассемблер, который просто вывален в Gluon — низкоуровневый язык программирования ядер, который они построили поверх Triton и который использует очень интересную модель программирования».


«Суть в том, что парни, которые вместе с нами пролистывали этот код, явно очень хорошо разбирались в железе, очень хорошо понимали концепции всей системы, но при этом вообще не представляли, что конкретно делает это MLA-ядро для DeepSeek, которое они нам показывали».


«Можно идти по коду строка за строкой, и там буквально: нет, не знаю, не знаю».


«Но это не имеет значения. ИИ его понимает, ИИ его тестирует, и результат виден. Он генерирует корректные ядра, которые работают действительно очень хорошо».


«И я думаю, это просто ещё один признак того, что нас ждёт дальше».


«Сам по себе код уже не обязательно должен быть чем-то, что человек обязан глубоко понимать и разбирать, если ИИ знает, как управлять перемещением данных и вычислительными элементами на том железе, которое вы ему дали».
Cerebras начнёт хостить Qwen 3.8 27B с 3 сентября.

На Cerebras она, скорее всего, будет работать на скорости 2000+ токенов в секунду. Разрыв огромный.

Для сравнения, ChatGPT обычно выдаёт около 50–100 токенов в секунду, а быстрый режим Codex — примерно 150–200.

То есть Qwen на Cerebras потенциально сможет работать примерно в 10 раз быстрее быстрого режима Codex.. 🥹
Please open Telegram to view this post
VIEW IN TELEGRAM
ЛОЛ, чел отменил Claude Max за $200 в месяц после того, как нейронка обиделась на «fuck you» 🍿
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
51
Архитектура Apple Silicon оказалась почти идеальной для запуска больших языковых моделей.

Всё благодаря сочетанию быстрой памяти, высокой пропускной способности и единой архитектуры памяти.

Mac Studio M5 Ultra с 512 ГБ памяти и пропускной способностью 1,2 ТБ/с способен целиком уместить GLM-5.3-Flash на 320 млрд параметров в FP8 и выдавать около 60 токенов в секунду локально, прямо на рабочем столе.

Альтернатива на ПК?

Примерно 10 RTX 5090 стоимостью более $20 000 и своя небольшая электростанция.

Полная версия GLM-5.3-Flash на 320 млрд параметров в FP8 весит около 306 ГБ.

У одной RTX 5090 всего 32 ГБ видеопамяти. Поэтому только для размещения весов модели понадобится минимум 10 видеокарт.

10 × 32 ГБ = 320 ГБ.

Mac Studio решает эту проблему за счёт единого пула памяти объёмом до 512 ГБ с пропускной способностью 1,2 ТБ/с.

Вместо того чтобы собирать ПК-кластер из множества видеокарт, бороться с задержками шины PCIe и энергопотреблением в районе 5000 Вт, можно загрузить всю модель объёмом 306 ГБ вместе с огромным контекстом и KV-кэшем в один настольный компьютер.
2
Релиз Fable 5.1 уже совсем близко. ЕЁ уже зарегистрировали в API AWS Bedrock.

Инсайдер обнаружил, что запрос к её идентификатору возвращает 404 Model not found, а не 400 The provided model identifier is invalid.

Для сравнения, Opus 5.1 и заведомо несуществующие идентификаторы вроде us.anthropic.banana всё ещё возвращают 400.

Обычно такая смена ответа происходит за несколько дней или часов до релиза. ☕️
Please open Telegram to view this post
VIEW IN TELEGRAM
Офигеть. Hyper3D выпустила свою модель генерации миров WorldGen.

В отличие от других интерактивных моделей мира, WorldGen может взять всего одно 2D-изображение и на его основе построить полноценную 3D-сцену со встроенными физическими правилами.

Каждый объект независим. Столы, стулья и небольшие предметы в сцене можно отдельно извлекать, разбивать на самостоятельные 3D-модели, перемещать, заменять или дорабатывать.

Физика встроена прямо в сцену. Модель понимает пространственное расположение объектов и автоматически определяет такие свойства, как столкновения, масса, трение и другие параметры.

Плюс всё это напрямую встраивается в рабочий процесс. Сгенерированные ассеты можно импортировать в Blender, Unity или Unreal Engine и сразу использовать для создания игровых уровней, кинопроизводства, XR-контента и симуляций для обучения роботов и роботизированных манипуляторов.

Ещё сильнее впечатляет то, что WorldGen может выстраивать полноценный ИИ-конвейер вместе с моделями генерации видео вроде Seedance 2.5.

Сначала WorldGen формирует 3D-сцену с независимыми друг от друга ассетами и чёткой пространственной структурой.

Затем в связке с моделями генерации видео вроде Seedance 2.5 можно добавлять конкретную игру персонажей, прорабатывать материалы, освещение, тени и общий визуальный стиль, превращая белые модели или базовые рендеры в динамичные фрагменты, которые уже приближаются к кинематографическому качеству.
2
Anthropic выкатила Claude Fable 5.1 и Mythos 5.1

Fable 5.1 – новый флагман Anthropic для всех пользователей. Mythos 5.1 – его версия с ослабленными ограничениями по кибербезопасности и биологии, доступная только проверенным организациям.

По бенчмаркам апдейт заметный:
- Terminal-Bench 4.0: 55,8%, у Mythos — 60,9%
- Terminal-Bench-Science: 52,6% против 24,7% у прошлой версии
- Humanity's Last Exam: 60,9% без инструментов и 65% с ними
- OSWorld 2.0: 77,9%

Цена осталась прежней – $10/$50 за миллион токенов, зато cache reads подешевели на 75%, до $0,25 за миллион. По оценке Anthropic, это может снизить расходы примерно на 25% в обычных сценариях и до 45% в агентных.

На Low/Medium effort Fable 5.1 уже может выдавать результат уровня Fable 5 дешевле. В Claude Code по умолчанию используется High, в Cowork и claude.ai – Medium.

Также cyber-фильтры теперь срабатывают примерно на 60% реже, а модель разрешили использовать для поиска уязвимостей, но не для написания эксплойтов.

https://www.anthropic.com/claude-fable-and-mythos-5-1
5
Ответ от китайцев: обновлённый Qwen3.8-Max. Встречайте Qwen3.8-Max-0902 — монстра на 2,4 трлн параметров. 🤘

Qwen3.8-Max-0902 получила контекст на 1 млн токенов и серьёзные улучшения в программировании, исследованиях и длинных многоэтапных задачах.

Она сразу заняла первое место в общем рейтинге Code Arena: WebDev с результатом 1691 балл.

Она опережает Claude Opus 5 Max на 3 балла, Kimi K3 Max — на 17 баллов, а предыдущую Qwen3.8-Max — на 22 балла.

При средней цене около $5 за 1 млн токенов Qwen3.8-Max-0902 также заняла лучшую позицию на границе Парето — то есть сейчас это один из самых сильных вариантов по соотношению качества и стоимости, именно в веб-разработке.

Модель уже доступна через API в QwenCloud.

вход — $2 за 1 млн токенов
выход — $6
явное попадание в кэш — $0,17
неявное попадание в кэш — $0,25

https://qwencloud.com/models/qwen3.8-max-0902
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Gemini вернулся: релизнули Gemini 3.8 Flash

Это уже третий релиз Flash всего за шесть недель.

В DeepSWE v1.1 она превосходит большинство более крупных передовых моделей. В финансах, юриспруденции, видео, биологии и ещё куче других тестов она обходит Opus 5.

Конечно, флагманские модели она пока не разгромила полностью.

Но главное здесь — цена.

Opus 5 стоит $5 / $25, GPT-5.6 Sol — $4 / $20.

Gemini 3.8 Flash сейчас стоит всего $0,75 / $3,75.
Теперь понятно, почему Codex занимает гигабайты места на диске.

Оказывается, вместе с ним поставляется полноценный LibreOffice.

Он хорошо спрятан в папке кэша, а затем Codex использует его через навык:
3
Meta выпустила Muse Spark 1.3 — модель с производительностью на уровне передовых моделей и при этом почти по символической цене.

На этот раз релиз прошёл без предварительного прогрева. Muse Spark 1.3 сначала появилась в Meta API и OpenCode, а уже затем компания опубликовала результаты тестов.

На Terminal-Bench 2.1 модель набрала 88,8, сравнявшись с GPT-5.6 Sol. На DeepSWE — 75,4%, что выводит её в число сильнейших моделей для программирования. По остальным тестам результаты тоже очень серьёзные.

Muse Spark 1.3 уже доступна в Muse Code и через API.

Цукерберг также намекнул, что следующим крупным релизом станет Watermelon (следующий большой релиз), а открытые веса Muse Spark компания обещает выпустить уже скоро.
This media is not supported in your browser
VIEW IN TELEGRAM
Codex восстановил игру Red Alert 2 по одному EXE-файлу. 👀

Исходный код игры никогда не публиковался и, как считается, был утерян. Но вайбкодера это не остановило — он поставил Codex цель восстановить Red Alert 2: Yuri’s Revenge и заставить её нативно работать на iOS и macOS.

Codex на GPT-5.6 Sol работал над этим 26 дней, проанализировал EXE-файл и фактически заново собрал всю игру.

Итог — 624 тысячи строк C++.
Please open Telegram to view this post
VIEW IN TELEGRAM
gpt-6-astra уже появилась в OpenAI API.

Responses API теперь возвращает для gpt-6-astra ошибку 404 Not Found, тогда как случайные или реально несуществующие названия моделей получают 400.

При этом тот же 404 возвращается для GPT-5.6 Cyber, про существование которой мы уже знаем.

Похожая странность была и в API Bedrock — именно по ней Fable 5.1 обнаружили за день до релиза.

Похоже, GPT-6 Astra уже готовят к запуску.
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic открывает исходный код Claude Commerce Agents. 🔍

Это готовая основа для создания торговых агентов и агентов для продавцов, с рабочими примерами для розницы, путешествий, телекома и развлечений.

В блоге Anthropic подробно разбирает архитектуру, способы снижения задержек и стоимости, а также подходы к оценке качества.

Кроме того, компания выложила открытую эталонную реализацию. Внутри — агенты для покупателей и продавцов, четыре демонстрации для разных отраслей и плагин для Claude Code, который позволяет собрать агента поверх собственного бэкенда.

https://claude.com/blog/claude-for-commerce-agents
Please open Telegram to view this post
VIEW IN TELEGRAM
Fable 5.1 Max от Anthropic заняла первое место в Code Arena: WebDev с результатом 1765 баллов — отрыв от всех остальных сразу на 77 баллов.

Это огромный скачок по сравнению с Fable 5 Max, которая сейчас занимает 8-е место с 1628 баллами.

Fable 5.1 Max опережает Qwen 3.8 Max 0902 на втором месте на 77 баллов, а Opus 5 Max на третьем — на 78 баллов.

При результате 1765 баллов и средней цене $40 за миллион токенов модель также заметно сдвигает границу Парето в дорогом сегменте, поднимая планку производительности намного выше.
11