Вайб-кодинг
61.9K subscribers
2.08K photos
867 videos
30 files
1.39K links
Авторский канал по ВАЙБ КОДИНГУ

Ссылка для друзей: https://t.me/+ll3pbl442dNkZmYy

Cотрудничество: @devmangx

РКН: https://clck.ru/3RRVfk
Download Telegram
Архитектура Apple Silicon оказалась почти идеальной для запуска больших языковых моделей.

Всё благодаря сочетанию быстрой памяти, высокой пропускной способности и единой архитектуры памяти.

Mac Studio M5 Ultra с 512 ГБ памяти и пропускной способностью 1,2 ТБ/с способен целиком уместить GLM-5.3-Flash на 320 млрд параметров в FP8 и выдавать около 60 токенов в секунду локально, прямо на рабочем столе.

Альтернатива на ПК?

Примерно 10 RTX 5090 стоимостью более $20 000 и своя небольшая электростанция.

Полная версия GLM-5.3-Flash на 320 млрд параметров в FP8 весит около 306 ГБ.

У одной RTX 5090 всего 32 ГБ видеопамяти. Поэтому только для размещения весов модели понадобится минимум 10 видеокарт.

10 × 32 ГБ = 320 ГБ.

Mac Studio решает эту проблему за счёт единого пула памяти объёмом до 512 ГБ с пропускной способностью 1,2 ТБ/с.

Вместо того чтобы собирать ПК-кластер из множества видеокарт, бороться с задержками шины PCIe и энергопотреблением в районе 5000 Вт, можно загрузить всю модель объёмом 306 ГБ вместе с огромным контекстом и KV-кэшем в один настольный компьютер.
2
Релиз Fable 5.1 уже совсем близко. ЕЁ уже зарегистрировали в API AWS Bedrock.

Инсайдер обнаружил, что запрос к её идентификатору возвращает 404 Model not found, а не 400 The provided model identifier is invalid.

Для сравнения, Opus 5.1 и заведомо несуществующие идентификаторы вроде us.anthropic.banana всё ещё возвращают 400.

Обычно такая смена ответа происходит за несколько дней или часов до релиза. ☕️
Please open Telegram to view this post
VIEW IN TELEGRAM
Офигеть. Hyper3D выпустила свою модель генерации миров WorldGen.

В отличие от других интерактивных моделей мира, WorldGen может взять всего одно 2D-изображение и на его основе построить полноценную 3D-сцену со встроенными физическими правилами.

Каждый объект независим. Столы, стулья и небольшие предметы в сцене можно отдельно извлекать, разбивать на самостоятельные 3D-модели, перемещать, заменять или дорабатывать.

Физика встроена прямо в сцену. Модель понимает пространственное расположение объектов и автоматически определяет такие свойства, как столкновения, масса, трение и другие параметры.

Плюс всё это напрямую встраивается в рабочий процесс. Сгенерированные ассеты можно импортировать в Blender, Unity или Unreal Engine и сразу использовать для создания игровых уровней, кинопроизводства, XR-контента и симуляций для обучения роботов и роботизированных манипуляторов.

Ещё сильнее впечатляет то, что WorldGen может выстраивать полноценный ИИ-конвейер вместе с моделями генерации видео вроде Seedance 2.5.

Сначала WorldGen формирует 3D-сцену с независимыми друг от друга ассетами и чёткой пространственной структурой.

Затем в связке с моделями генерации видео вроде Seedance 2.5 можно добавлять конкретную игру персонажей, прорабатывать материалы, освещение, тени и общий визуальный стиль, превращая белые модели или базовые рендеры в динамичные фрагменты, которые уже приближаются к кинематографическому качеству.
2
Anthropic выкатила Claude Fable 5.1 и Mythos 5.1

Fable 5.1 – новый флагман Anthropic для всех пользователей. Mythos 5.1 – его версия с ослабленными ограничениями по кибербезопасности и биологии, доступная только проверенным организациям.

По бенчмаркам апдейт заметный:
- Terminal-Bench 4.0: 55,8%, у Mythos — 60,9%
- Terminal-Bench-Science: 52,6% против 24,7% у прошлой версии
- Humanity's Last Exam: 60,9% без инструментов и 65% с ними
- OSWorld 2.0: 77,9%

Цена осталась прежней – $10/$50 за миллион токенов, зато cache reads подешевели на 75%, до $0,25 за миллион. По оценке Anthropic, это может снизить расходы примерно на 25% в обычных сценариях и до 45% в агентных.

На Low/Medium effort Fable 5.1 уже может выдавать результат уровня Fable 5 дешевле. В Claude Code по умолчанию используется High, в Cowork и claude.ai – Medium.

Также cyber-фильтры теперь срабатывают примерно на 60% реже, а модель разрешили использовать для поиска уязвимостей, но не для написания эксплойтов.

https://www.anthropic.com/claude-fable-and-mythos-5-1
5
Ответ от китайцев: обновлённый Qwen3.8-Max. Встречайте Qwen3.8-Max-0902 — монстра на 2,4 трлн параметров. 🤘

Qwen3.8-Max-0902 получила контекст на 1 млн токенов и серьёзные улучшения в программировании, исследованиях и длинных многоэтапных задачах.

Она сразу заняла первое место в общем рейтинге Code Arena: WebDev с результатом 1691 балл.

Она опережает Claude Opus 5 Max на 3 балла, Kimi K3 Max — на 17 баллов, а предыдущую Qwen3.8-Max — на 22 балла.

При средней цене около $5 за 1 млн токенов Qwen3.8-Max-0902 также заняла лучшую позицию на границе Парето — то есть сейчас это один из самых сильных вариантов по соотношению качества и стоимости, именно в веб-разработке.

Модель уже доступна через API в QwenCloud.

вход — $2 за 1 млн токенов
выход — $6
явное попадание в кэш — $0,17
неявное попадание в кэш — $0,25

https://qwencloud.com/models/qwen3.8-max-0902
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Gemini вернулся: релизнули Gemini 3.8 Flash

Это уже третий релиз Flash всего за шесть недель.

В DeepSWE v1.1 она превосходит большинство более крупных передовых моделей. В финансах, юриспруденции, видео, биологии и ещё куче других тестов она обходит Opus 5.

Конечно, флагманские модели она пока не разгромила полностью.

Но главное здесь — цена.

Opus 5 стоит $5 / $25, GPT-5.6 Sol — $4 / $20.

Gemini 3.8 Flash сейчас стоит всего $0,75 / $3,75.
Теперь понятно, почему Codex занимает гигабайты места на диске.

Оказывается, вместе с ним поставляется полноценный LibreOffice.

Он хорошо спрятан в папке кэша, а затем Codex использует его через навык:
3
Meta выпустила Muse Spark 1.3 — модель с производительностью на уровне передовых моделей и при этом почти по символической цене.

На этот раз релиз прошёл без предварительного прогрева. Muse Spark 1.3 сначала появилась в Meta API и OpenCode, а уже затем компания опубликовала результаты тестов.

На Terminal-Bench 2.1 модель набрала 88,8, сравнявшись с GPT-5.6 Sol. На DeepSWE — 75,4%, что выводит её в число сильнейших моделей для программирования. По остальным тестам результаты тоже очень серьёзные.

Muse Spark 1.3 уже доступна в Muse Code и через API.

Цукерберг также намекнул, что следующим крупным релизом станет Watermelon (следующий большой релиз), а открытые веса Muse Spark компания обещает выпустить уже скоро.
This media is not supported in your browser
VIEW IN TELEGRAM
Codex восстановил игру Red Alert 2 по одному EXE-файлу. 👀

Исходный код игры никогда не публиковался и, как считается, был утерян. Но вайбкодера это не остановило — он поставил Codex цель восстановить Red Alert 2: Yuri’s Revenge и заставить её нативно работать на iOS и macOS.

Codex на GPT-5.6 Sol работал над этим 26 дней, проанализировал EXE-файл и фактически заново собрал всю игру.

Итог — 624 тысячи строк C++.
Please open Telegram to view this post
VIEW IN TELEGRAM
gpt-6-astra уже появилась в OpenAI API.

Responses API теперь возвращает для gpt-6-astra ошибку 404 Not Found, тогда как случайные или реально несуществующие названия моделей получают 400.

При этом тот же 404 возвращается для GPT-5.6 Cyber, про существование которой мы уже знаем.

Похожая странность была и в API Bedrock — именно по ней Fable 5.1 обнаружили за день до релиза.

Похоже, GPT-6 Astra уже готовят к запуску.
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic открывает исходный код Claude Commerce Agents. 🔍

Это готовая основа для создания торговых агентов и агентов для продавцов, с рабочими примерами для розницы, путешествий, телекома и развлечений.

В блоге Anthropic подробно разбирает архитектуру, способы снижения задержек и стоимости, а также подходы к оценке качества.

Кроме того, компания выложила открытую эталонную реализацию. Внутри — агенты для покупателей и продавцов, четыре демонстрации для разных отраслей и плагин для Claude Code, который позволяет собрать агента поверх собственного бэкенда.

https://claude.com/blog/claude-for-commerce-agents
Please open Telegram to view this post
VIEW IN TELEGRAM
Fable 5.1 Max от Anthropic заняла первое место в Code Arena: WebDev с результатом 1765 баллов — отрыв от всех остальных сразу на 77 баллов.

Это огромный скачок по сравнению с Fable 5 Max, которая сейчас занимает 8-е место с 1628 баллами.

Fable 5.1 Max опережает Qwen 3.8 Max 0902 на втором месте на 77 баллов, а Opus 5 Max на третьем — на 78 баллов.

При результате 1765 баллов и средней цене $40 за миллион токенов модель также заметно сдвигает границу Парето в дорогом сегменте, поднимая планку производительности намного выше.