ЛОЛ, чел отменил Claude Max за $200 в месяц после того, как нейронка обиделась на «fuck you» 🍿
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
51
Архитектура Apple Silicon оказалась почти идеальной для запуска больших языковых моделей.
Всё благодаря сочетанию быстрой памяти, высокой пропускной способности и единой архитектуры памяти.
Mac Studio M5 Ultra с 512 ГБ памяти и пропускной способностью 1,2 ТБ/с способен целиком уместить GLM-5.3-Flash на 320 млрд параметров в FP8 и выдавать около 60 токенов в секунду локально, прямо на рабочем столе.
Альтернатива на ПК?
Примерно 10 RTX 5090 стоимостью более $20 000 и своя небольшая электростанция.
Полная версия GLM-5.3-Flash на 320 млрд параметров в FP8 весит около 306 ГБ.
У одной RTX 5090 всего 32 ГБ видеопамяти. Поэтому только для размещения весов модели понадобится минимум 10 видеокарт.
10 × 32 ГБ = 320 ГБ.
Mac Studio решает эту проблему за счёт единого пула памяти объёмом до 512 ГБ с пропускной способностью 1,2 ТБ/с.
Вместо того чтобы собирать ПК-кластер из множества видеокарт, бороться с задержками шины PCIe и энергопотреблением в районе 5000 Вт, можно загрузить всю модель объёмом 306 ГБ вместе с огромным контекстом и KV-кэшем в один настольный компьютер.
Всё благодаря сочетанию быстрой памяти, высокой пропускной способности и единой архитектуры памяти.
Mac Studio M5 Ultra с 512 ГБ памяти и пропускной способностью 1,2 ТБ/с способен целиком уместить GLM-5.3-Flash на 320 млрд параметров в FP8 и выдавать около 60 токенов в секунду локально, прямо на рабочем столе.
Альтернатива на ПК?
Примерно 10 RTX 5090 стоимостью более $20 000 и своя небольшая электростанция.
Полная версия GLM-5.3-Flash на 320 млрд параметров в FP8 весит около 306 ГБ.
У одной RTX 5090 всего 32 ГБ видеопамяти. Поэтому только для размещения весов модели понадобится минимум 10 видеокарт.
10 × 32 ГБ = 320 ГБ.
Mac Studio решает эту проблему за счёт единого пула памяти объёмом до 512 ГБ с пропускной способностью 1,2 ТБ/с.
Вместо того чтобы собирать ПК-кластер из множества видеокарт, бороться с задержками шины PCIe и энергопотреблением в районе 5000 Вт, можно загрузить всю модель объёмом 306 ГБ вместе с огромным контекстом и KV-кэшем в один настольный компьютер.
2
Релиз Fable 5.1 уже совсем близко. ЕЁ уже зарегистрировали в API AWS Bedrock.
Инсайдер обнаружил, что запрос к её идентификатору возвращает
Для сравнения, Opus 5.1 и заведомо несуществующие идентификаторы вроде
Обычно такая смена ответа происходит за несколько дней или часов до релиза.☕️
Инсайдер обнаружил, что запрос к её идентификатору возвращает
404 Model not found, а не 400 The provided model identifier is invalid.Для сравнения, Opus 5.1 и заведомо несуществующие идентификаторы вроде
us.anthropic.banana всё ещё возвращают 400.Обычно такая смена ответа происходит за несколько дней или часов до релиза.
Please open Telegram to view this post
VIEW IN TELEGRAM
Офигеть. Hyper3D выпустила свою модель генерации миров WorldGen.
В отличие от других интерактивных моделей мира, WorldGen может взять всего одно 2D-изображение и на его основе построить полноценную 3D-сцену со встроенными физическими правилами.
Каждый объект независим. Столы, стулья и небольшие предметы в сцене можно отдельно извлекать, разбивать на самостоятельные 3D-модели, перемещать, заменять или дорабатывать.
Физика встроена прямо в сцену. Модель понимает пространственное расположение объектов и автоматически определяет такие свойства, как столкновения, масса, трение и другие параметры.
Плюс всё это напрямую встраивается в рабочий процесс. Сгенерированные ассеты можно импортировать в Blender, Unity или Unreal Engine и сразу использовать для создания игровых уровней, кинопроизводства, XR-контента и симуляций для обучения роботов и роботизированных манипуляторов.
Ещё сильнее впечатляет то, что WorldGen может выстраивать полноценный ИИ-конвейер вместе с моделями генерации видео вроде Seedance 2.5.
Сначала WorldGen формирует 3D-сцену с независимыми друг от друга ассетами и чёткой пространственной структурой.
Затем в связке с моделями генерации видео вроде Seedance 2.5 можно добавлять конкретную игру персонажей, прорабатывать материалы, освещение, тени и общий визуальный стиль, превращая белые модели или базовые рендеры в динамичные фрагменты, которые уже приближаются к кинематографическому качеству.
В отличие от других интерактивных моделей мира, WorldGen может взять всего одно 2D-изображение и на его основе построить полноценную 3D-сцену со встроенными физическими правилами.
Каждый объект независим. Столы, стулья и небольшие предметы в сцене можно отдельно извлекать, разбивать на самостоятельные 3D-модели, перемещать, заменять или дорабатывать.
Физика встроена прямо в сцену. Модель понимает пространственное расположение объектов и автоматически определяет такие свойства, как столкновения, масса, трение и другие параметры.
Плюс всё это напрямую встраивается в рабочий процесс. Сгенерированные ассеты можно импортировать в Blender, Unity или Unreal Engine и сразу использовать для создания игровых уровней, кинопроизводства, XR-контента и симуляций для обучения роботов и роботизированных манипуляторов.
Ещё сильнее впечатляет то, что WorldGen может выстраивать полноценный ИИ-конвейер вместе с моделями генерации видео вроде Seedance 2.5.
Сначала WorldGen формирует 3D-сцену с независимыми друг от друга ассетами и чёткой пространственной структурой.
Затем в связке с моделями генерации видео вроде Seedance 2.5 можно добавлять конкретную игру персонажей, прорабатывать материалы, освещение, тени и общий визуальный стиль, превращая белые модели или базовые рендеры в динамичные фрагменты, которые уже приближаются к кинематографическому качеству.
2
Anthropic выкатила Claude Fable 5.1 и Mythos 5.1
Fable 5.1 – новый флагман Anthropic для всех пользователей. Mythos 5.1 – его версия с ослабленными ограничениями по кибербезопасности и биологии, доступная только проверенным организациям.
По бенчмаркам апдейт заметный:
- Terminal-Bench 4.0: 55,8%, у Mythos — 60,9%
- Terminal-Bench-Science: 52,6% против 24,7% у прошлой версии
- Humanity's Last Exam: 60,9% без инструментов и 65% с ними
- OSWorld 2.0: 77,9%
Цена осталась прежней – $10/$50 за миллион токенов, зато cache reads подешевели на 75%, до $0,25 за миллион. По оценке Anthropic, это может снизить расходы примерно на 25% в обычных сценариях и до 45% в агентных.
На Low/Medium effort Fable 5.1 уже может выдавать результат уровня Fable 5 дешевле. В Claude Code по умолчанию используется High, в Cowork и claude.ai – Medium.
Также cyber-фильтры теперь срабатывают примерно на 60% реже, а модель разрешили использовать для поиска уязвимостей, но не для написания эксплойтов.
https://www.anthropic.com/claude-fable-and-mythos-5-1
Fable 5.1 – новый флагман Anthropic для всех пользователей. Mythos 5.1 – его версия с ослабленными ограничениями по кибербезопасности и биологии, доступная только проверенным организациям.
По бенчмаркам апдейт заметный:
- Terminal-Bench 4.0: 55,8%, у Mythos — 60,9%
- Terminal-Bench-Science: 52,6% против 24,7% у прошлой версии
- Humanity's Last Exam: 60,9% без инструментов и 65% с ними
- OSWorld 2.0: 77,9%
Цена осталась прежней – $10/$50 за миллион токенов, зато cache reads подешевели на 75%, до $0,25 за миллион. По оценке Anthropic, это может снизить расходы примерно на 25% в обычных сценариях и до 45% в агентных.
На Low/Medium effort Fable 5.1 уже может выдавать результат уровня Fable 5 дешевле. В Claude Code по умолчанию используется High, в Cowork и claude.ai – Medium.
Также cyber-фильтры теперь срабатывают примерно на 60% реже, а модель разрешили использовать для поиска уязвимостей, но не для написания эксплойтов.
https://www.anthropic.com/claude-fable-and-mythos-5-1
5
Ответ от китайцев: обновлённый Qwen3.8-Max. Встречайте Qwen3.8-Max-0902 — монстра на 2,4 трлн параметров. 🤘
Qwen3.8-Max-0902 получила контекст на 1 млн токенов и серьёзные улучшения в программировании, исследованиях и длинных многоэтапных задачах.
Она сразу заняла первое место в общем рейтинге Code Arena: WebDev с результатом 1691 балл.
Она опережает Claude Opus 5 Max на 3 балла, Kimi K3 Max — на 17 баллов, а предыдущую Qwen3.8-Max — на 22 балла.
При средней цене около $5 за 1 млн токенов Qwen3.8-Max-0902 также заняла лучшую позицию на границе Парето — то есть сейчас это один из самых сильных вариантов по соотношению качества и стоимости, именно в веб-разработке.
Модель уже доступна через API в QwenCloud.
вход — $2 за 1 млн токенов
выход — $6
явное попадание в кэш — $0,17
неявное попадание в кэш — $0,25
https://qwencloud.com/models/qwen3.8-max-0902
Qwen3.8-Max-0902 получила контекст на 1 млн токенов и серьёзные улучшения в программировании, исследованиях и длинных многоэтапных задачах.
Она сразу заняла первое место в общем рейтинге Code Arena: WebDev с результатом 1691 балл.
Она опережает Claude Opus 5 Max на 3 балла, Kimi K3 Max — на 17 баллов, а предыдущую Qwen3.8-Max — на 22 балла.
При средней цене около $5 за 1 млн токенов Qwen3.8-Max-0902 также заняла лучшую позицию на границе Парето — то есть сейчас это один из самых сильных вариантов по соотношению качества и стоимости, именно в веб-разработке.
Модель уже доступна через API в QwenCloud.
вход — $2 за 1 млн токенов
выход — $6
явное попадание в кэш — $0,17
неявное попадание в кэш — $0,25
https://qwencloud.com/models/qwen3.8-max-0902
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Gemini вернулся: релизнули Gemini 3.8 Flash
Это уже третий релиз Flash всего за шесть недель.
В DeepSWE v1.1 она превосходит большинство более крупных передовых моделей. В финансах, юриспруденции, видео, биологии и ещё куче других тестов она обходит Opus 5.
Конечно, флагманские модели она пока не разгромила полностью.
Но главное здесь — цена.
Opus 5 стоит $5 / $25, GPT-5.6 Sol — $4 / $20.
Gemini 3.8 Flash сейчас стоит всего $0,75 / $3,75.
Это уже третий релиз Flash всего за шесть недель.
В DeepSWE v1.1 она превосходит большинство более крупных передовых моделей. В финансах, юриспруденции, видео, биологии и ещё куче других тестов она обходит Opus 5.
Конечно, флагманские модели она пока не разгромила полностью.
Но главное здесь — цена.
Opus 5 стоит $5 / $25, GPT-5.6 Sol — $4 / $20.
Gemini 3.8 Flash сейчас стоит всего $0,75 / $3,75.