Claude Fable 5 — Антропик выкатили публичный Mythos
Если коротко: это та самая Mythos-модель, которую в апреле закрыли на замок из-за слишком страшных возможностей в кибербезе. Теперь сделали публичную версию с гарднрейлами — и называется она Fable 5
SOTA практически на всех бенчах: кодинг, аналитика, документы, зрение, научные задачи. Чем длиннее и сложнее задача — тем больше отрыв от пред моделей. Реальный пример из анонса: миграция в кодовой базе на 50 миллионов строк Ruby за один день, на которую у команды ушло бы больше двух месяцев.
Про гарднрейлы честно: запросы в высокорисковых зонах — кибербез, биология, химия — автоматически падают на Opus 4.8. Та же модель без ограничений — это Mythos 5, доступна только в ограниченном релизе через Project Glasswing.
Цена: — $10 за млн входных токенов — $50 за млн выход
До 22 июня включена в Pro, Max, Team и Enterprise без доплаты — потом переедет на кредиты. Так что тестировать прямо сейчас
Анонс · System card
🚀 umaai.site/computer
👾 Друг Опенсурса
Если коротко: это та самая Mythos-модель, которую в апреле закрыли на замок из-за слишком страшных возможностей в кибербезе. Теперь сделали публичную версию с гарднрейлами — и называется она Fable 5
SOTA практически на всех бенчах: кодинг, аналитика, документы, зрение, научные задачи. Чем длиннее и сложнее задача — тем больше отрыв от пред моделей. Реальный пример из анонса: миграция в кодовой базе на 50 миллионов строк Ruby за один день, на которую у команды ушло бы больше двух месяцев.
Про гарднрейлы честно: запросы в высокорисковых зонах — кибербез, биология, химия — автоматически падают на Opus 4.8. Та же модель без ограничений — это Mythos 5, доступна только в ограниченном релизе через Project Glasswing.
Цена: — $10 за млн входных токенов — $50 за млн выход
До 22 июня включена в Pro, Max, Team и Enterprise без доплаты — потом переедет на кредиты. Так что тестировать прямо сейчас
Анонс · System card
🚀 umaai.site/computer
👾 Друг Опенсурса
🔥7❤2🤮1
⚡️Minimax M3 - открыли веса
Ну такое. Бенчи сами видите, я потыкал сегодня на реальной задаче, не понравилось
Веса
🔥🔥Kimi k2.7 code - поинтереснее релиз
Во первых, хочу заметить, что Кими - единственные китайские модели, в которых будто есть душа, проявляется это в письме и в дизайне кстати они хороши (ui/ux).
Но новая моделька прям типа на уровне Claude 4.7 - 4.8 opus (я кстати разницу уже не замечаю, честно, и Fable 5 меня в деле не очень удивил, сегодня кстати кончилась подписка Клод код, может кто то хочет добавить меня к своей подписке?😁🙏). Добавляем к этому цену ($0,95 / $4per 1M токенов, что в ≈ 6 раз дешевле чем опус) и хороший экспириенс
Я сейчас посижу побалуюсь с моделькой, чё нибудь навайбкодю и отпишу
Веса
🚀 umaai.site/computer
👾 Друг Опенсурса
Ну такое. Бенчи сами видите, я потыкал сегодня на реальной задаче, не понравилось
Веса
🔥🔥Kimi k2.7 code - поинтереснее релиз
Во первых, хочу заметить, что Кими - единственные китайские модели, в которых будто есть душа, проявляется это в письме и в дизайне кстати они хороши (ui/ux).
Но новая моделька прям типа на уровне Claude 4.7 - 4.8 opus (я кстати разницу уже не замечаю, честно, и Fable 5 меня в деле не очень удивил, сегодня кстати кончилась подписка Клод код, может кто то хочет добавить меня к своей подписке?😁🙏). Добавляем к этому цену ($0,95 / $4per 1M токенов, что в ≈ 6 раз дешевле чем опус) и хороший экспириенс
Я сейчас посижу побалуюсь с моделькой, чё нибудь навайбкодю и отпишу
Веса
🚀 umaai.site/computer
👾 Друг Опенсурса
👍7🔥2🙏2
Claude Fable 5 отключили через три дня после релиза
Американское правительство потребовало закрыть доступ для иностранных пользователей — а верифицировать всех по паспорту нереально, поэтому Антропик просто вырубили доступ всем. Включая API.
И вот тут интересно — два варианта как это читать
Вариант один — ИИ это уже реально новая ядерка
Государство не просто так дёргается. Fable 5 это Mythos-класс, который изначально закрыли именно из-за возможностей в кибербезе и биологии. Может правительство США уже понимает что фронтирные модели это оружие стратегического уровня — и начинает закрывать периметр
Вариант два — корпоративная политика
GPT-5.6 на подходе и будет примерно в том же весе что Fable 5. Совпадение что именно сейчас Антропику запрещают давать эту модель широкой аудитории? OpenAI влияние на американский госаппарат имеет колоссальное — убрать конкурента руками регуляторов это элегантно
🚀 umaai.site/computer
👾 Друг Опенсурса
Американское правительство потребовало закрыть доступ для иностранных пользователей — а верифицировать всех по паспорту нереально, поэтому Антропик просто вырубили доступ всем. Включая API.
И вот тут интересно — два варианта как это читать
Вариант один — ИИ это уже реально новая ядерка
Государство не просто так дёргается. Fable 5 это Mythos-класс, который изначально закрыли именно из-за возможностей в кибербезе и биологии. Может правительство США уже понимает что фронтирные модели это оружие стратегического уровня — и начинает закрывать периметр
Вариант два — корпоративная политика
GPT-5.6 на подходе и будет примерно в том же весе что Fable 5. Совпадение что именно сейчас Антропику запрещают давать эту модель широкой аудитории? OpenAI влияние на американский госаппарат имеет колоссальное — убрать конкурента руками регуляторов это элегантно
🚀 umaai.site/computer
👾 Друг Опенсурса
🤯5👍1🤡1
Claude Sonnet 5 вышел
А еще сегодня всем вернут доступ к Fable 5, судя по всему уже без паспорта (ура!). Еще по подписку какое то время, а потом будет апишная цена после 7 числа
Вот вот выкатят gpt 5.6, которая по идее обходит даже оригинальный митоз, что очень очень круто, но зная опенаи цена по апи будет больше чем на фейбл, однако в подписке usage по идее должен быть больше чем у claude code
Пока что ждем. Не хочу чтобы дюди забывали про гемини: я уверен, что инженеры дипмайд там щас просто летают, чтобы гемини 3.5 про догнала всех ваших митозов
🚀 umaai.site/computer
👾 Друг Опенсурса
А еще сегодня всем вернут доступ к Fable 5, судя по всему уже без паспорта (ура!). Еще по подписку какое то время, а потом будет апишная цена после 7 числа
Вот вот выкатят gpt 5.6, которая по идее обходит даже оригинальный митоз, что очень очень круто, но зная опенаи цена по апи будет больше чем на фейбл, однако в подписке usage по идее должен быть больше чем у claude code
Пока что ждем. Не хочу чтобы дюди забывали про гемини: я уверен, что инженеры дипмайд там щас просто летают, чтобы гемини 3.5 про догнала всех ваших митозов
🚀 umaai.site/computer
👾 Друг Опенсурса
👍2❤1🔥1👌1
🔥Немного конспирологии
Я часто делаю предположения, когда выйдут те или иные модельки и всегда угадываю (почти).
И полагаясь на всякие намеки от гугл, на то что сейчас на арене под видом старой гемини 3.1 про сейчас работает какая тт лютая модель, на уровне fable, думаю что в течении этой недели выйдет гемини 3.5 про.
Сейчас гуглу критически важно показать новую модель, которая хотя бы сравняется с фейблом, иначе они начнут сильно проигрывать. Опенаи уже показали gpt 5.6 sol. Да и 3.1 про уже правда устаревшая модель, по крайней мере в сфере кодинга, в остальном тт различий сейчас уже не увидишь.
🚀 umaai.site/computer
👾 Друг Опенсурса
Я часто делаю предположения, когда выйдут те или иные модельки и всегда угадываю (почти).
И полагаясь на всякие намеки от гугл, на то что сейчас на арене под видом старой гемини 3.1 про сейчас работает какая тт лютая модель, на уровне fable, думаю что в течении этой недели выйдет гемини 3.5 про.
Сейчас гуглу критически важно показать новую модель, которая хотя бы сравняется с фейблом, иначе они начнут сильно проигрывать. Опенаи уже показали gpt 5.6 sol. Да и 3.1 про уже правда устаревшая модель, по крайней мере в сфере кодинга, в остальном тт различий сейчас уже не увидишь.
🚀 umaai.site/computer
👾 Друг Опенсурса
👍3
Gpt 5.6 вышла!
Я уже протестировал, очень радует, что цена дешевле чем 5.5, она экономичнее при этом фейбл левел
Ниже буду кидать интересные юз кейсы, если скажете в коммах - выложу способ получить подписку на гпт бесплатно, чтобы самим в кодексе потестить
🚀 umaai.site/computer
👾 Друг Опенсурса
Я уже протестировал, очень радует, что цена дешевле чем 5.5, она экономичнее при этом фейбл левел
Ниже буду кидать интересные юз кейсы, если скажете в коммах - выложу способ получить подписку на гпт бесплатно, чтобы самим в кодексе потестить
🚀 umaai.site/computer
👾 Друг Опенсурса
👍5🔥2
🔥 Kimi k3 вышла!
Уровень опуса 4.8, по некоторым бенчам почти фейбл!
Цена 3$/15$ за вход/выход 1m токенов
Люди пишет ооочень хорошие отзывы, говорят что ChatGPT sol 5.6 уделывает
Буду тестить
🚀 umaai.site/computer
👾 Друг Опенсурса
Уровень опуса 4.8, по некоторым бенчам почти фейбл!
Цена 3$/15$ за вход/выход 1m токенов
Люди пишет ооочень хорошие отзывы, говорят что ChatGPT sol 5.6 уделывает
Буду тестить
🚀 umaai.site/computer
👾 Друг Опенсурса
🔥8🤯3
🔥 Alibaba показала Qwen 3.8.
Если коротко: это новый флагман на 2,4 трлн параметров. Пока модель уже доступна через API по сниженной цене, а открытые веса обещают выложить совсем скоро.
Честно, меня тут больше цепляют не бенчмарки. Интереснее посмотреть, как она покажет себя в кодинге и агентных сценариях. Судя по первым отзывам, именно там Qwen 3.8 ощущается сильнее всего — люди пишут, что проекты с AI-агентами стали выполняться заметно быстрее.
Ну и отдельный плюс — это open-weight модель. Как только веса выложат, начнется самое интересное: нормальные независимые тесты.
Буду тестить. Посмотрим.
🚀 umaai.site/computer
👾 Друг Опенсурса
Если коротко: это новый флагман на 2,4 трлн параметров. Пока модель уже доступна через API по сниженной цене, а открытые веса обещают выложить совсем скоро.
Честно, меня тут больше цепляют не бенчмарки. Интереснее посмотреть, как она покажет себя в кодинге и агентных сценариях. Судя по первым отзывам, именно там Qwen 3.8 ощущается сильнее всего — люди пишут, что проекты с AI-агентами стали выполняться заметно быстрее.
Ну и отдельный плюс — это open-weight модель. Как только веса выложат, начнется самое интересное: нормальные независимые тесты.
Буду тестить. Посмотрим.
🚀 umaai.site/computer
👾 Друг Опенсурса
❤5👍1
⚡️ Google показала сразу три новые Gemini: 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber.
3.6 Flash стала лучше в кодинге, рассуждениях и работе с инструментами. При этом она дешевле прошлой версии — $1.50 / $7.50 за миллион входных и выходных токенов. Плюс Google заявляет, что модель тратит заметно меньше output-токенов. Если это подтвердится, экономия будет приятной.
3.5 Flash-Lite теперь самая дешевая модель в линейке — $0.30 / $2.50 за миллион токенов. Для простых задач выглядит неплохо. А 3.5 Flash Cyber пока доступна только партнерам и заточена под поиск и исправление уязвимостей в коде.
Но если честно, я вообще ждал не этого.
OpenAI, Anthropic, Alibaba, xAI, Mistral, Moonshot - все дропнули по несколько(!) поколений моделей. Даже Meta, отсталая мета, на которой я, признаюсь, поставил крест, как на ai labe выложила muse 1.1, тоже фронтир
А гугл где? По моему мнению главный игрок в индустрии. Стыд и позор, искренни обидно (раньше модельки в аи студии появлялись чуть ли не каждый день)
umaai.site
3.6 Flash стала лучше в кодинге, рассуждениях и работе с инструментами. При этом она дешевле прошлой версии — $1.50 / $7.50 за миллион входных и выходных токенов. Плюс Google заявляет, что модель тратит заметно меньше output-токенов. Если это подтвердится, экономия будет приятной.
3.5 Flash-Lite теперь самая дешевая модель в линейке — $0.30 / $2.50 за миллион токенов. Для простых задач выглядит неплохо. А 3.5 Flash Cyber пока доступна только партнерам и заточена под поиск и исправление уязвимостей в коде.
Но если честно, я вообще ждал не этого.
OpenAI, Anthropic, Alibaba, xAI, Mistral, Moonshot - все дропнули по несколько(!) поколений моделей. Даже Meta, отсталая мета, на которой я, признаюсь, поставил крест, как на ai labe выложила muse 1.1, тоже фронтир
А гугл где? По моему мнению главный игрок в индустрии. Стыд и позор, искренни обидно (раньше модельки в аи студии появлялись чуть ли не каждый день)
umaai.site
❤4
⚡️ Poolside выкатили Laguna S 2.1.
И вот это уже реально интересно.
118B MoE (активно всего 8B на токен), контекст до 1 млн токенов, открытые веса уже лежат на Hugging Face. Есть BF16, FP8, INT4, GGUF, MLX — короче, релиз сразу (не как у муншотов с кими к3)
Самое интересное — это размер. По словам Poolside, Laguna S 2.1 на Terminal-Bench 2.1 идет рядом с моделями, которые в 5–25 раз больше, а местами вообще их обгоняет. Если это подтвердится независимыми тестами, получится очень сильная open-weight модель именно для кодинга.
Еще понравилось, что они прямо написали про минусы. Модель иногда начинает слишком долго думать на сложной математике, а промежуточного режима между thinking и no-thinking пока нет. Обычно компании про такое молчат.
🚀 umaai.site/computer
👾 Друг Опенсурса
И вот это уже реально интересно.
118B MoE (активно всего 8B на токен), контекст до 1 млн токенов, открытые веса уже лежат на Hugging Face. Есть BF16, FP8, INT4, GGUF, MLX — короче, релиз сразу (не как у муншотов с кими к3)
Самое интересное — это размер. По словам Poolside, Laguna S 2.1 на Terminal-Bench 2.1 идет рядом с моделями, которые в 5–25 раз больше, а местами вообще их обгоняет. Если это подтвердится независимыми тестами, получится очень сильная open-weight модель именно для кодинга.
Еще понравилось, что они прямо написали про минусы. Модель иногда начинает слишком долго думать на сложной математике, а промежуточного режима между thinking и no-thinking пока нет. Обычно компании про такое молчат.
🚀 umaai.site/computer
👾 Друг Опенсурса
👌5👍2
ДругОпенсурса Aka. Новости нейросетей
⚡️ Poolside выкатили Laguna S 2.1. И вот это уже реально интересно. 118B MoE (активно всего 8B на токен), контекст до 1 млн токенов, открытые веса уже лежат на Hugging Face. Есть BF16, FP8, INT4, GGUF, MLX — короче, релиз сразу (не как у муншотов с кими…
и кстати да, она сверх дешевая ($0,10/M input tokens
$0,20/M output tokens)
учитесь , гугол
$0,20/M output tokens)
учитесь , гугол
👍5
⚡️ Чем больше читаю про Kimi K3, тем меньше понимаю, почему все называют ее "дешевой".
Да, по прайсу вроде не катастрофа — $3 за миллион input-токенов и $15 за миллион output. Но есть нюанс.
По факту модель во время рассуждений жрет просто какое-то безумное количество токенов. Видел сравнение с Sonnet 5 — Kimi тратит почти в три раза больше. И проблема даже не в цене за миллион токенов, а в том, сколько их реально уходит на одну задачу.
По ощущениям, она просто перебирает варианты. Иногда буквально забывает, о чем сама же писала несколько шагов назад, начинает заходить на новый круг... и в итоге за счет огромного количества итераций все-таки приходит к правильному ответу. Работает? Да. Но какой ценой.
Для сравнения, тот же Muse Spark 1.1 стоит около $2 за миллион input и $4–6 за output. И в итоге многие задачи обходятся банально дешевле.
Но я бы пока не хоронил Kimi.
27 числа обещают открыть веса. Почти уверен, что довольно быстро появятся первые файнтюны. Возможно, кто-то сможет хотя бы немного уменьшить этот дикий расход токенов. Плюс появятся неофициальные провайдеры, которые начнут гонять модель на своем железе и сильно собьют цену. Не удивлюсь, если NVIDIA тоже добавит бесплатный inference с лимитами.
А вот разговоры в духе "ну запустим локально" меня забавляют. Там почти 3 триллиона параметров. Да, это MoE. Но это все еще модель совсем не для домашнего ПК. Если у вас не стоит небольшой дата-центр в гараже, про локальный запуск можно особо не мечтать.
🚀 umaai.site/computer
👾 Друг Опенсурса
Да, по прайсу вроде не катастрофа — $3 за миллион input-токенов и $15 за миллион output. Но есть нюанс.
По факту модель во время рассуждений жрет просто какое-то безумное количество токенов. Видел сравнение с Sonnet 5 — Kimi тратит почти в три раза больше. И проблема даже не в цене за миллион токенов, а в том, сколько их реально уходит на одну задачу.
По ощущениям, она просто перебирает варианты. Иногда буквально забывает, о чем сама же писала несколько шагов назад, начинает заходить на новый круг... и в итоге за счет огромного количества итераций все-таки приходит к правильному ответу. Работает? Да. Но какой ценой.
Для сравнения, тот же Muse Spark 1.1 стоит около $2 за миллион input и $4–6 за output. И в итоге многие задачи обходятся банально дешевле.
Но я бы пока не хоронил Kimi.
27 числа обещают открыть веса. Почти уверен, что довольно быстро появятся первые файнтюны. Возможно, кто-то сможет хотя бы немного уменьшить этот дикий расход токенов. Плюс появятся неофициальные провайдеры, которые начнут гонять модель на своем железе и сильно собьют цену. Не удивлюсь, если NVIDIA тоже добавит бесплатный inference с лимитами.
А вот разговоры в духе "ну запустим локально" меня забавляют. Там почти 3 триллиона параметров. Да, это MoE. Но это все еще модель совсем не для домашнего ПК. Если у вас не стоит небольшой дата-центр в гараже, про локальный запуск можно особо не мечтать.
🚀 umaai.site/computer
👾 Друг Опенсурса
Uma AI
Uma AI — студия ИИ-контента
Изображения, видео, музыка и агенты — в одной нейросети.
👌4❤1
⚡️ Alibaba представила Qwen-Image 3.0.
Главная идея новой версии — сделать генерацию изображений не просто красивой, а реально полезной для работы.
Промпты теперь могут быть до 4500 токенов. Модель умеет за один проход собирать сложные макеты: сториборды, газеты, экзаменационные листы, инфографику, интерфейсы. Плюс заявлена поддержка более 100 художественных стилей, 12 языков и генерация с учетом знаний о мире.
Еще один большой упор сделали на текст. Alibaba говорит, что модель умеет рисовать читаемый текст вплоть до 10 px, генерировать полноценные LaTeX-документы, лучше передавать мелкие детали вроде кожи и волос.
Я уже немного потыкал. С текстом реально стало лучше, причем даже с русским. Но на совсем мелких надписях все еще начинает сыпаться (см 3 картинку). До гпт имг 2 пока далеко
В целом выглядит интересно.
🚀 umaai.site/computer
👾 Друг Опенсурса
Главная идея новой версии — сделать генерацию изображений не просто красивой, а реально полезной для работы.
Промпты теперь могут быть до 4500 токенов. Модель умеет за один проход собирать сложные макеты: сториборды, газеты, экзаменационные листы, инфографику, интерфейсы. Плюс заявлена поддержка более 100 художественных стилей, 12 языков и генерация с учетом знаний о мире.
Еще один большой упор сделали на текст. Alibaba говорит, что модель умеет рисовать читаемый текст вплоть до 10 px, генерировать полноценные LaTeX-документы, лучше передавать мелкие детали вроде кожи и волос.
Я уже немного потыкал. С текстом реально стало лучше, причем даже с русским. Но на совсем мелких надписях все еще начинает сыпаться (см 3 картинку). До гпт имг 2 пока далеко
В целом выглядит интересно.
🚀 umaai.site/computer
👾 Друг Опенсурса
👍6🔥1