Да, это возможно. Кстати, Anthropic не стремятся выпускать линейку-5.
Они считают, что должны решить проблему с безопасностью Claude Mythos. Именно поэтому мы, вероятно, увидим не только предстоящий Claude Opus 4.8 в этом месяце, но и 4.9 потом. Они хотят сделать что-то приближенное к Mythos.
Anthropic, ваши модели всё ещё прекрасны, но дело не в моделях, как мне кажется, дело в доступности вашего продукта и в вашей политике. Пора бы вам проснуться и увидеть, что больше половины перешло в Codex.
Источник насчет claude-opus-4.8 тут. А, эм. Если что ему можно верить, claude-opus-4.8 светилась в бекенде vertex ещё месяц назад, просто об этом никто не говорил.
Они считают, что должны решить проблему с безопасностью Claude Mythos. Именно поэтому мы, вероятно, увидим не только предстоящий Claude Opus 4.8 в этом месяце, но и 4.9 потом. Они хотят сделать что-то приближенное к Mythos.
Anthropic, ваши модели всё ещё прекрасны, но дело не в моделях, как мне кажется, дело в доступности вашего продукта и в вашей политике. Пора бы вам проснуться и увидеть, что больше половины перешло в Codex.
Источник насчет claude-opus-4.8 тут. А, эм. Если что ему можно верить, claude-opus-4.8 светилась в бекенде vertex ещё месяц назад, просто об этом никто не говорил.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🙏4
У этой модели очень хороший поиск, и это хорошо, когда знания новые и есть представления о мире.
Но блин, зачем настолько? Это же бред. Какой смысл у Image-модели, если она просто берет и возвращает картинки из интернета?
У нее вообще будет тогда свой вкус?
Но блин, зачем настолько? Это же бред. Какой смысл у Image-модели, если она просто берет и возвращает картинки из интернета?
У нее вообще будет тогда свой вкус?
🤔6 2❤🔥1
Как вы думаете, сможет ли предстоящий Claude Opus 4.8 стать таким же, как Claude Opus 4.6, в плане логики и качества написания текстов?
Может быть это снова будет хорошая модель для общения, и она снова окажется умной.
С 100% вероятностью они изменили свой подход в обучении своих моделей и теперь ориентируются только на код, что на самом деле плохо, но это уже давняя практика Anthropic.
Новая модель ожидается на этой неделе.
Кстати, я всё ещё использую Claude Opus 4.6 для себя, потому что он во всём лучше, чем 4.7, кроме отладки.
Может быть это снова будет хорошая модель для общения, и она снова окажется умной.
С 100% вероятностью они изменили свой подход в обучении своих моделей и теперь ориентируются только на код, что на самом деле плохо, но это уже давняя практика Anthropic.
Новая модель ожидается на этой неделе.
Кстати, я всё ещё использую Claude Opus 4.6 для себя, потому что он во всём лучше, чем 4.7, кроме отладки.
🤔7❤🔥4
MiniMax M3.0 уже скоро, по намекам от самой MiniMax_AI.
Мне интересно, что они приготовят, но, скорее всего, никаких отличительных вещей не будет.
Хотя, если посмотреть на прикрепленное изображение, там якобы есть какой-то архитектурный прирост.
Но признаться честно, мне уже всё равно на них: Они слишком нагло дистиллируют свои модели на Claude, а для меня дистилляция — это ужасная практика обучения моделей. В таких моделях, как правило, куча дыр в плане логических рассуждений. И кстати, я напомню про отчёт от Anthropic, который вышел в начале этого года, посмотрите что там было с M2.7.
Мне интересно, где же Hailuo 3?
Мне интересно, что они приготовят, но, скорее всего, никаких отличительных вещей не будет.
Хотя, если посмотреть на прикрепленное изображение, там якобы есть какой-то архитектурный прирост.
Но признаться честно, мне уже всё равно на них: Они слишком нагло дистиллируют свои модели на Claude, а для меня дистилляция — это ужасная практика обучения моделей. В таких моделях, как правило, куча дыр в плане логических рассуждений. И кстати, я напомню про отчёт от Anthropic, который вышел в начале этого года, посмотрите что там было с M2.7.
Мне интересно, где же Hailuo 3?
Новый бенчмарк который кажется мне безумно интересным.
«DeepSWE, новый стандарт для тестирования производительности агентного программирования».
«DeepSWE показывает, где они действительно расходятся, отражая реалистичный опыт разработчиков в их повседневной работе».
Dive deeper in our blog:
deepswe.datacurve.ai/blog
«DeepSWE, новый стандарт для тестирования производительности агентного программирования».
«DeepSWE показывает, где они действительно расходятся, отражая реалистичный опыт разработчиков в их повседневной работе».
Dive deeper in our blog:
deepswe.datacurve.ai/blog