У этой модели очень хороший поиск, и это хорошо, когда знания новые и есть представления о мире.
Но блин, зачем настолько? Это же бред. Какой смысл у Image-модели, если она просто берет и возвращает картинки из интернета?
У нее вообще будет тогда свой вкус?
Но блин, зачем настолько? Это же бред. Какой смысл у Image-модели, если она просто берет и возвращает картинки из интернета?
У нее вообще будет тогда свой вкус?
🤔6 2❤🔥1
Как вы думаете, сможет ли предстоящий Claude Opus 4.8 стать таким же, как Claude Opus 4.6, в плане логики и качества написания текстов?
Может быть это снова будет хорошая модель для общения, и она снова окажется умной.
С 100% вероятностью они изменили свой подход в обучении своих моделей и теперь ориентируются только на код, что на самом деле плохо, но это уже давняя практика Anthropic.
Новая модель ожидается на этой неделе.
Кстати, я всё ещё использую Claude Opus 4.6 для себя, потому что он во всём лучше, чем 4.7, кроме отладки.
Может быть это снова будет хорошая модель для общения, и она снова окажется умной.
С 100% вероятностью они изменили свой подход в обучении своих моделей и теперь ориентируются только на код, что на самом деле плохо, но это уже давняя практика Anthropic.
Новая модель ожидается на этой неделе.
Кстати, я всё ещё использую Claude Opus 4.6 для себя, потому что он во всём лучше, чем 4.7, кроме отладки.
🤔7❤🔥4
MiniMax M3.0 уже скоро, по намекам от самой MiniMax_AI.
Мне интересно, что они приготовят, но, скорее всего, никаких отличительных вещей не будет.
Хотя, если посмотреть на прикрепленное изображение, там якобы есть какой-то архитектурный прирост.
Но признаться честно, мне уже всё равно на них: Они слишком нагло дистиллируют свои модели на Claude, а для меня дистилляция — это ужасная практика обучения моделей. В таких моделях, как правило, куча дыр в плане логических рассуждений. И кстати, я напомню про отчёт от Anthropic, который вышел в начале этого года, посмотрите что там было с M2.7.
Мне интересно, где же Hailuo 3?
Мне интересно, что они приготовят, но, скорее всего, никаких отличительных вещей не будет.
Хотя, если посмотреть на прикрепленное изображение, там якобы есть какой-то архитектурный прирост.
Но признаться честно, мне уже всё равно на них: Они слишком нагло дистиллируют свои модели на Claude, а для меня дистилляция — это ужасная практика обучения моделей. В таких моделях, как правило, куча дыр в плане логических рассуждений. И кстати, я напомню про отчёт от Anthropic, который вышел в начале этого года, посмотрите что там было с M2.7.
Мне интересно, где же Hailuo 3?
Новый бенчмарк который кажется мне безумно интересным.
«DeepSWE, новый стандарт для тестирования производительности агентного программирования».
«DeepSWE показывает, где они действительно расходятся, отражая реалистичный опыт разработчиков в их повседневной работе».
Dive deeper in our blog:
deepswe.datacurve.ai/blog
«DeepSWE, новый стандарт для тестирования производительности агентного программирования».
«DeepSWE показывает, где они действительно расходятся, отражая реалистичный опыт разработчиков в их повседневной работе».
Dive deeper in our blog:
deepswe.datacurve.ai/blog
Для тех, кто ждёт сегодня Opus-4.8.
Сейчас даже некоторые крупные рыбы, особенно в твиттере, нагоняют информацию о том, что сегодня выйдут две крутые вещи и так далее, некоторые упоминают Opus-4.8.
Но проанализировав все текущие известные факторы, я могу с уверенностью сказать, что это фейк, и вам верить в это не стоит. Даже Лео. Он с ума сошёл.
Да, Opus-4.8 реально существует но его выход не каноничен, даже обычному человеку легко понять, что сейчас конец месяца, а Anthropic никогда не выкатывает флагманы в последние дни мая. Это просто безумно ненормально.
Делать еще один флагман через 5 недель — нет.
Ранее я писал, что всё ожидается на этой неделе. Но! Я начинаю складывать некоторые пазлы и понимаю, что нет. Не ждите.
Если бы релиз был на этой неделе, то он состоялся бы во вторник или среду, но этого не случилось.
Сейчас даже некоторые крупные рыбы, особенно в твиттере, нагоняют информацию о том, что сегодня выйдут две крутые вещи и так далее, некоторые упоминают Opus-4.8.
Но проанализировав все текущие известные факторы, я могу с уверенностью сказать, что это фейк, и вам верить в это не стоит. Даже Лео. Он с ума сошёл.
Да, Opus-4.8 реально существует но его выход не каноничен, даже обычному человеку легко понять, что сейчас конец месяца, а Anthropic никогда не выкатывает флагманы в последние дни мая. Это просто безумно ненормально.
Делать еще один флагман через 5 недель — нет.
Ранее я писал, что всё ожидается на этой неделе. Но! Я начинаю складывать некоторые пазлы и понимаю, что нет. Не ждите.
Если бы релиз был на этой неделе, то он состоялся бы во вторник или среду, но этого не случилось.
🤔4
Светлый Уголок | ии
Для тех, кто ждёт сегодня Opus-4.8. Сейчас даже некоторые крупные рыбы, особенно в твиттере, нагоняют информацию о том, что сегодня выйдут две крутые вещи и так далее, некоторые упоминают Opus-4.8. Но проанализировав все текущие известные факторы, я могу…
Opus 4.8 был найден в селекторе моделей Claude Code в десктопном приложении.
🙏6
Светлый Уголок | ии
Opus 4.8 был найден в селекторе моделей Claude Code в десктопном приложении.
Да идите вы! Релиз сегодня. Модель появиться через несколько минут.
🙏7 2
Небольшая сводка ИИ:
Улучшенный интеллект: Модель умнее Claude Opus 4.7 в кодинге, логике, работе агентов и решении практических задач.
Честность и надежность: Opus 4.8 в 4 раза реже пропускает баги в своем коде. Она лучше признает свои ошибки, открыто говорит о неуверенности и не выдумывает результаты.
Безопасность: Модель ставит новые рекорды по «просоциальному поведению» и преданности интересам пользователя. Вероятность обмана или помощи в злоупотреблениях значительно ниже.
Улучшенный интеллект: Модель умнее Claude Opus 4.7 в кодинге, логике, работе агентов и решении практических задач.
Честность и надежность: Opus 4.8 в 4 раза реже пропускает баги в своем коде. Она лучше признает свои ошибки, открыто говорит о неуверенности и не выдумывает результаты.
Безопасность: Модель ставит новые рекорды по «просоциальному поведению» и преданности интересам пользователя. Вероятность обмана или помощи в злоупотреблениях значительно ниже.
❤🔥2