Forwarded from r/ретранслятор
This media is not supported in your browser
VIEW IN TELEGRAM
Буквально вчера мы писали про модель Qwen2.5-1M от Alibaba, а теперь они выпустили Qwen2.5-Max, которая обогнала по мощности DeepSeek и GPT-4o.
Qwen2.5-Max предобучен на более чем 20 триллионах токенов и использует передовые методы пост-обучения. Он основан на архитектуре MoE (Mixture-of-Experts), что позволяет эффективно масштабировать модель.
Главный акцент сделан на мышлении и логике.
Модель отвечает на вопросы уровня университетских экзаменов, умеет качественно кодить, создавать игры и искать актуальную информацию. Также может анализировать видео и изображения. И это лишь малая часть её способностей.
При этом доступна бесплатно и без VPN.
Опробовать можно здесь (выберите в списке Qwen2.5-Max).
DeepSeek похоронил OpenAI, а Alibaba похоронил DeepSeek. Великая битва
r/#LocalLLaMA
Qwen2.5-Max предобучен на более чем 20 триллионах токенов и использует передовые методы пост-обучения. Он основан на архитектуре MoE (Mixture-of-Experts), что позволяет эффективно масштабировать модель.
Главный акцент сделан на мышлении и логике.
Модель отвечает на вопросы уровня университетских экзаменов, умеет качественно кодить, создавать игры и искать актуальную информацию. Также может анализировать видео и изображения. И это лишь малая часть её способностей.
При этом доступна бесплатно и без VPN.
Опробовать можно здесь (выберите в списке Qwen2.5-Max).
DeepSeek похоронил OpenAI, а Alibaba похоронил DeepSeek. Великая битва
r/#LocalLLaMA