Кажется, Яндекс решил плотно вкатиться в нейронки — компания представила новую базовую языковую модель AliceAI-Foundation-80B-A3B-Base с гибридной архитектурой и MoE-экспертами. Объем модели 80 млрд общих параметров, но для обработки каждого токена активируются только 3 млрд, а контекстное достигает 262 144 токенов.
В архитектуре используется 48 слоёв, 512 экспертов MoE с выбором 10 экспертов на токен, а словарь нейронки достигает 129 024 токена. Для обработки длинного контекста используются механизмы KDA и Gated Attention, а также один слой MTP.
В тестах AliceAI особенно сильна на русскоязычных данных. Она набрала 86,5% в WikiWebFacts против 62,4% у Qwen3.5-35B-A3B, 70,2% у GLM-4.5-Air, 72,8% у Nemotron-3-Super и 83,2% у DeepSeek-V4-Flash. В HardMultiQA результат составил 67,9% против 47,2%, 48,6%, 54,5% и 65,4% соответственно.
При сложном рассуждении модель получила 96,7% в AIME 2026 pass@32 против 96,7% у Qwen3.5-35B-A3B и 90% у Nemotron-3-Super. В HMMT 2026 результат AliceAI составил 96,9% против 87,9% и 66,7%, а в IMO Answerbench — 88,7% против 84,5% и 64,5%. В CodeForces CPP AliceAI набрала 68,9%, уступив Qwen3.5 с 73,7%, но опередив Nemotron с 56,6%.
Веса доступны на Hugging Face.
😅 Канал Serverflow в MAX: Подписаться
В архитектуре используется 48 слоёв, 512 экспертов MoE с выбором 10 экспертов на токен, а словарь нейронки достигает 129 024 токена. Для обработки длинного контекста используются механизмы KDA и Gated Attention, а также один слой MTP.
В тестах AliceAI особенно сильна на русскоязычных данных. Она набрала 86,5% в WikiWebFacts против 62,4% у Qwen3.5-35B-A3B, 70,2% у GLM-4.5-Air, 72,8% у Nemotron-3-Super и 83,2% у DeepSeek-V4-Flash. В HardMultiQA результат составил 67,9% против 47,2%, 48,6%, 54,5% и 65,4% соответственно.
При сложном рассуждении модель получила 96,7% в AIME 2026 pass@32 против 96,7% у Qwen3.5-35B-A3B и 90% у Nemotron-3-Super. В HMMT 2026 результат AliceAI составил 96,9% против 87,9% и 66,7%, а в IMO Answerbench — 88,7% против 84,5% и 64,5%. В CodeForces CPP AliceAI набрала 68,9%, уступив Qwen3.5 с 73,7%, но опередив Nemotron с 56,6%.
Веса доступны на Hugging Face.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍22💩9🍾8💅1
SpaceXAI представила новую флагманскую ИИ-модель Grok 4.7, которая на голову обходит Grok 4.6 при той же стоимости API и превосходит GPT 5.6 Sol и Fable 5.1 в ряде задач при кратно меньшей цене за токены.
Модель отлично справляется с повседневными сценариями использования, работой с длинным контекстом при окне в 500 тыс токенов, а также она неплоха в юриспруденции, инженерии, 3D-дизайне и других тасках. Однако в кодинге, сложных логических сценариях, математике и науке она все же уступает более мощным конкурентам от OpenAI и Anthropic.
Grok 4.7 уже доступен в Cursor и Grok Build, а также в Grok API: $2 за млн входных токенов и $6 за млн выходных токенов.
😅 Канал Serverflow в MAX: Подписаться
Модель отлично справляется с повседневными сценариями использования, работой с длинным контекстом при окне в 500 тыс токенов, а также она неплоха в юриспруденции, инженерии, 3D-дизайне и других тасках. Однако в кодинге, сложных логических сценариях, математике и науке она все же уступает более мощным конкурентам от OpenAI и Anthropic.
Grok 4.7 уже доступен в Cursor и Grok Build, а также в Grok API: $2 за млн входных токенов и $6 за млн выходных токенов.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6
This media is not supported in your browser
VIEW IN TELEGRAM
Grok 4.7 не оправдал ожидания юзеров — в 3D-моделировании нейронка значительно уступает даже открытой Kimi K3. Иронично, что в качестве примера моделировали запуск ракеты…
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯24💩2💅2
Nvidia GeForce RTX исполняется 8 лет. Легендарные RTX 2080 Ti и RTX 2080 вышли в сентябре 2018 года. Как быстро летит время…
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾19💩3
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾12👍8💅1
ARM Vera 🆚 x86 Xeon 6900P
Nvidia продолжает пытаться доказывать всем, что их новейший CPU Vera на архитектуре ARM лучше x86 решений конкурентов. В прошлый раз компания проверяла свой топовый чип в общих процессорных бенчмарках, а в этот раз дело дошло до производительности в базах данных. В качестве x86-конкурента взяли 96-ядерный Intel Xeon 6952P Granite Rapids (судя по характеристикам, в сравнении не указан конкретный чип). Давайте ознакомимся с характеристиками этих процессоров:
🚗 NVIDIA Vera (88c/176t, до 4.0GHz, 250-450W)
😎 Intel Xeon 6952P (96c/192t, 2.1GHz-3.9GHz, 400W)
Nvidia до сих пор не раскрыла тактовой частоты Nvidia Vera, но очевидно, что она никак не может быть меньше частоты Grace (3.1-3.6 ГГц), поэтому можно предположить, что ядра Vera будут работать как минимум в диапазоне 3.1-4.0 ГГц, и это априори ставит Nvidia в выгодное положение относительно Intel Xeon 6952P, ведь именно от базовой тактовой частоты зависит производительность чипа в СУБД.
Производительность меряли по двум версиям СУБД DuckDB (1.5.5 и 2.0.0-alpha) в тесте TPC-H, который проверяет производительность систем на сложных аналитических запросах и обработке больших массивов данных.
DuckDB — это очень специфичная СУБД, которая подходит скорее для задач аналитики больших объемов данных, нежели для более приземленных сценариев, для подключения 1С или к сайту она точно не подойдет. Это СУБД для BigData-инфраструктур, а не для бизнеса, и это вносит свою лепту.
Обе системы имели технологию многопоточности (Spatial Multithreading у Nvidia / Hyper-Threading у Intel), имели по 768 ГБ оперативной памяти (LPDDR5X у Nvidia / DDR5 у Intel), SSD объемом более 3 ТБ и работали под управлением Ubuntu 26.04. Итак, какие результаты?
🦆 В стабильной DuckDB 1.5.5 — 2,48 млн баллов у Vera против 1,67 млн баллов у Xeon, преимущество Nvidia составило около 48%.
🦆 В тестовой DuckDB 2.0.0-alpha — 3,07 млн баллов у Vera против 2,11 млн баллов у Xeon, преимущество Nvidia составило около 46%.
То есть, Nvidia взяла далеко не самый высокочастотный чип Intel, взяла крайне специфичный тест и СУБД, и провела тестирование, гордо заявляя о превосходстве ARM Vera над x86 Intel Xeon 6. Браво, Хуанг!
😅 Канал Serverflow в MAX: Подписаться
Nvidia продолжает пытаться доказывать всем, что их новейший CPU Vera на архитектуре ARM лучше x86 решений конкурентов. В прошлый раз компания проверяла свой топовый чип в общих процессорных бенчмарках, а в этот раз дело дошло до производительности в базах данных. В качестве x86-конкурента взяли 96-ядерный Intel Xeon 6952P Granite Rapids (судя по характеристикам, в сравнении не указан конкретный чип). Давайте ознакомимся с характеристиками этих процессоров:
Nvidia до сих пор не раскрыла тактовой частоты Nvidia Vera, но очевидно, что она никак не может быть меньше частоты Grace (3.1-3.6 ГГц), поэтому можно предположить, что ядра Vera будут работать как минимум в диапазоне 3.1-4.0 ГГц, и это априори ставит Nvidia в выгодное положение относительно Intel Xeon 6952P, ведь именно от базовой тактовой частоты зависит производительность чипа в СУБД.
Производительность меряли по двум версиям СУБД DuckDB (1.5.5 и 2.0.0-alpha) в тесте TPC-H, который проверяет производительность систем на сложных аналитических запросах и обработке больших массивов данных.
Конечно, не самый популярный выбор базы данных, и многих скорее интересует производительность Vera в MySQL, PostgreSQL или Microsoft SQL Server, но Nvidia намеренно выбрала эту базу данных.
DuckDB — это очень специфичная СУБД, которая подходит скорее для задач аналитики больших объемов данных, нежели для более приземленных сценариев, для подключения 1С или к сайту она точно не подойдет. Это СУБД для BigData-инфраструктур, а не для бизнеса, и это вносит свою лепту.
Обе системы имели технологию многопоточности (Spatial Multithreading у Nvidia / Hyper-Threading у Intel), имели по 768 ГБ оперативной памяти (LPDDR5X у Nvidia / DDR5 у Intel), SSD объемом более 3 ТБ и работали под управлением Ubuntu 26.04. Итак, какие результаты?
🦆 В стабильной DuckDB 1.5.5 — 2,48 млн баллов у Vera против 1,67 млн баллов у Xeon, преимущество Nvidia составило около 48%.
🦆 В тестовой DuckDB 2.0.0-alpha — 3,07 млн баллов у Vera против 2,11 млн баллов у Xeon, преимущество Nvidia составило около 46%.
Важно, что это не официальный сертифицированный результат TPC-H: тестирование проводилось при сотрудничестве DuckDB и NVIDIA, а при официальной аудированной публикации TPC.
То есть, Nvidia взяла далеко не самый высокочастотный чип Intel, взяла крайне специфичный тест и СУБД, и провела тестирование, гордо заявляя о превосходстве ARM Vera над x86 Intel Xeon 6. Браво, Хуанг!
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14🍾5💅3
AMD начала подготовку открытого Linux-драйвера к видеокартам с GDDR7. В свежих патчах AMDGPU появился отдельный идентификатор GDDR7, а вместе с ним — поддержка новых аппаратных блоков, которые связаны с будущей архитектурой RDNA 5. Пока это не означает анонс конкретных видеокарт — AMD лишь постепенно добавляет поддержку будущего железа в ядро Linux, но уже очевидно, что грядущее поколение Radeon обзаведется топовыми чипами VRAM.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍22🌭4💅2
MSI представила EdgeMesa N AI+ — компактный ИИ-ПК на базеNVIDIA RTX Spark N1X. Внутри 20-процессорных ядер от Grace, GPU Blackwell на 6144 CUDA-ядер и 128 ГБ унифицированной памяти LPDDR5X.
MSI оснастила EdgeMesa N AI+ накопителем NVMe до 4 ТБ, набором портов, включающим 4x USB-C 20 Гбит/с, причем 3 из них поддерживают DisplayPort 1.4 Alt Mode, а также HDMI 2.1b и встроенный 10GbE. Для беспроводной связи предусмотрены Wi-Fi 7 и Bluetooth 5.4. Охлаждение базируется на одной испарительной камере и тихом вентиляторе.
MSI пока не раскрыла цену, точные конфигурации памяти и дату начала продаж EdgeMesa N AI+.
😅 Канал Serverflow в MAX: Подписаться
MSI оснастила EdgeMesa N AI+ накопителем NVMe до 4 ТБ, набором портов, включающим 4x USB-C 20 Гбит/с, причем 3 из них поддерживают DisplayPort 1.4 Alt Mode, а также HDMI 2.1b и встроенный 10GbE. Для беспроводной связи предусмотрены Wi-Fi 7 и Bluetooth 5.4. Охлаждение базируется на одной испарительной камере и тихом вентиляторе.
MSI пока не раскрыла цену, точные конфигурации памяти и дату начала продаж EdgeMesa N AI+.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯8👍5🍾1
Alibaba на конференции Apsara официально анонсировала новое поколение ИИ-моделей Qwen4-27B, Qwen4-Flash, Qwen4-Max и Qwen4-Plus. Все нейронки, по заявлению компании, выйдут в ближайшее время.
Компания также планирует увеличить количество параметров до 5-10 триллионов в поколениях Qwen 4.5 и Qwen 5.
😅 Канал Serverflow в MAX: Подписаться
Компания также планирует увеличить количество параметров до 5-10 триллионов в поколениях Qwen 4.5 и Qwen 5.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍25🤯6🍾5💅2
Компания T-Head (дочка Alibaba) представила Zhenwu V900 — свой новый ИИ-ускоритель подразделения, который компания называет самым мощным китайским чипом для ИИ на сегодняшний день. По заявлению T-Head, V900 примерно в 3 раза производительнее Zhenwu M890, предыдущего ускорителя компании.
Внутри V900 установлено 216 ГБ HBM-памяти местного производства, а сам ускоритель поддерживает вычисления в форматах FP8 и FP4. Для связи между чипами предусмотрен межчиповый интерконнект с пропускной способностью 1,2 ТБ/с. Пока полные характеристики чипа неизвестны, но их должны раскрыть в ближайшее время.
Серийное производство и выход V900 на рынок запланированы на первый квартал 2027 года. Alibaba также рассчитывает строить на его основе крупные кластеры — конфигурации могут включать до 500 000 ускорителей.
Одновременно T-Head уже раскрыла следующий этап развития линейки. Ускоритель Zhenwu J900 должен появиться в третьем квартале 2028 года. Параллельно компания готовит собственные серверные CPU Yitian 720 и Yitian 730, ориентированные на агентный ИИ. Их выпуск ожидается в 2027 году, причем Yitian 730 должен стать первым процессором T-Head на собственной микроархитектуре.
😅 Канал Serverflow в MAX: Подписаться
Внутри V900 установлено 216 ГБ HBM-памяти местного производства, а сам ускоритель поддерживает вычисления в форматах FP8 и FP4. Для связи между чипами предусмотрен межчиповый интерконнект с пропускной способностью 1,2 ТБ/с. Пока полные характеристики чипа неизвестны, но их должны раскрыть в ближайшее время.
Серийное производство и выход V900 на рынок запланированы на первый квартал 2027 года. Alibaba также рассчитывает строить на его основе крупные кластеры — конфигурации могут включать до 500 000 ускорителей.
Одновременно T-Head уже раскрыла следующий этап развития линейки. Ускоритель Zhenwu J900 должен появиться в третьем квартале 2028 года. Параллельно компания готовит собственные серверные CPU Yitian 720 и Yitian 730, ориентированные на агентный ИИ. Их выпуск ожидается в 2027 году, причем Yitian 730 должен стать первым процессором T-Head на собственной микроархитектуре.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9🌭4🤯1
ServerFlow | Новости и Железо 💾
Компания T-Head (дочка Alibaba) представила Zhenwu V900 — свой новый ИИ-ускоритель подразделения, который компания называет самым мощным китайским чипом для ИИ на сегодняшний день. По заявлению T-Head, V900 примерно в 3 раза производительнее Zhenwu M890, предыдущего…
Media is too big
VIEW IN TELEGRAM
Презентация ИИ-чипов Zhenwu V900 и стоечной инфраструктуры на их базе в стиле Nvidia 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯7👍3🍾3
В логах Microsoft Azure появились ИИ-модели GPT 6 Sol, GPT 6 Luna и GPT 6 Astra Minor 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💅15👍5🤯1
Сообщается, что Micron прекращает производство 2-ГБ микросхем GDDR7, используемых в видеокартах GeForce RTX 50. Возможно, это связано с перебросом ресурсов на выпуск памяти HBM. Выпуск 3-ГБ чипов GDDR7 при этом прдолжается.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯12👍2💅1
Anthropic представила Claude Opus 5.5 — свою новую флагманскую ИИ-модель семейства Opus, которая превосходит даже решения семейства Claude Fable, при этом стоит значительно дешевле своего старшего собрата.
В тестах Claude Opus 5.5 набрала 66,4% в Terminal-Bench 4.0, против 55,8% у Fable 5.1, 52,3% у Opus 5, 57,9% у GPT-6 Astra и 37,3% у GPT-5.6 Sol. В FrontierCode v1.1 результат составил 54,4% против 50,3% у Fable 5.1, 48,0% у Opus 5, 53,3% у GPT-6 Astra и 47,5% у GPT-5.6 Sol.
В задачах профессиональной работы Opus 5.5 получила 1846 Elo в GDPval-AA v2.1, где Fable 5.1 набрала 1735, Opus 5 — 1708, GPT-6 Astra — 1542, а GPT-5.6 Sol — 1588. В AutomationBench результат составил 40,0% против 31,4% у Fable 5.1, 26,9% у Opus 5, 41,4% у GPT-6 Astra и 28,8% у GPT-5.6 Sol.
Цена на Claude Opus 5.5 в API: $4 за млн входных и $20 за млн выходных токенов. Для Claude Code и платформы Claude также доступен быстрый режим Opus 5.5 с ускорением до 2,5 раза, который стоит стоит $8 за млн входных и $40 за млн выходных токенов.
В ближайшие недели Anthropic также планирует представить Claude Sonnet 5.5 и Claude Haiku 5.5.
😅 Канал Serverflow в MAX: Подписаться
В тестах Claude Opus 5.5 набрала 66,4% в Terminal-Bench 4.0, против 55,8% у Fable 5.1, 52,3% у Opus 5, 57,9% у GPT-6 Astra и 37,3% у GPT-5.6 Sol. В FrontierCode v1.1 результат составил 54,4% против 50,3% у Fable 5.1, 48,0% у Opus 5, 53,3% у GPT-6 Astra и 47,5% у GPT-5.6 Sol.
В задачах профессиональной работы Opus 5.5 получила 1846 Elo в GDPval-AA v2.1, где Fable 5.1 набрала 1735, Opus 5 — 1708, GPT-6 Astra — 1542, а GPT-5.6 Sol — 1588. В AutomationBench результат составил 40,0% против 31,4% у Fable 5.1, 26,9% у Opus 5, 41,4% у GPT-6 Astra и 28,8% у GPT-5.6 Sol.
Цена на Claude Opus 5.5 в API: $4 за млн входных и $20 за млн выходных токенов. Для Claude Code и платформы Claude также доступен быстрый режим Opus 5.5 с ускорением до 2,5 раза, который стоит стоит $8 за млн входных и $40 за млн выходных токенов.
В ближайшие недели Anthropic также планирует представить Claude Sonnet 5.5 и Claude Haiku 5.5.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12💩4🌭1🍾1
Claude Opus 5.5 занимает первое место в рейтинге Artificial Analysis 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9