ServerFlow | Новости и Железо 💾
5.19K subscribers
5.34K photos
420 videos
12 files
2.71K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
Кажется, Яндекс решил плотно вкатиться в нейронки — компания представила новую базовую языковую модель AliceAI-Foundation-80B-A3B-Base с гибридной архитектурой и MoE-экспертами. Объем модели 80 млрд общих параметров, но для обработки каждого токена активируются только 3 млрд, а контекстное достигает 262 144 токенов.

В архитектуре используется 48 слоёв, 512 экспертов MoE с выбором 10 экспертов на токен, а словарь нейронки достигает 129 024 токена. Для обработки длинного контекста используются механизмы KDA и Gated Attention, а также один слой MTP.

В тестах AliceAI особенно сильна на русскоязычных данных. Она набрала 86,5% в WikiWebFacts против 62,4% у Qwen3.5-35B-A3B, 70,2% у GLM-4.5-Air, 72,8% у Nemotron-3-Super и 83,2% у DeepSeek-V4-Flash. В HardMultiQA результат составил 67,9% против 47,2%, 48,6%, 54,5% и 65,4% соответственно.

При сложном рассуждении модель получила 96,7% в AIME 2026 pass@32 против 96,7% у Qwen3.5-35B-A3B и 90% у Nemotron-3-Super. В HMMT 2026 результат AliceAI составил 96,9% против 87,9% и 66,7%, а в IMO Answerbench — 88,7% против 84,5% и 64,5%. В CodeForces CPP AliceAI набрала 68,9%, уступив Qwen3.5 с 73,7%, но опередив Nemotron с 56,6%.

Веса доступны на Hugging Face.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍22💩9🍾8💅1
SpaceXAI представила новую флагманскую ИИ-модель Grok 4.7, которая на голову обходит Grok 4.6 при той же стоимости API и превосходит GPT 5.6 Sol и Fable 5.1 в ряде задач при кратно меньшей цене за токены.

Модель отлично справляется с повседневными сценариями использования, работой с длинным контекстом при окне в 500 тыс токенов, а также она неплоха в юриспруденции, инженерии, 3D-дизайне и других тасках. Однако в кодинге, сложных логических сценариях, математике и науке она все же уступает более мощным конкурентам от OpenAI и Anthropic.

Grok 4.7 уже доступен в Cursor и Grok Build, а также в Grok API: $2 за млн входных токенов и $6 за млн выходных токенов.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6
This media is not supported in your browser
VIEW IN TELEGRAM
Grok 4.7 не оправдал ожидания юзеров — в 3D-моделировании нейронка значительно уступает даже открытой Kimi K3. Иронично, что в качестве примера моделировали запуск ракеты…

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯24💩2💅2
Nvidia GeForce RTX исполняется 8 лет. Легендарные RTX 2080 Ti и RTX 2080 вышли в сентябре 2018 года. Как быстро летит время…

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾19💩3
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾12👍8💅1
ARM Vera 🆚 x86 Xeon 6900P

Nvidia продолжает пытаться доказывать всем, что их новейший CPU Vera на архитектуре ARM лучше x86 решений конкурентов. В прошлый раз компания проверяла свой топовый чип в общих процессорных бенчмарках, а в этот раз дело дошло до производительности в базах данных. В качестве x86-конкурента взяли 96-ядерный Intel Xeon 6952P Granite Rapids (судя по характеристикам, в сравнении не указан конкретный чип). Давайте ознакомимся с характеристиками этих процессоров:

🚗 NVIDIA Vera (88c/176t, до 4.0GHz, 250-450W)

😎 Intel Xeon 6952P (96c/192t, 2.1GHz-3.9GHz, 400W)

Nvidia до сих пор не раскрыла тактовой частоты Nvidia Vera, но очевидно, что она никак не может быть меньше частоты Grace (3.1-3.6 ГГц), поэтому можно предположить, что ядра Vera будут работать как минимум в диапазоне 3.1-4.0 ГГц, и это априори ставит Nvidia в выгодное положение относительно Intel Xeon 6952P, ведь именно от базовой тактовой частоты зависит производительность чипа в СУБД.

Производительность меряли по двум версиям СУБД DuckDB (1.5.5 и 2.0.0-alpha) в тесте TPC-H, который проверяет производительность систем на сложных аналитических запросах и обработке больших массивов данных. 

Конечно, не самый популярный выбор базы данных, и многих скорее интересует производительность Vera в MySQL, PostgreSQL или Microsoft SQL Server, но Nvidia намеренно выбрала эту базу данных.


DuckDB — это очень специфичная СУБД, которая подходит скорее для задач аналитики больших объемов данных, нежели для более приземленных сценариев, для подключения 1С или к сайту она точно не подойдет. Это СУБД для BigData-инфраструктур, а не для бизнеса, и это вносит свою лепту.

Обе системы имели технологию многопоточности (Spatial Multithreading у Nvidia / Hyper-Threading у Intel), имели по 768 ГБ оперативной памяти (LPDDR5X у Nvidia / DDR5 у Intel), SSD объемом более 3 ТБ и работали под управлением Ubuntu 26.04. Итак, какие результаты?

🦆 В стабильной DuckDB 1.5.5 — 2,48 млн баллов у Vera против 1,67 млн баллов у Xeon, преимущество Nvidia составило около 48%.

🦆 В тестовой DuckDB 2.0.0-alpha — 3,07 млн баллов у Vera против 2,11 млн баллов у Xeon, преимущество Nvidia составило около 46%.

Важно, что это не официальный сертифицированный результат TPC-H: тестирование проводилось при сотрудничестве DuckDB и NVIDIA, а при официальной аудированной публикации TPC.


То есть, Nvidia взяла далеко не самый высокочастотный чип Intel, взяла крайне специфичный тест и СУБД, и провела тестирование, гордо заявляя о превосходстве ARM Vera над x86 Intel Xeon 6. Браво, Хуанг!

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14🍾5💅3
AMD начала подготовку открытого Linux-драйвера к видеокартам с GDDR7. В свежих патчах AMDGPU появился отдельный идентификатор GDDR7, а вместе с ним — поддержка новых аппаратных блоков, которые связаны с будущей архитектурой RDNA 5. Пока это не означает анонс конкретных видеокарт — AMD лишь постепенно добавляет поддержку будущего железа в ядро Linux, но уже очевидно, что грядущее поколение Radeon обзаведется топовыми чипами VRAM.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍22🌭4💅2
MSI представила EdgeMesa N AI+ — компактный ИИ-ПК на базеNVIDIA RTX Spark N1X. Внутри 20-процессорных ядер от Grace, GPU Blackwell на 6144 CUDA-ядер и 128 ГБ унифицированной памяти LPDDR5X.

MSI оснастила EdgeMesa N AI+ накопителем NVMe до 4 ТБ, набором портов, включающим 4x USB-C 20 Гбит/с, причем 3 из них поддерживают DisplayPort 1.4 Alt Mode, а также HDMI 2.1b и встроенный 10GbE. Для беспроводной связи предусмотрены Wi-Fi 7 и Bluetooth 5.4. Охлаждение базируется на одной испарительной камере и тихом вентиляторе.

MSI пока не раскрыла цену, точные конфигурации памяти и дату начала продаж EdgeMesa N AI+.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯8👍5🍾1
Alibaba на конференции Apsara официально анонсировала новое поколение ИИ-моделей Qwen4-27B, Qwen4-Flash, Qwen4-Max и Qwen4-Plus. Все нейронки, по заявлению компании, выйдут в ближайшее время.

Компания также планирует увеличить количество параметров до 5-10 триллионов в поколениях Qwen 4.5 и Qwen 5.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍25🤯6🍾5💅2
Компания T-Head (дочка Alibaba) представила Zhenwu V900 — свой новый ИИ-ускоритель подразделения, который компания называет самым мощным китайским чипом для ИИ на сегодняшний день. По заявлению T-Head, V900 примерно в 3 раза производительнее Zhenwu M890, предыдущего ускорителя компании.

Внутри V900 установлено 216 ГБ HBM-памяти местного производства, а сам ускоритель поддерживает вычисления в форматах FP8 и FP4. Для связи между чипами предусмотрен межчиповый интерконнект с пропускной способностью 1,2 ТБ/с. Пока полные характеристики чипа неизвестны, но их должны раскрыть в ближайшее время.

Серийное производство и выход V900 на рынок запланированы на первый квартал 2027 года. Alibaba также рассчитывает строить на его основе крупные кластеры — конфигурации могут включать до 500 000 ускорителей.

Одновременно T-Head уже раскрыла следующий этап развития линейки. Ускоритель Zhenwu J900 должен появиться в третьем квартале 2028 года. Параллельно компания готовит собственные серверные CPU Yitian 720 и Yitian 730, ориентированные на агентный ИИ. Их выпуск ожидается в 2027 году, причем Yitian 730 должен стать первым процессором T-Head на собственной микроархитектуре.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9🌭4🤯1
В логах Microsoft Azure появились ИИ-модели GPT 6 Sol, GPT 6 Luna и GPT 6 Astra Minor 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💅15👍5🤯1
Сообщается, что Micron прекращает производство 2-ГБ микросхем GDDR7, используемых в видеокартах GeForce RTX 50. Возможно, это связано с перебросом ресурсов на выпуск памяти HBM. Выпуск 3-ГБ чипов GDDR7 при этом прдолжается.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯12👍2💅1
Anthropic представила Claude Opus 5.5 — свою новую флагманскую ИИ-модель семейства Opus, которая превосходит даже решения семейства Claude Fable, при этом стоит значительно дешевле своего старшего собрата.

В тестах Claude Opus 5.5 набрала 66,4% в Terminal-Bench 4.0, против 55,8% у Fable 5.1, 52,3% у Opus 5, 57,9% у GPT-6 Astra и 37,3% у GPT-5.6 Sol. В FrontierCode v1.1 результат составил 54,4% против 50,3% у Fable 5.1, 48,0% у Opus 5, 53,3% у GPT-6 Astra и 47,5% у GPT-5.6 Sol.

В задачах профессиональной работы Opus 5.5 получила 1846 Elo в GDPval-AA v2.1, где Fable 5.1 набрала 1735, Opus 5 — 1708, GPT-6 Astra — 1542, а GPT-5.6 Sol — 1588. В AutomationBench результат составил 40,0% против 31,4% у Fable 5.1, 26,9% у Opus 5, 41,4% у GPT-6 Astra и 28,8% у GPT-5.6 Sol.

Цена на Claude Opus 5.5 в API: $4 за млн входных и $20 за млн выходных токенов. Для Claude Code и платформы Claude также доступен быстрый режим Opus 5.5 с ускорением до 2,5 раза, который стоит стоит $8 за млн входных и $40 за млн выходных токенов.

В ближайшие недели Anthropic также планирует представить Claude Sonnet 5.5 и Claude Haiku 5.5.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12💩4🌭1🍾1
GPT-6 Sol и Luna уже появились в селекторе ChatGPT и Codex 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7
Claude Opus 5.5 занимает первое место в рейтинге Artificial Analysis 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9