ServerFlow | Новости и Железо 💾
4.23K subscribers
4.85K photos
386 videos
12 files
2.35K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
🔥 Huawei Atlas 350 быстрее H20 до 2,8 раз в ИИ-инференсе

Китайский гигант Huawei представил долгожданное продолжение своей линейки ИИ-решений семейства Atlas — ИИ-ускоритель Atlas 350 на базе NPU Ascend 950PR (7-нм SMIC). По заявлениям компании, новая карточка в 2,8 раз производительнее в инференсе, чем урезанная NVIDIA H20 для китайского рынка.

Ускоритель Atlas 350 стал первым китайским ИИ-решением с поддержкой режима вычислений FP4, и выдает в нем 1,56 PFLOPS производительности. Еще Atlas 350 поддерживает режим FP8, обеспечивая производительность в 1 PFLOPS. По сути, это выводит Atlas 350 в один сегмент с Nvidia H100 SXM, которые обеспечивают 989 TFLOPS в FP8. Также поддерживаются режимы. Также поддерживаются форматы FP32, FP16/BF16, MXFP8 и MXFP4, однако производительность не уточняется.


Atlas 350 оснащен 112 ГБ HiZQ HBM собственной разработки с пропускной способностью ~1,6 ТБ/с, что сопоставимо со скоростью HBM2, обеспечивающей 1,55 ТБ/с.

Архитектура ускорителя оптимизирована под стадию префилла, снижая задержку генерации первого токена и обеспечивая высочайшую эффективность в ИИ-задачах реального времени. В инфраструктуре Huawei Atlas 350 будет работать в рамках кластеров Atlas 950, объединяющих до 8192 NPU и обеспечивающих производительность до 8 EFLOPS FP8 на систему.


Похоже, что Huawei Atlas 350 стал новым флагманом среди китайских ИИ-ускорителей! ServerFlow обязательно начнут поставки этого монстра сразу после их выхода в продажу!

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍5
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️


Сегодня у нас обзор Huawei Atlas 300i Duo - запускаем и квантизуем Qwen3 на Ascend NPU!

- Установка драйверов, firmware и CANN
- Квантизация Qwen3 32B и Qwen3-30B-A3B
- Запуск моделей через MindIE и тесты в OpenWebUI
- Сравнение скорости до и после квантизации
- Разбор возможностей Huawei Atlas 300i Duo для локального запуска LLM


Это и многое другое вы узнаете в новом видео!

Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)

Смотреть: https://youtu.be/O16C0HGbgyU?si=qVreLBpQSvVDy8Gk

Канал Serverflow в MAX: Подписаться
1👍7🤯4🌭3
Qwen 3.5 вышел🏃‍♂️

В СерверФлоу вышел гайд по квантизации Qwen3


———-

Atlas 350 вышел🏃‍♂️

В СерверФлоу вышел гайд по Atlas 300i duo


Честно хотел в коммент написать, получился перебор метаиронии в рамках поста)

P.S Qwen 3.5 на Huawei Atlas 300i Duo не запустился даже на свежих драйверах. По логам было видно, что текущая версия MindIE пока просто не распознаёт архитектуру Qwen 3.5 как поддерживаемый тип модели
35
Intel Core Ultra 9 290K Plus засветился в новых тестах Geekbench с результатом около 3 535 баллов в одноядерном производительности (по более ранним прогонам ~3 450-3 500). Это примерно +10% к предыдущему 285K и фактически выводит чип в лидеры среди настольных CPU в этом бенчмарке. В многопотоке прирост тоже +10-11%, но в играх ситуация, скорее всего, останется прежней

Конфигурация осталась прежней — 24 ядра (8P + 16E), но добавили частоты (до ~5,8 ГГц в бусте) и слегка подтянули скорость интерконнекта с памятью. В тестах использовалась DDR5-6800/8000, что тоже влияет на результат, но ключевой прирост — именно за счет частот и оптимизаций архитектуры Arrow Lake Refresh. Тем не менее, Ryzen X3D от AMD все еще впереди за счет большого объема кеша.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Рост TDP графических ускорителей Nvidia 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11
ServerFlow | Новости и Железо 💾
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️ Сегодня у нас обзор Huawei Atlas 300i Duo - запускаем и квантизуем Qwen3 на Ascend NPU! - Установка драйверов, firmware и CANN - Квантизация Qwen3 32B и Qwen3-30B-A3B - Запуск моделей через MindIE и тесты в OpenWebUI - Сравнение…
Инфа для тех кто пришел с видеоролика #atlas300iduo

Прикладываем файлы:
- Калибровочные json файлы для запуска скрипта
- Python скрипт
для квантизации MoE модели


Сегодня еще допишем текстовый гайд по запуску квантизации, позже отправим ссылку.

Вот ссылка на ftp для скачивания файлов

Файлы в посте ниже👇
👍1
Nvidia официально зарелизила NemoClaw, но пока только в собственной веб-среде NVIDIA Brev Launchable. Хуанг говорил, что NemoClaw будет открытым и бесплатным, но не уточнял когда...

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🌭1
This media is not supported in your browser
VIEW IN TELEGRAM
Дженсен Хуанг заявил, что индустрия уже достигла уровня AGI 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭21
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic добавила функцию использования компьютера в Claude. Нейронка теперь может открывать приложения, управлять браузером, заполняит электронные таблицы и выполнять другие действия прямо на вашем устройстве. Функция доступна в Claude Cowork и Claude Code по тарифам Pro и Max, пока что только для macOS. Да, теперь Claude — это буквально платный OpenClaw.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Марк Цукерберг заявил, что его команда работает над ИИ-агентом, который будет выполнять его работу на посту CEO Meta*. На самом деле, вряд ли кто-то почувствует разницу, но будем иметь ввиду...

*Деятельность Meta Platforms Inc. в России признана экстремистской и запрещена

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯11
Сэм Альтман планирует добавить в ChatGPT “взрослый режим”, который отключает ограничители нейронки на генерацию изображений характера 18+. Многие сотрудники OpenAI встретили такие планы с большой критикой — они обеспокоены, что у пользователей чат-бота появится нездоровая зависимость от общения с GPT. Эти опасения более чем оправданы — по статистике, уже 10-14 млн человек проводят в ChatGPT более 4-5 часов в день для удовлетворения потребности в общении и заполнении “эмоциональной пустоты”, постепенно отдаляясь от других людей и реального мира, что уже неоднократно приводило к трагическому исходу с последующими судебными тяжбами для OpenAI.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯2
Какими будут GPU-ускорители после архитектуры Nvidia Feryman 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
3👍2
Завтра выходит ARC-AGI-3 — первый интерактивный бенчмарк для оценки способности к логическому мышлению, созданный для тестирования искусственного интеллекта на уровне человеческого интеллекта. Тест включает 1000 уровней в более чем 150 нишах, требующих исследования, обучения, планирования и адаптации.

Наивысший результат на ARC-AGI-1 на данный момент — 98 % у Gemini 3.1 Pro, а на ARC-AGI-2 — 84,6 % у Gemini 3 Deep Think, но скоро вскроется их реальная производительность в самом сложном тесте.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
🔥 Arm выходит на рынок CPU с собственным чипом для ИИ

Arm представила первый центральный процессор под своей маркой. Чип получил название Arm AGI и он ориентирован на агентный искусственный интеллект.

Чип построен на 136 ядрах Neoverse V3 на кристалл, тактовая частота достигает ~3,7 ГГц, кэш L2 в 2 МБ на ядро. Используется двухкристальная компоновка, техпроцесс 3 нм TSMC, есть поддержка памяти DDR5‑8800, 96 линий PCIe 6.0 и CXL 3.0 — все для масштабирования высокопараллельных ИИ-задач и больших объемов памяти на сокет.

Это стратегический сдвиг: компания перестает только лицензировать энергоэффективную архитектуру CPU и начинает предлагать собственные чипы для серверов и ИИ‑вычислений.


AGI CPU будет использоваться гиперскелерами для выполнения высокопроизводительных ИИ‑вычислений вместе с GPU и другими ИИ-ускорителями. Начало производства намечено на вторую половину 2026 года.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3