Китайская компания CIX представила семейство центральных процессоров ClawCore на архитектуре Armv9.2, которые ориентированы на развертывание агентной среды OpenClaw.
Линейка включает три чипа: 12-ядерный ClawCore-P (3,2 ГГц, до 45 TOPS, до 64 ГБ памяти, уже в продаже), 8-ядерный ClawCore-A (3,0 ГГц, до 80 TOPS, релиз в 2026), а также энергоэффективный ClawCore-E для IoT (характеристики не раскрыты, выход в декабре 2026). Чипы будут использоваться в широком списке устройств: от компактных ИИ-ПК, ноутбуков и рабочих станций до ИИ-серверов и СХД и роботах.
Все чипы имеют интегрированный NPU Zhouyi и поддерживают унифицированную память LPDDR5. Доступен SDK-стэк для быстрого и безопасного развертывания OpenClaw на Windows, Android и Linux. Также компания планирует выпускать платы платы от Radxa и Orange Pi для тестирования и разработки аппаратных решений для периферийного ИИ.
😅 Канал Serverflow в MAX: Подписаться
Линейка включает три чипа: 12-ядерный ClawCore-P (3,2 ГГц, до 45 TOPS, до 64 ГБ памяти, уже в продаже), 8-ядерный ClawCore-A (3,0 ГГц, до 80 TOPS, релиз в 2026), а также энергоэффективный ClawCore-E для IoT (характеристики не раскрыты, выход в декабре 2026). Чипы будут использоваться в широком списке устройств: от компактных ИИ-ПК, ноутбуков и рабочих станций до ИИ-серверов и СХД и роботах.
Все чипы имеют интегрированный NPU Zhouyi и поддерживают унифицированную память LPDDR5. Доступен SDK-стэк для быстрого и безопасного развертывания OpenClaw на Windows, Android и Linux. Также компания планирует выпускать платы платы от Radxa и Orange Pi для тестирования и разработки аппаратных решений для периферийного ИИ.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤯2👍1 1
⚛️ HPE GX5000: до 640 CPU Vera в стойке и InfiniBand 800 Гбит/с
HPE представила новые HPC-узлы на базе CPU Nvidia Vera в составе платформы Cray Supercomputing GX5000. Blade-серверы GX240 могут нести до 16 процессоров Vera (88 ядер каждый), а одна стойка масштабируется до 40 узлов — это до 640 CPU и 56 320 ядер Olympus с жидкостным охлаждением. Поставки ожидаются в 2027 году, среди ранних пользователей — национальные лаборатории США и крупнейшие HPC-центры.
Параллельно HPE готовит OCP-системы Compute XD700 на базе HGX Rubin NVL8: до 128 GPU Rubin в стойке для обучения и инференса LLM. Эти решения выйдут в начале 2027 года и дополнят CPU-кластеры Vera в рамках единой инфраструктуры ИИ-ЦОД.
😅 Канал Serverflow в MAX: Подписаться
HPE представила новые HPC-узлы на базе CPU Nvidia Vera в составе платформы Cray Supercomputing GX5000. Blade-серверы GX240 могут нести до 16 процессоров Vera (88 ядер каждый), а одна стойка масштабируется до 40 узлов — это до 640 CPU и 56 320 ядер Olympus с жидкостным охлаждением. Поставки ожидаются в 2027 году, среди ранних пользователей — национальные лаборатории США и крупнейшие HPC-центры.
Для межсоединений услов используются коммутаторы Quantum-X800 InfiniBand с 144 портами и скоростью до 800 Гбит/с. Такая конфигурация рассчитана на плотные CPU-кластеры под ИИ и HPC-нагрузки, где важны максимальная пропускная способность памяти и высочайшая масштабируемость внутри стойки.
Параллельно HPE готовит OCP-системы Compute XD700 на базе HGX Rubin NVL8: до 128 GPU Rubin в стойке для обучения и инференса LLM. Эти решения выйдут в начале 2027 года и дополнят CPU-кластеры Vera в рамках единой инфраструктуры ИИ-ЦОД.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍2
Micron Technology заявила, что автомобили с автопилотом уровня L4 (полная автоматизация вождения) в будущем будут требовать 300+ ГБ DRAM на борт. Для сравнения, сегодня в большинстве машин с автопилотом стоит около 16 ГБ оперативки.
Такие объемы нужны для обработки потоков с камер, лидаров и радаров в реальном времени, плюс для работы локальных ИИ-моделей и хранения их контекста. По сути, машины будут превращаться в локальный ИИ-сервер, а память становится критическим узким местом наряду с мощностями GPU/NPU. Аналогичные требования ожидаются и у гуманоидных роботов, где требуемый объем DRAM будет сопоставим с автомобилями.
😅 Канал Serverflow в MAX: Подписаться
Такие объемы нужны для обработки потоков с камер, лидаров и радаров в реальном времени, плюс для работы локальных ИИ-моделей и хранения их контекста. По сути, машины будут превращаться в локальный ИИ-сервер, а память становится критическим узким местом наряду с мощностями GPU/NPU. Аналогичные требования ожидаются и у гуманоидных роботов, где требуемый объем DRAM будет сопоставим с автомобилями.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Anthropic ищут специалистов по химическому оружию и вызрывчатке большой мощности с зарплатой до $285 000 в год. Зачем...?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍3
🔥 Huawei Atlas 350 быстрее H20 до 2,8 раз в ИИ-инференсе
Китайский гигант Huawei представил долгожданное продолжение своей линейки ИИ-решений семейства Atlas — ИИ-ускоритель Atlas 350 на базе NPU Ascend 950PR (7-нм SMIC). По заявлениям компании, новая карточка в 2,8 раз производительнее в инференсе, чем урезанная NVIDIA H20 для китайского рынка.
Atlas 350 оснащен 112 ГБ HiZQ HBM собственной разработки с пропускной способностью ~1,6 ТБ/с, что сопоставимо со скоростью HBM2, обеспечивающей 1,55 ТБ/с.
Похоже, что Huawei Atlas 350 стал новым флагманом среди китайских ИИ-ускорителей! ServerFlow обязательно начнут поставки этого монстра сразу после их выхода в продажу!
😅 Канал Serverflow в MAX: Подписаться
Китайский гигант Huawei представил долгожданное продолжение своей линейки ИИ-решений семейства Atlas — ИИ-ускоритель Atlas 350 на базе NPU Ascend 950PR (7-нм SMIC). По заявлениям компании, новая карточка в 2,8 раз производительнее в инференсе, чем урезанная NVIDIA H20 для китайского рынка.
Ускоритель Atlas 350 стал первым китайским ИИ-решением с поддержкой режима вычислений FP4, и выдает в нем 1,56 PFLOPS производительности. Еще Atlas 350 поддерживает режим FP8, обеспечивая производительность в 1 PFLOPS. По сути, это выводит Atlas 350 в один сегмент с Nvidia H100 SXM, которые обеспечивают 989 TFLOPS в FP8. Также поддерживаются режимы. Также поддерживаются форматы FP32, FP16/BF16, MXFP8 и MXFP4, однако производительность не уточняется.
Atlas 350 оснащен 112 ГБ HiZQ HBM собственной разработки с пропускной способностью ~1,6 ТБ/с, что сопоставимо со скоростью HBM2, обеспечивающей 1,55 ТБ/с.
Архитектура ускорителя оптимизирована под стадию префилла, снижая задержку генерации первого токена и обеспечивая высочайшую эффективность в ИИ-задачах реального времени. В инфраструктуре Huawei Atlas 350 будет работать в рамках кластеров Atlas 950, объединяющих до 8192 NPU и обеспечивающих производительность до 8 EFLOPS FP8 на систему.
Похоже, что Huawei Atlas 350 стал новым флагманом среди китайских ИИ-ускорителей! ServerFlow обязательно начнут поставки этого монстра сразу после их выхода в продажу!
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍5
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️
Сегодня у нас обзор Huawei Atlas 300i Duo - запускаем и квантизуем Qwen3 на Ascend NPU!
Это и многое другое вы узнаете в новом видео!
Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://youtu.be/O16C0HGbgyU?si=qVreLBpQSvVDy8Gk
Канал Serverflow в MAX: Подписаться
Сегодня у нас обзор Huawei Atlas 300i Duo - запускаем и квантизуем Qwen3 на Ascend NPU!
- Установка драйверов, firmware и CANN
- Квантизация Qwen3 32B и Qwen3-30B-A3B
- Запуск моделей через MindIE и тесты в OpenWebUI
- Сравнение скорости до и после квантизации
- Разбор возможностей Huawei Atlas 300i Duo для локального запуска LLM
Это и многое другое вы узнаете в новом видео!
Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://youtu.be/O16C0HGbgyU?si=qVreLBpQSvVDy8Gk
Канал Serverflow в MAX: Подписаться
YouTube
Запуск Qwen-30B-A3B Q8 на Huawei Atlas 300i Duo - но есть нюанс😆
В этом видео смотрим на Huawei Atlas 300i Duo 96GB и показываем, как устроен запуск нейросетей на ускорителях Huawei Ascend. Проходим весь путь от установки драйверов, обновления firmware и установки CANN до запуска моделей через MindIE в Docker.
Главная…
Главная…
1👍7🤯4🌭3
Qwen 3.5 вышел🏃♂️
В СерверФлоу вышел гайд по квантизации Qwen3 ✅
———-
Atlas 350 вышел🏃♂️
В СерверФлоу вышел гайд по Atlas 300i duo ✅
Честно хотел в коммент написать, получился перебор метаиронии в рамках поста)
P.S Qwen 3.5 на Huawei Atlas 300i Duo не запустился даже на свежих драйверах. По логам было видно, что текущая версия MindIE пока просто не распознаёт архитектуру Qwen 3.5 как поддерживаемый тип модели
В СерверФлоу вышел гайд по квантизации Qwen3 ✅
———-
Atlas 350 вышел🏃♂️
В СерверФлоу вышел гайд по Atlas 300i duo ✅
Честно хотел в коммент написать, получился перебор метаиронии в рамках поста)
P.S Qwen 3.5 на Huawei Atlas 300i Duo не запустился даже на свежих драйверах. По логам было видно, что текущая версия MindIE пока просто не распознаёт архитектуру Qwen 3.5 как поддерживаемый тип модели
3 5
Intel Core Ultra 9 290K Plus засветился в новых тестах Geekbench с результатом около 3 535 баллов в одноядерном производительности (по более ранним прогонам ~3 450-3 500). Это примерно +10% к предыдущему 285K и фактически выводит чип в лидеры среди настольных CPU в этом бенчмарке. В многопотоке прирост тоже +10-11%, но в играх ситуация, скорее всего, останется прежней
Конфигурация осталась прежней — 24 ядра (8P + 16E), но добавили частоты (до ~5,8 ГГц в бусте) и слегка подтянули скорость интерконнекта с памятью. В тестах использовалась DDR5-6800/8000, что тоже влияет на результат, но ключевой прирост — именно за счет частот и оптимизаций архитектуры Arrow Lake Refresh. Тем не менее, Ryzen X3D от AMD все еще впереди за счет большого объема кеша.
😅 Канал Serverflow в MAX: Подписаться
Конфигурация осталась прежней — 24 ядра (8P + 16E), но добавили частоты (до ~5,8 ГГц в бусте) и слегка подтянули скорость интерконнекта с памятью. В тестах использовалась DDR5-6800/8000, что тоже влияет на результат, но ключевой прирост — именно за счет частот и оптимизаций архитектуры Arrow Lake Refresh. Тем не менее, Ryzen X3D от AMD все еще впереди за счет большого объема кеша.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
ServerFlow | Новости и Железо 💾
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️ Сегодня у нас обзор Huawei Atlas 300i Duo - запускаем и квантизуем Qwen3 на Ascend NPU! - Установка драйверов, firmware и CANN - Квантизация Qwen3 32B и Qwen3-30B-A3B - Запуск моделей через MindIE и тесты в OpenWebUI - Сравнение…
Инфа для тех кто пришел с видеоролика #atlas300iduo
Прикладываем файлы:
Сегодня еще допишем текстовый гайд по запуску квантизации, позже отправим ссылку.
Вот ссылка на ftp для скачивания файлов
Файлы в посте ниже👇
Прикладываем файлы:
- Калибровочные json файлы для запуска скрипта
- Python скрипт для квантизации MoE модели
Сегодня еще допишем текстовый гайд по запуску квантизации, позже отправим ссылку.
Вот ссылка на ftp для скачивания файлов
Файлы в посте ниже👇
👍1
Nvidia официально зарелизила NemoClaw, но пока только в собственной веб-среде NVIDIA Brev Launchable. Хуанг говорил, что NemoClaw будет открытым и бесплатным, но не уточнял когда...
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🌭1