Micron Technology заявила, что автомобили с автопилотом уровня L4 (полная автоматизация вождения) в будущем будут требовать 300+ ГБ DRAM на борт. Для сравнения, сегодня в большинстве машин с автопилотом стоит около 16 ГБ оперативки.
Такие объемы нужны для обработки потоков с камер, лидаров и радаров в реальном времени, плюс для работы локальных ИИ-моделей и хранения их контекста. По сути, машины будут превращаться в локальный ИИ-сервер, а память становится критическим узким местом наряду с мощностями GPU/NPU. Аналогичные требования ожидаются и у гуманоидных роботов, где требуемый объем DRAM будет сопоставим с автомобилями.
😅 Канал Serverflow в MAX: Подписаться
Такие объемы нужны для обработки потоков с камер, лидаров и радаров в реальном времени, плюс для работы локальных ИИ-моделей и хранения их контекста. По сути, машины будут превращаться в локальный ИИ-сервер, а память становится критическим узким местом наряду с мощностями GPU/NPU. Аналогичные требования ожидаются и у гуманоидных роботов, где требуемый объем DRAM будет сопоставим с автомобилями.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Anthropic ищут специалистов по химическому оружию и вызрывчатке большой мощности с зарплатой до $285 000 в год. Зачем...?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍3
🔥 Huawei Atlas 350 быстрее H20 до 2,8 раз в ИИ-инференсе
Китайский гигант Huawei представил долгожданное продолжение своей линейки ИИ-решений семейства Atlas — ИИ-ускоритель Atlas 350 на базе NPU Ascend 950PR (7-нм SMIC). По заявлениям компании, новая карточка в 2,8 раз производительнее в инференсе, чем урезанная NVIDIA H20 для китайского рынка.
Atlas 350 оснащен 112 ГБ HiZQ HBM собственной разработки с пропускной способностью ~1,6 ТБ/с, что сопоставимо со скоростью HBM2, обеспечивающей 1,55 ТБ/с.
Похоже, что Huawei Atlas 350 стал новым флагманом среди китайских ИИ-ускорителей! ServerFlow обязательно начнут поставки этого монстра сразу после их выхода в продажу!
😅 Канал Serverflow в MAX: Подписаться
Китайский гигант Huawei представил долгожданное продолжение своей линейки ИИ-решений семейства Atlas — ИИ-ускоритель Atlas 350 на базе NPU Ascend 950PR (7-нм SMIC). По заявлениям компании, новая карточка в 2,8 раз производительнее в инференсе, чем урезанная NVIDIA H20 для китайского рынка.
Ускоритель Atlas 350 стал первым китайским ИИ-решением с поддержкой режима вычислений FP4, и выдает в нем 1,56 PFLOPS производительности. Еще Atlas 350 поддерживает режим FP8, обеспечивая производительность в 1 PFLOPS. По сути, это выводит Atlas 350 в один сегмент с Nvidia H100 SXM, которые обеспечивают 989 TFLOPS в FP8. Также поддерживаются режимы. Также поддерживаются форматы FP32, FP16/BF16, MXFP8 и MXFP4, однако производительность не уточняется.
Atlas 350 оснащен 112 ГБ HiZQ HBM собственной разработки с пропускной способностью ~1,6 ТБ/с, что сопоставимо со скоростью HBM2, обеспечивающей 1,55 ТБ/с.
Архитектура ускорителя оптимизирована под стадию префилла, снижая задержку генерации первого токена и обеспечивая высочайшую эффективность в ИИ-задачах реального времени. В инфраструктуре Huawei Atlas 350 будет работать в рамках кластеров Atlas 950, объединяющих до 8192 NPU и обеспечивающих производительность до 8 EFLOPS FP8 на систему.
Похоже, что Huawei Atlas 350 стал новым флагманом среди китайских ИИ-ускорителей! ServerFlow обязательно начнут поставки этого монстра сразу после их выхода в продажу!
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍5
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️
Сегодня у нас обзор Huawei Atlas 300i Duo - запускаем и квантизуем Qwen3 на Ascend NPU!
Это и многое другое вы узнаете в новом видео!
Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://youtu.be/O16C0HGbgyU?si=qVreLBpQSvVDy8Gk
Канал Serverflow в MAX: Подписаться
Сегодня у нас обзор Huawei Atlas 300i Duo - запускаем и квантизуем Qwen3 на Ascend NPU!
- Установка драйверов, firmware и CANN
- Квантизация Qwen3 32B и Qwen3-30B-A3B
- Запуск моделей через MindIE и тесты в OpenWebUI
- Сравнение скорости до и после квантизации
- Разбор возможностей Huawei Atlas 300i Duo для локального запуска LLM
Это и многое другое вы узнаете в новом видео!
Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://youtu.be/O16C0HGbgyU?si=qVreLBpQSvVDy8Gk
Канал Serverflow в MAX: Подписаться
YouTube
Запуск Qwen-30B-A3B Q8 на Huawei Atlas 300i Duo - но есть нюанс😆
В этом видео смотрим на Huawei Atlas 300i Duo 96GB и показываем, как устроен запуск нейросетей на ускорителях Huawei Ascend. Проходим весь путь от установки драйверов, обновления firmware и установки CANN до запуска моделей через MindIE в Docker.
Главная…
Главная…
1👍7🤯4🌭3
Qwen 3.5 вышел🏃♂️
В СерверФлоу вышел гайд по квантизации Qwen3 ✅
———-
Atlas 350 вышел🏃♂️
В СерверФлоу вышел гайд по Atlas 300i duo ✅
Честно хотел в коммент написать, получился перебор метаиронии в рамках поста)
P.S Qwen 3.5 на Huawei Atlas 300i Duo не запустился даже на свежих драйверах. По логам было видно, что текущая версия MindIE пока просто не распознаёт архитектуру Qwen 3.5 как поддерживаемый тип модели
В СерверФлоу вышел гайд по квантизации Qwen3 ✅
———-
Atlas 350 вышел🏃♂️
В СерверФлоу вышел гайд по Atlas 300i duo ✅
Честно хотел в коммент написать, получился перебор метаиронии в рамках поста)
P.S Qwen 3.5 на Huawei Atlas 300i Duo не запустился даже на свежих драйверах. По логам было видно, что текущая версия MindIE пока просто не распознаёт архитектуру Qwen 3.5 как поддерживаемый тип модели
3 5
Intel Core Ultra 9 290K Plus засветился в новых тестах Geekbench с результатом около 3 535 баллов в одноядерном производительности (по более ранним прогонам ~3 450-3 500). Это примерно +10% к предыдущему 285K и фактически выводит чип в лидеры среди настольных CPU в этом бенчмарке. В многопотоке прирост тоже +10-11%, но в играх ситуация, скорее всего, останется прежней
Конфигурация осталась прежней — 24 ядра (8P + 16E), но добавили частоты (до ~5,8 ГГц в бусте) и слегка подтянули скорость интерконнекта с памятью. В тестах использовалась DDR5-6800/8000, что тоже влияет на результат, но ключевой прирост — именно за счет частот и оптимизаций архитектуры Arrow Lake Refresh. Тем не менее, Ryzen X3D от AMD все еще впереди за счет большого объема кеша.
😅 Канал Serverflow в MAX: Подписаться
Конфигурация осталась прежней — 24 ядра (8P + 16E), но добавили частоты (до ~5,8 ГГц в бусте) и слегка подтянули скорость интерконнекта с памятью. В тестах использовалась DDR5-6800/8000, что тоже влияет на результат, но ключевой прирост — именно за счет частот и оптимизаций архитектуры Arrow Lake Refresh. Тем не менее, Ryzen X3D от AMD все еще впереди за счет большого объема кеша.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
ServerFlow | Новости и Железо 💾
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️ Сегодня у нас обзор Huawei Atlas 300i Duo - запускаем и квантизуем Qwen3 на Ascend NPU! - Установка драйверов, firmware и CANN - Квантизация Qwen3 32B и Qwen3-30B-A3B - Запуск моделей через MindIE и тесты в OpenWebUI - Сравнение…
Инфа для тех кто пришел с видеоролика #atlas300iduo
Прикладываем файлы:
Сегодня еще допишем текстовый гайд по запуску квантизации, позже отправим ссылку.
Вот ссылка на ftp для скачивания файлов
Файлы в посте ниже👇
Прикладываем файлы:
- Калибровочные json файлы для запуска скрипта
- Python скрипт для квантизации MoE модели
Сегодня еще допишем текстовый гайд по запуску квантизации, позже отправим ссылку.
Вот ссылка на ftp для скачивания файлов
Файлы в посте ниже👇
👍1
Nvidia официально зарелизила NemoClaw, но пока только в собственной веб-среде NVIDIA Brev Launchable. Хуанг говорил, что NemoClaw будет открытым и бесплатным, но не уточнял когда...
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🌭1
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭2 1
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic добавила функцию использования компьютера в Claude. Нейронка теперь может открывать приложения, управлять браузером, заполняит электронные таблицы и выполнять другие действия прямо на вашем устройстве. Функция доступна в Claude Cowork и Claude Code по тарифам Pro и Max, пока что только для macOS. Да, теперь Claude — это буквально платный OpenClaw.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2