Перед вами тестовый образец ИИ-процессора Jotunn8 от французского стартапа VSORA. Чип собран из 8 вычислительных чиплетов 5-нм в компоновке TSMC CoWoS-S, имеет 8 стэков HBM3E, которые в сумме дают 288 ГБ с пропускной способностью до 8 ТБ/с. Обеспечивает производительность до 3,2 PFLOPS в режиме FP8 при энергопотреблении всего 500 Вт.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍6🍾2
This media is not supported in your browser
VIEW IN TELEGRAM
Google выпустила TurboQuant — передовой алгоритм экстремального сжатия ИИ-моделей. TurboQuant способен в 6 и более раз сократить расход памяти под KV-кэш в LLM, а также ускоряет инференс до 8 раз без какой-либо потери точности. Это настоящий прорыв, ведь теперь для инференса даже самых тяжелых моделей будет достаточно потребительских ИИ-ПК по типу Mac Mini, а объемы памяти, потребляемой ИИ-инфраструктурами, резко сократятся.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8
Как бы высоко ты не летал с EPYC, никогда не забывай, как ты ползал с Hygon...
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4🌭3
🔥 AMD выпустила ROCm 7.2.1
AMD обновила свой ИИ-стек ROCm до версии 7.2.1 — это точечный релиз с фокусом на стабильность и поддержку свежего ПО. Главное изменение — официальная поддержка Ubuntu 24.04.4 LTS с ядрами Linux 6.8 и HWE 6.17, при этом предыдущая версия 24.04.3 переведена в статус EOL.
Это скорее “сервисный” релиз: AMD доводит стабильность и софт-экосистему под ИИ-нагрузки, но без функционального скачка. Такие обновления важны для продакшена — меньше багов в стеке ROCm напрямую влияет на стабильность обучения и инференса искусственного интеллекта, особенно в Linux-кластерах.
😅 Канал Serverflow в MAX: Подписаться
AMD обновила свой ИИ-стек ROCm до версии 7.2.1 — это точечный релиз с фокусом на стабильность и поддержку свежего ПО. Главное изменение — официальная поддержка Ubuntu 24.04.4 LTS с ядрами Linux 6.8 и HWE 6.17, при этом предыдущая версия 24.04.3 переведена в статус EOL.
Список поддерживаемых GPU не изменился, новых ИИ-ускорителей не добавили. Из полезного — улучшения производительности в hipBLASLt (MXFP8/MXFP4 GEMM), поддержка JAX 0.8.2, а также расширенный мониторинг через amd-smi с показаниями температуры GPU и платы. Плюс набор фиксов по библиотекам и отказ от ROCm Offline Installer Creator.
Это скорее “сервисный” релиз: AMD доводит стабильность и софт-экосистему под ИИ-нагрузки, но без функционального скачка. Такие обновления важны для продакшена — меньше багов в стеке ROCm напрямую влияет на стабильность обучения и инференса искусственного интеллекта, особенно в Linux-кластерах.
Please open Telegram to view this post
VIEW IN TELEGRAM
1 3
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️
Сегодня у нас установка и запуск ComfyUI на Huawei Atlas 300i Duo 96GB📈
Это и многое другое вы узнаете в новом видео!
Также выложили текстовый гайд по запуску ComfyUI на Huawei Atlas 300i Duo!
Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://youtu.be/5dOx683d_K8?si=edQ8lt6vwhfVm_bP
Канал Serverflow в MAX: Подписаться
Сегодня у нас установка и запуск ComfyUI на Huawei Atlas 300i Duo 96GB
- Установка ComfyUI и зависимостей
- Запуск моделей и тесты генерации фото
Это и многое другое вы узнаете в новом видео!
Также выложили текстовый гайд по запуску ComfyUI на Huawei Atlas 300i Duo!
Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://youtu.be/5dOx683d_K8?si=edQ8lt6vwhfVm_bP
Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
YouTube
Установка и запуск ComfyUI на Huawei Atlas 300i Duo. Тесты SDXL и FLUX.1
Текстовый гайд - https://clck.ru/3SmYuG
В этом видео продолжаем разбирать возможности Huawei Atlas 300i Duo 96GB и пробуем запустить на нём уже не LLM, а ComfyUI. Показываем весь путь от старта Docker-контейнера до запуска генерации изображений через ComfyUI…
В этом видео продолжаем разбирать возможности Huawei Atlas 300i Duo 96GB и пробуем запустить на нём уже не LLM, а ComfyUI. Показываем весь путь от старта Docker-контейнера до запуска генерации изображений через ComfyUI…
👍3🌭1 1
🔥 AMD анонсировала — Ryzen 9 9950X3D2 первый CPU с двойным 3D V-Cache
AMD официально Ryzen 9 9950X3D2 — первый десктопный CPU AMD, где 3D V-Cache установлен сразу на оба CCD. В отличие от обычного 9950X3D с кэшем только на одном чиплете, в новейшем Ryzen 9 9950X3D2 общий объем L3 достигает 192 МБ (по ~96 МБ на каждый CCD), и это абсолютный рекорд по 3D V-Cache на сегодняшний день.
Чип имеет 16 ядер с 32 потоками, базируется на архитектуре Zen 5, а тактовая частота в бусте достигает около 5,6 ГГц. TDP чипа вырастет до 200 Вт. Благодаря двойному 3D V-Cache, оба кластера ядер плучают одинаковый быстрый доступ к большому объему L3, тогда как раньше системе приходилось угадывать, на каком CCD запускать приложение. Двойной кэш кратно снижает задержки и значительно увеличит производительность в играх.
😅 Канал Serverflow в MAX: Подписаться
AMD официально Ryzen 9 9950X3D2 — первый десктопный CPU AMD, где 3D V-Cache установлен сразу на оба CCD. В отличие от обычного 9950X3D с кэшем только на одном чиплете, в новейшем Ryzen 9 9950X3D2 общий объем L3 достигает 192 МБ (по ~96 МБ на каждый CCD), и это абсолютный рекорд по 3D V-Cache на сегодняшний день.
Чип имеет 16 ядер с 32 потоками, базируется на архитектуре Zen 5, а тактовая частота в бусте достигает около 5,6 ГГц. TDP чипа вырастет до 200 Вт. Благодаря двойному 3D V-Cache, оба кластера ядер плучают одинаковый быстрый доступ к большому объему L3, тогда как раньше системе приходилось угадывать, на каком CCD запускать приложение. Двойной кэш кратно снижает задержки и значительно увеличит производительность в играх.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Intel представила Arc Pro B70 и B65 — первые видеокарты на новом большом GPU “Big Battlemage” (BMG-G31) для профессионального сегмента.
Флагманский ИИ-ускоритель Intel Arc Pro B70 получил 32 ядер Xe2-HPG с 256 блоками XMX и частотой до ~2,8 ГГц, 32 ГБ памяти GDDR6 на 256-битной шине с пропускной способностью ~608 ГБ/с. ИИ-производительность достигает до 367 TOPS в INT8. TDP варьируется от 160 до 290 Вт в зависимости от нагрузки. Цена вопроса — $949.
Младшая видеокарта Intel Arc Pro B65 сохраняет те же 32 ГБ VRAM со скоростью ~608 ГБ/с, но c частото до 2,4 ГГц, на 192-битной шине, а GPU был урезан до 20 Xe-ядер и 160 XMX, поэтому производительность в INT8 снижается до 197 TOPS. TDP достигает 200 Вт. Цена Intel Arc Pro B65 не раскрывается.
Intel Arc Pro B70 поступит в продажу 25 марта 2026 года, старт продаж B65 пока неизвестен.
😅 Канал Serverflow в MAX: Подписаться
Флагманский ИИ-ускоритель Intel Arc Pro B70 получил 32 ядер Xe2-HPG с 256 блоками XMX и частотой до ~2,8 ГГц, 32 ГБ памяти GDDR6 на 256-битной шине с пропускной способностью ~608 ГБ/с. ИИ-производительность достигает до 367 TOPS в INT8. TDP варьируется от 160 до 290 Вт в зависимости от нагрузки. Цена вопроса — $949.
Младшая видеокарта Intel Arc Pro B65 сохраняет те же 32 ГБ VRAM со скоростью ~608 ГБ/с, но c частото до 2,4 ГГц, на 192-битной шине, а GPU был урезан до 20 Xe-ядер и 160 XMX, поэтому производительность в INT8 снижается до 197 TOPS. TDP достигает 200 Вт. Цена Intel Arc Pro B65 не раскрывается.
Intel позиционирует видеокарту Arc Pro B70 как прямого конкурента Nvidia RTX Pro 4000, заявляя о 2,2-кратном увеличении контекстных окон, до 85 % более высокую пропускную способности токенов в многопользовательских рабочих нагрузках, 6,2-кратное ускорение времени получения первого токена, 2-кратное улучшение соотношения токенов к доллару.
Intel Arc Pro B70 поступит в продажу 25 марта 2026 года, старт продаж B65 пока неизвестен.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍2