⚡️ Google выводит TPU Ironwood и CPU Axion в продакшн для “ИИ-гиперкомпьютера”
Google объявила о выходе в продакшен тензорных ускорителей Ironwood v7 и Arm-процессоров Axion.
TPU Ironwood оснащен 192 ГБ HBM3E (до 7,37 ТБ/с), выдает 4 614 TFLOPS FP8, и объединяется в кластеры до 9 216 ускорителей, суммарно обеспечивая 42,5 EFLOPS FP8 — больше, чем у Nvidia GB300 NVL72 (720 PFLOPS или 0,72 EFLOPS в FP8), но и GPU в нем намного меньше (72 B300).
Axion построен на Arm Neoverse v2, поддерживает до 96 vCPU и 768 ГБ DDR5, обеспечивая прирост до 50% производительности и 60% энергоэффективности по сравнению с x86-решениями.Это, кстати, первый серверный CPU Google.
Внутри ”ИИ-гиперкомпьютера” Google применяет сеть Optical Circuit Switching — она моментально перенаправляет трафик при сбоях и обеспечивает отказоустойчивость.
Теперь у Googe есть свой замкнутый процессорный стек!
Google объявила о выходе в продакшен тензорных ускорителей Ironwood v7 и Arm-процессоров Axion.
TPU Ironwood оснащен 192 ГБ HBM3E (до 7,37 ТБ/с), выдает 4 614 TFLOPS FP8, и объединяется в кластеры до 9 216 ускорителей, суммарно обеспечивая 42,5 EFLOPS FP8 — больше, чем у Nvidia GB300 NVL72 (720 PFLOPS или 0,72 EFLOPS в FP8), но и GPU в нем намного меньше (72 B300).
Axion построен на Arm Neoverse v2, поддерживает до 96 vCPU и 768 ГБ DDR5, обеспечивая прирост до 50% производительности и 60% энергоэффективности по сравнению с x86-решениями.
Внутри ”ИИ-гиперкомпьютера” Google применяет сеть Optical Circuit Switching — она моментально перенаправляет трафик при сбоях и обеспечивает отказоустойчивость.
Архитектура кластера снижает TCO на 28% и повышает операционную эффективность на 55%. К системе уже подключились Anthropic и Lightricks.
Теперь у Googe есть свой замкнутый процессорный стек!
👍3💩1
😢 Бренд Xilinx уходит в историю
В 2022 году AMD закрыла сделку по покупке Xilinx, и по началу все было нормально — руководство красных отдавало дань уважения известному производителю FPGA-схем, но со временем лого Xilinx все больше и больше уходило на третий план.
Теперь AMD и вовсе начала поэтапно заменять логотип Xilinx на своих сайтах, в документации и материалах для партнеров. По словам AMD, процесс уже подходит к завершающему этапу и в ближайшие месяцы бренд Xilinx больше никогда не будет использоваться отдельно.
AMD, конечно же, сохранит названия продуктовых линеек, но все новые релизы и обновления будут выходить под брендом красных без упоминания Xilinx.
Прощай, Xilinx...
В 2022 году AMD закрыла сделку по покупке Xilinx, и по началу все было нормально — руководство красных отдавало дань уважения известному производителю FPGA-схем, но со временем лого Xilinx все больше и больше уходило на третий план.
Теперь AMD и вовсе начала поэтапно заменять логотип Xilinx на своих сайтах, в документации и материалах для партнеров. По словам AMD, процесс уже подходит к завершающему этапу и в ближайшие месяцы бренд Xilinx больше никогда не будет использоваться отдельно.
AMD, конечно же, сохранит названия продуктовых линеек, но все новые релизы и обновления будут выходить под брендом красных без упоминания Xilinx.
Прощай, Xilinx...
1👍3🤯1 1
🤔 Почему Китай запретил западные ускорители
Многие до сих пор думают: “Товарищ Си совсем из ума выжил? Как он собирается обогнать Запад в сфере ИИ без топовых ускорителей Nvidia?”. На самом деле, он еще как может, и все благодаря передовым чипам Huawei Ascend.
С такой-то эффективностью совсем неудивительно, почему в Китае полностью запретили использовать зарубежные GPU в государственных инфраструктурах — местные NPU почти ничем не хуже.
Ascend — это не просто замена ради выживания, а вполне достойная альтернатива Nvidia.
Многие до сих пор думают: “Товарищ Си совсем из ума выжил? Как он собирается обогнать Запад в сфере ИИ без топовых ускорителей Nvidia?”. На самом деле, он еще как может, и все благодаря передовым чипам Huawei Ascend.
По данным источников, Huawei сейчас выпускает около 200 000 ускорителей Ascend в месяц, а их производительность отстает от NVIDIA H100 всего на 8-12%.
С такой-то эффективностью совсем неудивительно, почему в Китае полностью запретили использовать зарубежные GPU в государственных инфраструктурах — местные NPU почти ничем не хуже.
Чипы Ascend активно применяются в ИИ-системах DeepSeek и Alibaba, которые регулярно радуют нас топовыми нейронками, а при таких объемах производства Ascend могут полностью захватить рынок ИИ-оборудования в КНР.
Ascend — это не просто замена ради выживания, а вполне достойная альтернатива Nvidia.
👍5💩1
⚡️ Samsung готовится представить LPDDR6 и ультракомпактный SSD Gen5
На выставке CES 2026 Samsung планирует представить новые решения в области хранения данных новый тип памяти LPDDR6 и ультракомпактный SSD PM9E1 M.2 22×42 Gen5.
✅ LPDDR6 базируется на усовершенствованном техпроцессе 12-нм, предлагает максимальную скорость на уровне 10,7 Гбит/с и имеет 21% лучшую энергоэффективностью в сравнении с решениями LPDDR5X предыдущего поколения. LPDDR6 лягут в основу новых типов портативных ИИ-устройств.
✅ PM9E1 M.2 22×42 оснащен контроллером Presto и памятью V8 TLC V‑NAND, поддерживает до 4 ТБ и SPDM v1.2 для безопасности данных. Решение также предлагает скорость чтения до 14,8 ГБ/с и записи до 13,4 ГБ/с, а небольшой форм‑фактор делает его универсальным решением для вычислений в компактных устройствах.
Мы обязательно будем следить за событиями на CES 2026 и оперативно делиться с вами всеми новинками!
На выставке CES 2026 Samsung планирует представить новые решения в области хранения данных новый тип памяти LPDDR6 и ультракомпактный SSD PM9E1 M.2 22×42 Gen5.
✅ LPDDR6 базируется на усовершенствованном техпроцессе 12-нм, предлагает максимальную скорость на уровне 10,7 Гбит/с и имеет 21% лучшую энергоэффективностью в сравнении с решениями LPDDR5X предыдущего поколения. LPDDR6 лягут в основу новых типов портативных ИИ-устройств.
✅ PM9E1 M.2 22×42 оснащен контроллером Presto и памятью V8 TLC V‑NAND, поддерживает до 4 ТБ и SPDM v1.2 для безопасности данных. Решение также предлагает скорость чтения до 14,8 ГБ/с и записи до 13,4 ГБ/с, а небольшой форм‑фактор делает его универсальным решением для вычислений в компактных устройствах.
На CES 2026 Samsung покажет и другие разработки в области памяти, включая собственную VRAM GDDR7.
Мы обязательно будем следить за событиями на CES 2026 и оперативно делиться с вами всеми новинками!
👍3
⚒️ Microsoft переносит CUDA-модели на AMD Instinct
Компиляция CUDA-кода для запуска ИИ на оборудовании других вендоров — настоящая морока для ИИ-разработчиков, поэтому эффективные компиляторы крайне востребованы на рынке.
Инженеры Microsoft прекрасно знают об этом, поэтому они создали наборы инструментов для преобразования моделей CUDA в AMD ROCm, чтобы запускать их на Instinct MI300X, MI400X и MI450X.
Пока что в инфраструктуре Azure все еще доминируют NVIDIA H100 и GB200, но Microsoft все больше диверсифицирует парк ускорителей, чтобы снизить зависимость от NVIDIA и оптимизировать стоимость ИИ-нагрузок за счет поддержки альтернативных платформ.
Эти инструменты могут существенно повлиять на рынок ИИ-ориентированных дата-центров, где совместимость с CUDA остается главным барьером для массового внедрения решений AMD.
Компиляция CUDA-кода для запуска ИИ на оборудовании других вендоров — настоящая морока для ИИ-разработчиков, поэтому эффективные компиляторы крайне востребованы на рынке.
Инженеры Microsoft прекрасно знают об этом, поэтому они создали наборы инструментов для преобразования моделей CUDA в AMD ROCm, чтобы запускать их на Instinct MI300X, MI400X и MI450X.
Конечно, они сделали это не только по доброте душевной, а еще и в рамках сотрудничества с компанией AMD, чтобы чтобы добиться максимальной производительности и стабильности стека.
Пока что в инфраструктуре Azure все еще доминируют NVIDIA H100 и GB200, но Microsoft все больше диверсифицирует парк ускорителей, чтобы снизить зависимость от NVIDIA и оптимизировать стоимость ИИ-нагрузок за счет поддержки альтернативных платформ.
Эти инструменты могут существенно повлиять на рынок ИИ-ориентированных дата-центров, где совместимость с CUDA остается главным барьером для массового внедрения решений AMD.
👍4💩1
⚡️Вышел SGLang для диффузионных ИИ-моделей Diffusion
Разработчики команды LMSYS представил свою инновационную разработку — движок инференса диффузионных моделей на базе SGLang, ускоряющий вывод нейронок и уже поддерживающий топовые ИИ.
Система построена с использованием открытого фреймворка FastVideo для создания полноценной экосистемы диффузии. А еще SGLang Diffusion глубоко оптимизирована для работы под ускорители NVIDIA (и даже DGX Spark) благодаря чему достигается высокая производительность при генерации изображений и обработке видео.
Скоро про ComfyUI можно будет забыть.
Разработчики команды LMSYS представил свою инновационную разработку — движок инференса диффузионных моделей на базе SGLang, ускоряющий вывод нейронок и уже поддерживающий топовые ИИ.
SGLang Diffusion выполняет вывод моделей в 5,9 раза быстрее, чем аналогичные движки, поддерживает передовые открытые модели Wan, Hunyuan, Qwen‑Image, Qwen‑Image‑Edit и Flux, а также полностью совместим с OpenAI API и Python API.
Система построена с использованием открытого фреймворка FastVideo для создания полноценной экосистемы диффузии. А еще SGLang Diffusion глубоко оптимизирована для работы под ускорители NVIDIA (и даже DGX Spark) благодаря чему достигается высокая производительность при генерации изображений и обработке видео.
Но запустить SGLang Diffusion также можно на GPU AMD, CPU Intel и даже TPU от Google за счет поддержки проприетарных программных стеков.
Скоро про ComfyUI можно будет забыть.
1👍2
🍊 Orange Pi 6 Plus: 12 ядер и 45 TOPS на ладони
Orange Pi показала новый одноплатный компьютер 6 Plus с 12-ядерным процессором и встроенным NPU на 45 TOPS.
Orange Pi 6 Plus поддерживает до 64 ГБ LPDDR5-5500 (128-бит), 2 слота M.2 2280 под SSD NVMe и отдельный M.2 для сетевой карты. Еще есть 2 порта USB-C 3.0, 2 USB 3.0, 2 USB 2.0, DisplayPort 1.4, HDMI 1.4, двойной 5 Gigabit Ethernet, microSD и GPIO на 40 контактов.
Мини-сервер размером с ладонь, идеально для DIY-сборок и краевых ИИ-проектов.
Orange Pi показала новый одноплатный компьютер 6 Plus с 12-ядерным процессором и встроенным NPU на 45 TOPS.
В корпусе 115 × 100 мм и весом 132 г разместились 4 ядра Cortex-A720 2,8 ГГц, 4 ядра A720 2,4 ГГц и 4 ядра A520 1,8 ГГц, а также графика Immortalis-G720 MC10.
Orange Pi 6 Plus поддерживает до 64 ГБ LPDDR5-5500 (128-бит), 2 слота M.2 2280 под SSD NVMe и отдельный M.2 для сетевой карты. Еще есть 2 порта USB-C 3.0, 2 USB 3.0, 2 USB 2.0, DisplayPort 1.4, HDMI 1.4, двойной 5 Gigabit Ethernet, microSD и GPIO на 40 контактов.
Решение поддерживает Debian, Ubuntu, Android и Windows. Версия Orange Pi 6 Plus с 64 ГБ ОЗУ оценивается в ~$600$.
Мини-сервер размером с ладонь, идеально для DIY-сборок и краевых ИИ-проектов.
1👍4
This media is not supported in your browser
VIEW IN TELEGRAM
⚙️ AWS запустила инстансы EC2 R8a C AMD EPYC Turin и приростом до 30%
Amazon представила новые инстансы EC2 R8a на базе серверных процессоров AMD EPYC 9005 (Turin). Производительность выросла на ~30% по сравнению с R7a, а соотношение цены и эффективности — на 19%.
Решения отлично подходят для высокопроизводительных рабочих нагрузок, требующих большого объема памяти, вроде баз данных SQL/NoSQL, in-memory-кэшей и EDA-нагрузок. Сертификация SAP подтверждена, R8a дает +38 % SAPS против R7a.
Пока R8a доступны в трех регионах США (Вирджиния, Огайо и Орегон) по тарифам On-Demand, Reserved и Spot.
Amazon представила новые инстансы EC2 R8a на базе серверных процессоров AMD EPYC 9005 (Turin). Производительность выросла на ~30% по сравнению с R7a, а соотношение цены и эффективности — на 19%.
Пропускная способность памяти увеличена на 45 %, работа GroovyJVM показывает +60% прироста. Новые инстансы используют платформу AWS Nitro v6 для еще большего увеличения эффективности и безопасности.
Решения отлично подходят для высокопроизводительных рабочих нагрузок, требующих большого объема памяти, вроде баз данных SQL/NoSQL, in-memory-кэшей и EDA-нагрузок. Сертификация SAP подтверждена, R8a дает +38 % SAPS против R7a.
Пока R8a доступны в трех регионах США (Вирджиния, Огайо и Орегон) по тарифам On-Demand, Reserved и Spot.
1👍4
📦 Завтра на канале выходит необычный обзор!
Мы нашли шасси от Gooxi, которое по сути является аналогом Supermicro CSE-826, но...
⚡️ с NVMe бекплейном,
⚡️ с более мощными блоками питания,
⚡️ и самое приятное - его реально можно купить
Ролик выйдет уже завтра!
Мы нашли шасси от Gooxi, которое по сути является аналогом Supermicro CSE-826, но...
Если вы подбираете корпус под мощную систему с материнкой в форм-факторе ATX или E-ATX, возможно Gooxi окажется интереснее, чем "ехегате")))
Ролик выйдет уже завтра!
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🌭1🍾1
🔥 AMD Zen 7 Grimlock — до 264 ядер и FP512 в новой архитектуре
Датамайнер Moore’s Law Is Dead вновь выпустил интересный инсайд. По его данным, AMD активно готовит новую архитектуру Zen 7 (Grimlock): вычислительные кристаллы CCD будут изготавливаться по техпроцессу TSMC A14, а модули с V-Cache — по N4P. Один CCD площадью ~98 мм² вмещает до 16 ядер, каждое с 2 МБ L2 и 4 МБ L3.
Если утечки верны, Zen 7 станет крупнейшим скачком AMD по эффективности и масштабируемости за всю историю линейки процессоров.
Датамайнер Moore’s Law Is Dead вновь выпустил интересный инсайд. По его данным, AMD активно готовит новую архитектуру Zen 7 (Grimlock): вычислительные кристаллы CCD будут изготавливаться по техпроцессу TSMC A14, а модули с V-Cache — по N4P. Один CCD площадью ~98 мм² вмещает до 16 ядер, каждое с 2 МБ L2 и 4 МБ L3.
Серверные чипы EPYC на Zen 7 могут насчитывать до 264 ядер и 2122 МБ L3-кэша (без 3D Cache). Варианты X3D получат 160 МБ дополнительного кэша и дают прирост 20–36% к Zen 6 при энергопотреблении всего 312 Вт на ядро. Поддержка FP512 (аналог AVX-512) подтверждает, что чипы будут сделаны с фокусом на HPC и ИИ-нагрузках(как будто и так было непонятно) .
Если утечки верны, Zen 7 станет крупнейшим скачком AMD по эффективности и масштабируемости за всю историю линейки процессоров.
👍4💩1🌭1