ServerFlow | Новости и Железо 💾
Итак, в этом году на GTC 2026 Хуанг показал нам: 🔥 Новое поколение ИИ-ускорителей Vera Rubin и Vera Rubin Ultra 🔥 Решения на базе чипов Groq 3 LPU и LPX 🔥 Дорожную карту с устройствами экосистемы Nvidia Feynman 🔥 Платформу Nvidia DSX для прототипирования…
Итак, начнем, конечно же, с гвоздя программы — Vera Rubin. В экосистемы новейшей архитектуры вошли аж 7 чипов, каждый из которых отвечает за свою задачу.
Помимо вычислительных модулей, представлены ноды для хранения данных BlueField-4 STX, сетевые адаптеры CX9, а также оптические коммутаторы Spectrum-X CPO. Ну и конечно же показали Groq 3 LPU и Groq LPX — подробнее о новых чипах в следующем посте.
Канал Serverflow в MAX: Подписаться
🤖 Канал Serverflow в MAX: Подписаться
GPU Rubin выполнен по 3 нм техпроцессу и несёт 288 ГБ HBM4 с пропускной способностью до ~22 ТБ/с при производительности около 50 PFLOPS (NVFP4). В стойке NVL72 объединяются с помощью коммутаторов NVL6 до 72 GPU и 36 CPU, обеспечивая до ~3,6 EFLOPS и до ~260 ТБ/с по NVLink 6, а общий пул памяти достигает ~20,7 ТБ HBM4.
CPU Vera обеспечивает 88 Arm-ядер, до 1,5 ТБ LPDDR5X и масштабирование в стойки на 256 процессоров с пропускной способностью памяти до 300 ТБ/с. Как и решения Grace, Vera будут поставляться отдельно вне GPU Rubin как самостоятельный продукт.
Помимо вычислительных модулей, представлены ноды для хранения данных BlueField-4 STX, сетевые адаптеры CX9, а также оптические коммутаторы Spectrum-X CPO. Ну и конечно же показали Groq 3 LPU и Groq LPX — подробнее о новых чипах в следующем посте.
Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍5🤯1🍾1
Второй, но не по значимости, анонс на GTC 2026 — Groq 3 LPU и LPX
Новейшие ИИ-чипы Groq 3 LPU представляют из себя ASIC-решения для ускорения инференса искусственного интеллекта. Они имеют 500 МБ SRAM с пропускной способностью до 150 ТБ/с, что кратно быстрее чем у HBM4 с 22 ТБ/с.
Связка с GPU Rubin позволяет использовать Groq LPX как сопроцессор для инференса, обеспечивая скорость генерации токенов 1500 токенов в секунду, что ускоряет работу многоагентных систем и масштабных моделей ИИ.
🤖 Канал Serverflow в MAX: Подписаться
Новейшие ИИ-чипы Groq 3 LPU представляют из себя ASIC-решения для ускорения инференса искусственного интеллекта. Они имеют 500 МБ SRAM с пропускной способностью до 150 ТБ/с, что кратно быстрее чем у HBM4 с 22 ТБ/с.
На базе Groq 3 LPU будут проектироваться ноды по 8 ускорителей, а уже они будут формировать стойки Groq 3 LPX, объединяющие до 256 чипов, обеспечивая памяти 128 ГБ SRAM и до 40 ПБ/с пропускной способности. Соединение LPU в стойках происходит через оптический интерфейс LPU C2C с 640 ТБ/с.
Связка с GPU Rubin позволяет использовать Groq LPX как сопроцессор для инференса, обеспечивая скорость генерации токенов 1500 токенов в секунду, что ускоряет работу многоагентных систем и масштабных моделей ИИ.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4🍾1 1
NVIDIA на GTC 2026 раскрыла детали и о будущей платформы Feynman, которая придет на смену Rubin в 2028 году. GPU Feynman получит вертикальное 3D-стекирование кристаллов и кастомную память уровня HBM5, а новый CPU Rosa обещает заметный прирост производительности по сравнению с 88-ядерным Vera.
Детали производительности и платформенной совместимости станут ясны на следующих анонсах Nvidia.
🤖 Канал Serverflow в MAX: Подписаться
Также возможна диверсификация производства с TSMC на заводы Intel с использованием технологии EMIB. Также экосистема Feynman получит новые DPU-чипы BlueField-5 и свичи NVLink 8 CPO (по всей видимости, с оптикой), коммутаторы Spectrum 7 204T и сетевые адаптеры CX10 — все они обеспечат масштабирование экосистемы на уровне ИИ-фабрик.
Детали производительности и платформенной совместимости станут ясны на следующих анонсах Nvidia.
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4🍾1 1
Хуанг решил подхватить хайп вокруг популярной агентной среды, представив на GTC 2026…собственный форк OpenClaw.
Платформа называется NemoClaw — она поддерживает создание изолированных песочниц, многоуровневую систему безопасности, контролирует взаимодействие ИИ-агентов, предотвращает утечки данных и обеспечивает интеграцию с библиотеками Nvidia: cuDF, Nemotron Dynamo, cuOPT и другими.
NemoClaw рассчитан на быстрый запуск и масштабирование в бизнес-инфраструктуре, позволяя развернуть полноценную агентную среду за пару команд.
По сути, NemoClaw объединяет открытость OpenClaw с корпоративными стандартами надежности, создавая платформу для безопасного и эффективного внедрения многоагентных ИИ-систем. Релиз системы можно ожидать уже в ближайшее время.
NVIDIA на GTC 2026 раскрыла детали и о будущей платформы Feynman, которая придет на смену Rubin в 2028 году. GPU Feynman получит вертикальное 3D-стекирование кристаллов и кастомную память уровня HBM5, а новый CPU Rosa обещает заметный прирост производительности по сравнению с 88-ядерным Vera.
Детали производительности и платформенной совместимости станут ясны на следующих анонсах Nvidia.
🤖 Канал Serverflow в MAX: Подписаться
Платформа называется NemoClaw — она поддерживает создание изолированных песочниц, многоуровневую систему безопасности, контролирует взаимодействие ИИ-агентов, предотвращает утечки данных и обеспечивает интеграцию с библиотеками Nvidia: cuDF, Nemotron Dynamo, cuOPT и другими.
NemoClaw рассчитан на быстрый запуск и масштабирование в бизнес-инфраструктуре, позволяя развернуть полноценную агентную среду за пару команд.
По сути, NemoClaw объединяет открытость OpenClaw с корпоративными стандартами надежности, создавая платформу для безопасного и эффективного внедрения многоагентных ИИ-систем. Релиз системы можно ожидать уже в ближайшее время.
NVIDIA на GTC 2026 раскрыла детали и о будущей платформы Feynman, которая придет на смену Rubin в 2028 году. GPU Feynman получит вертикальное 3D-стекирование кристаллов и кастомную память уровня HBM5, а новый CPU Rosa обещает заметный прирост производительности по сравнению с 88-ядерным Vera.
Также возможна диверсификация производства с TSMC на заводы Intel с использованием технологии EMIB. Также экосистема Feynman получит новые DPU-чипы BlueField-5 и свичи NVLink 8 CPO (по всей видимости, с оптикой), коммутаторы Spectrum 7 204T и сетевые адаптеры CX10 — все они обеспечат масштабирование экосистемы на уровне ИИ-фабрик.
Детали производительности и платформенной совместимости станут ясны на следующих анонсах Nvidia.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍3💩1🍾1
🔥 Готовим для вас видео сборку системы с кастомным контуром водяного охлаждения!
🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
2🌭8👍5 3
NVIDIA на GTC 2026 показала DGX Station на базе суперчипа GB300 Blackwell Ultra — настольную ИИ-систему с уровнем ИИ-сервера. Заявлена производительность до 20 PFLOPS в NVFP4 и объем памяти около 784 ГБ.
Это уже не просто рабочая станция, а дата-центр под столом: можно запускать огромные ИИ-модели, ускорять инференс без выноса в ЦОД и собирать ИИ-прототипы без сборки кластера. Ограничения тоже очевидны — около 1600 Вт TDP и огромная цена, так что массовым решением система точно не станет, но для R&D и enterprise-разработки это must-have. Запуск продаж намечен уже на март 2026.
🤖 Канал Serverflow в MAX: Подписаться
GPU B300 дает 288 ГБ HBM3e с пропускной способностью до 8 ТБ/с и до 640 тензорных ядер, CPU Grace — 72 Arm-ядра и 496 ГБ LPDDR5X. Связка через NVLink-C2C обеспечивает до 900 ГБ/с между CPU и GPU, плюс сетевой адаптер CX8 SuperNIC на 800 Гбит/с, четыре M.2 Gen5 и несколько PCIe Gen5 слотов под расширение.
Это уже не просто рабочая станция, а дата-центр под столом: можно запускать огромные ИИ-модели, ускорять инференс без выноса в ЦОД и собирать ИИ-прототипы без сборки кластера. Ограничения тоже очевидны — около 1600 Вт TDP и огромная цена, так что массовым решением система точно не станет, но для R&D и enterprise-разработки это must-have. Запуск продаж намечен уже на март 2026.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4
Nvidia завезла еще один очень интересный анонс — серверные видюхи RTX PRO 4500 Blackwell Server Edition, которые являются идейными продолжателями Nvidia L4.
Видеокарта получила однослотовый форм-фактор FHFL, пассивную систему охлаждения для плотных серверных конфигураций, а также TDP в 165 Вт. Есть 3 аппаратных блока NVENC/NVDEC.
Еще есть поддержка технологии виртуализации GPU MIG, но поделить VRAM можно только на 2 части по 16 ГБ. Питание подается через через 12VHPWR. В остальном эта все та же RTX PRO 4500 Blackwell для рабочих станций — чип GB203 с 10 496 CUDA-ядрами и 82 RT-ядрами.
Видеокарта дает до 1,6 PFLOPS (FP4), 811 TFLOPS (FP8), FP16/BF16 (406 TFLOPS), TF32 (203 TFLOPS) и FP32 (51 TFLOPS), оснащена 32 ГБ GDDR7 с пропускной способностью около 800 ГБ/с.
Поставки уже стартовали через партнеров Nvidia, но прайсы неизвестны.
🤖 Канал Serverflow в MAX: Подписаться
Видеокарта получила однослотовый форм-фактор FHFL, пассивную систему охлаждения для плотных серверных конфигураций, а также TDP в 165 Вт. Есть 3 аппаратных блока NVENC/NVDEC.
Еще есть поддержка технологии виртуализации GPU MIG, но поделить VRAM можно только на 2 части по 16 ГБ. Питание подается через через 12VHPWR. В остальном эта все та же RTX PRO 4500 Blackwell для рабочих станций — чип GB203 с 10 496 CUDA-ядрами и 82 RT-ядрами.
Видеокарта дает до 1,6 PFLOPS (FP4), 811 TFLOPS (FP8), FP16/BF16 (406 TFLOPS), TF32 (203 TFLOPS) и FP32 (51 TFLOPS), оснащена 32 ГБ GDDR7 с пропускной способностью около 800 ГБ/с.
Поставки уже стартовали через партнеров Nvidia, но прайсы неизвестны.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4