ServerFlow | Новости и Железо 💾
4.24K subscribers
4.91K photos
389 videos
12 files
2.39K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
Итак, в этом году на GTC 2026 Хуанг показал нам:

🔥 Новое поколение ИИ-ускорителей Vera Rubin и Vera Rubin Ultra

🔥 Решения на базе чипов Groq 3 LPU и LPX

🔥 Дорожную карту с устройствами экосистемы Nvidia Feynman

🔥 Платформу Nvidia DSX для прототипирования ИИ-фабрик

🔥 Анонс космического дата-центра Nvidia Vera Rubin Space-1

🔥 Систему NemoClaw для упрощения запуска OpenClaw

🔥 Анонс новых базовых ИИ-моделей Nemotron 3 Ultra

🔥 110 роботов и роботакси под управлением решений Nvidia

Завтра расскажем обо всех этих интересностях более подробно!

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
4👍8🍾11
ServerFlow | Новости и Железо 💾
Итак, в этом году на GTC 2026 Хуанг показал нам: 🔥 Новое поколение ИИ-ускорителей Vera Rubin и Vera Rubin Ultra 🔥 Решения на базе чипов Groq 3 LPU и LPX 🔥 Дорожную карту с устройствами экосистемы Nvidia Feynman 🔥 Платформу Nvidia DSX для прототипирования…
Итак, начнем, конечно же, с гвоздя программы — Vera Rubin. В экосистемы новейшей архитектуры вошли аж 7 чипов, каждый из которых отвечает за свою задачу.

GPU Rubin выполнен по 3 нм техпроцессу и несёт 288 ГБ HBM4 с пропускной способностью до ~22 ТБ/с при производительности около 50 PFLOPS (NVFP4). В стойке NVL72 объединяются с помощью коммутаторов NVL6 до 72 GPU и 36 CPU, обеспечивая до ~3,6 EFLOPS и до ~260 ТБ/с по NVLink 6, а общий пул памяти достигает ~20,7 ТБ HBM4.

CPU Vera обеспечивает 88 Arm-ядер, до 1,5 ТБ LPDDR5X и масштабирование в стойки на 256 процессоров с пропускной способностью памяти до 300 ТБ/с. Как и решения Grace, Vera будут поставляться отдельно вне GPU Rubin как самостоятельный продукт.


Помимо вычислительных модулей, представлены ноды для хранения данных BlueField-4 STX, сетевые адаптеры CX9, а также оптические коммутаторы Spectrum-X CPO. Ну и конечно же показали Groq 3 LPU и Groq LPX — подробнее о новых чипах в следующем посте.

Канал Serverflow в MAX: Подписаться

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍5🤯1🍾1
Второй, но не по значимости, анонс на GTC 2026 — Groq 3 LPU и LPX

Новейшие ИИ-чипы Groq 3 LPU представляют из себя ASIC-решения для ускорения инференса искусственного интеллекта. Они имеют 500 МБ SRAM с пропускной способностью до 150 ТБ/с, что кратно быстрее чем у HBM4 с 22 ТБ/с.

На базе Groq 3 LPU будут проектироваться ноды по 8 ускорителей, а уже они будут формировать стойки Groq 3 LPX, объединяющие до 256 чипов, обеспечивая памяти 128 ГБ SRAM и до 40 ПБ/с пропускной способности. Соединение LPU в стойках происходит через оптический интерфейс LPU C2C с 640 ТБ/с.


Связка с GPU Rubin позволяет использовать Groq LPX как сопроцессор для инференса, обеспечивая скорость генерации токенов 1500 токенов в секунду, что ускоряет работу многоагентных систем и масштабных моделей ИИ.

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4🍾11
NVIDIA на GTC 2026 раскрыла детали и о будущей платформы Feynman, которая придет на смену Rubin в 2028 году. GPU Feynman получит вертикальное 3D-стекирование кристаллов и кастомную память уровня HBM5, а новый CPU Rosa обещает заметный прирост производительности по сравнению с 88-ядерным Vera.

Также возможна диверсификация производства с TSMC на заводы Intel с использованием технологии EMIB. Также экосистема Feynman получит новые DPU-чипы BlueField-5 и свичи NVLink 8 CPO (по всей видимости, с оптикой), коммутаторы Spectrum 7 204T и сетевые адаптеры CX10 — все они обеспечат масштабирование экосистемы на уровне ИИ-фабрик.


Детали производительности и платформенной совместимости станут ясны на следующих анонсах Nvidia.

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4🍾11
Хуанг решил подхватить хайп вокруг популярной агентной среды, представив на GTC 2026…собственный форк OpenClaw.

Платформа называется NemoClaw — она поддерживает создание изолированных песочниц, многоуровневую систему безопасности, контролирует взаимодействие ИИ-агентов, предотвращает утечки данных и обеспечивает интеграцию с библиотеками Nvidia: cuDF, Nemotron Dynamo, cuOPT и другими.

NemoClaw рассчитан на быстрый запуск и масштабирование в бизнес-инфраструктуре, позволяя развернуть полноценную агентную среду за пару команд.

По сути, NemoClaw объединяет открытость OpenClaw с корпоративными стандартами надежности, создавая платформу для безопасного и эффективного внедрения многоагентных ИИ-систем. Релиз системы можно ожидать уже в ближайшее время.

NVIDIA на GTC 2026 раскрыла детали и о будущей платформы Feynman, которая придет на смену Rubin в 2028 году. GPU Feynman получит вертикальное 3D-стекирование кристаллов и кастомную память уровня HBM5, а новый CPU Rosa обещает заметный прирост производительности по сравнению с 88-ядерным Vera.

Также возможна диверсификация производства с TSMC на заводы Intel с использованием технологии EMIB. Также экосистема Feynman получит новые DPU-чипы BlueField-5 и свичи NVLink 8 CPO (по всей видимости, с оптикой), коммутаторы Spectrum 7 204T и сетевые адаптеры CX10 — все они обеспечат масштабирование экосистемы на уровне ИИ-фабрик.


Детали производительности и платформенной совместимости станут ясны на следующих анонсах Nvidia.

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍3💩1🍾1
🔥 Готовим для вас видео сборку системы с кастомным контуром водяного охлаждения!

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
2🌭8👍53
NVIDIA на GTC 2026 показала DGX Station на базе суперчипа GB300 Blackwell Ultra — настольную ИИ-систему с уровнем ИИ-сервера. Заявлена производительность до 20 PFLOPS в NVFP4 и объем памяти около 784 ГБ.

GPU B300 дает 288 ГБ HBM3e с пропускной способностью до 8 ТБ/с и до 640 тензорных ядер, CPU Grace — 72 Arm-ядра и 496 ГБ LPDDR5X. Связка через NVLink-C2C обеспечивает до 900 ГБ/с между CPU и GPU, плюс сетевой адаптер CX8 SuperNIC на 800 Гбит/с, четыре M.2 Gen5 и несколько PCIe Gen5 слотов под расширение.


Это уже не просто рабочая станция, а дата-центр под столом: можно запускать огромные ИИ-модели, ускорять инференс без выноса в ЦОД и собирать ИИ-прототипы без сборки кластера. Ограничения тоже очевидны — около 1600 Вт TDP и огромная цена, так что массовым решением система точно не станет, но для R&D и enterprise-разработки это must-have. Запуск продаж намечен уже на март 2026.

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4