Второй, но не по значимости, анонс на GTC 2026 — Groq 3 LPU и LPX
Новейшие ИИ-чипы Groq 3 LPU представляют из себя ASIC-решения для ускорения инференса искусственного интеллекта. Они имеют 500 МБ SRAM с пропускной способностью до 150 ТБ/с, что кратно быстрее чем у HBM4 с 22 ТБ/с.
Связка с GPU Rubin позволяет использовать Groq LPX как сопроцессор для инференса, обеспечивая скорость генерации токенов 1500 токенов в секунду, что ускоряет работу многоагентных систем и масштабных моделей ИИ.
🤖 Канал Serverflow в MAX: Подписаться
Новейшие ИИ-чипы Groq 3 LPU представляют из себя ASIC-решения для ускорения инференса искусственного интеллекта. Они имеют 500 МБ SRAM с пропускной способностью до 150 ТБ/с, что кратно быстрее чем у HBM4 с 22 ТБ/с.
На базе Groq 3 LPU будут проектироваться ноды по 8 ускорителей, а уже они будут формировать стойки Groq 3 LPX, объединяющие до 256 чипов, обеспечивая памяти 128 ГБ SRAM и до 40 ПБ/с пропускной способности. Соединение LPU в стойках происходит через оптический интерфейс LPU C2C с 640 ТБ/с.
Связка с GPU Rubin позволяет использовать Groq LPX как сопроцессор для инференса, обеспечивая скорость генерации токенов 1500 токенов в секунду, что ускоряет работу многоагентных систем и масштабных моделей ИИ.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4🍾1 1
NVIDIA на GTC 2026 раскрыла детали и о будущей платформы Feynman, которая придет на смену Rubin в 2028 году. GPU Feynman получит вертикальное 3D-стекирование кристаллов и кастомную память уровня HBM5, а новый CPU Rosa обещает заметный прирост производительности по сравнению с 88-ядерным Vera.
Детали производительности и платформенной совместимости станут ясны на следующих анонсах Nvidia.
🤖 Канал Serverflow в MAX: Подписаться
Также возможна диверсификация производства с TSMC на заводы Intel с использованием технологии EMIB. Также экосистема Feynman получит новые DPU-чипы BlueField-5 и свичи NVLink 8 CPO (по всей видимости, с оптикой), коммутаторы Spectrum 7 204T и сетевые адаптеры CX10 — все они обеспечат масштабирование экосистемы на уровне ИИ-фабрик.
Детали производительности и платформенной совместимости станут ясны на следующих анонсах Nvidia.
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4🍾1 1
Хуанг решил подхватить хайп вокруг популярной агентной среды, представив на GTC 2026…собственный форк OpenClaw.
Платформа называется NemoClaw — она поддерживает создание изолированных песочниц, многоуровневую систему безопасности, контролирует взаимодействие ИИ-агентов, предотвращает утечки данных и обеспечивает интеграцию с библиотеками Nvidia: cuDF, Nemotron Dynamo, cuOPT и другими.
NemoClaw рассчитан на быстрый запуск и масштабирование в бизнес-инфраструктуре, позволяя развернуть полноценную агентную среду за пару команд.
По сути, NemoClaw объединяет открытость OpenClaw с корпоративными стандартами надежности, создавая платформу для безопасного и эффективного внедрения многоагентных ИИ-систем. Релиз системы можно ожидать уже в ближайшее время.
NVIDIA на GTC 2026 раскрыла детали и о будущей платформы Feynman, которая придет на смену Rubin в 2028 году. GPU Feynman получит вертикальное 3D-стекирование кристаллов и кастомную память уровня HBM5, а новый CPU Rosa обещает заметный прирост производительности по сравнению с 88-ядерным Vera.
Детали производительности и платформенной совместимости станут ясны на следующих анонсах Nvidia.
🤖 Канал Serverflow в MAX: Подписаться
Платформа называется NemoClaw — она поддерживает создание изолированных песочниц, многоуровневую систему безопасности, контролирует взаимодействие ИИ-агентов, предотвращает утечки данных и обеспечивает интеграцию с библиотеками Nvidia: cuDF, Nemotron Dynamo, cuOPT и другими.
NemoClaw рассчитан на быстрый запуск и масштабирование в бизнес-инфраструктуре, позволяя развернуть полноценную агентную среду за пару команд.
По сути, NemoClaw объединяет открытость OpenClaw с корпоративными стандартами надежности, создавая платформу для безопасного и эффективного внедрения многоагентных ИИ-систем. Релиз системы можно ожидать уже в ближайшее время.
NVIDIA на GTC 2026 раскрыла детали и о будущей платформы Feynman, которая придет на смену Rubin в 2028 году. GPU Feynman получит вертикальное 3D-стекирование кристаллов и кастомную память уровня HBM5, а новый CPU Rosa обещает заметный прирост производительности по сравнению с 88-ядерным Vera.
Также возможна диверсификация производства с TSMC на заводы Intel с использованием технологии EMIB. Также экосистема Feynman получит новые DPU-чипы BlueField-5 и свичи NVLink 8 CPO (по всей видимости, с оптикой), коммутаторы Spectrum 7 204T и сетевые адаптеры CX10 — все они обеспечат масштабирование экосистемы на уровне ИИ-фабрик.
Детали производительности и платформенной совместимости станут ясны на следующих анонсах Nvidia.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍3💩1🍾1
🔥 Готовим для вас видео сборку системы с кастомным контуром водяного охлаждения!
🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
2🌭8👍5 3
NVIDIA на GTC 2026 показала DGX Station на базе суперчипа GB300 Blackwell Ultra — настольную ИИ-систему с уровнем ИИ-сервера. Заявлена производительность до 20 PFLOPS в NVFP4 и объем памяти около 784 ГБ.
Это уже не просто рабочая станция, а дата-центр под столом: можно запускать огромные ИИ-модели, ускорять инференс без выноса в ЦОД и собирать ИИ-прототипы без сборки кластера. Ограничения тоже очевидны — около 1600 Вт TDP и огромная цена, так что массовым решением система точно не станет, но для R&D и enterprise-разработки это must-have. Запуск продаж намечен уже на март 2026.
🤖 Канал Serverflow в MAX: Подписаться
GPU B300 дает 288 ГБ HBM3e с пропускной способностью до 8 ТБ/с и до 640 тензорных ядер, CPU Grace — 72 Arm-ядра и 496 ГБ LPDDR5X. Связка через NVLink-C2C обеспечивает до 900 ГБ/с между CPU и GPU, плюс сетевой адаптер CX8 SuperNIC на 800 Гбит/с, четыре M.2 Gen5 и несколько PCIe Gen5 слотов под расширение.
Это уже не просто рабочая станция, а дата-центр под столом: можно запускать огромные ИИ-модели, ускорять инференс без выноса в ЦОД и собирать ИИ-прототипы без сборки кластера. Ограничения тоже очевидны — около 1600 Вт TDP и огромная цена, так что массовым решением система точно не станет, но для R&D и enterprise-разработки это must-have. Запуск продаж намечен уже на март 2026.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4
Nvidia завезла еще один очень интересный анонс — серверные видюхи RTX PRO 4500 Blackwell Server Edition, которые являются идейными продолжателями Nvidia L4.
Видеокарта получила однослотовый форм-фактор FHFL, пассивную систему охлаждения для плотных серверных конфигураций, а также TDP в 165 Вт. Есть 3 аппаратных блока NVENC/NVDEC.
Еще есть поддержка технологии виртуализации GPU MIG, но поделить VRAM можно только на 2 части по 16 ГБ. Питание подается через через 12VHPWR. В остальном эта все та же RTX PRO 4500 Blackwell для рабочих станций — чип GB203 с 10 496 CUDA-ядрами и 82 RT-ядрами.
Видеокарта дает до 1,6 PFLOPS (FP4), 811 TFLOPS (FP8), FP16/BF16 (406 TFLOPS), TF32 (203 TFLOPS) и FP32 (51 TFLOPS), оснащена 32 ГБ GDDR7 с пропускной способностью около 800 ГБ/с.
Поставки уже стартовали через партнеров Nvidia, но прайсы неизвестны.
🤖 Канал Serverflow в MAX: Подписаться
Видеокарта получила однослотовый форм-фактор FHFL, пассивную систему охлаждения для плотных серверных конфигураций, а также TDP в 165 Вт. Есть 3 аппаратных блока NVENC/NVDEC.
Еще есть поддержка технологии виртуализации GPU MIG, но поделить VRAM можно только на 2 части по 16 ГБ. Питание подается через через 12VHPWR. В остальном эта все та же RTX PRO 4500 Blackwell для рабочих станций — чип GB203 с 10 496 CUDA-ядрами и 82 RT-ядрами.
Видеокарта дает до 1,6 PFLOPS (FP4), 811 TFLOPS (FP8), FP16/BF16 (406 TFLOPS), TF32 (203 TFLOPS) и FP32 (51 TFLOPS), оснащена 32 ГБ GDDR7 с пропускной способностью около 800 ГБ/с.
Поставки уже стартовали через партнеров Nvidia, но прайсы неизвестны.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Хуанг на GTC 2026 позволил нам вживую узреть ИИ-решений следующего поколения под названием Rubin Ultra — первые в мире ИИ-ускорители с 1 ТБ HBM4E, релиз которых ожидается в 2027 году.
Стойки Kyber NVL144 поддерживают интеграцию нод не горизонтально, а вертикально, что позволяет масштабировать количество GPU в одной системе, объединяя их с помощью NVLink 7 со скоростью 3,600 ТБ/с. Новые сетевые адаптеры CX9-1600G, которые также будут использоваться в NVL144, ускоряют масштабируемую передачу данных между узлами. Объем памяти на стойку достигает 576 ТБ HBM4E.
🤖 Канал Serverflow в MAX: Подписаться
GPU построен с компактной многослойной конструкцией и плотной компоновкой кристаллов, что позволяет уместить большой объем памяти в небольшом корпусе. Каждый GPU Rubin Ultra поддерживает работу с большими контекстами и триллионными моделями, Вычислительные узлы Rubin Ultra объединяют по 4 GPU и минимизируют количество кабелей, упрощая сборку стоечных систем Kyber NVL144.
Стойки Kyber NVL144 поддерживают интеграцию нод не горизонтально, а вертикально, что позволяет масштабировать количество GPU в одной системе, объединяя их с помощью NVLink 7 со скоростью 3,600 ТБ/с. Новые сетевые адаптеры CX9-1600G, которые также будут использоваться в NVL144, ускоряют масштабируемую передачу данных между узлами. Объем памяти на стойку достигает 576 ТБ HBM4E.
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤯4
This media is not supported in your browser
VIEW IN TELEGRAM
Амбиции Nvidia выходят на принципиально новый уровень — компания анонсировала решения Space-1 Vera Rubin Modul для развертывания на орбитальных станциях.
Пока о чипах известно немного — подробности, скорее всего, узнаем в ближайшие пару лет. Анонс этих решений напрямую связан с ростом интереса гиперскелеров к теме орбитальных гигаваттных ЦОД, которые смогут автономно питаться солнечной энергией и охлаждаться естественным образом от космического ваккуума. По прогнозам, такие ЦОД появятся не раньше, чем через 10-20 лет, но Nvidia уже создает готовое решение, чтобы занять перспективную нишу раньше всех.
🤖 Канал Serverflow в MAX: Подписаться
Модули базируются на GPU Rubin и CPU Vera, объединенные через NVLink 6. Да, по сути, это стандартные суперчипы Vera Rubin, но оптимизированные под экстремальные условия эксплуатации в космосе. Space-1 Vera Rubin Modul будут обрабатывать большие потоки данных от различных датчиков и научного оборудования в реальном времени и передавать их на Землю с минимальными задержками.
Пока о чипах известно немного — подробности, скорее всего, узнаем в ближайшие пару лет. Анонс этих решений напрямую связан с ростом интереса гиперскелеров к теме орбитальных гигаваттных ЦОД, которые смогут автономно питаться солнечной энергией и охлаждаться естественным образом от космического ваккуума. По прогнозам, такие ЦОД появятся не раньше, чем через 10-20 лет, но Nvidia уже создает готовое решение, чтобы занять перспективную нишу раньше всех.
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍3
Совсем забыли рассказать об еще одном основополагающем решении экосистемы Rubin — новейших центральных процессорах Nvidia Vera.
CPU Vera будут использоваться как в гибридных системах с GPU Rubin, так и отдельно в собственных стойках Vera на базе одноименных суперчипов. Платформа поддерживают масштабирование до сотен процессоров и обеспечивает высокую плотность вычислений, а интеграция с GPU Rubin и сетевыми адаптерами ConnectX-9 обеспечивает единый технологический стек для обучения и инференса ИИ-моделей триллионного масштаба.
🤖 Канал Serverflow в MAX: Подписаться
Чипы построены на 88 кастомных Arm-ядрах Olympus с поддержкой 176 потоков и 162 МБ L3-кэша. Также используется шина Nvidia Scalable Coherency Fabric Gen2 с пропускной способностью 3,4 ТБ/с, каждому ядру доступно до 14 Гбит/с. Подсистема памяти LPDDR5X SOCAMM обеспечивает до 1,5 ТБ и 1,2 ТБ/с пропускной способности при энергопотреблении втрое ниже DDR-конфигураций.
CPU Vera будут использоваться как в гибридных системах с GPU Rubin, так и отдельно в собственных стойках Vera на базе одноименных суперчипов. Платформа поддерживают масштабирование до сотен процессоров и обеспечивает высокую плотность вычислений, а интеграция с GPU Rubin и сетевыми адаптерами ConnectX-9 обеспечивает единый технологический стек для обучения и инференса ИИ-моделей триллионного масштаба.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4
Если ИИ-чипы Groq 3 LPU и ноды Groq LPX вас не удивили, то Nvidia подготовила для вас еще одно уникальное решение — СХД Nvidia BlueField-4 STX для хранения контекстной памяти ИИ-агентов. Система обеспечивает мгновенный доступ к системной памяти для роя параллельно работающих ИИ-агентов и всех этапов обработки ИИ-данных.
Энергоэффективность системы увеличена в 4 раза в сравнении с традиционными СХОД на базе x86 CPU, а объем обрабатываемых данных для корпоративных систем ИИ увеличен вдвое в сравнении с аналогичными системами хранения данных.
🤖 Канал Serverflow в MAX: Подписаться
В основе Nvidia BlueField-4 STX лежит центральный процессор Vera и DPU-сопроцессор BlueField-4, а также сетевой адаптер ConnectX-9 SuperNIC и оптические коммутаторы Spectrum-X Ethernet. Платформа также использует технологии контекстной памяти Nvidia CMX, расширяющую доступ к памяти графических ускорителей Rubin и обеспечивающую 5-кратное увеличение скорости генерации токенов по сравнению с традиционными СХД.
Энергоэффективность системы увеличена в 4 раза в сравнении с традиционными СХОД на базе x86 CPU, а объем обрабатываемых данных для корпоративных систем ИИ увеличен вдвое в сравнении с аналогичными системами хранения данных.
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍5
На выставке GTC 2026 заметили стойки на базе интерконнекта NVQLink, который позволяет объединять квантовые и графические процессоры в единую систему 👀
🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4 1