🔥 Готовим для вас видео сборку системы с кастомным контуром водяного охлаждения!
🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
2🌭8👍5 3
NVIDIA на GTC 2026 показала DGX Station на базе суперчипа GB300 Blackwell Ultra — настольную ИИ-систему с уровнем ИИ-сервера. Заявлена производительность до 20 PFLOPS в NVFP4 и объем памяти около 784 ГБ.
Это уже не просто рабочая станция, а дата-центр под столом: можно запускать огромные ИИ-модели, ускорять инференс без выноса в ЦОД и собирать ИИ-прототипы без сборки кластера. Ограничения тоже очевидны — около 1600 Вт TDP и огромная цена, так что массовым решением система точно не станет, но для R&D и enterprise-разработки это must-have. Запуск продаж намечен уже на март 2026.
🤖 Канал Serverflow в MAX: Подписаться
GPU B300 дает 288 ГБ HBM3e с пропускной способностью до 8 ТБ/с и до 640 тензорных ядер, CPU Grace — 72 Arm-ядра и 496 ГБ LPDDR5X. Связка через NVLink-C2C обеспечивает до 900 ГБ/с между CPU и GPU, плюс сетевой адаптер CX8 SuperNIC на 800 Гбит/с, четыре M.2 Gen5 и несколько PCIe Gen5 слотов под расширение.
Это уже не просто рабочая станция, а дата-центр под столом: можно запускать огромные ИИ-модели, ускорять инференс без выноса в ЦОД и собирать ИИ-прототипы без сборки кластера. Ограничения тоже очевидны — около 1600 Вт TDP и огромная цена, так что массовым решением система точно не станет, но для R&D и enterprise-разработки это must-have. Запуск продаж намечен уже на март 2026.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4
Nvidia завезла еще один очень интересный анонс — серверные видюхи RTX PRO 4500 Blackwell Server Edition, которые являются идейными продолжателями Nvidia L4.
Видеокарта получила однослотовый форм-фактор FHFL, пассивную систему охлаждения для плотных серверных конфигураций, а также TDP в 165 Вт. Есть 3 аппаратных блока NVENC/NVDEC.
Еще есть поддержка технологии виртуализации GPU MIG, но поделить VRAM можно только на 2 части по 16 ГБ. Питание подается через через 12VHPWR. В остальном эта все та же RTX PRO 4500 Blackwell для рабочих станций — чип GB203 с 10 496 CUDA-ядрами и 82 RT-ядрами.
Видеокарта дает до 1,6 PFLOPS (FP4), 811 TFLOPS (FP8), FP16/BF16 (406 TFLOPS), TF32 (203 TFLOPS) и FP32 (51 TFLOPS), оснащена 32 ГБ GDDR7 с пропускной способностью около 800 ГБ/с.
Поставки уже стартовали через партнеров Nvidia, но прайсы неизвестны.
🤖 Канал Serverflow в MAX: Подписаться
Видеокарта получила однослотовый форм-фактор FHFL, пассивную систему охлаждения для плотных серверных конфигураций, а также TDP в 165 Вт. Есть 3 аппаратных блока NVENC/NVDEC.
Еще есть поддержка технологии виртуализации GPU MIG, но поделить VRAM можно только на 2 части по 16 ГБ. Питание подается через через 12VHPWR. В остальном эта все та же RTX PRO 4500 Blackwell для рабочих станций — чип GB203 с 10 496 CUDA-ядрами и 82 RT-ядрами.
Видеокарта дает до 1,6 PFLOPS (FP4), 811 TFLOPS (FP8), FP16/BF16 (406 TFLOPS), TF32 (203 TFLOPS) и FP32 (51 TFLOPS), оснащена 32 ГБ GDDR7 с пропускной способностью около 800 ГБ/с.
Поставки уже стартовали через партнеров Nvidia, но прайсы неизвестны.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Хуанг на GTC 2026 позволил нам вживую узреть ИИ-решений следующего поколения под названием Rubin Ultra — первые в мире ИИ-ускорители с 1 ТБ HBM4E, релиз которых ожидается в 2027 году.
Стойки Kyber NVL144 поддерживают интеграцию нод не горизонтально, а вертикально, что позволяет масштабировать количество GPU в одной системе, объединяя их с помощью NVLink 7 со скоростью 3,600 ТБ/с. Новые сетевые адаптеры CX9-1600G, которые также будут использоваться в NVL144, ускоряют масштабируемую передачу данных между узлами. Объем памяти на стойку достигает 576 ТБ HBM4E.
🤖 Канал Serverflow в MAX: Подписаться
GPU построен с компактной многослойной конструкцией и плотной компоновкой кристаллов, что позволяет уместить большой объем памяти в небольшом корпусе. Каждый GPU Rubin Ultra поддерживает работу с большими контекстами и триллионными моделями, Вычислительные узлы Rubin Ultra объединяют по 4 GPU и минимизируют количество кабелей, упрощая сборку стоечных систем Kyber NVL144.
Стойки Kyber NVL144 поддерживают интеграцию нод не горизонтально, а вертикально, что позволяет масштабировать количество GPU в одной системе, объединяя их с помощью NVLink 7 со скоростью 3,600 ТБ/с. Новые сетевые адаптеры CX9-1600G, которые также будут использоваться в NVL144, ускоряют масштабируемую передачу данных между узлами. Объем памяти на стойку достигает 576 ТБ HBM4E.
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤯4
This media is not supported in your browser
VIEW IN TELEGRAM
Амбиции Nvidia выходят на принципиально новый уровень — компания анонсировала решения Space-1 Vera Rubin Modul для развертывания на орбитальных станциях.
Пока о чипах известно немного — подробности, скорее всего, узнаем в ближайшие пару лет. Анонс этих решений напрямую связан с ростом интереса гиперскелеров к теме орбитальных гигаваттных ЦОД, которые смогут автономно питаться солнечной энергией и охлаждаться естественным образом от космического ваккуума. По прогнозам, такие ЦОД появятся не раньше, чем через 10-20 лет, но Nvidia уже создает готовое решение, чтобы занять перспективную нишу раньше всех.
🤖 Канал Serverflow в MAX: Подписаться
Модули базируются на GPU Rubin и CPU Vera, объединенные через NVLink 6. Да, по сути, это стандартные суперчипы Vera Rubin, но оптимизированные под экстремальные условия эксплуатации в космосе. Space-1 Vera Rubin Modul будут обрабатывать большие потоки данных от различных датчиков и научного оборудования в реальном времени и передавать их на Землю с минимальными задержками.
Пока о чипах известно немного — подробности, скорее всего, узнаем в ближайшие пару лет. Анонс этих решений напрямую связан с ростом интереса гиперскелеров к теме орбитальных гигаваттных ЦОД, которые смогут автономно питаться солнечной энергией и охлаждаться естественным образом от космического ваккуума. По прогнозам, такие ЦОД появятся не раньше, чем через 10-20 лет, но Nvidia уже создает готовое решение, чтобы занять перспективную нишу раньше всех.
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍3
Совсем забыли рассказать об еще одном основополагающем решении экосистемы Rubin — новейших центральных процессорах Nvidia Vera.
CPU Vera будут использоваться как в гибридных системах с GPU Rubin, так и отдельно в собственных стойках Vera на базе одноименных суперчипов. Платформа поддерживают масштабирование до сотен процессоров и обеспечивает высокую плотность вычислений, а интеграция с GPU Rubin и сетевыми адаптерами ConnectX-9 обеспечивает единый технологический стек для обучения и инференса ИИ-моделей триллионного масштаба.
🤖 Канал Serverflow в MAX: Подписаться
Чипы построены на 88 кастомных Arm-ядрах Olympus с поддержкой 176 потоков и 162 МБ L3-кэша. Также используется шина Nvidia Scalable Coherency Fabric Gen2 с пропускной способностью 3,4 ТБ/с, каждому ядру доступно до 14 Гбит/с. Подсистема памяти LPDDR5X SOCAMM обеспечивает до 1,5 ТБ и 1,2 ТБ/с пропускной способности при энергопотреблении втрое ниже DDR-конфигураций.
CPU Vera будут использоваться как в гибридных системах с GPU Rubin, так и отдельно в собственных стойках Vera на базе одноименных суперчипов. Платформа поддерживают масштабирование до сотен процессоров и обеспечивает высокую плотность вычислений, а интеграция с GPU Rubin и сетевыми адаптерами ConnectX-9 обеспечивает единый технологический стек для обучения и инференса ИИ-моделей триллионного масштаба.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4
Если ИИ-чипы Groq 3 LPU и ноды Groq LPX вас не удивили, то Nvidia подготовила для вас еще одно уникальное решение — СХД Nvidia BlueField-4 STX для хранения контекстной памяти ИИ-агентов. Система обеспечивает мгновенный доступ к системной памяти для роя параллельно работающих ИИ-агентов и всех этапов обработки ИИ-данных.
Энергоэффективность системы увеличена в 4 раза в сравнении с традиционными СХОД на базе x86 CPU, а объем обрабатываемых данных для корпоративных систем ИИ увеличен вдвое в сравнении с аналогичными системами хранения данных.
🤖 Канал Serverflow в MAX: Подписаться
В основе Nvidia BlueField-4 STX лежит центральный процессор Vera и DPU-сопроцессор BlueField-4, а также сетевой адаптер ConnectX-9 SuperNIC и оптические коммутаторы Spectrum-X Ethernet. Платформа также использует технологии контекстной памяти Nvidia CMX, расширяющую доступ к памяти графических ускорителей Rubin и обеспечивающую 5-кратное увеличение скорости генерации токенов по сравнению с традиционными СХД.
Энергоэффективность системы увеличена в 4 раза в сравнении с традиционными СХОД на базе x86 CPU, а объем обрабатываемых данных для корпоративных систем ИИ увеличен вдвое в сравнении с аналогичными системами хранения данных.
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍5
На выставке GTC 2026 заметили стойки на базе интерконнекта NVQLink, который позволяет объединять квантовые и графические процессоры в единую систему 👀
🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4 1
И напоследок, Nvidia также анонсировала открытую ИИ-модель Nemotron 3 Ultra Base — новую базовую модель с 500 млрд параметров которая, по заявлениям Хуанга, станет основой нового поколения мощнейших ИИ-моделей.
А теперь давайте посмотрим на слайд: вы увидите, что Nvidia решила не указывать версию моделей GLM (предположительно, речь идет о GLM-4.5), а также взяла устаревшую Kimi-K2, с которыми сравнивает свою флагманскую нейронку, гордо заявляя о 5-кратном приросте производительности в задачах размышления (и то на GB300 NVL72). На самом деле, это оправданно, так как только именно в этих версиях LLM разработчики из Z.ai и Moonshot ai публиковали открытый исходный код Base-нейронок.
🤖 Канал Serverflow в MAX: Подписаться
А теперь давайте посмотрим на слайд: вы увидите, что Nvidia решила не указывать версию моделей GLM (предположительно, речь идет о GLM-4.5), а также взяла устаревшую Kimi-K2, с которыми сравнивает свою флагманскую нейронку, гордо заявляя о 5-кратном приросте производительности в задачах размышления (и то на GB300 NVL72). На самом деле, это оправданно, так как только именно в этих версиях LLM разработчики из Z.ai и Moonshot ai публиковали открытый исходный код Base-нейронок.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
Друзья, блокировка Telegram идет уже полным ходом, платформа замедлена уже на 80%, а в некоторых регионах этот показатель вовсе приближается к 90%.
Мы сами неоднократно сталкивались с последствиями блокировки: медиа загружаются в канал крайне медленно, посты выходят с задержками, в комментарии не зайти, и даже самые проверенные методы помогают все хуже и хуже. Пока есть возможность, мы будем делать посты здесь, но все может схлопнуться в любой момент.
На фоне этого, рекомендуем вам подписаться на наш канал в MAX — возможно, для многих из вас это будет последней возможностью перейти с нашего лампового Telegram-блога на альтернативную платформу.
Мы сами неоднократно сталкивались с последствиями блокировки: медиа загружаются в канал крайне медленно, посты выходят с задержками, в комментарии не зайти, и даже самые проверенные методы помогают все хуже и хуже. Пока есть возможность, мы будем делать посты здесь, но все может схлопнуться в любой момент.
На фоне этого, рекомендуем вам подписаться на наш канал в MAX — возможно, для многих из вас это будет последней возможностью перейти с нашего лампового Telegram-блога на альтернативную платформу.
💩28😡6👍2 2🍾1
А теперь к самым важным новостям с GTC 2026 — Nvidia наконец-то позволила соединять DGX Spark в кластеры из четырех устройств вместо двух...
А сразу нельзя было так сделать?(нет, потому что кластеров из четырех Minisforum тогда еще не было)
😅 Канал Serverflow в MAX: Подписаться
А сразу нельзя было так сделать?
Please open Telegram to view this post
VIEW IN TELEGRAM
1 4🤯1
ServerFlow | Новости и Железо 💾
Кстати, мы все еще в поисках сервисного инженера по гарантии серверного оборудования 😅 (город Санкт-Петербург) Заработная плата – от 110 000 рублей! Мы ищем: Специалиста с глубоким пониманием схемотехники материнских плат: назначение и принципы работы конденсаторов…
Напоминаем, что вакансия сервисный инженер все еще открыта, а также спешим сообщить, что денежное довольствие повышается до 130 000 - 160 000 рублей!
Если Вы или Ваши знакомые (с опытом в пайке) проживают в Санкт-Петербурге и хотят попасть в нашу команду, то можете смело писать в личные сообщения канала!
Подробности сможете почитать в сообщении, на которое сделан реплай
До встречи в офисе! 😄
Если Вы или Ваши знакомые (с опытом в пайке) проживают в Санкт-Петербурге и хотят попасть в нашу команду, то можете смело писать в личные сообщения канала!
Подробности сможете почитать в сообщении, на которое сделан реплай
До встречи в офисе! 😄
1👍4
ServerFlow | Новости и Железо 💾 pinned «Напоминаем, что вакансия сервисный инженер все еще открыта, а также спешим сообщить, что денежное довольствие повышается до 130 000 - 160 000 рублей! Если Вы или Ваши знакомые (с опытом в пайке) проживают в Санкт-Петербурге и хотят попасть в нашу команду…»
ServerFlow | Новости и Железо 💾
Nvidia завезла еще один очень интересный анонс — серверные видюхи RTX PRO 4500 Blackwell Server Edition, которые являются идейными продолжателями Nvidia L4. Видеокарта получила однослотовый форм-фактор FHFL, пассивную систему охлаждения для плотных серверных…
А вот и первые фото новых однослотовых серверных карточек Nvidia RTX PRO 4500 Blackwell Server Edition. Толщина буквально в два больших пальца. Nvidia L4, с которыми компания сравнивает новинку, были такими же тонкими, но они были еще и низкопрофильными, впрочем, как и A2, T4, P4. Именно сочетание однослотового, низкопрофильного форм-фактора делало все эти видеокарты действительно компактными. Nvidia RTX PRO 4500 Blackwell Server Edition низкопрофильного корпуса все же лишена.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💅3 3
Кстати, вчера компания OpenAI решила под шумок разелизить свои младшие модели семейства GPT-5.4 — mini и nano. GPT-5.4 mini оптимизирована под кодинг, агентные задачи и поддерживает мультимодальные функции, а стоит всего $0,75 за 1 млн входных и $4,5 за 1 млн выходных токенов. GPT-5.4 nano является самой дешевой нейронкой в семействе — $0,20 за 1 млн входных и $1,25 за 1 млн выходных токенов. Несмотря на компактность и дешевизну, OpenAI заявляет, что модели почти не уступают флагманским ИИ-моделям. Однако, многие пользователи, уже успевшие протестировать нейросеть, все же сомневаются в эффективности этих нейронок…
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🤯2