ServerFlow | Новости и Железо 💾
4.24K subscribers
4.89K photos
389 videos
12 files
2.38K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
Хуанг решил подхватить хайп вокруг популярной агентной среды, представив на GTC 2026…собственный форк OpenClaw.

Платформа называется NemoClaw — она поддерживает создание изолированных песочниц, многоуровневую систему безопасности, контролирует взаимодействие ИИ-агентов, предотвращает утечки данных и обеспечивает интеграцию с библиотеками Nvidia: cuDF, Nemotron Dynamo, cuOPT и другими.

NemoClaw рассчитан на быстрый запуск и масштабирование в бизнес-инфраструктуре, позволяя развернуть полноценную агентную среду за пару команд.

По сути, NemoClaw объединяет открытость OpenClaw с корпоративными стандартами надежности, создавая платформу для безопасного и эффективного внедрения многоагентных ИИ-систем. Релиз системы можно ожидать уже в ближайшее время.

NVIDIA на GTC 2026 раскрыла детали и о будущей платформы Feynman, которая придет на смену Rubin в 2028 году. GPU Feynman получит вертикальное 3D-стекирование кристаллов и кастомную память уровня HBM5, а новый CPU Rosa обещает заметный прирост производительности по сравнению с 88-ядерным Vera.

Также возможна диверсификация производства с TSMC на заводы Intel с использованием технологии EMIB. Также экосистема Feynman получит новые DPU-чипы BlueField-5 и свичи NVLink 8 CPO (по всей видимости, с оптикой), коммутаторы Spectrum 7 204T и сетевые адаптеры CX10 — все они обеспечат масштабирование экосистемы на уровне ИИ-фабрик.


Детали производительности и платформенной совместимости станут ясны на следующих анонсах Nvidia.

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍3💩1🍾1
🔥 Готовим для вас видео сборку системы с кастомным контуром водяного охлаждения!

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
2🌭8👍53
NVIDIA на GTC 2026 показала DGX Station на базе суперчипа GB300 Blackwell Ultra — настольную ИИ-систему с уровнем ИИ-сервера. Заявлена производительность до 20 PFLOPS в NVFP4 и объем памяти около 784 ГБ.

GPU B300 дает 288 ГБ HBM3e с пропускной способностью до 8 ТБ/с и до 640 тензорных ядер, CPU Grace — 72 Arm-ядра и 496 ГБ LPDDR5X. Связка через NVLink-C2C обеспечивает до 900 ГБ/с между CPU и GPU, плюс сетевой адаптер CX8 SuperNIC на 800 Гбит/с, четыре M.2 Gen5 и несколько PCIe Gen5 слотов под расширение.


Это уже не просто рабочая станция, а дата-центр под столом: можно запускать огромные ИИ-модели, ускорять инференс без выноса в ЦОД и собирать ИИ-прототипы без сборки кластера. Ограничения тоже очевидны — около 1600 Вт TDP и огромная цена, так что массовым решением система точно не станет, но для R&D и enterprise-разработки это must-have. Запуск продаж намечен уже на март 2026.

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4
Nvidia завезла еще один очень интересный анонс — серверные видюхи RTX PRO 4500 Blackwell Server Edition, которые являются идейными продолжателями Nvidia L4.

Видеокарта получила однослотовый форм-фактор FHFL, пассивную систему охлаждения для плотных серверных конфигураций, а также TDP в 165 Вт. Есть 3 аппаратных блока NVENC/NVDEC.

Еще есть поддержка технологии виртуализации GPU MIG, но поделить VRAM можно только на 2 части по 16 ГБ. Питание подается через через 12VHPWR. В остальном эта все та же RTX PRO 4500 Blackwell для рабочих станций — чип GB203 с 10 496 CUDA-ядрами и 82 RT-ядрами.

Видеокарта дает до 1,6 PFLOPS (FP4), 811 TFLOPS (FP8), FP16/BF16 (406 TFLOPS), TF32 (203 TFLOPS) и FP32 (51 TFLOPS), оснащена 32 ГБ GDDR7 с пропускной способностью около 800 ГБ/с.

Поставки уже стартовали через партнеров Nvidia, но прайсы неизвестны.

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Хуанг на GTC 2026 позволил нам вживую узреть ИИ-решений следующего поколения под названием Rubin Ultra — первые в мире ИИ-ускорители с 1 ТБ HBM4E, релиз которых ожидается в 2027 году.

GPU построен с компактной многослойной конструкцией и плотной компоновкой кристаллов, что позволяет уместить большой объем памяти в небольшом корпусе. Каждый GPU Rubin Ultra поддерживает работу с большими контекстами и триллионными моделями, Вычислительные узлы Rubin Ultra объединяют по 4 GPU и минимизируют количество кабелей, упрощая сборку стоечных систем Kyber NVL144.


Стойки Kyber NVL144 поддерживают интеграцию нод не горизонтально, а вертикально, что позволяет масштабировать количество GPU в одной системе, объединяя их с помощью NVLink 7 со скоростью 3,600 ТБ/с. Новые сетевые адаптеры CX9-1600G, которые также будут использоваться в NVL144, ускоряют масштабируемую передачу данных между узлами. Объем памяти на стойку достигает 576 ТБ HBM4E.

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤯4
This media is not supported in your browser
VIEW IN TELEGRAM
Амбиции Nvidia выходят на принципиально новый уровень — компания анонсировала решения Space-1 Vera Rubin Modul для развертывания на орбитальных станциях.

Модули базируются на GPU Rubin и CPU Vera, объединенные через NVLink 6. Да, по сути, это стандартные суперчипы Vera Rubin, но оптимизированные под экстремальные условия эксплуатации в космосе. Space-1 Vera Rubin Modul будут обрабатывать большие потоки данных от различных датчиков и научного оборудования в реальном времени и передавать их на Землю с минимальными задержками.


Пока о чипах известно немного — подробности, скорее всего, узнаем в ближайшие пару лет. Анонс этих решений напрямую связан с ростом интереса гиперскелеров к теме орбитальных гигаваттных ЦОД, которые смогут автономно питаться солнечной энергией и охлаждаться естественным образом от космического ваккуума. По прогнозам, такие ЦОД появятся не раньше, чем через 10-20 лет, но Nvidia уже создает готовое решение, чтобы занять перспективную нишу раньше всех.

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍3
Совсем забыли рассказать об еще одном основополагающем решении экосистемы Rubin — новейших центральных процессорах Nvidia Vera.

Чипы построены на 88 кастомных Arm-ядрах Olympus с поддержкой 176 потоков и 162 МБ L3-кэша. Также используется шина Nvidia Scalable Coherency Fabric Gen2 с пропускной способностью 3,4 ТБ/с, каждому ядру доступно до 14 Гбит/с. Подсистема памяти LPDDR5X SOCAMM обеспечивает до 1,5 ТБ и 1,2 ТБ/с пропускной способности при энергопотреблении втрое ниже DDR-конфигураций.


CPU Vera будут использоваться как в гибридных системах с GPU Rubin, так и отдельно в собственных стойках Vera на базе одноименных суперчипов. Платформа поддерживают масштабирование до сотен процессоров и обеспечивает высокую плотность вычислений, а интеграция с GPU Rubin и сетевыми адаптерами ConnectX-9 обеспечивает единый технологический стек для обучения и инференса ИИ-моделей триллионного масштаба.

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4
Если ИИ-чипы Groq 3 LPU и ноды Groq LPX вас не удивили, то Nvidia подготовила для вас еще одно уникальное решение — СХД Nvidia BlueField-4 STX для хранения контекстной памяти ИИ-агентов. Система обеспечивает мгновенный доступ к системной памяти для роя параллельно работающих ИИ-агентов и всех этапов обработки ИИ-данных.

В основе Nvidia BlueField-4 STX лежит центральный процессор Vera и DPU-сопроцессор BlueField-4, а также сетевой адаптер ConnectX-9 SuperNIC и оптические коммутаторы Spectrum-X Ethernet. Платформа также использует технологии контекстной памяти Nvidia CMX, расширяющую доступ к памяти графических ускорителей Rubin и обеспечивающую 5-кратное увеличение скорости генерации токенов по сравнению с традиционными СХД.


Энергоэффективность системы увеличена в 4 раза в сравнении с традиционными СХОД на базе x86 CPU, а объем обрабатываемых данных для корпоративных систем ИИ увеличен вдвое в сравнении с аналогичными системами хранения данных.

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍5
На выставке GTC 2026 заметили стойки на базе интерконнекта NVQLink, который позволяет объединять квантовые и графические процессоры в единую систему 👀

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍41
И напоследок, Nvidia также анонсировала открытую ИИ-модель Nemotron 3 Ultra Base — новую базовую модель с 500 млрд параметров которая, по заявлениям Хуанга, станет основой нового поколения мощнейших ИИ-моделей.

А теперь давайте посмотрим на слайд: вы увидите, что Nvidia решила не указывать версию моделей GLM (предположительно, речь идет о GLM-4.5), а также взяла устаревшую Kimi-K2, с которыми сравнивает свою флагманскую нейронку, гордо заявляя о 5-кратном приросте производительности в задачах размышления (и то на GB300 NVL72). На самом деле, это оправданно, так как только именно в этих версиях LLM разработчики из Z.ai и Moonshot ai публиковали открытый исходный код Base-нейронок.

🤖 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
Друзья, блокировка Telegram идет уже полным ходом, платформа замедлена уже на 80%, а в некоторых регионах этот показатель вовсе приближается к 90%.

Мы сами неоднократно сталкивались с последствиями блокировки: медиа загружаются в канал крайне медленно, посты выходят с задержками, в комментарии не зайти, и даже самые проверенные методы помогают все хуже и хуже. Пока есть возможность, мы будем делать посты здесь, но все может схлопнуться в любой момент.

На фоне этого, рекомендуем вам подписаться на наш канал в MAX — возможно, для многих из вас это будет последней возможностью перейти с нашего лампового Telegram-блога на альтернативную платформу.
💩28😡6👍22🍾1
А теперь к самым важным новостям с GTC 2026 — Nvidia наконец-то позволила соединять DGX Spark в кластеры из четырех устройств вместо двух...

А сразу нельзя было так сделать? (нет, потому что кластеров из четырех Minisforum тогда еще не было)

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
14🤯1
ServerFlow | Новости и Железо 💾
Кстати, мы все еще в поисках сервисного инженера по гарантии серверного оборудования 😅 (город Санкт-Петербург) Заработная плата – от 110 000 рублей! Мы ищем: Специалиста с глубоким пониманием схемотехники материнских плат: назначение и принципы работы конденсаторов…
Напоминаем, что вакансия сервисный инженер все еще открыта, а также спешим сообщить, что денежное довольствие повышается до 130 000 - 160 000 рублей!

Если Вы или Ваши знакомые (с опытом в пайке) проживают в Санкт-Петербурге и хотят попасть в нашу команду, то можете смело писать в личные сообщения канала!

Подробности сможете почитать в сообщении, на которое сделан реплай

До встречи в офисе! 😄
1👍4