ServerFlow | Новости и Железо 💾
4.24K subscribers
4.88K photos
387 videos
12 files
2.37K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
OpenAI сравнила свой первый кастомный ИИ-чип Jalapeño с системами NVIDIA GB200 и GB300. В собственных тестах InferenceX на GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T чип показал в 1,5-1,9 раза больше ИИ-производительности на ватт при максимальной пропускной способности и в 1,7-3,6 раза меньшую задержку в генерации ответа.

На интерактивных нагрузках разрыв оказался еще выше: OpenAI заявляет преимущество Jalapeño в 2,1-4,1 раза по производительности. Сам ускоритель рассчитан на 700 Вт, но во время указанных тестов потреблял не более 550 Вт.

OpenAI планирует начать развертывание Jalapeño до конца 2026 года. Второе поколение уже находится в активной разработке, работа над третьим поколением также началось. При этом все приведенные показатели получены во внутренних тестах OpenAI, поэтому сравнение с GB200 и GB300 пока нельзя считать независимым бенчмарком. К тому же очевидно, что на данном этапе развития Jalapeño масштабирование инфраструктуры вокруг этого процессора не идет ни в какое сравнение с NVIDIA NVL.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾7
Тайванская прокуратура предъявила обвинения менеджеру NVIDIA Чану, которого считает одним из организаторов поставок серверов с ускорителями B200 в Китай в обход экспортных ограничений США. По версии следствия, группа из девяти человек организовала отправку 74 серверов через Японию и Индонезию, а еще 56 серверов власти успели изъять до вывоза.

В схеме, по данным прокуратуры, участвовали также два руководителя, связанных с Supermicro. Для оформления закупки Flying Tiger должна была выглядеть легитимным партнером NVIDIA и арендатором мощностей в дата-центре Chief Telecom. Во время проверки Чан и один из фигурантов от Supermicro посетили площадку, после чего NVIDIA получила подтверждение проверки и разрешила заказ. В итоге Supermicro согласилась поставить Flying Tiger 130 серверов, хотя часть оборудования затем направили китайским покупателям.

Следствие считает, что схема работала как минимум с февраля 2025 года. Сама NVIDIA фигурантом дела не является, а Supermicro заявила, что после собственного расследования уволила сотрудников, связанных с нарушениями экспортного контроля.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4💩2😡2
SK hynix сообщила о работе сразу с несколькими технологиями корпусирования для HBM, включая CoWoS-S, CoWoS-L, CoWoS-R и Intel EMIB. На Hot Chips 2026 компания показала, что у HBM4 число контактов выросло с 1024 до 2048, а дальнейшее развитие памяти требует более сложной 2.5D и 3D-интеграции.

Особый интерес представляет EMIB-T. В этой версии упаковки Intel используются вертикальные TSV, которые позволяют подавать питание через несколько расположенных друг над другом кристаллов. По данным аналитиков, такая упаковка может оказаться до 50% дешевле TSMC CoWoS в зависимости от конфигурации и необходимости кремниевого интерпозера. Для производителей HBM это оставляет больше средств на увеличение объемов самой памяти, а для заказчиков дает альтернативу зависимости от упаковочных мощностей TSMC.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯9👍3
NVIDIA анонсировала новый ИИ-модуль Jetson Orin Nano 2 для робототехники и Edge AI. Платформа сохранила архитектуру Ampere, 8-ядерный Arm CPU и 8 ГБ LPDDR5X, но получила до 78 TOPS INT8 при TDP всего 40 Вт. Пропускная способность памяти составляет 120 ГБ/с, а заявленная производительность инференса выросла вдвое относительно предыдущей версии Jetson Orin Nano.

При работе в режиме с теплопакетом 15 Вт NVIDIA заявляет ту же производительность, которую предыдущий Orin Nano обеспечивал при более высоком энергопотреблении, но с экономией до 40%. Решение рассчитано на локальный запуск современных моделей на периферии, включая Qwen 3.5, Gemma 4, Nemotron и Cosmos. Старт продаж в 2027 году.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9🍾4
По данным инсайдеров, компания OpenAI завершила новое предварительное обучение ИИ-модели под кодовым названием Bel — преемника модели Doug, с более чем 10 триллионами параметров, которая является базовой моделью для дообучения с подкреплением грядущей флагманской нейронки GPT-6 Astra.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭11👍4🍾3
За кулисами конференции Hot Chips 2026. Высокие технологии, низкий кабель-менеджмент.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1💅16💩9🤯3👍1
Цены на GPU могут вырасти еще больше. Компания PC Partner, производящая видеокарты для таких брендов, как Zotac, Inno3D, Manli и Sapphire, ожидает, что во второй половине 2026 года ситуация с поставками графических процессоров значительно ухудшится. Сообщается, что в третьем квартале поставки RTX Blackwell от Nvidia уже ниже, чем во втором, и к концу года ожидается дальнейшее сокращение.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩13🤯5
На Hot Chips 2026 компания Waymo раскрыла детали о Sensor Fusion Processor — их ASIC-чипе для обработки данных с камер, LiDAR и радаров. Чип производится по техпроцессу TSMC N5, устанавливается в корпус FCBGA и работает с TDP менее 75 Вт. Внутри чипа находятся 64 МБ SRAM, 8 МБ регистровой памяти, LPDDR5X с пропускной способностью 273 ГБ/с, PCIe 5.0 x8 и контроллер 25GbE.

Основная вычислительная часть Waymo carTPU выдает 160 TOPS INT8 и 80 TFLOPS FP16. Архитектура разделена на три направления обработки данных: камеры, радары и объединение данных с разных датчиков. Каждая вычислительная секция содержит 2 RISC-V ядра с векторными расширениями и 2 МБ SRAM. Выполнение заранее компилируется в единый большой вычислительный модуль, поэтому процессор работает без кэшей и ветвлений, а компилятор заранее распределяет вычисления и обмен данными между блоками.

Waymo также встроила в чип значительную часть обработки самих датчиков. Камерный тракт включает прием данных, HDR-обработку, шумоподавление, собственную демозаикизацию и подготовку отдельных участков изображения. Для радаров и лидаров используются отдельные вычислительные блоки, в том числе для обработки точечных облаков и быстрого преобразования Фурье. После этого обработанные данные поступают в систему объединения информации от всех датчиков. По словам Waymo, этот процессор уже используется в автомобилях шестого поколения компании.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭2👍1
Компания XCENA представила MX1 — устройство на базе протокола CXL 3.2 Type 3, которое одновременно расширяет память сервера и выполняет вычисления рядом с данными. Через 4 канала DDR5 можно добавить до 2 ТБ памяти, подключение идет по PCIe 6.0. Кроме обычной оперативной памяти, MX1 умеет использовать SSD как дополнительное хранилище: часто используемые блоки по 64 КБ автоматически помещаются в DRAM, поэтому система может обращаться к ним через общий адресный интерфейс CXL.

В MX1 установлено более 1000 специализированных RISC-V ядер для обработки данных непосредственно рядом с памятью. Они берут на себя операции, которые обычно выполняются центральным процессором и требуют постоянного перетаскивания больших массивов данных: поиск по векторам, обработку KV-кэша, фильтрацию, сортировку трафика и другие подобные задачи. Встроенные векторные блоки обеспечивают до 3 TFLOPS в FP32/FP16 на операциях скалярного произведения.

В собственных тестах XCENA один MX1 обработал типовые задачи в 4,7 раза быстрее, чем центральный процессор при работе через CXL, и оказался в 18,7 раза эффективнее по энергопотреблению. При обращении к локальной DDR5 преимущество составило 2 раза по скорости и 6,2 раза по энергоэффективности. Массовое производство MX1 XCENA планирует начать к концу 2026 года.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7