ServerFlow | Новости и Железо 💾
4.25K subscribers
4.93K photos
392 videos
12 files
2.41K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
⚡️ До 336 МБ L3 в рабочих станциях: новые утечки о линейке Intel Granite Rapids-WS

По данным инсайдера, Intel готовит линейку Xeon Granite Rapids-WS для HEDT-станций. В списке фигурирует модель 698X с L3 объемом ~336 МБ и частотой 2,0 ГГц.

Эти чипы базируются на серверных кристаллах XCC и потенциально поднимают планку до ~86 ядер на CPU.


Серверные Granite Rapids работают с DDR5-6400 и MR-DIMM, для рабочих станций Intel, скорее всего, задействует 8-канальную память, хотя по данным утечки возможен и 12-канальный вариант.

Чипы также получат вычислительные блоки на техпроцессе Intel 3, а I/O кристалл — на Intel 7. Линейка включает модели от 2,0 до 3,5 ГГц и L3 от 48 до 336 МБ — но все параметры пока предварительные.


Если утечка подтвердится, Intel вернется в тяжелый HEDT-класс с архитектурой серверного уровня и большими объемами кэша, закрывая нишу между бюджетными десктопами и серверными платформами Xeon.
👍1
🧑‍💻 Huawei готовит софт для удвоения эффективности ИИ-чипов

По данным SCMP со ссылкой на госСМИ КНР, новая программная платформа Huawei позволит использовать ускорители Huawei, NVIDIA и других производителей с эффективностью до ~70% против текущих 30-40 %. Решение особенно актуально на фоне дефицита актуальных чипов NVIDIA и массовых закупок старого западного оборудования в Китае.

Технология повышает потенциал ИИ-платформ на базе чипов Huawei Ascend, включая грядущие SuperPOD с 8-15 тыс. ускорителей и перспективные суперкластеры на 500 тысяч чипов.


Похожий подход применялся в ПО израильского стартапа Run:ai, купленного NVIDIA в 2024 году за $700 млн для оркестрации нагрузки между массивами ускорителей.

Решение позволит компенсировать дефицит оборудования и укрепить позиции Huawei на рынке высокопроизводительных ИИ-систем.


Как именно работает программное ускорение — пока не раскрывается, да и вряд ли товарищ Си позволит рассказать на публику о такой перспективной и стратегически важной разработке.
👍5
🇨🇳 Loongson готовит к выпуску серверные CPU 3D7000 на 2027 год

Китайский производитель CPU Loongson анонсировал разработку серверных центральных процессоров 3D7000 с более чем 32 ядрами в одном чиплете.

Новые модели будут производиться как минимум на 10 нм техпроцессе, будут поддерживать DDR5 и PCIe 5.0, а их полноценный выход на китайский рынок ожидается к 2028 году.

Напомним, что процессоры предыдущего поколения 3C6000 имеют до 16 ядер на чиплет (всего 64 ядра) и TDP до 300 Вт, а чипы 3D5000 были ориентированы на рабочие станции, имели 32 ядра с частотой 2,0 ГГц.


В линейке 3D7000 компания Loongson планирует удвоить число ядер в чиплете, что сделает их более конкурентоспособными на фоне появления топовых западных серверных решений AMD Zen 6 с 32-ядерными CCD.

Помимо CPU, в разработке также находятся графические процессоры 9A1000 для ИИ-ПК начального уровня с поддержкой Windows.


Оба решения будут ориентированы на внутренний рынок Китая и позволят сократить зависимость от зарубежных решений.
👍3
🥇 TOП-10 PCI-E карт для ИИ-нагрузок

Судя по реакциям, наш прошлый ТОП-10 вам очень понравился! 🥰

Не будем тянуть резину — предлагаем ознакомиться с рейтингом лучших ИИ-решений, которые подойдут для любого сервера или ПК 👀
1👍7🌭1🍾1
🇨🇳 Первый GPU Lisuan на уровне RTX 4060 уже дошел до партнеров

Китайская компания Lisuan Tech отправила заказчикам первые тестовые образцы GPU 7G100 на 6 нм техпроцессе.

Компания говорит о штатных тестах и сборе отзывов, хотя изначально планировала начать испытания еще в августе и подготовить массовый выпуск к сентябрю, однако график сместился.


Чип 7G100 ляжет в основу моделей видеокарт 7G106 и 7G105 с поддержкой DirectX 12 (без RT), Vulkan 1.3 и OpenGL 4.6.

Потребительская карта 7G106 имеет 12 ГБ GDDR6 и питание через один 8-pin, а профессиональная версия 7G105 получает до 24 ГБ, ECC и защиту данных.


По заявлениям Lisuan Tech, в синтетических тестах 7G106 выдает ~26 800 баллов в Fire Strike и ~111 000 в Geekbench OpenCL, что ставит ее в один ряд с RTX 4060.

В целом проект выглядит рабочим, но без стабильного плана производства ждать девайсы в рознице рано. Для локального рынка КНР такие карты могут закрывать потребности там, где актуальные модели NVIDIA недоступны.
1🌭3🍾2💩1
😱 Дефицит DRAM обостряется: производители ПК срочно скупают память

По данным DigiTimes, Asus, MSI и другие производители ПК начали массово скупать DRAM и NAND — не только по контрактам, но и на спотовом рынке, где обычно закупаются небольшие компании.

Asus утверждает, что собственных запасов ей хватит примерно на два месяца и до конца 2025 года компания чувствует себя уверенно. Но если ситуация не изменится, в 2026-м производитель ожидает дефицит и, вероятно, повышение цен.

Причина — взрывной спрос на HBM и RDIMM со стороны центров обработки данных под задачи ИИ, которые забирают все поставки и оставляют потребительский сегмент без ресурсов.


Показательно, что даже крупные игроки вынуждены выходить на спотовый рынок — это уже привело к удвоению стоимости многих модулей ОЗУ и их исчезновению из розницы.

Все настолько плохо, что некоторые дистрибьюторы требуют от клиентов покупать материнские платы вместе с модулями DRAM.


Акции, золото, крипта? А может лучше…инвестировать в DRAM?
1👍5💅1
😵‍💫 AMD поднимет цены на видеокарты из-за подорожания памяти GDDR

Кризис памяти добрался даже до VRAM. По данным Chinese Board Channels, партнеры получили от AMD письмо, согласно которому из-за роста цен на видеопамять компания готовится поднять ценники на свои видеокарты Radeon и ИИ-ускорители Instinct.

Публичных комментариев и сроков нет.


Пока память DRAM дорожает на 60-80%, ценники на GDDR увеличиваются умереннее. Например, стоимость GDDR6 увеличилась лишь на 30%, но и этого хватает, чтобы себестоимость производства заметно выросла.

Производители памяти уводят мощности под DDR5, HBM и ИИ-оборудование, из-за чего обычная VRAM оказываются в очереди.


Если верить отчету, изменения в рознице проявятся не сразу. На рынке уже ходят слухи, что NVIDIA может сделать аналогичный шаг в начале 2026 года, а также по той же причине готовится к переносу релиза RTX 6000.
💩3
⚒️ d-Matrix и Alchip создают первый в мире ИИ-ускоритель на базе 3D DRAM

d-Matrix и Alchip объявили о стратегическом партнерстве по разработке первого в мире ускорителя инференса для дата-центров, использующего 3D DRAM вместо HBM.

Компании заявляют, что новый подход устранит ограничения производительности и стоимости производства HBM.

В основе проекта лежит технология d-Matrix 3DIMC, уже задействованная в тестовых кристаллах Pavehawk. Коммерческий дебют технологии ожидается в ускорителе d-Matrix Raptor, преемнике решений Corsair.


По заявлениям разработчиков, Raptor обеспечит до 10x более быстрый вывод, чем решения на основе HBM4, что выглядит очень и очень перспективно.

d-Matrix делает ставку на архитектуру “compute-in-memory”, а Alchip предоставляет свои компетенции в области высокопроизводительных ASIC-микросхем.


Партнерство стало развитием идей, впервые публично представленных на Hot Chips 2025.
1👍3🌭1
🚀 MSI показала серверы и рабочие станции на базе NVIDIA MGX и DGX AI

Компания MSI на конференции SC25 представила новое поколение систем ИИ: от 4U-серверов на AMD EPYC и Intel Xeon 6 до настольных платформ на базе суперчипов Grace Blackwell.

Линейка базируется на платформах NVIDIA MGX, DGX Station и DGX Spark и рассчитана на обучение LLM, развертывание системы Omniverse и требовательный ИИ-инференс.


Старшая 4U-серия CG481-S6053 поддерживает до 8x GPU по 600 Вт, 24-32 слота DDR5 и быстрый NVMe-пул, доступна интеграция 2x Xeon 6 или 2x EPYC 9005.

Также есть 2U-модель CG290-S3063 на базе 1x Xeon 6 с 4x GPU, рассчитанная под легкий ИИ-инференс.

В области настольных решений представили AI Station CT60-S8060 с ускорителем GB300 и памятью до 784 ГБ, а также мини-ПК EdgeXpert на базе GB10 для домашних ИИ-лабораторий.

MSI закрыла весь диапазон задач — от крупных дата-центров до персональных сетапов.
👍3💩1
⚛️ AMD и Eviden работают над европейским суперкомпьютером Alice Recoque

Франция заказала у AMD и Eviden создать Alice Recoque — вторую в Европе HPC-систему экзафлопсного класса. Проект создается за счет бюджете организации EuroHPC, стоимость суперкомпьютера составляет более 544€ млн.

Машина станет первой во Франции с уровнем Exascale и будет выполнять роль ИИ-фабрики для научных исследований и промышленности.

В стойках новые AMD EPYC Venice, Instinct MI430X с 432 ГБ HBM4 и пропускной способностью до 19.6 ТБ/с, плюс FPGA AMD для ускорения вычислений.


Все собрано на новой HPC-платформе BullSequana XH3500 с сетью BXI и хранилищем DDN. Архитектура требует примерно на 25% меньше стоек, а энергоэффективность на GPU, по данным Eviden, выше примерно на 50%.

При этом систему делают под широкий стек задач — от климатического моделирования до цифровых двойников и тренировок моделей ИИ.


Жидкостное охлаждение снижает энергозатраты, а ПО Eviden Argos позволяет мониторить эффективность HPC в реальном времени.
🌭3
⚡️ Вышла Gemini 3 Pro Preview: контекст до 1M токенов и бесплатный доступ в AI Studio

Google наконец-то выпустила долгожданную ИИ-модель Gemini 3 Pro Preview в AI Studio.

Моделью уже пользоваться можно совершенно бесплатно, если разрешить использование диалогов для обучения. Позже нейронка появится в приложении Gemini, Vertex AI и через API.

Стоимость API уже известна: от $2 до $4 за миллион входящих токенов и от $12 до $18 за миллион выходных в зависимости от размера контекстного окна.


Модель обучали с нуля на TPU Ironwood и заявлено контекстное окно до 1 млн токенов. В SWE-Bench Verified она почти сравнялась с Claude Sonnet 4.5, а в ряде тестов ушла вперед.

Например, в ARC-AGI-2 результат 31.1% против 17.6% у GPT-5.1 Thinking, а в MathArena Apex — 23.4%. Уровень в ScreenSpot-Pro тоже заметно вырос, что важно для агентских задач.


Пока это, конечно, статус Preview. Google, скорее всего, даст еще несколько чекпоинтов перед полноценным релизом, так что характеристики могут еще заметно подняться.
1👍2🌭11
❄️ Noctua готовит к релизу total-black кулер NH-D15 G2 Chromax Black

Noctua начала официально подогревать интерес к новому кулеру Chromax Black NH-D15 G2 — полностью черной версии своего флагманского NH-D15 G2.

Согласно дорожной карте Noctua, релиз намечен на четвертый квартал 2025 года, так что компания уже входит в финальную фазу подготовки продукта.

Вместе с кулером выйдут и новые вентиляторы NF-A14x25 G2 — также в исполнении Chromax Black, включая стандартную и R-версию.


Как и другие устройства линейки Chromax Black, новинка отличается в первую очередь эстетикой: вместо фирменной бежево-коричневой гаммы — полностью черное исполнение. При этом уровень охлаждения остается таким же, как у стандартного NH-D15 G2~240 Вт.

Совместимость также должна соответствовать текущим моделям G2, включая Intel LGA1851 и LGA1700, а также AMD AM5 и AM4 с помощью системы крепления SecuFirm2+.


Ценники пока неизвестны — предположительно, немногим выше стандартного NH-D15 G2 (~$150).
1👍5💩2💅1
⚒️ Open-source пакет AMD Enterprise AI Suite выходит в продакшен

AMD запустила Enterprise AI Suiteновый открытый пакет для разработки и запуска ИИ-нагрузок на ускорителях Instinct (фактически полный аналог Nvidia AI Enterprise). Решение строится поверх стека ROCm и включает микросервисы AIM, которые ускоряют развертывание моделей и помогают навести порядок в инфраструктуре ИИ.

Пакет ориентирован на развертывание через Kubernetes и уже доступен администраторам и командам MLOps.


Новый ПО-стек также включает AI Workbench, а в основе решения лежат технологии Cluster-Forge, доставшиеся AMD после покупки Silo AI.

Пакет помогает распределять ИИ-задачи, следить за производительностью и сокращать время вывода моделей в продакшен.


Для рынка это еще один шаг к более цельной экосистеме AMD в корпоративном ИИ. Скорее всего, Suite станет стандартным вариантом для кластеров на Instinct и позволит конкурировать с проприетарными стеками Nvidia.
1👍3💩11
👀 А вот так выглядит новый центральный процессор Microsoft

Это Arm-CPU Azure Cobalt 200, анонсированный еще 2 года назад.

Microsoft заявляет, что его производительность будет аж на 50% выше, чем у 128-ядерного Cobalt 100 — всего благодаря переходу с 5-нм на 3-нм техпроцесс.

Но в купить Cobalt 200, к сожалению, не получится — его задействуют для оптимизации производительности и уменьшения энергопотребления облачной инфраструктуры Azure.
2👍4