🗓 Коротко о главных новостях за эту неделю
❗️ В нашем блоге вышла статья о векторных базах данных.
❗️ AMD раскрыла подробности о архитектурах Zen 6/Zen 7 и ускорителях MI400/MI500.
❗️ IBM представила передовые квантовые процессоры NightHawk и Loon.
❗️ OpenAI релизнула новую ИИ-модель GPT-5.1.
❗️ Baidu анонсировала NPU-чипы M100/M300 и новую модель Ernie 5.0.
❗️ Мы также выпустили статью о операционной системе Nvidia DGX-OS.
❗️ HPE и Eviden показали новые суперкомпьютерные платформы.
❗️ Мы сделали подробный разбор причин и следствий кризиса памяти в 2025 году.
❗️ В нашем блоге вышла статья о векторных базах данных.
❗️ AMD раскрыла подробности о архитектурах Zen 6/Zen 7 и ускорителях MI400/MI500.
❗️ IBM представила передовые квантовые процессоры NightHawk и Loon.
❗️ OpenAI релизнула новую ИИ-модель GPT-5.1.
❗️ Baidu анонсировала NPU-чипы M100/M300 и новую модель Ernie 5.0.
❗️ Мы также выпустили статью о операционной системе Nvidia DGX-OS.
❗️ HPE и Eviden показали новые суперкомпьютерные платформы.
❗️ Мы сделали подробный разбор причин и следствий кризиса памяти в 2025 году.
ServerFlow
Что такое векторные базы данных и как они устроены | Блог Serverflow
1👍5💅1
❌ Intel делает ставку на 16-канальные Xeon 7: 8-канальные модели отменены
Компания Intel убрала 8-канальные серверные чипы Diamond Rapids из дорожной карты и теперь фокусируется на 16-канальных версиях.
В линейке будут использоваться P-ядра Panther Cove, всего линейка будет иметь до 192 ядер, при этом Diamond Rapids не будут иметь многопоточности, что нетипично для серверного сегмента.
Рост числа каналов памяти с 8 до 16 и MRDIMM 2-го поколения должны дать ощутимый выигрыш в тяжелых серверных нагрузках, но без многопоточки они все-таки выглядят странно.
Компания Intel убрала 8-канальные серверные чипы Diamond Rapids из дорожной карты и теперь фокусируется на 16-канальных версиях.
Это даст заметный прирост пропускной способности: второе поколение MRDIMM поднимает скорость передачи данных до ~12 800 MT/s против ~8 800 MT/s у Xeon 6.
В линейке будут использоваться P-ядра Panther Cove, всего линейка будет иметь до 192 ядер, при этом Diamond Rapids не будут иметь многопоточности, что нетипично для серверного сегмента.
Новое поколение CPU выйдет во второй половине 2026 года, а поддержка Hyper-Threading вернется уже в семействе Coral Rapids.
Рост числа каналов памяти с 8 до 16 и MRDIMM 2-го поколения должны дать ощутимый выигрыш в тяжелых серверных нагрузках, но без многопоточки они все-таки выглядят странно.
👍2
⚡️ До 336 МБ L3 в рабочих станциях: новые утечки о линейке Intel Granite Rapids-WS
По данным инсайдера, Intel готовит линейку Xeon Granite Rapids-WS для HEDT-станций. В списке фигурирует модель 698X с L3 объемом ~336 МБ и частотой 2,0 ГГц.
Серверные Granite Rapids работают с DDR5-6400 и MR-DIMM, для рабочих станций Intel, скорее всего, задействует 8-канальную память, хотя по данным утечки возможен и 12-канальный вариант.
Если утечка подтвердится, Intel вернется в тяжелый HEDT-класс с архитектурой серверного уровня и большими объемами кэша, закрывая нишу между бюджетными десктопами и серверными платформами Xeon.
По данным инсайдера, Intel готовит линейку Xeon Granite Rapids-WS для HEDT-станций. В списке фигурирует модель 698X с L3 объемом ~336 МБ и частотой 2,0 ГГц.
Эти чипы базируются на серверных кристаллах XCC и потенциально поднимают планку до ~86 ядер на CPU.
Серверные Granite Rapids работают с DDR5-6400 и MR-DIMM, для рабочих станций Intel, скорее всего, задействует 8-канальную память, хотя по данным утечки возможен и 12-канальный вариант.
Чипы также получат вычислительные блоки на техпроцессе Intel 3, а I/O кристалл — на Intel 7. Линейка включает модели от 2,0 до 3,5 ГГц и L3 от 48 до 336 МБ — но все параметры пока предварительные.
Если утечка подтвердится, Intel вернется в тяжелый HEDT-класс с архитектурой серверного уровня и большими объемами кэша, закрывая нишу между бюджетными десктопами и серверными платформами Xeon.
👍1
🧑💻 Huawei готовит софт для удвоения эффективности ИИ-чипов
По данным SCMP со ссылкой на госСМИ КНР, новая программная платформа Huawei позволит использовать ускорители Huawei, NVIDIA и других производителей с эффективностью до ~70% против текущих 30-40 %. Решение особенно актуально на фоне дефицита актуальных чипов NVIDIA и массовых закупок старого западного оборудования в Китае.
Похожий подход применялся в ПО израильского стартапа Run:ai, купленного NVIDIA в 2024 году за $700 млн для оркестрации нагрузки между массивами ускорителей.
Как именно работает программное ускорение — пока не раскрывается, да и вряд ли товарищ Си позволит рассказать на публику о такой перспективной и стратегически важной разработке.
По данным SCMP со ссылкой на госСМИ КНР, новая программная платформа Huawei позволит использовать ускорители Huawei, NVIDIA и других производителей с эффективностью до ~70% против текущих 30-40 %. Решение особенно актуально на фоне дефицита актуальных чипов NVIDIA и массовых закупок старого западного оборудования в Китае.
Технология повышает потенциал ИИ-платформ на базе чипов Huawei Ascend, включая грядущие SuperPOD с 8-15 тыс. ускорителей и перспективные суперкластеры на 500 тысяч чипов.
Похожий подход применялся в ПО израильского стартапа Run:ai, купленного NVIDIA в 2024 году за $700 млн для оркестрации нагрузки между массивами ускорителей.
Решение позволит компенсировать дефицит оборудования и укрепить позиции Huawei на рынке высокопроизводительных ИИ-систем.
Как именно работает программное ускорение — пока не раскрывается, да и вряд ли товарищ Си позволит рассказать на публику о такой перспективной и стратегически важной разработке.
👍5
🇨🇳 Loongson готовит к выпуску серверные CPU 3D7000 на 2027 год
Китайский производитель CPU Loongson анонсировал разработку серверных центральных процессоров 3D7000 с более чем 32 ядрами в одном чиплете.
Новые модели будут производиться как минимум на 10 нм техпроцессе, будут поддерживать DDR5 и PCIe 5.0, а их полноценный выход на китайский рынок ожидается к 2028 году.
В линейке 3D7000 компания Loongson планирует удвоить число ядер в чиплете, что сделает их более конкурентоспособными на фоне появления топовых западных серверных решений AMD Zen 6 с 32-ядерными CCD.
Оба решения будут ориентированы на внутренний рынок Китая и позволят сократить зависимость от зарубежных решений.
Китайский производитель CPU Loongson анонсировал разработку серверных центральных процессоров 3D7000 с более чем 32 ядрами в одном чиплете.
Новые модели будут производиться как минимум на 10 нм техпроцессе, будут поддерживать DDR5 и PCIe 5.0, а их полноценный выход на китайский рынок ожидается к 2028 году.
Напомним, что процессоры предыдущего поколения 3C6000 имеют до 16 ядер на чиплет (всего 64 ядра) и TDP до 300 Вт, а чипы 3D5000 были ориентированы на рабочие станции, имели 32 ядра с частотой 2,0 ГГц.
В линейке 3D7000 компания Loongson планирует удвоить число ядер в чиплете, что сделает их более конкурентоспособными на фоне появления топовых западных серверных решений AMD Zen 6 с 32-ядерными CCD.
Помимо CPU, в разработке также находятся графические процессоры 9A1000 для ИИ-ПК начального уровня с поддержкой Windows.
Оба решения будут ориентированы на внутренний рынок Китая и позволят сократить зависимость от зарубежных решений.
👍3
🇨🇳 Первый GPU Lisuan на уровне RTX 4060 уже дошел до партнеров
Китайская компания Lisuan Tech отправила заказчикам первые тестовые образцы GPU 7G100 на 6 нм техпроцессе.
Чип 7G100 ляжет в основу моделей видеокарт 7G106 и 7G105 с поддержкой DirectX 12(без RT) , Vulkan 1.3 и OpenGL 4.6.
По заявлениям Lisuan Tech, в синтетических тестах 7G106 выдает ~26 800 баллов в Fire Strike и ~111 000 в Geekbench OpenCL, что ставит ее в один ряд с RTX 4060.
В целом проект выглядит рабочим, но без стабильного плана производства ждать девайсы в рознице рано. Для локального рынка КНР такие карты могут закрывать потребности там, где актуальные модели NVIDIA недоступны.
Китайская компания Lisuan Tech отправила заказчикам первые тестовые образцы GPU 7G100 на 6 нм техпроцессе.
Компания говорит о штатных тестах и сборе отзывов, хотя изначально планировала начать испытания еще в августе и подготовить массовый выпуск к сентябрю, однако график сместился.
Чип 7G100 ляжет в основу моделей видеокарт 7G106 и 7G105 с поддержкой DirectX 12
Потребительская карта 7G106 имеет 12 ГБ GDDR6 и питание через один 8-pin, а профессиональная версия 7G105 получает до 24 ГБ, ECC и защиту данных.
По заявлениям Lisuan Tech, в синтетических тестах 7G106 выдает ~26 800 баллов в Fire Strike и ~111 000 в Geekbench OpenCL, что ставит ее в один ряд с RTX 4060.
В целом проект выглядит рабочим, но без стабильного плана производства ждать девайсы в рознице рано. Для локального рынка КНР такие карты могут закрывать потребности там, где актуальные модели NVIDIA недоступны.
1🌭3🍾2💩1
😱 Дефицит DRAM обостряется: производители ПК срочно скупают память
По данным DigiTimes, Asus, MSI и другие производители ПК начали массово скупать DRAM и NAND — не только по контрактам, но и на спотовом рынке, где обычно закупаются небольшие компании.
Asus утверждает, что собственных запасов ей хватит примерно на два месяца и до конца 2025 года компания чувствует себя уверенно. Но если ситуация не изменится, в 2026-м производитель ожидает дефицит и, вероятно, повышение цен.
Показательно, что даже крупные игроки вынуждены выходить на спотовый рынок — это уже привело к удвоению стоимости многих модулей ОЗУ и их исчезновению из розницы.
Акции, золото, крипта? А может лучше…инвестировать в DRAM?
По данным DigiTimes, Asus, MSI и другие производители ПК начали массово скупать DRAM и NAND — не только по контрактам, но и на спотовом рынке, где обычно закупаются небольшие компании.
Asus утверждает, что собственных запасов ей хватит примерно на два месяца и до конца 2025 года компания чувствует себя уверенно. Но если ситуация не изменится, в 2026-м производитель ожидает дефицит и, вероятно, повышение цен.
Причина — взрывной спрос на HBM и RDIMM со стороны центров обработки данных под задачи ИИ, которые забирают все поставки и оставляют потребительский сегмент без ресурсов.
Показательно, что даже крупные игроки вынуждены выходить на спотовый рынок — это уже привело к удвоению стоимости многих модулей ОЗУ и их исчезновению из розницы.
Все настолько плохо, что некоторые дистрибьюторы требуют от клиентов покупать материнские платы вместе с модулями DRAM.
Акции, золото, крипта? А может лучше…инвестировать в DRAM?
1👍5💅1
😵💫 AMD поднимет цены на видеокарты из-за подорожания памяти GDDR
Кризис памяти добрался даже до VRAM. По данным Chinese Board Channels, партнеры получили от AMD письмо, согласно которому из-за роста цен на видеопамять компания готовится поднять ценники на свои видеокарты Radeon и ИИ-ускорители Instinct.
Пока память DRAM дорожает на 60-80%, ценники на GDDR увеличиваются умереннее. Например, стоимость GDDR6 увеличилась лишь на 30%, но и этого хватает, чтобы себестоимость производства заметно выросла.
Если верить отчету, изменения в рознице проявятся не сразу. На рынке уже ходят слухи, что NVIDIA может сделать аналогичный шаг в начале 2026 года, а также по той же причине готовится к переносу релиза RTX 6000.
Кризис памяти добрался даже до VRAM. По данным Chinese Board Channels, партнеры получили от AMD письмо, согласно которому из-за роста цен на видеопамять компания готовится поднять ценники на свои видеокарты Radeon и ИИ-ускорители Instinct.
Публичных комментариев и сроков нет.
Пока память DRAM дорожает на 60-80%, ценники на GDDR увеличиваются умереннее. Например, стоимость GDDR6 увеличилась лишь на 30%, но и этого хватает, чтобы себестоимость производства заметно выросла.
Производители памяти уводят мощности под DDR5, HBM и ИИ-оборудование, из-за чего обычная VRAM оказываются в очереди.
Если верить отчету, изменения в рознице проявятся не сразу. На рынке уже ходят слухи, что NVIDIA может сделать аналогичный шаг в начале 2026 года, а также по той же причине готовится к переносу релиза RTX 6000.
💩3
⚒️ d-Matrix и Alchip создают первый в мире ИИ-ускоритель на базе 3D DRAM
d-Matrix и Alchip объявили о стратегическом партнерстве по разработке первого в мире ускорителя инференса для дата-центров, использующего 3D DRAM вместо HBM.
Компании заявляют, что новый подход устранит ограничения производительности и стоимости производства HBM.
По заявлениям разработчиков, Raptor обеспечит до 10x более быстрый вывод, чем решения на основе HBM4, что выглядит очень и очень перспективно.
Партнерство стало развитием идей, впервые публично представленных на Hot Chips 2025.
d-Matrix и Alchip объявили о стратегическом партнерстве по разработке первого в мире ускорителя инференса для дата-центров, использующего 3D DRAM вместо HBM.
Компании заявляют, что новый подход устранит ограничения производительности и стоимости производства HBM.
В основе проекта лежит технология d-Matrix 3DIMC, уже задействованная в тестовых кристаллах Pavehawk. Коммерческий дебют технологии ожидается в ускорителе d-Matrix Raptor, преемнике решений Corsair.
По заявлениям разработчиков, Raptor обеспечит до 10x более быстрый вывод, чем решения на основе HBM4, что выглядит очень и очень перспективно.
d-Matrix делает ставку на архитектуру “compute-in-memory”, а Alchip предоставляет свои компетенции в области высокопроизводительных ASIC-микросхем.
Партнерство стало развитием идей, впервые публично представленных на Hot Chips 2025.
1👍3🌭1
🚀 MSI показала серверы и рабочие станции на базе NVIDIA MGX и DGX AI
Компания MSI на конференции SC25 представила новое поколение систем ИИ: от 4U-серверов на AMD EPYC и Intel Xeon 6 до настольных платформ на базе суперчипов Grace Blackwell.
✅ Старшая 4U-серия CG481-S6053 поддерживает до 8x GPU по 600 Вт, 24-32 слота DDR5 и быстрый NVMe-пул, доступна интеграция 2x Xeon 6 или 2x EPYC 9005.
✅ Также есть 2U-модель CG290-S3063 на базе 1x Xeon 6 с 4x GPU, рассчитанная под легкий ИИ-инференс.
✅ В области настольных решений представили AI Station CT60-S8060 с ускорителем GB300 и памятью до 784 ГБ, а также мини-ПК EdgeXpert на базе GB10 для домашних ИИ-лабораторий.
MSI закрыла весь диапазон задач — от крупных дата-центров до персональных сетапов.
Компания MSI на конференции SC25 представила новое поколение систем ИИ: от 4U-серверов на AMD EPYC и Intel Xeon 6 до настольных платформ на базе суперчипов Grace Blackwell.
Линейка базируется на платформах NVIDIA MGX, DGX Station и DGX Spark и рассчитана на обучение LLM, развертывание системы Omniverse и требовательный ИИ-инференс.
✅ Старшая 4U-серия CG481-S6053 поддерживает до 8x GPU по 600 Вт, 24-32 слота DDR5 и быстрый NVMe-пул, доступна интеграция 2x Xeon 6 или 2x EPYC 9005.
✅ Также есть 2U-модель CG290-S3063 на базе 1x Xeon 6 с 4x GPU, рассчитанная под легкий ИИ-инференс.
✅ В области настольных решений представили AI Station CT60-S8060 с ускорителем GB300 и памятью до 784 ГБ, а также мини-ПК EdgeXpert на базе GB10 для домашних ИИ-лабораторий.
MSI закрыла весь диапазон задач — от крупных дата-центров до персональных сетапов.
👍3💩1
⚛️ AMD и Eviden работают над европейским суперкомпьютером Alice Recoque
Франция заказала у AMD и Eviden создать Alice Recoque — вторую в Европе HPC-систему экзафлопсного класса. Проект создается за счет бюджете организации EuroHPC, стоимость суперкомпьютера составляет более 544€ млн.
Машина станет первой во Франции с уровнем Exascale и будет выполнять роль ИИ-фабрики для научных исследований и промышленности.
Все собрано на новой HPC-платформе BullSequana XH3500 с сетью BXI и хранилищем DDN. Архитектура требует примерно на 25% меньше стоек, а энергоэффективность на GPU, по данным Eviden, выше примерно на 50%.
Жидкостное охлаждение снижает энергозатраты, а ПО Eviden Argos позволяет мониторить эффективность HPC в реальном времени.
Франция заказала у AMD и Eviden создать Alice Recoque — вторую в Европе HPC-систему экзафлопсного класса. Проект создается за счет бюджете организации EuroHPC, стоимость суперкомпьютера составляет более 544€ млн.
Машина станет первой во Франции с уровнем Exascale и будет выполнять роль ИИ-фабрики для научных исследований и промышленности.
В стойках новые AMD EPYC Venice, Instinct MI430X с 432 ГБ HBM4 и пропускной способностью до 19.6 ТБ/с, плюс FPGA AMD для ускорения вычислений.
Все собрано на новой HPC-платформе BullSequana XH3500 с сетью BXI и хранилищем DDN. Архитектура требует примерно на 25% меньше стоек, а энергоэффективность на GPU, по данным Eviden, выше примерно на 50%.
При этом систему делают под широкий стек задач — от климатического моделирования до цифровых двойников и тренировок моделей ИИ.
Жидкостное охлаждение снижает энергозатраты, а ПО Eviden Argos позволяет мониторить эффективность HPC в реальном времени.
🌭3
⚡️ Вышла Gemini 3 Pro Preview: контекст до 1M токенов и бесплатный доступ в AI Studio
Google наконец-то выпустила долгожданную ИИ-модель Gemini 3 Pro Preview в AI Studio.
Моделью уже пользоваться можно совершенно бесплатно, если разрешить использование диалогов для обучения. Позже нейронка появится в приложении Gemini, Vertex AI и через API.
Модель обучали с нуля на TPU Ironwood и заявлено контекстное окно до 1 млн токенов. В SWE-Bench Verified она почти сравнялась с Claude Sonnet 4.5, а в ряде тестов ушла вперед.
Пока это, конечно, статус Preview. Google, скорее всего, даст еще несколько чекпоинтов перед полноценным релизом, так что характеристики могут еще заметно подняться.
Google наконец-то выпустила долгожданную ИИ-модель Gemini 3 Pro Preview в AI Studio.
Моделью уже пользоваться можно совершенно бесплатно, если разрешить использование диалогов для обучения. Позже нейронка появится в приложении Gemini, Vertex AI и через API.
Стоимость API уже известна: от $2 до $4 за миллион входящих токенов и от $12 до $18 за миллион выходных в зависимости от размера контекстного окна.
Модель обучали с нуля на TPU Ironwood и заявлено контекстное окно до 1 млн токенов. В SWE-Bench Verified она почти сравнялась с Claude Sonnet 4.5, а в ряде тестов ушла вперед.
Например, в ARC-AGI-2 результат 31.1% против 17.6% у GPT-5.1 Thinking, а в MathArena Apex — 23.4%. Уровень в ScreenSpot-Pro тоже заметно вырос, что важно для агентских задач.
Пока это, конечно, статус Preview. Google, скорее всего, даст еще несколько чекпоинтов перед полноценным релизом, так что характеристики могут еще заметно подняться.
1👍2🌭1 1
❄️ Noctua готовит к релизу total-black кулер NH-D15 G2 Chromax Black
Noctua начала официально подогревать интерес к новому кулеру Chromax Black NH-D15 G2 — полностью черной версии своего флагманского NH-D15 G2.
Согласно дорожной карте Noctua, релиз намечен на четвертый квартал 2025 года, так что компания уже входит в финальную фазу подготовки продукта.
Как и другие устройства линейки Chromax Black, новинка отличается в первую очередь эстетикой: вместо фирменной бежево-коричневой гаммы — полностью черное исполнение. При этом уровень охлаждения остается таким же, как у стандартного NH-D15 G2 — ~240 Вт.
Ценники пока неизвестны — предположительно, немногим выше стандартного NH-D15 G2 (~$150).
Noctua начала официально подогревать интерес к новому кулеру Chromax Black NH-D15 G2 — полностью черной версии своего флагманского NH-D15 G2.
Согласно дорожной карте Noctua, релиз намечен на четвертый квартал 2025 года, так что компания уже входит в финальную фазу подготовки продукта.
Вместе с кулером выйдут и новые вентиляторы NF-A14x25 G2 — также в исполнении Chromax Black, включая стандартную и R-версию.
Как и другие устройства линейки Chromax Black, новинка отличается в первую очередь эстетикой: вместо фирменной бежево-коричневой гаммы — полностью черное исполнение. При этом уровень охлаждения остается таким же, как у стандартного NH-D15 G2 — ~240 Вт.
Совместимость также должна соответствовать текущим моделям G2, включая Intel LGA1851 и LGA1700, а также AMD AM5 и AM4 с помощью системы крепления SecuFirm2+.
Ценники пока неизвестны — предположительно, немногим выше стандартного NH-D15 G2 (~$150).
1👍5💩2💅1
⚒️ Open-source пакет AMD Enterprise AI Suite выходит в продакшен
AMD запустила Enterprise AI Suite — новый открытый пакет для разработки и запуска ИИ-нагрузок на ускорителях Instinct (фактически полный аналог Nvidia AI Enterprise). Решение строится поверх стека ROCm и включает микросервисы AIM, которые ускоряют развертывание моделей и помогают навести порядок в инфраструктуре ИИ.
Новый ПО-стек также включает AI Workbench, а в основе решения лежат технологии Cluster-Forge, доставшиеся AMD после покупки Silo AI.
Для рынка это еще один шаг к более цельной экосистеме AMD в корпоративном ИИ. Скорее всего, Suite станет стандартным вариантом для кластеров на Instinct и позволит конкурировать с проприетарными стеками Nvidia.
AMD запустила Enterprise AI Suite — новый открытый пакет для разработки и запуска ИИ-нагрузок на ускорителях Instinct (фактически полный аналог Nvidia AI Enterprise). Решение строится поверх стека ROCm и включает микросервисы AIM, которые ускоряют развертывание моделей и помогают навести порядок в инфраструктуре ИИ.
Пакет ориентирован на развертывание через Kubernetes и уже доступен администраторам и командам MLOps.
Новый ПО-стек также включает AI Workbench, а в основе решения лежат технологии Cluster-Forge, доставшиеся AMD после покупки Silo AI.
Пакет помогает распределять ИИ-задачи, следить за производительностью и сокращать время вывода моделей в продакшен.
Для рынка это еще один шаг к более цельной экосистеме AMD в корпоративном ИИ. Скорее всего, Suite станет стандартным вариантом для кластеров на Instinct и позволит конкурировать с проприетарными стеками Nvidia.
1👍3💩1 1