ServerFlow | Новости и Железо 💾
4.23K subscribers
4.87K photos
386 videos
12 files
2.36K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
По данным портала Phoronix, в новых патчах для ядра Linux появилось упоминание нового, ранее неизвестного x86-процессора. Процессор работает только в 64-битном PM64-режиме и использует 5-уровневую адресацию PML5, полностью отказываясь от старых 16 и 32-битных режимов. Это фактически тот путь развития x86S, от которого Intel отказалась в 2024 году.

По архитектуре проект выглядит очень необычно. APX увеличивает число регистров общего назначения с 16 до 32, FRED упрощает обработку системных событий и переходов между уровнями привилегий, а AMX/ACE может использовать конфигурации на 16 и 32 тайлов-регистра против 8 в актуальных Intel Xeon. Последнее особенно интересно для матричных вычислений и ИИ-нагрузок, хотя реальная производительность неизвестна: публичных тестов и даже точных характеристик самого CPU пока нет.

Кто разработал чип, неизвестно. Среди возможных кандидатов называют китайские Zhaoxin и Hygon, а также стартап RosaicLabs, которому, по сообщениям, Intel предоставила доступ к технологиям Atom. Связь с любой из этих компаний пока не подтверждена.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11
DeepSeek V4.1 Flash появилась в Vercel AI Gateway в формате бета-тестирования. Нейронка имеет контекстное окно в 1 миллион токенов и нативную поддержку мультимодального ввода изображений.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8💅2
NVIDIA, по данным инсайдера hongxing2020, готовит вторую версию GeForce RTX 5070 с кристаллом GB203 вместо нынешнего GB205. При этом характеристики карты, судя по утечке, останутся прежними: 6 144 CUDA-ядер, 12 ГБ GDDR7 и 192-битная шина. NVIDIA официально эти изменения пока не подтверждала.

Разница между чипами существенная. GB203 физически имеет площадь около 378 мм² против 263 мм² у GB205 и используется в более старших RTX 5070 Ti и RTX 5080. Чтобы превратить его в RTX 5070, NVIDIA должна отключить около 43% CUDA-ядер и четверть каналов памяти. Скорее всего, речь о биннинге: неудачные чипы GB203, которые не проходят требования для старших видеокарт, можно использовать в более низком сегменте рынка для утилизации брака.

Для пользователя прирост производительности не ожидается, поскольку итоговые характеристики останутся на уровне обычной RTX 5070. Зато NVIDIA получит больше свободы в использовании кремния, а на рынке могут одновременно появиться две RTX 5070 с разными физическими GPU при одинаковом названии и спецификациях.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯7👍2💅1
Китайская компания Rayson представила модуль памяти LPDDR5X LPCAMM2 на 96 ГБ со скоростью до 9 600 MT/s. Формат сочетает высокую плотность LPDDR5X с возможностью замены.

Модуль имеет размеры всего 78 × 23 × 3 мм и, по данным производителя, занимает примерно на 60% меньше площади платы, чем DDR5 SO-DIMM, энергопотребление заявлено примерно на 50% ниже, а энергоэффективность на 70% выше аналога.

96 ГБ при 9 600 MT/s уже не являются уникальной конфигурацией: аналогичный модуль Samsung показывали ещё в феврале, но тогда он не был запущен в массовое производство. Rayson также готовит версии на 16, 32 и 64 ГБ, однако цену и дату появления 96-гигабайтного модуля в рознице пока не раскрыла.

Модули Rayson LPDDR5X LPCAMM2 будут использоваться в ультрабуках с мощными CPU, встроенной графикой и ИИ-функционалом, обеспечивая большой пул быстрой памяти для локального инференса

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🍾1
Китайские производители памяти CXMT и YMTC, по данным Financial Times, приобрели достаточно литографических DUV-машин ASML, чтобы обеспечить планы расширения производства на ближайшие три года.

Параллельно Китай ускоряет развитие собственного оборудования. Компания Yuliangsheng рассчитывает выпустить до 12 отечественных DUV-сканеров уже к концу 2026 года, тогда как ранее ожидалось только пять машин от связанной с ней Aishenga.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍16
Phanteks представила серию корпусов EX5 для ПК, где компоненты распределены по отдельным отсекам вместо привычной аквариумной компоновки. Это позволяет направлять воздух непосредственно к нужным узлам и эффективнее выводить тепло, снижая необходимость в большом количестве вентиляторов.

Все версии поддерживают видеокарты до 358 мм и радиаторы до 360 мм, а сзади материнской платы установлен дополнительный вентилятор для охлаждения VRM и оперативной памяти и отвода горячего воздуха от GPU. Также предусмотрены USB-C 20 Гбит/с, два USB 3.0 и встроенный GPU-кронштейн серверного класса.

Линейка состоит из трех вариантов: EX5 ($109,99) — пустая основа под собственную СЖО, EX5 PLUS ($159,99) — со встроенной СЖО Glacier One 360S25-SE, и EX5 MAX ($229,99) — с той же СЖО и дополнительным 6-дюймовым дисплеем для мониторинга системы. Все модели уже поступили в продажу.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14🤯2
OpenAI официально подтвердила, что GPT-6 Astra решила уравнение Навье-Стокса, которое также известно как “одна из 7 задач тысячелетия” — теперь компания может претендовать на официальную выплату в размере $1 млн. Ранее еще одну из этих задач решил знаменитый математик Григорий Перельман.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍24🤯9🌭1
Arm представила Neoverse CSS N4 (Ranger) — новейшую платформу для создания кастомных серверных процессоров. Она позволяет выбирать конфигурацию от 8 до 128 ядер Neoverse N4, до 3,8 ГГц, а производство рассчитано на 3-нм техпроцесс TSMC N3P с поддержкой мультичиплетных и мультисокетных систем.

На каждый кристалл приходится до 256 МБ L3 с ECC, до 2 МБ L2 на ядро, а из памяти поддерживаются DDR5 и LPDDR6. Для расширения системы предусмотрено до 128 линий PCIe 6.0/7.0, CXL 4.0, UCIe и интерфейсы AMBA.

По заявлению Arm, относительно Neoverse N3 новая платформа обеспечивает до 2 раз больше производительности, 1,25 раз выше производительность на ватт и 1,75 раз больше пропускной способности памяти. CSS поставляется как RTL с документацией и интегрированным ПО, поэтому разработчики могут заранее запускать Linux и тестировать будущую платформу еще до появления готового чипа.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯4
This media is not supported in your browser
VIEW IN TELEGRAM
OpenAI выпустила GPT-Image 2.5 — свою самую передовую генеративную модель для создания высококачественных изображений. Из нововведений — скорость генерации увеличили на 50%, модель стала лучше справляться с деталями и стала лучше редактировать конкретные элементы контента. Еще добавили функцию “набросок”, которая позволяет рисовать черновики в качестве примера желаемого изображения, а также различные шаблоны. Нейронка уже доступна юзера ChatGPT.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8
This media is not supported in your browser
VIEW IN TELEGRAM
SemiAnalysis заявила, что AMD ускорила инференс ИИ-модели MiniMax M3 в vLLM в 11 раз при агентны нагрузках на серверном ИИ-ускорителе Instinct MI355X…аж за 19 дней. То есть, все это время скорость инференса нейронки была в 11 раз уже, чем могла бы быть изначально?

Конечно, назвать SemiAnalysis “непредвзятым” ресурсом вряд ли получится (компания ни раз слишком активно навалила Nvidia и упрекала AMD), однако при покупке топового серверного ИИ-ускорителя за сотни тысяч долларов (который, между прочим, продается только в OEM-формате в составе готовы серверов), хочется ведь сразу получить максимум возможностей от железа, верно?

Кто-то скажет, что AMD просто не раскрыла весь свой потенциал и продолжает оптимизировать софт с возможностями вывода, но с другой стороны — почему нельзя сразу сделать качественный продукт?

А вы что думаете по этому поводу?

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💅6👍4💩1
ASUS представила сервер ESC8000-E12P. на модульной архитектуре NVIDIA MGX с двумя процессорами Intel Xeon 6 Granite Rapids-SP. Система поддерживает до 8 ТБ DDR5-6400/5200 RDIMM/3DS RDIMM.

Система имеет 8 слотов PCIe 5.0 x16 для двухслотовых ИИ-ускорителей вроде NVIDIA H200 или RTX Pro 6000 Blackwell Server Edition. Еще 5 слото PCIe 5.0 x16 предназначены для сетевых карт или DPU, а для хранения предусмотрены 8 отсеков NVMe SFF с функцией горячей замены и два внутренних слота M.2 PCIe 5.0 x4.

За питание отвечают 4 БП по 3200 Вт с резервированием и сертификатом 80 PLUS Titanium. Все это помещается в корпус 4U, охлаждение полностью на воздухе. Цена не объявлена.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12🌭2
Тибо из OpenAI намекает, что ChatGPT может временно приостановить выдачу новых подписок Pro, если спрос на GPT-6 Astra продолжит расти.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7💩5