ServerFlow | Новости и Железо 💾
4.25K subscribers
4.94K photos
392 videos
12 files
2.41K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
🚀 Azure HBv5: AMD EPYC 9V64H с HBM3 — феноменальная эффективности в HPC

Microsoft открыла доступ к виртуальным машинам HBv5, построенным на специальных процессорах AMD EPYC 9V64H с памятью HBM3. Эти Zen 4-чипы без SMT предлагают до 368 ядер на сервер и 6,9 ТБ/с пропускной способности памяти, используя до 450 ГБ HBM3 (до 9 ГБ на ядро).

Несмотря на архитектуру Zen 4, а не более современную Zen 5, скорость работы чипов с большими наборами данных впечатляет — EPYC 9V64H демонстрирует 35-60% прирост скорости в сравнении с HBv4 на базе Genoa-X с 3D V-Cache. Тесты проводились на Ubuntu 24.04 LTS с ядром Linux 6.14.


HBv5 создает новый класс VM с локальной HBM-памятью, а AMD впервые вывела HBM в серверный сегмент Azure. Конфиг на базе Zen 5, скорее всего, не за горами, и он может стать новым витком эффективности в HPC-задачах.
👍41
🤣 Защита лувра: Windows Server 2003 и пароль “Louvre”

Музей лувра недавно ограбили, и это подняло весь мир на уши. Обстоятельства события все еще выясняются, а воры до сих пор не пойманы, но в ходе расследования стали известны интересные подробности о системе защиты музея.

Система видеонаблюдения работала, вы не поверите, на устаревшей Windows Server 2003 (тот же Windows XP, но под сервера), которая не получала патчи уже больше 15 лет. Дыр в ней больше, чем в швейцарском сыре — уязвимость SMBv1, критические RCE всех видов, слабая обработка шифров, бэкдоры IE и сотни других проблем.

Все стало еще смешнее, когда вскрылось, что паролем от системы было слово “Louvre”. Если у системы нет кулдауна ввода пароля (а его 100% нет) взлом лувра брутфорсом занял бы примерно 5 секунд.

Короче, самый известный музей в мире с технической точки зрения охранялся хуже, чем продуктовый магазин.


А вот если бы они купили сервер видеонаблюдения в ServerFlow, все могло бы закончиться куда лучше…
5👍522
💣 Apple готовит M5 Ultra для Mac Studio — релиз ожидается в 2026 году

По данным Bloomberg, что Apple планирует выпустить чип M5 Ultra для Mac Studio примерно в середине 2026 года. Это будет продолжение традиции выпуска Ultra-версий, которые появляются спустя несколько месяцев после моделей Pro и Max.

M5 Ultra объединит два кристалла M5 Max через шину UltraFusion, как и прошлые Ultra-чипы. Чип должен лечь в основу обновленного Mac Studio и, возможно, появится в новой версии Mac Pro.

По слухам, внешне топовые рабочие станции Apple на базе M5 Ultra не будут отличаться от предыдущих поколений — скорее всего, компания вложит время и средства не в пресловутый дизайн, а в наращивание вычислительной мощности и энергоэффективности.


Ждем будущую звезду локального инференса!
2👍2💅1
Если вам когда-нибудь было интересно, зачем компании покупают системы DGX, HGX, MGX высочайшего корпоративного уровня, стоимость которых может переваливать за $5 млн.

А вот для чего: на скрине — компактный дата-сетик Nvidia для обучения физического искусственного интеллекта автономных автомобилей. Объем данных в нем достигает всего лишь 98,7 ТБ (слабо, Хуанг, мог бы и до 100 ТБ поднажать).

А если серьезно, то цифры просто колоссальные, и чтобы обучить нейронку на таком дата-сете, серверы DGX, HGX, MGX должны из раза в раз с минимальной задержкой и максимальной скоростью перегонять эти данные туда-сюда днями, неделями или месяцами.

Вот для этого и покупают решения Nvidia, ведь ни одна другая машина не смогла бы справиться с такой колоссальной ИИ-нагрузкой.


Теперь понятно, за что Хуанг получил свои лавры и раскрутил капитализацию Nvidia до $5 трлн.
1👍4
🤑 AMD прибавила 36%: рекордная выручка $9,2 млрд за III квартал 2025

AMD отчиталась о доходах за 3-й квартал 2025 года: выручка выросла на 36% — до $9,2 млрд, операционная рентабельность поднялась до 14% (+3 п.п.), а прибыль на акцию составила $1,20, что на $0,03 выше ожиданий аналитиков.

Компания прогнозирует рост еще на 25% в 4-м квартале 2025 года — до $9,6 млрд. Основной драйвер роста — серверные центральные процессоры EPYC и ИИ- ускорители Instinct, которые активно скупают ИИ-ориентированные дата-центры и суперкомпьютерные комплексы по всему миру.

Такими темпами, AMD постепенно закрепится в верхнем ценовом диапазоне ИИ и HPC рынка, сокращая отставание от NVIDIA в области ИИ-ускорителей.
👍2
🤔 Ryzen AI MAX+ 388: 8 ядер, Radeon 8060S и TDP до 125 Вт

AMD готовит новый гибридный чип Ryzen AI MAX+ 388. Он засветился в базе PassMark и скоро его могут официально зарелизить.

Процессор оснащен 8 ядрами с 16 потоками, 32 МБ L3-кэша и графикой Radeon 8060S (40 блоков RDNA 3.5), которая ранее встречалась только в старшем 16-ядерном Ryzen AI MAX+ 395.

Чип имеет настраиваемый TDP от 45 до 125 Вт, что позволит ставить процессор как в игровые ноутбуки, так и в настольные рабочие станции, а также поддерживается до 128 ГБ LPDDR5x 8000 МТ/с.

В PassMark Ryzen AI MAX+ 388 набирает ~4160 баллов в однопоточке и ~54 000 в многопоточке, в последнем отставая от старшего решения AI MAX+ 395 почти в два раза, но имея значительно меньшее энергопотребление.


Если у чипа сохранится NPU-блок уровня AI MAX-серии, Ryzen AI MAX+ 388 может стать неплохим решением для бюджетного ИИ-инференса.
2👍5
⚡️Ryzen 7 9700X3D засветился в PassMark — 8 ядер Zen 5 и 5,8 ГГц

В базе PassMark появился еще один новый чип AMDRyzen 7 9700X3D. Судя по утечке, это 8-ядерный 16-поточный процессор на архитектуре Zen 5 с 96 МБ 3D V-Cache и частотой до 5,8 ГГц в бусте.

В тестах он набрал 4 687 баллов в однопоточке и 40 438 в многопоточке — примерно на 1-5 % выше, чем у 9800X3D.


У чипа ожидается TDP около 120 Вт и цена в диапазоне $400-450. AMD, похоже, готовит этот чип как более доступную игровую альтернативу 9800X3D, немного снизив тактовые частоты 9700X3D на релизе — аналогично прошлогоднему выпуску 5700X3D.

Параллельно в сети активно распространяются слухи о выходе других процессоров с 3D-V кэшем, вроде 9850X3D, 9950X3D2 и 7500X3D, которые могут дебютировать на CES 2026.


Если показатели PassMark подтвердятся, то 9700X3D может стать самым сбалансированным решением на Zen 5 для игровых сборок — высокой тактовой частоты и 3D V-Cache хватит, чтобы обойти даже некоторые старшие модели.
👍4
🇨🇳 Nvidia, подвинься: AMD будет поставлять MI308 в Китай

Пока Дженсен Хуанг судорожно пытался получить экспортные лицензии на ИИ-ускорители H20 и B30 для Китая, договариваясь с Трампом и товарищем Си на компромисс, AMD под шумок получила бумаги для поставки решений MI308 в КНР.

Это стало первым за долгое время случаем, когда американскому производителю все же удалось согласовать поставки ускорителей, подпадающих под экспортные ограничения США.


Характеристики MI308 держатся в секрете, но, по оценкам, они близки к решениям Nvidia H20 и также адаптированы специально под экспорт в Китай.

К слову, на днях Си Цзиньпин полностью запретил интеграцию любых западных ИИ-ускорителей в критически важные инфраструктуры, поэтому MI308 не попадут в стойки DeepSeek или Alibaba.


Для AMD это отличная возможность ворваться на ИИ-рынок Китая на фоне того, что Nvidia временно вышла из этого сектора, по крайней мере до тех пор, пока архитектура Blackwell не устареет.
👍5
💧 Мини-ПК с водянкой и 128 ГБ памяти: Abee показала AI Station 395 Max

Китайская компания Abee представила AI Station 395 Max — свой первый мини-ПК, рассчитанный для выполнения требовательных ИИ-нагрузок. Корпус размером 199×199×199 мм получил жидкостное охлаждение и встроенный блок питания на 400 Вт.

Цена кусается — ~$2 524.


Мини-ПК базируется на флагманском гибридном процессоре Ryzen AI Max+ 395 (16 ядер / 32 потока, Zen 5) с графикой Radeon 8060S (RDNA 3.5), поддерживает 128 ГБ LPDDR5X-8000 и имеет SSD емкостью 2 ТБ.

Система также поддерживает 2,5 и 10 Гбит/с LAN, а также USB4 Type-C и Type-A. Питание подается через новый 10-контактный ATX12VO, который снижает энергопотребление в простое примерно на 27%.

Abee позиционирует Station 395 Max как рабочую станцию для задач ИИ и игр, где важны компактность и большой объем памяти. Конкретная ИИ-производительность не раскрывается, но можно ожидать около 50 TOPS (столько выдает NPU-блок Ryzen AI Max+ 395).


ИИ-ПК — это уже новый мейнстрим 💯
25💅1
🧠 Gemini 3.0 Pro появится до конца ноября

В коде Google Vertex AI нашли упоминание модели Gemini 3.0 Pro. Судя по отметке “2025-11”, релиз превью-версии запланирован на ноябрь. Google уже использовала такую схему с 2.5 Pro — сначала preview-релиз, а затем полноценный запуск через пару месяцев.

У Gemini 3.0 Pro будет две вариации с контекстным окном в 200K и 1M токенов. В модели также значительно улучшат работу с инструментами — Gemini 3.0 Pro сможет использовать Python для вычислений и делать серию уточняющих веб-поисков, как это уже реализовано в GPT-5 и Grok 4.

По результатам сливов тестам в Google AI Studio новинка сможет уверенно писать код, создавать программы и интерфейсы за 1-2 промпта.


Google, похоже, возвращается к стратегии ускоренных релизов, каждые 3-4 месяца улучшая базовую модель. Если темпы сохранятся, релиз Gemini 3.5 можно ожидать уже весной 2026 года.
👍4
👀 Когда-нибудь видели GPU-серверы Intel? Теперь видели.

В нем стоит материнка W790-112L и четыре GPU Intel Arc Pro B60 Dual 48G Turbo, которые обеспечивают 192 ГБ видеопамяти.

Конечно, не такие красивые, как у Nvidia, но тоже ничего.
1👍6
🤖 Apple готовит апдейт Siri с 1,2 трлн параметров и собственную модель с 1 трлн параметров

Bloomberg сообщает, что Apple планирует использовать внешнюю модель от Google с 1,2 трлн параметров для апдейта своего голосового ассистента Siri и параллельно разрабатывает собственную базовую ИИ-модель с 1 трлн параметров.

Сроки внедрения ни Siri, ни новой LLM пока не раскрываются, да и о характеристиках ничего неизвестно. Очевидно, что для развертывания и обучения таких нейронок понадобятся самые продвинутые ИИ-ускорители и огромные объемы памяти для хранения дата-сетов.

Какого поставщика выберет Apple? Топовые решения Nvidia или, возможно, в рамках сотрудничества Google будет поставлять яблочным свои TPU? Пока у нас на руках одни догадки.


Но уже ясно одно — Apple планирует полноценно ворваться в ИИ-гонку, и очень уверенно.
1👍3
🍌 Google готовит к запуску Nano Banana 2, кодовое название — “GEMPIX2”

В каталоге Google Gemini появилось упоминание проекта под кодовым названием GEMPIX2 — обычно такое происходит перед публичным релизом новой ИИ-модели.

Пользователи предполагают, что под этим названием скрывается Nano Banana 2, которая должна выйти в ближайшие несколько недель.


Точных характеристик диффузионки, конечно же, пока нет, но очевидно, что Nano Banana 2 будет распространяться через облако Gemini и Google AI Studio и породит новую волну брейнрот контента в сети.
23👍11
🚨 Kimi готовит две новые модели — kimi-k2-thinking и kimi-k2-thinking-turbo

Компания Moonshot, неожиданно ворвавшаяся в топы ИИ-рынка со своей флагманской моделью Kimi-K2, готовится выложить на своей API-платформе две новые топовые нейросети — kimi-k2-thinking и kimi-k2-thinking-turbo.

Цены за токены эквивалентны kimi-k2-preview и kimi-k2-turbo-preview — $0.15 за 1 млн входных и $2.50 (thinking)/$8.00 (thinking-turbo) за 1 млн выходных. Скорее всего, цены поменяют.

Контекстное окно моделей — 262K токенов. Детали архитектуры пока не раскрываются, но очевидно, что речь идет о следующем поколении систем Kimi, ориентированных на глубокие рассуждения и высокую скорость отклика.

Судя по названию, turbo-версия будет оптимизирована под быструю генерацию ответов с размышлением и короткие сессии, тогда как базовая thinking станет оптимальным вариантом для решения сложных логических задач.


После появления в API нейронки выложат в публичный доступ в ближайшие недели, и они обязательно вызовут фурор.
2👍1🌭1
⚡️ Cyberpunk 2077 завели на ИИ-станции NVIDIA DGX Spark

Пользователи Reddit решили запустить Cyberpunk 2077 на мини-суперкомпьютере DGX-Spark и, о чудо, она заработала! Правда, через слои совместимости и эмуляцию x86 на ARM, но все же…

Cyberpunk 2077 идет на уровне ~50 FPS при 1080p и средних настройках, при этом включить DLSS не получится и стабильность пока плавает, а работает это все на Linux.

Энтузиасты также смогли запустить на Spark и консольную эмуляцию через RPCS3 (игры с PS 3) и Xemu (игры с Xbox).


На самом деле, в этом нет ничего удивительного — чип GB10 Blackwell, лежащий в основе DGX Spark, имеет столько же ядер, что и GeForce RTX 5070, потому и игровая производительность у них одинаковая.

Spark позиционируется как ИИ-ПК, но эксперименты показывают, что даже чистое ИИ-железо при желании и большом количестве свободного времени можно заставить тянуть современный гейминг.
2👍2🌭11