ServerFlow | Новости и Железо 💾
4.24K subscribers
4.92K photos
391 videos
12 files
2.4K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
Хуанг решил в очередной раз покичиться, насколько крута архитектура Blackwell в инференсе ИИ. Чтобы доказать это всему миру, он сравнил показатели инференса DeepSeek‑V3.2 + TensorRT LLM на ИИ-ускорителях Nvidia GB200 NVFP4/FP8 в стойке NVL72 с…(барабанная дробь 🥁) Nvidia H200 FP8, торжественно отчитавшись о 16-кратном приросте пропускной способности и снижении задержек в 2,5 раз. Может кто-нибудь уже скажет ему, что Nvidia H200 вышли 2 года назад?
13
🎉 Релиз vLLM 0.17.0: FlashAttention 4, поддержка Qwen3.5 и многое другое

Команда vLLM выпустила версию 0.17.0 — одно из крупнейших обновлений движка инференса.

Главные изменения: интеграция FlashAttention 4, поддержка моделей Qwen3.5 с архитектурой Gated Delta Networks и масштабная переработка системы Model Runner V2 с параллельным конвейером и декодированием контекста.

Добавлены оптимизации под новые GPU поколения NVIDIA SM100 и SM120 с поддержкой MXFP8 и FP8 GEMM, а для AMD объединен стек ROCm + AITER. В ядре появились FlashInfer Sparse MLA, Triton-ядра для top-k/top-p выборки и ускоренный маршрутизатор TRTLLM DSV3 GEMM, который дает около +6% производительности при пакетной обработке.


Добавили новый флаг режима работы: balanced, latency-oriented или throughput-oriented. QLoRA-адаптеры теперь можно загружать напрямую без дополнительной сборки. Отдельно обновили стек до PyTorch 2.10 и добавили новые модели, включая Qwen3.5, Nemotron-embedding, Ovis 2.6 и потоковые ASR-модели.
👍21
⚡️ CXL захватывает ЦОД: SK Telecom готовит новую архитектуру ИИ-кластеров

SK Telecom (входит в SK Group) и разработчик интерконнект-решений Panmnesia договорились создать новую архитектуру ИИ-дата-центров, полностью состояющую из решений CXL (Compute Express Link). Партнерство было официально подписано на MWC 2026, цель — кратно повысить эффективность ИИ=инфраструктуры без наращивания количества GPU.

Компании предлагается отказаться от жесткой серверной схемы и разделить ресурсы на уровне стойки. CPU, GPU и память будут объединяться через CXL Fabric Switch, а не фиксироваться внутри одного сервера. Это позволит динамически распределять память и мощности ускорителей между задачами, повышая полезную нагрузку на железо и снижая эксплуатационные расходы на инфраструктуру. Еще один ключевой момент — замена сетевых обменов между GPU на прямые CXL-соединения.


Архитектуру планируют протестировать на реальных ИИ-нагрузках до конца года, после чего возможен переход к пилотным внедрениям.
👍31
Anthropic рассказала, какие профессии сможет заменить искусственный интеллект уже в ближайшее время. В зоне особого риска: программисты, финансовые аналитики и специалисты по работе с клиентами. Рабочие профессии, вроде инженеров, архитекторов, логистов и обслуживающего персонала. К слову, статистику собирали по запросам к Claude Code. Верим?
3
На китайских форумах активно обсуждают интересную тему вокруг DeepSeek. Юзеры повсеместно отмечают заметные улучшения возможностей веб-версии модели и мобильного приложения DeepSeek в программировании и математических задачах. Может, DeepSeek V4 уже вышел, а мы даже и не в курсе?
👍5
🇨🇳 YMTC представила новый SSD PC550 со скоростью до 10,5 ГБ/с

Китайский производитель памяти YMTC анонсировал новый потребительский SSD PC550 с интерфейсом PCIe 5.0 x4. Накопитель выходит в версиях 512 ГБ, 1 ТБ и 2 ТБ и рассчитан на массовый рынок ПК. Прайсы пока неизвестны.

Заявленная скорость достигает 10,5 ГБ/с на чтение и до 10 ГБ/с на запись, что заметно быстрее PCIe 4.0-решений, но ниже топовых PCIe 5.0 SSD, которые уже приближаются к ~14-15 ГБ/с.


PC550 использует собственную флеш-память YMTC и является вторым потребительским PCIe 5.0 SSD компании. Накопители поставляются в стандартном форм-факторе M.2 и рассчитаны на современные платформы с поддержкой PCIe 5.0, например новые поколения чипсетов AMD и Intel.
🤯2🌭1
🫡 “Я люблю ограничения”: глава NVIDIA объяснил, почему дефицит выгоден Nvidia

Дженсен Хуанг заявил, что текущие ограничения в цепочках поставок для индустрии ИИ на самом деле играют на руку Nvidia (а то мы не знали). По его словам, в условиях дефицита памяти, энергии и других критически важных ресурсов, компании вынуждены выбирать самые эффективные решения, а не экспериментировать с аналогичным оборудованием.
💩5👍1
Intel добавила новую видеокарту Arc Pro B70 на свой официальный сайт. Неужели скоро релиз нового профессионального GPU?
👍21
Изнутри нового Panther Lake-H 👀

В сети появились фото нового ноутбучного чипа Intel Core Ultra Series 3. В топовой конфигурации кристалл имеет 16 ядер (4 P-core Cougar Cove + 8 E-core Darkmont + 4 LP-E), интегрированную графику Arc Xe3-LPG до 12 Xe-ядер, а также отдельный NPU до 50 TOPS для локальных ИИ-задач. Поддерживаются LPDDR5X-9600 или DDR5-7200, до 128 ГБ памяти и до 20 линий PCIe в H-серии.
👍2
⚡️ STMicroelectronics представила новые микроконтроллеры, работающие без батарей

STMicroelectronics анонсировала микроконтроллеры STM32U3B5 и STM32U3C5, рассчитанные на автономные устройства с элементами ИИ и машинного обучения. Благодаря сверхнизкому энергопотреблению они могут работать без батарей, получая питание от окружающей среды — света, тепла, вибраций или радиосигналов.

В основе ядра Arm Cortex-M33 (96 МГц), до 640 КБ SRAM и 2 МБ флеш-памяти, а также специализированный блок HSP (Hardware Signal Processor) для ускорения вычислений, связанных с ИИ-задачами. Производительность заявлена на уровне 1,5 DMIPS/МГц и около 395 в CoreMark, при этом чип поддерживает подключение внешней памяти через SDMMC и OCTOSPI.


По периферии это полноценный контроллер для IoT-устройств: до 114 GPIO, USB 2.0, I3C, CAN FD, несколько SPI/I2C/UART, 12-битные ADC/DAC, DMA на 12 каналов и широкий диапазон температур -40…+105 °C. Модель STM32U3C5 дополнительно получила криптографический ускоритель для операций шифрования.
👍5
Передовой 144-ядерный центральный процессор Fujitsu MONAKA. Будет использоваться в новейших суперкомпьютерный кластерах 👀
👍5
🗓 Коротко о главных новостях за эту неделю

❗️ Alibaba открыла исходный код агентского фреймворка CoPaw

❗️ Alibaba представила ИИ-модели Qwen3.5 Small

❗️ Intel представила центральные процессоры Xeon 6+ Clearwater Forest

❗️ Qualcomm показала ИИ-стойку с ИИ-ускорителями AI200

❗️ Энтузиаст смог обучить ИИ на Apple NPU

❗️ OpenAI выпустила GPT-5.3 Instant

❗️ Intel анонсировала сетевой адаптер E830-XXVDA4F

❗️ OpenAI представила GPT-5.4

❗️ Запилили статью об использовании Apple Mac для ИИ-инференса

❗️ Запилили видеообзор YOLO26

❗️ Together AI выпустила FlashAttention-4
👍1
🤨 ИИ-стартап ТРЕБУЕТ от AMD GPU с 96 ГБ VRAM на RDNA 5

Небольшая ИИ-компания TinyCorp публично призвала AMD выпустить видеокарту на архитектуре RDNA 5 с 96 ГБ видеопамяти.

По мнению разработчиков, такой GPU мог бы стать доступной альтернативой дорогим ускорителям NVIDIA для локального запуска больших моделей.


Идея в том, чтобы сделать видеокарту уровня профессиональных решений с огромным объемом VRAM, но по относительно низкой цене — около $2500. Для сравнения, единственный GPU с похожим объемом памяти сегодня — NVIDIA RTX PRO 6000 Blackwell с 96 ГБ, который продается примерно за $8 000-10 000.

В чем профит для AMD выпускать мощный GPU по лоу-прайсу, по сути, себе в убыток — неизвестно.

Если AMD не выпустит такой продукт, TinyCorp заявляет, что попробует создать собственную плату с RDNA-чипом самостоятельно.
19💩2
В марте 2000 года AMD начала поставки центральных процессоров Athlon — первых в истории CPU, которые дали старт эпохе “гигагерцовых CPU”. Частота в 1 000 МГц тогда воспринималась как символический рубеж, и компания успела начать поставки прорывного процессора поставки раньше Intel, которая в те времена считалась главным драйвером CPU-технологий.

Чип AMD Athlon базировался на архитектуре K7 Athlon, выпускался по техпроцессу 180 нм, имел 128 КБ L1 и 512 КБ L2 кеша, работал на напряжении ~1,8 В. На старте поставок прайс на Athlon составлял не менее $1299.

Intel ответила буквально через пару дней после релиза Athlon выпуском Pentium III с частотой в 1 ГГц, но было поздно — все поняли, что с AMD нужно считаться, даже такому гиганту как Intel.
👍7