Хуанг решил в очередной раз покичиться, насколько крута архитектура Blackwell в инференсе ИИ. Чтобы доказать это всему миру, он сравнил показатели инференса DeepSeek‑V3.2 + TensorRT LLM на ИИ-ускорителях Nvidia GB200 NVFP4/FP8 в стойке NVL72 с…(барабанная дробь 🥁) Nvidia H200 FP8, торжественно отчитавшись о 16-кратном приросте пропускной способности и снижении задержек в 2,5 раз. Может кто-нибудь уже скажет ему, что Nvidia H200 вышли 2 года назад?
1 3
🎉 Релиз vLLM 0.17.0: FlashAttention 4, поддержка Qwen3.5 и многое другое
Команда vLLM выпустила версию 0.17.0 — одно из крупнейших обновлений движка инференса.
Главные изменения: интеграция FlashAttention 4, поддержка моделей Qwen3.5 с архитектурой Gated Delta Networks и масштабная переработка системы Model Runner V2 с параллельным конвейером и декодированием контекста.
Добавили новый флаг режима работы: balanced, latency-oriented или throughput-oriented. QLoRA-адаптеры теперь можно загружать напрямую без дополнительной сборки. Отдельно обновили стек до PyTorch 2.10 и добавили новые модели, включая Qwen3.5, Nemotron-embedding, Ovis 2.6 и потоковые ASR-модели.
Команда vLLM выпустила версию 0.17.0 — одно из крупнейших обновлений движка инференса.
Главные изменения: интеграция FlashAttention 4, поддержка моделей Qwen3.5 с архитектурой Gated Delta Networks и масштабная переработка системы Model Runner V2 с параллельным конвейером и декодированием контекста.
Добавлены оптимизации под новые GPU поколения NVIDIA SM100 и SM120 с поддержкой MXFP8 и FP8 GEMM, а для AMD объединен стек ROCm + AITER. В ядре появились FlashInfer Sparse MLA, Triton-ядра для top-k/top-p выборки и ускоренный маршрутизатор TRTLLM DSV3 GEMM, который дает около +6% производительности при пакетной обработке.
Добавили новый флаг режима работы: balanced, latency-oriented или throughput-oriented. QLoRA-адаптеры теперь можно загружать напрямую без дополнительной сборки. Отдельно обновили стек до PyTorch 2.10 и добавили новые модели, включая Qwen3.5, Nemotron-embedding, Ovis 2.6 и потоковые ASR-модели.
👍2 1
⚡️ CXL захватывает ЦОД: SK Telecom готовит новую архитектуру ИИ-кластеров
SK Telecom (входит в SK Group) и разработчик интерконнект-решений Panmnesia договорились создать новую архитектуру ИИ-дата-центров, полностью состояющую из решений CXL (Compute Express Link). Партнерство было официально подписано на MWC 2026, цель — кратно повысить эффективность ИИ=инфраструктуры без наращивания количества GPU.
Архитектуру планируют протестировать на реальных ИИ-нагрузках до конца года, после чего возможен переход к пилотным внедрениям.
SK Telecom (входит в SK Group) и разработчик интерконнект-решений Panmnesia договорились создать новую архитектуру ИИ-дата-центров, полностью состояющую из решений CXL (Compute Express Link). Партнерство было официально подписано на MWC 2026, цель — кратно повысить эффективность ИИ=инфраструктуры без наращивания количества GPU.
Компании предлагается отказаться от жесткой серверной схемы и разделить ресурсы на уровне стойки. CPU, GPU и память будут объединяться через CXL Fabric Switch, а не фиксироваться внутри одного сервера. Это позволит динамически распределять память и мощности ускорителей между задачами, повышая полезную нагрузку на железо и снижая эксплуатационные расходы на инфраструктуру. Еще один ключевой момент — замена сетевых обменов между GPU на прямые CXL-соединения.
Архитектуру планируют протестировать на реальных ИИ-нагрузках до конца года, после чего возможен переход к пилотным внедрениям.
👍3 1
Anthropic рассказала, какие профессии сможет заменить искусственный интеллект уже в ближайшее время. В зоне особого риска: программисты, финансовые аналитики и специалисты по работе с клиентами. Рабочие профессии, вроде инженеров, архитекторов, логистов и обслуживающего персонала. К слову, статистику собирали по запросам к Claude Code. Верим?
🇨🇳 YMTC представила новый SSD PC550 со скоростью до 10,5 ГБ/с
Китайский производитель памяти YMTC анонсировал новый потребительский SSD PC550 с интерфейсом PCIe 5.0 x4. Накопитель выходит в версиях 512 ГБ, 1 ТБ и 2 ТБ и рассчитан на массовый рынок ПК. Прайсы пока неизвестны.
PC550 использует собственную флеш-память YMTC и является вторым потребительским PCIe 5.0 SSD компании. Накопители поставляются в стандартном форм-факторе M.2 и рассчитаны на современные платформы с поддержкой PCIe 5.0, например новые поколения чипсетов AMD и Intel.
Китайский производитель памяти YMTC анонсировал новый потребительский SSD PC550 с интерфейсом PCIe 5.0 x4. Накопитель выходит в версиях 512 ГБ, 1 ТБ и 2 ТБ и рассчитан на массовый рынок ПК. Прайсы пока неизвестны.
Заявленная скорость достигает 10,5 ГБ/с на чтение и до 10 ГБ/с на запись, что заметно быстрее PCIe 4.0-решений, но ниже топовых PCIe 5.0 SSD, которые уже приближаются к ~14-15 ГБ/с.
PC550 использует собственную флеш-память YMTC и является вторым потребительским PCIe 5.0 SSD компании. Накопители поставляются в стандартном форм-факторе M.2 и рассчитаны на современные платформы с поддержкой PCIe 5.0, например новые поколения чипсетов AMD и Intel.
🤯2🌭1
🫡 “Я люблю ограничения”: глава NVIDIA объяснил, почему дефицит выгоден Nvidia
Дженсен Хуанг заявил, что текущие ограничения в цепочках поставок для индустрии ИИ на самом деле играют на руку Nvidia (а то мы не знали). По его словам, в условиях дефицита памяти, энергии и других критически важных ресурсов, компании вынуждены выбирать самые эффективные решения, а не экспериментировать с аналогичным оборудованием.
Дженсен Хуанг заявил, что текущие ограничения в цепочках поставок для индустрии ИИ на самом деле играют на руку Nvidia (а то мы не знали). По его словам, в условиях дефицита памяти, энергии и других критически важных ресурсов, компании вынуждены выбирать самые эффективные решения, а не экспериментировать с аналогичным оборудованием.
💩5👍1
Изнутри нового Panther Lake-H 👀
В сети появились фото нового ноутбучного чипа Intel Core Ultra Series 3. В топовой конфигурации кристалл имеет 16 ядер (4 P-core Cougar Cove + 8 E-core Darkmont + 4 LP-E), интегрированную графику Arc Xe3-LPG до 12 Xe-ядер, а также отдельный NPU до 50 TOPS для локальных ИИ-задач. Поддерживаются LPDDR5X-9600 или DDR5-7200, до 128 ГБ памяти и до 20 линий PCIe в H-серии.
В сети появились фото нового ноутбучного чипа Intel Core Ultra Series 3. В топовой конфигурации кристалл имеет 16 ядер (4 P-core Cougar Cove + 8 E-core Darkmont + 4 LP-E), интегрированную графику Arc Xe3-LPG до 12 Xe-ядер, а также отдельный NPU до 50 TOPS для локальных ИИ-задач. Поддерживаются LPDDR5X-9600 или DDR5-7200, до 128 ГБ памяти и до 20 линий PCIe в H-серии.
👍2
⚡️ STMicroelectronics представила новые микроконтроллеры, работающие без батарей
STMicroelectronics анонсировала микроконтроллеры STM32U3B5 и STM32U3C5, рассчитанные на автономные устройства с элементами ИИ и машинного обучения. Благодаря сверхнизкому энергопотреблению они могут работать без батарей, получая питание от окружающей среды — света, тепла, вибраций или радиосигналов.
По периферии это полноценный контроллер для IoT-устройств: до 114 GPIO, USB 2.0, I3C, CAN FD, несколько SPI/I2C/UART, 12-битные ADC/DAC, DMA на 12 каналов и широкий диапазон температур -40…+105 °C. Модель STM32U3C5 дополнительно получила криптографический ускоритель для операций шифрования.
STMicroelectronics анонсировала микроконтроллеры STM32U3B5 и STM32U3C5, рассчитанные на автономные устройства с элементами ИИ и машинного обучения. Благодаря сверхнизкому энергопотреблению они могут работать без батарей, получая питание от окружающей среды — света, тепла, вибраций или радиосигналов.
В основе ядра Arm Cortex-M33 (96 МГц), до 640 КБ SRAM и 2 МБ флеш-памяти, а также специализированный блок HSP (Hardware Signal Processor) для ускорения вычислений, связанных с ИИ-задачами. Производительность заявлена на уровне 1,5 DMIPS/МГц и около 395 в CoreMark, при этом чип поддерживает подключение внешней памяти через SDMMC и OCTOSPI.
По периферии это полноценный контроллер для IoT-устройств: до 114 GPIO, USB 2.0, I3C, CAN FD, несколько SPI/I2C/UART, 12-битные ADC/DAC, DMA на 12 каналов и широкий диапазон температур -40…+105 °C. Модель STM32U3C5 дополнительно получила криптографический ускоритель для операций шифрования.
👍5
🗓 Коротко о главных новостях за эту неделю
❗️ Alibaba открыла исходный код агентского фреймворка CoPaw
❗️ Alibaba представила ИИ-модели Qwen3.5 Small
❗️ Intel представила центральные процессоры Xeon 6+ Clearwater Forest
❗️ Qualcomm показала ИИ-стойку с ИИ-ускорителями AI200
❗️ Энтузиаст смог обучить ИИ на Apple NPU
❗️ OpenAI выпустила GPT-5.3 Instant
❗️ Intel анонсировала сетевой адаптер E830-XXVDA4F
❗️ OpenAI представила GPT-5.4
❗️ Запилили статью об использовании Apple Mac для ИИ-инференса
❗️ Запилили видеообзор YOLO26
❗️ Together AI выпустила FlashAttention-4
❗️ Alibaba открыла исходный код агентского фреймворка CoPaw
❗️ Alibaba представила ИИ-модели Qwen3.5 Small
❗️ Intel представила центральные процессоры Xeon 6+ Clearwater Forest
❗️ Qualcomm показала ИИ-стойку с ИИ-ускорителями AI200
❗️ Энтузиаст смог обучить ИИ на Apple NPU
❗️ OpenAI выпустила GPT-5.3 Instant
❗️ Intel анонсировала сетевой адаптер E830-XXVDA4F
❗️ OpenAI представила GPT-5.4
❗️ Запилили статью об использовании Apple Mac для ИИ-инференса
❗️ Запилили видеообзор YOLO26
❗️ Together AI выпустила FlashAttention-4
ServerFlow
Alibaba открыла исходный код CoPaw — агентский фреймворк для разработки ИИ-экосистем | Блог Serverflow
👍1
🤨 ИИ-стартап ТРЕБУЕТ от AMD GPU с 96 ГБ VRAM на RDNA 5
Небольшая ИИ-компания TinyCorp публично призвала AMD выпустить видеокарту на архитектуре RDNA 5 с 96 ГБ видеопамяти.
Идея в том, чтобы сделать видеокарту уровня профессиональных решений с огромным объемом VRAM, но по относительно низкой цене — около $2500. Для сравнения, единственный GPU с похожим объемом памяти сегодня — NVIDIA RTX PRO 6000 Blackwell с 96 ГБ, который продается примерно за $8 000-10 000.
Если AMD не выпустит такой продукт, TinyCorp заявляет, что попробует создать собственную плату с RDNA-чипом самостоятельно.
Небольшая ИИ-компания TinyCorp публично призвала AMD выпустить видеокарту на архитектуре RDNA 5 с 96 ГБ видеопамяти.
По мнению разработчиков, такой GPU мог бы стать доступной альтернативой дорогим ускорителям NVIDIA для локального запуска больших моделей.
Идея в том, чтобы сделать видеокарту уровня профессиональных решений с огромным объемом VRAM, но по относительно низкой цене — около $2500. Для сравнения, единственный GPU с похожим объемом памяти сегодня — NVIDIA RTX PRO 6000 Blackwell с 96 ГБ, который продается примерно за $8 000-10 000.
В чем профит для AMD выпускать мощный GPU по лоу-прайсу, по сути, себе в убыток — неизвестно.
Если AMD не выпустит такой продукт, TinyCorp заявляет, что попробует создать собственную плату с RDNA-чипом самостоятельно.
1 9💩2
В марте 2000 года AMD начала поставки центральных процессоров Athlon — первых в истории CPU, которые дали старт эпохе “гигагерцовых CPU”. Частота в 1 000 МГц тогда воспринималась как символический рубеж, и компания успела начать поставки прорывного процессора поставки раньше Intel, которая в те времена считалась главным драйвером CPU-технологий.
Чип AMD Athlon базировался на архитектуре K7 Athlon, выпускался по техпроцессу 180 нм, имел 128 КБ L1 и 512 КБ L2 кеша, работал на напряжении ~1,8 В. На старте поставок прайс на Athlon составлял не менее $1299.
Intel ответила буквально через пару дней после релиза Athlon выпуском Pentium III с частотой в 1 ГГц, но было поздно — все поняли, что с AMD нужно считаться, даже такому гиганту как Intel.
Чип AMD Athlon базировался на архитектуре K7 Athlon, выпускался по техпроцессу 180 нм, имел 128 КБ L1 и 512 КБ L2 кеша, работал на напряжении ~1,8 В. На старте поставок прайс на Athlon составлял не менее $1299.
Intel ответила буквально через пару дней после релиза Athlon выпуском Pentium III с частотой в 1 ГГц, но было поздно — все поняли, что с AMD нужно считаться, даже такому гиганту как Intel.
👍7