⚡️ MI350 ускоряет обучение ИИ в 2,8 раза на MLPerf Training 5.1
AMD впервые протестировала серию ИИ-ускорителей Instinct MI350 в MLPerf Training 5.1 и показала заметный прирост: MI355X обучает Llama* 2-70B LoRA (FP8) за 10,18 минут против ~28 минут у MI300X и ~20 минут у MI325X. Все благодаря новой архитектуре CDNA 4, памяти HBM3E и обновленному стеку ROCm 7.1.
Формат FP4 AMD сознательно пропустила — с их слов, он малопригоден для обучения из-за снижения точности. При этом Nvidia, наоборот, участвовала в тестировании только с FP4-нагрузками.
Ежегодный ритм обновления платформы сохраняется: MI300X → MI325X → MI350 → MI450. Скоро не AMD, будет нагонять Nvidia, а совсем наоборот.
AMD впервые протестировала серию ИИ-ускорителей Instinct MI350 в MLPerf Training 5.1 и показала заметный прирост: MI355X обучает Llama* 2-70B LoRA (FP8) за 10,18 минут против ~28 минут у MI300X и ~20 минут у MI325X. Все благодаря новой архитектуре CDNA 4, памяти HBM3E и обновленному стеку ROCm 7.1.
По данным MLPerf, MI355X идет почти вровень со средними результатами систем NVIDIA B200/B300 в тех же FP8-нагрузках — разница в пределах нескольких процентов.
Формат FP4 AMD сознательно пропустила — с их слов, он малопригоден для обучения из-за снижения точности. При этом Nvidia, наоборот, участвовала в тестировании только с FP4-нагрузками.
Сразу 9 вендоров передали результатов тестов, и все уложились в 1% от внутренних бенчмарков AMD. Похоже, что ROCm 7.1 дозрел до предсказуемой производительности.
Ежегодный ритм обновления платформы сохраняется: MI300X → MI325X → MI350 → MI450. Скоро не AMD, будет нагонять Nvidia, а совсем наоборот.
👍2
🎂 Shield TV отмечает 10-летний юбилей с новым патчем 9.2.2
NVIDIA выкатили обновление Shield Experience 9.2.2 для Shield TV и Shield TV Pro — ТВ приставок, которые являются одними из самых давних поддерживаемых потребительских устройств Nvidia.
Приставки базируются на чипах Tegra X1/X1+ с графикой Maxwell и 256 CUDA-ядрами.
При этом преемника Shield от Nvidia пока не видно. Если он появится, логичным кандидатом выглядит чип семейства Orin — он тянет и ТВ-функции, и легкий гейминг, а рынок стриминговых приставок снова растет...
NVIDIA выкатили обновление Shield Experience 9.2.2 для Shield TV и Shield TV Pro — ТВ приставок, которые являются одними из самых давних поддерживаемых потребительских устройств Nvidia.
Апдейт добавил звуковые подсказки при сопряжении пультов, новые параметры повтора клавиш и расширил TalkBack до 23 европейских языков, а еще починил пропадающий звук в Disney+.
Приставки базируются на чипах Tegra X1/X1+ с графикой Maxwell и 256 CUDA-ядрами.
ПК-драйверы для Maxwell уже на исходе, так что это, скорее всего, последнее крупное обновление для линейки. Платформа прожила ~10 лет и до сих пор работает стабильнее многих Android TV-боксов.
При этом преемника Shield от Nvidia пока не видно. Если он появится, логичным кандидатом выглядит чип семейства Orin — он тянет и ТВ-функции, и легкий гейминг, а рынок стриминговых приставок снова растет...
1👍1
🤔 18-ядерный Xeon засветился в Geekbench — неужели Xeon-W
В базе Geekbench появился процессор под названием Intel Xeon 654 с 18 ядрами и 36 потоками. Частоты в тесте — от 2.98 до 4.78 ГГц.
Инсайдеры заявляют, что этот проц может относиться к семейству Granite Rapids, но не серверное GNR-SP, а возможную ветку Xeon 600 Series для рабочих станций.
Если утечка подтвердится, Intel готовит возрождение линейки Xeon-W и нового конкурента Threadripper Pro в среднем ценовом сегменте с упором на частоты и IPC, а не в количество ядер.
В базе Geekbench появился процессор под названием Intel Xeon 654 с 18 ядрами и 36 потоками. Частоты в тесте — от 2.98 до 4.78 ГГц.
Результаты: 2634 балла в однопоточке и 14 743 в многопоточке, что приближает его к настольным Core с аналогичным числом ядер.
Инсайдеры заявляют, что этот проц может относиться к семейству Granite Rapids, но не серверное GNR-SP, а возможную ветку Xeon 600 Series для рабочих станций.
Платформа, скорее всего, использует те же сокеты LGA 4710, что и серверные Granite Rapids, но будет иметь более высокие частоты под задачи однопроцессорных рабочих станций.
Если утечка подтвердится, Intel готовит возрождение линейки Xeon-W и нового конкурента Threadripper Pro в среднем ценовом сегменте с упором на частоты и IPC, а не в количество ядер.
1👍2💅1
🤖 AMD выкатила GAIA 0.13 с ИИ-кодером и Docker-агентом
AMD обновила свой открытый проект GAIA до версии 0.13. Это демонстрационная среда для генеративного ИИ на Ryzen, Radeon и Ryzen AI.
В релиз также вошел GAIA Code — экспериментальный ИИ-агент для кодинга в VS Code, умеющий генерировать Python по описанию, запускать тесты кода и распознавать контекст файлов. Еще появился Docker Agent для сборки и управления контейнерами, работы с Docker Compose и управления изолированными средами.
GAIA остается скорее демонстрацией зрелости ИИ-экосистемы AMD, чем полноценной продуктовой средой. Но релиз показывает, что компания активно строит собственный стек инструментов вокруг ИИ-железа, постепенно наращивая функциональность..
AMD GAIA 0.13 уже есть на GitHub.
AMD обновила свой открытый проект GAIA до версии 0.13. Это демонстрационная среда для генеративного ИИ на Ryzen, Radeon и Ryzen AI.
Изначально GAIA работала только Windows, но теперь завезли базовую поддержку Linux, а также Vulkan-ускорение.
В релиз также вошел GAIA Code — экспериментальный ИИ-агент для кодинга в VS Code, умеющий генерировать Python по описанию, запускать тесты кода и распознавать контекст файлов. Еще появился Docker Agent для сборки и управления контейнерами, работы с Docker Compose и управления изолированными средами.
Вдобавок команда AMD добавила инструменты для быстрой разработки других GAIA-агентов и общий набор интерфейсов: REST, MCP и консоль.
GAIA остается скорее демонстрацией зрелости ИИ-экосистемы AMD, чем полноценной продуктовой средой. Но релиз показывает, что компания активно строит собственный стек инструментов вокруг ИИ-железа, постепенно наращивая функциональность..
AMD GAIA 0.13 уже есть на GitHub.
1👍1🌭1 1
📈 Серверная DRAM продолжает дорожать: Samsung подняла цены на +60%
Samsung подняла стоимость серверных модулей DDR5 на ~60% после задержки октябрьского прайсинга. По данным Reuters, производители серверов уже признают, что не смогут закрыть свои объемы, а часть клиентов начали в спешке закупать тонны плашек.
Цены на 32 ГБ DDR5 подскочили со $149 до $239, планки 16 и 128 ГБ выросли примерно на 50%, до $135 и $1 194, а модули 64 и 96 ГБ подросли на 30%.
Сервис аналитики TrendForce заявляет, что цены Samsung в четвертом квартале 2025 года прибавят еще 40-50 %.
Если спрос со стороны ИИ-ЦОДов не упадет, высокие цены удержатся как минимум до 2026–2027 годов.
Samsung подняла стоимость серверных модулей DDR5 на ~60% после задержки октябрьского прайсинга. По данным Reuters, производители серверов уже признают, что не смогут закрыть свои объемы, а часть клиентов начали в спешке закупать тонны плашек.
Рост цен касается в первую очередь серверной оперативки по 16-128 ГБ и уже бьет по поставкам других серверных компонентов — компании скупают более доступные компоненты, чтобы освободить бюджет под DRAM.
Цены на 32 ГБ DDR5 подскочили со $149 до $239, планки 16 и 128 ГБ выросли примерно на 50%, до $135 и $1 194, а модули 64 и 96 ГБ подросли на 30%.
Сильный перекос спроса идет от сборки ИИ-кластеров, а ограниченное производство Samsung дает ей ценовое преимущество над SK Hynix и Micron.
Сервис аналитики TrendForce заявляет, что цены Samsung в четвертом квартале 2025 года прибавят еще 40-50 %.
Если спрос со стороны ИИ-ЦОДов не упадет, высокие цены удержатся как минимум до 2026–2027 годов.
1👍2 2
💾 LTO-10 получил картридж на 40 ТБ и обновленную дорожную карту до 913 ТБ
Компании-поставщики технологий LTO представила новый картридж Ultrium емкостью 40 ТБ (до ~100 ТБ в сжатии 2,5:1). Рост плотности обеспечили новая головка привода и базовая пленка Aramid, которая тоньше и стабильнее прежних материалов.
Такой носитель работает на тех же приводах LTO-10, что и версия на 30 ТБ, так что инфраструктуру под новые ленточные накопители менять не нужно — все благодаря Aramid, который дал возможность уложить больше ленты в стандартный корпус.
Платформа остается ориентированной на долгосрочное хранение вне сети, что важно для ИИ-кластеров и архивов критически важных данных.
Первые картриджи на 40 ТБ появятся в продаже в первом квартале 2026 года.
Компании-поставщики технологий LTO представила новый картридж Ultrium емкостью 40 ТБ (до ~100 ТБ в сжатии 2,5:1). Рост плотности обеспечили новая головка привода и базовая пленка Aramid, которая тоньше и стабильнее прежних материалов.
Такой носитель работает на тех же приводах LTO-10, что и версия на 30 ТБ, так что инфраструктуру под новые ленточные накопители менять не нужно — все благодаря Aramid, который дал возможность уложить больше ленты в стандартный корпус.
Для корпоративных архивов это большой плюс: снижение числа картриджей и стоек при той же глубине хранения.
Платформа остается ориентированной на долгосрочное хранение вне сети, что важно для ИИ-кластеров и архивов критически важных данных.
Дорожная карта тоже обновлена. В LTO-11-LTO-14 сделают акцент на надежности и стоимости на ТБ, а максимальная емкость для LTO-14 обозначена в ~913 ТБ.
Первые картриджи на 40 ТБ появятся в продаже в первом квартале 2026 года.
1👍3🍾1
🔧 Релиз Debian 13.2 — что нового?
Debian выкатили обновление 13.2 для ветки “Trixie”. В нем собраны свежие патчи для Firefox ESR, Chromium, OpenSSL, Linux 6.12.57 и еще ряд ключевых пакетов.
Обновленный установщик теперь работает на ядре 6.12.57 LTS, улучшена совместимость с AMD64, ARM64 и Asahi. Исправлены модули systemd, curl, libssh, libvirt, QEMU, Samba, а также драйверы NVIDIA Tesla.
В целом 13.2 — это аккуратная укладка всех правок, уже разосланных через security.debian.org. Если система регулярно обновляется, изменений почти не почувствуете, а для установки с нуля стоит брать именно этот релиз.
Debian выкатили обновление 13.2 для ветки “Trixie”. В нем собраны свежие патчи для Firefox ESR, Chromium, OpenSSL, Linux 6.12.57 и еще ряд ключевых пакетов.
Большая часть патчей закрывает уязвимости уровня CVE, связанные с переполнениями буфера, отказами в обслуживании и повреждением памяти.
Обновленный установщик теперь работает на ядре 6.12.57 LTS, улучшена совместимость с AMD64, ARM64 и Asahi. Исправлены модули systemd, curl, libssh, libvirt, QEMU, Samba, а также драйверы NVIDIA Tesla.
Образы netinst доступны для шести архитектур: amd64, arm64, armhf, ppc64el, riscv64 и s390x. Но live-сборки — только для AMD64.
В целом 13.2 — это аккуратная укладка всех правок, уже разосланных через security.debian.org. Если система регулярно обновляется, изменений почти не почувствуете, а для установки с нуля стоит брать именно этот релиз.
👍2
🔥 AMD взяла четверть рынка x86 и разогнала долю в десктопах до ~33%
В свежих данных Mercury Research за Q3 2025 у AMD два ключевых рубежа: 25,6% доли всех x86-процессоров и 33,6% доли настольных чипов.
Рост связан со стабильной поставкой чипов от самой AMD и просадки спроса на чипы Intel в сегменте бюджетных мобильных CPU и IoT-линейках.
В целом, уже становится очевидно, что AMD снимает сливки с дорогих, высокопроизводительных CPU, тогда как Intel на плаву за счет бюджетных потребительских чипов.
В свежих данных Mercury Research за Q3 2025 у AMD два ключевых рубежа: 25,6% доли всех x86-процессоров и 33,6% доли настольных чипов.
Рост связан со стабильной поставкой чипов от самой AMD и просадки спроса на чипы Intel в сегменте бюджетных мобильных CPU и IoT-линейках.
Спрос тянут настольные Ryzen 9000 и высокопроизводительные EPYC 9005. У Intel в серверном сегменте помогает Xeon 6, но объемы продаж падают, поэтому общая доля синих — 74%.
В целом, уже становится очевидно, что AMD снимает сливки с дорогих, высокопроизводительных CPU, тогда как Intel на плаву за счет бюджетных потребительских чипов.
👍3
🤖 Qwen Code обновился до версии 0.2.1
Команда Alibaba выпустила новую версиюИ- Иагента Qwen Code v0.2.1 всего через 17 дней после предыдущего релиза.
В Qwen Code v0.2.1 добавила бесплатный веб-поиск с несколькими провайдерами, появился новый конвейер для редактирования кода, который снижает число ошибок и экономит токены, а в настройках теперь доступны параметры temperature, top_p и max tokens.
Среда стала дружелюбнее к инструментам — улучшили интеграцию с Zed, доработали фильтрацию файлов с учетом .gitignore, упростили формат ответов инструментов и оптимизировали работу с Unicode. Благодаря этому работа на Windows и macOS стала стабильнее.
Qwen v0.2.1 — это аккуратный апдейт про скорость и управляемость, но кардинальных изменений не ждите.
Команда Alibaba выпустила новую версиюИ- Иагента Qwen Code v0.2.1 всего через 17 дней после предыдущего релиза.
В Qwen Code v0.2.1 добавила бесплатный веб-поиск с несколькими провайдерами, появился новый конвейер для редактирования кода, который снижает число ошибок и экономит токены, а в настройках теперь доступны параметры temperature, top_p и max tokens.
Среда стала дружелюбнее к инструментам — улучшили интеграцию с Zed, доработали фильтрацию файлов с учетом .gitignore, упростили формат ответов инструментов и оптимизировали работу с Unicode. Благодаря этому работа на Windows и macOS стала стабильнее.
Qwen v0.2.1 — это аккуратный апдейт про скорость и управляемость, но кардинальных изменений не ждите.
👍1
⚡️ Qualcomm запустила Dragonwing IQ-X для промышленных Windows-систем
Компания Qualcomm представила SoC-чипы IQ-X5181 и IQ-X7181.
Процессоры имеют по 8 и 12 Arm-ядер Oryon до ~3,4 ГГц, графику Adreno и NPU Hexagon. Общая производительность с учетом CPU, GPU и NPU ядер составляют ~45 TOPS ИИ-производительности.
В комплекте есть eDP1.4b, DisplayPort 1.4a через USB-C, до 4 CSI, а также PCIe 4.0 × 8 у 7181. Ethernet, Wi-Fi 7/6E и 5G можно подключить через внешние модули.
Такие SoC закрывают нишу компактных индустриальных ПК: высокая интеграция снижает сложность плат, а запас по температуре и интерфейсам упрощает сборку систем автоматизации и роботов.
Компания Qualcomm представила SoC-чипы IQ-X5181 и IQ-X7181.
Процессоры имеют по 8 и 12 Arm-ядер Oryon до ~3,4 ГГц, графику Adreno и NPU Hexagon. Общая производительность с учетом CPU, GPU и NPU ядер составляют ~45 TOPS ИИ-производительности.
Младшая версия IQ-X5181 тянет 4Kp60 AV1/VP9, старшая IQ-X7181 — до 4K120. Память — LPDDR5X до 64 ГБ, хранилище — UFS 4.0.
В комплекте есть eDP1.4b, DisplayPort 1.4a через USB-C, до 4 CSI, а также PCIe 4.0 × 8 у 7181. Ethernet, Wi-Fi 7/6E и 5G можно подключить через внешние модули.
Корпус 58 × 58 мм рассчитан на работу в условиях -40-+105 °C, заявлена совместимость с Windows 10/11 IoT Enterprise и жизненный цикл более 10 лет.
Такие SoC закрывают нишу компактных индустриальных ПК: высокая интеграция снижает сложность плат, а запас по температуре и интерфейсам упрощает сборку систем автоматизации и роботов.
👍2
🤖 LangCode: как собрать Gemini, Claude, OpenAI и Ollama в один рабочий инструмент
Разработчики открытого RAG-движка LangChain представили CLI, который объединяет разные ИИ-модели и платформы через общий лаунчер для работы с кодом, поиска связей и выполнения задач вроде реализации функций или рефакторинга.
Что по инструментам: поддерживаются режимы ReAct и Deep, настройки поведения хранятся в .langcode/langcode.md, а через MCP можно подключать собственные утилиты в рабочие процессы.
LangCode — эффективная прослойка для гибкой разработки без привязки к одному вендору.
Разработчики открытого RAG-движка LangChain представили CLI, который объединяет разные ИИ-модели и платформы через общий лаунчер для работы с кодом, поиска связей и выполнения задач вроде реализации функций или рефакторинга.
Выбор подходящей ИИ-модели происходит автоматически под разные типы пользовательского запроса.
Что по инструментам: поддерживаются режимы ReAct и Deep, настройки поведения хранятся в .langcode/langcode.md, а через MCP можно подключать собственные утилиты в рабочие процессы.
Такой подход удобен, когда в проекте нужны разные модели, но хочется единого рабочего пространства без переключения между разными вкладками и сервисами.
LangCode — эффективная прослойка для гибкой разработки без привязки к одному вендору.
👍3
🗓 Коротко о главных новостях за эту неделю
❗️ В нашем блоге вышла статья о векторных базах данных.
❗️ AMD раскрыла подробности о архитектурах Zen 6/Zen 7 и ускорителях MI400/MI500.
❗️ IBM представила передовые квантовые процессоры NightHawk и Loon.
❗️ OpenAI релизнула новую ИИ-модель GPT-5.1.
❗️ Baidu анонсировала NPU-чипы M100/M300 и новую модель Ernie 5.0.
❗️ Мы также выпустили статью о операционной системе Nvidia DGX-OS.
❗️ HPE и Eviden показали новые суперкомпьютерные платформы.
❗️ Мы сделали подробный разбор причин и следствий кризиса памяти в 2025 году.
❗️ В нашем блоге вышла статья о векторных базах данных.
❗️ AMD раскрыла подробности о архитектурах Zen 6/Zen 7 и ускорителях MI400/MI500.
❗️ IBM представила передовые квантовые процессоры NightHawk и Loon.
❗️ OpenAI релизнула новую ИИ-модель GPT-5.1.
❗️ Baidu анонсировала NPU-чипы M100/M300 и новую модель Ernie 5.0.
❗️ Мы также выпустили статью о операционной системе Nvidia DGX-OS.
❗️ HPE и Eviden показали новые суперкомпьютерные платформы.
❗️ Мы сделали подробный разбор причин и следствий кризиса памяти в 2025 году.
ServerFlow
Что такое векторные базы данных и как они устроены | Блог Serverflow
1👍5💅1
❌ Intel делает ставку на 16-канальные Xeon 7: 8-канальные модели отменены
Компания Intel убрала 8-канальные серверные чипы Diamond Rapids из дорожной карты и теперь фокусируется на 16-канальных версиях.
В линейке будут использоваться P-ядра Panther Cove, всего линейка будет иметь до 192 ядер, при этом Diamond Rapids не будут иметь многопоточности, что нетипично для серверного сегмента.
Рост числа каналов памяти с 8 до 16 и MRDIMM 2-го поколения должны дать ощутимый выигрыш в тяжелых серверных нагрузках, но без многопоточки они все-таки выглядят странно.
Компания Intel убрала 8-канальные серверные чипы Diamond Rapids из дорожной карты и теперь фокусируется на 16-канальных версиях.
Это даст заметный прирост пропускной способности: второе поколение MRDIMM поднимает скорость передачи данных до ~12 800 MT/s против ~8 800 MT/s у Xeon 6.
В линейке будут использоваться P-ядра Panther Cove, всего линейка будет иметь до 192 ядер, при этом Diamond Rapids не будут иметь многопоточности, что нетипично для серверного сегмента.
Новое поколение CPU выйдет во второй половине 2026 года, а поддержка Hyper-Threading вернется уже в семействе Coral Rapids.
Рост числа каналов памяти с 8 до 16 и MRDIMM 2-го поколения должны дать ощутимый выигрыш в тяжелых серверных нагрузках, но без многопоточки они все-таки выглядят странно.
👍2
⚡️ До 336 МБ L3 в рабочих станциях: новые утечки о линейке Intel Granite Rapids-WS
По данным инсайдера, Intel готовит линейку Xeon Granite Rapids-WS для HEDT-станций. В списке фигурирует модель 698X с L3 объемом ~336 МБ и частотой 2,0 ГГц.
Серверные Granite Rapids работают с DDR5-6400 и MR-DIMM, для рабочих станций Intel, скорее всего, задействует 8-канальную память, хотя по данным утечки возможен и 12-канальный вариант.
Если утечка подтвердится, Intel вернется в тяжелый HEDT-класс с архитектурой серверного уровня и большими объемами кэша, закрывая нишу между бюджетными десктопами и серверными платформами Xeon.
По данным инсайдера, Intel готовит линейку Xeon Granite Rapids-WS для HEDT-станций. В списке фигурирует модель 698X с L3 объемом ~336 МБ и частотой 2,0 ГГц.
Эти чипы базируются на серверных кристаллах XCC и потенциально поднимают планку до ~86 ядер на CPU.
Серверные Granite Rapids работают с DDR5-6400 и MR-DIMM, для рабочих станций Intel, скорее всего, задействует 8-канальную память, хотя по данным утечки возможен и 12-канальный вариант.
Чипы также получат вычислительные блоки на техпроцессе Intel 3, а I/O кристалл — на Intel 7. Линейка включает модели от 2,0 до 3,5 ГГц и L3 от 48 до 336 МБ — но все параметры пока предварительные.
Если утечка подтвердится, Intel вернется в тяжелый HEDT-класс с архитектурой серверного уровня и большими объемами кэша, закрывая нишу между бюджетными десктопами и серверными платформами Xeon.
👍1