Энтузиасты нашли в поставочных декларациях упоминания новых чипов Intel Nova Lake-AX для топовых ноутбуков и компактных ИИ-ПК. Чип будет иметь iGPU с 48 блоками Xe3p, а также 256-битную шину памяти LPDDR5X-10667. Но интересны не столько характеристики, а сокет этих процессоров — LGA 4326 с размерами 37,5 × 56,5 мм. Сокеты подобных габаритов обычно используют в серверных системах, поэтому странно, что Intel решила использовать его в десктопе, но очевидно, что чип будет очень мощным.
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
👍2🤯1
Исследователи впервые показали полноценную RowHammer-атаку на дискретный GPU Nvidia с GDDR6, в качестве цели использовался NVIDIA RTX A6000. Атака получила название GPUHammer и позволяет вызывать bit flip в видеопамяти через многократные обращения к соседним строкам DRAM — раньше такие сценарии в основном ассоциировались с системной DDR-памятью.
Основной риск — системы vGPU, VDI и облачные ИИ-платформы, где несколько пользователей делят один ускоритель. NVIDIA в качестве меры защиты рекомендует включать ECC через nvidia-smi -e 1, хотя это дает до ~10% просадки производительности и уменьшает доступный объем VRAM примерно на 6.25%. При этом ИИ-ускорители вроде H100 и часть свежих GeForce уже лучше защищены за счет on-die ECC.
Канал Serverflow в MAX: Подписаться
Исследователям удалось добиться до 8 битовых ошибок в 4 банках памяти GDDR6, а самое неприятное — влияние на AI-нагрузки. В proof-of-concept один измененный бит в весах модели уронил точность классификации с ~80% до ~0.1%, то есть речь уже не просто о сбое памяти, а о реальной атаке на целостность ИИ-инференса и GPU-среды в облаке.
Основной риск — системы vGPU, VDI и облачные ИИ-платформы, где несколько пользователей делят один ускоритель. NVIDIA в качестве меры защиты рекомендует включать ECC через nvidia-smi -e 1, хотя это дает до ~10% просадки производительности и уменьшает доступный объем VRAM примерно на 6.25%. При этом ИИ-ускорители вроде H100 и часть свежих GeForce уже лучше защищены за счет on-die ECC.
Канал Serverflow в MAX: Подписаться
👍4
По данным инсайдеров, полученных из цепочки поставок, Intel может провести еще один раунд повышения цен в мае этого года, причем суммарный рост прайсов по отдельным потребительским линейкам за 2026 год уже обсуждается на уровне до 30%. Это уже не разовая коррекция, а продолжающаяся тенденция с учетом мартовского роста цен и старта продаж Arrow Lake Refresh выше фактической рекомендованной розничной цены.
Инсайдеры говорят, что причина роста в дефиците производственных мощностей, но на самом деле, Intel просто набивает себе значимость, чтобы выгодно выделиться на фоне решений AMD, которые активно захватывают рынок как десктопных, так и серверных CPU — якобы, раз цены растут, значит на чины спрос большой. Будем надеяться, что Intel одумается, но шансы на это невелики.
Канал Serverflow в MAX: Подписаться
Инсайдеры говорят, что причина роста в дефиците производственных мощностей, но на самом деле, Intel просто набивает себе значимость, чтобы выгодно выделиться на фоне решений AMD, которые активно захватывают рынок как десктопных, так и серверных CPU — якобы, раз цены растут, значит на чины спрос большой. Будем надеяться, что Intel одумается, но шансы на это невелики.
Канал Serverflow в MAX: Подписаться
Nvidia выпустила квантированную версию Gemma 4 31B в режиме NVFP4 на Hugging Face, сжав модель в 2 раза (с 62 ГБ до 32 ГБ) при менее чем 0,3% потери точности от уровня базовой версии. Запустить можно на GPU с 24 ГБ VRAM. Видимо, Хуанг решил показать всем, что NVFP4 — это must-have, а TurboQuant от Google — не конкрурент. Ждем ответ от DeepMind, борьба будет интересной 🫠
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
1👍6🤯2
К слову, топовую нейронку Google Gemma 4 31B уже успели крякнуть и сделать полностью открытую версию без цензуры 👀
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
1👍6
Не одной Sora едины — появилась утечка о новой модели генерации изображений GPT-Image-2. Похоже, что модель тестируют на LM Arena под кодовыми названиями maskingtape-alpha, gaffertape-alpha, packingtape-alpha. Судя по результатам генерации, которые привел инсайдер, у нейронки неплохой багаж знаний об окружающем мире и хорошие навыки визуализации текста.
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
1👍5🤯2
ServerFlow | Новости и Железо 💾
Не одной Sora едины — появилась утечка о новой модели генерации изображений GPT-Image-2. Похоже, что модель тестируют на LM Arena под кодовыми названиями maskingtape-alpha, gaffertape-alpha, packingtape-alpha. Судя по результатам генерации, которые привел…
Ну ладно, с визуализацией текста погорячились...или просто переборщили с цензурой? По крайней мере теперь понятно, что это не реальное изображение карты 👀
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
🤯6🌭3💩1 1
Пользователь Reddit утверждает, что сломанная видеокарта Radeon RX 6700 XT ожила после 12 минут в духовке при температуре 188 °C. Не повторяйте этого дома 🫠
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
🤯4 2🌭1
H.264 внезапно стал в 40,5 раз дороже для стриминговых платформ
Via Licensing Alliance, крупнейший в мире администратор патентных пулов, тихо изменил модель лицензирования H.264 / AVC для стриминговых сервисов: вместо прежнего потолка в $100 000 в год новые лицензии теперь идут по верхней планке до $4.5 млн в год. Важно, что действующих лицензиатов это не касается — старые контракты сохраняются, а рост затрагивает новые соглашения с 2026 года.
Тем не менее, после проблем с лицензированием H.265 рынок уже начал постепенно уходить в более предсказуемые модели лицензирования, и теперь рост стоимости H.264 может еще сильнее подтолкнуть гиперскелеров и видеохостинги к устоявшейся смене парадигмы.
Канал Serverflow в MAX: Подписаться
Via Licensing Alliance, крупнейший в мире администратор патентных пулов, тихо изменил модель лицензирования H.264 / AVC для стриминговых сервисов: вместо прежнего потолка в $100 000 в год новые лицензии теперь идут по верхней планке до $4.5 млн в год. Важно, что действующих лицензиатов это не касается — старые контракты сохраняются, а рост затрагивает новые соглашения с 2026 года.
H.264 — один из самых ббазовых кодеков, на котором до сих пор держится огромный объем live-стриминга, OTT и VOD-инфраструктуры. H.264 остается де-факто стандартом из-за широчайшей аппаратной поддержки в GPU, CPU, смартфонах, Smart TV и браузерах, поэтому быстро уйти на AV1 или VP9 для многих платформ будет сложно.
Тем не менее, после проблем с лицензированием H.265 рынок уже начал постепенно уходить в более предсказуемые модели лицензирования, и теперь рост стоимости H.264 может еще сильнее подтолкнуть гиперскелеров и видеохостинги к устоявшейся смене парадигмы.
Канал Serverflow в MAX: Подписаться
👍5🤯2
По прогнозу Counterpoint Research, к 2029 году до 90% ИИ-серверов будут использовать Arm-процессоры в роли хостов, а доля x86 и RISC-V составит около 10%. Речь прежде всего о серверах гиперскейлеров с собственными ускорителями, где CPU нужен как управляющий слой для подачи данных, оркестрации и работы с памятью.
Если прогноз сбудется, x86 сохранит позиции в универсальных enterprise-серверах, а системы гиперскелеров и ИИ-инфраструктура почти полностью уйдет в кастомный Arm-кремний. Судьба RISK-V в таком будущем остается неизвестной.
Канал Serverflow в MAX: Подписаться
Основной драйвер роста — выпуск собственных Arm-чипов AWS (Graviton), Google (Axion), Microsoft (Cobalt) и NVIDIA (Grace/Vera) под связку с ASIC-ускорителями их же разработки. Для инфраструктур гиперскелеров критична не столько пиковая производительность, сколько производительность на ватт, высокая плотность размещения в стойках и пропускная способность интерконнекта, и со всеми этими задачами Arm показывает себя превосходно.
Если прогноз сбудется, x86 сохранит позиции в универсальных enterprise-серверах, а системы гиперскелеров и ИИ-инфраструктура почти полностью уйдет в кастомный Arm-кремний. Судьба RISK-V в таком будущем остается неизвестной.
Канал Serverflow в MAX: Подписаться
🤯2
This media is not supported in your browser
VIEW IN TELEGRAM
Материнской плате Apple I, родоначальнику всех яблочных продуктов, сегодня исполняется 50 лет. Пора отдать честь 🫡
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
👍5
В линейке Arrow Lake-HX неожиданно появился Core Ultra 7 251HX — чип засветился в спецификациях Lenovo Legion 5i 2026 и MSI Raider 16 HX, хотя Intel официально его не анонсировала. По утечкам, это новый чип для сегмента высокопроизводительных игровых ноутбуков с дискретной графикой.
Пока подтверждены только базовая частота 2.9 ГГц и TDP 55 Вт. По логике позиционирования это, скорее всего, более доступная версия Core Ultra 7 255HX, которая в текущей линейке использует 20 ядер (8P + 12E). Есть версия, что 251HX — это более бюджетный вариант с немного сниженными boost-частотами или просто версия с отключенной встроенной графикой под ноутбуки, где все равно используется RTX 5070 / 5080 GPU.
Канал Serverflow в MAX: Подписаться
Пока подтверждены только базовая частота 2.9 ГГц и TDP 55 Вт. По логике позиционирования это, скорее всего, более доступная версия Core Ultra 7 255HX, которая в текущей линейке использует 20 ядер (8P + 12E). Есть версия, что 251HX — это более бюджетный вариант с немного сниженными boost-частотами или просто версия с отключенной встроенной графикой под ноутбуки, где все равно используется RTX 5070 / 5080 GPU.
Канал Serverflow в MAX: Подписаться
👍3
NVIDIA показала технологию Neural Texture Compression (NTC) для нейросеточного сжатия текстур. Только в демо система сократила использование видеопамяти с 6.5 ГБ до 970 МБ, то есть примерно на 85%. При этом в сравнении сцены визуальная разница практически не видна, а технология уже доступна через SDK, хотя в реальных играх ее пока никто массово не внедрил.
Вместо хранения готовых texel-данных в VRAM NTC сохраняет компактные latent-карты признаков, а затем маленькая нейросеть прямо на GPU восстанавливает итоговые текстуры по запросу. По сути часть нагрузки переносится из памяти в вычисления на тензорных ядрах.
Канал Serverflow в MAX: Подписаться
Вместо хранения готовых texel-данных в VRAM NTC сохраняет компактные latent-карты признаков, а затем маленькая нейросеть прямо на GPU восстанавливает итоговые текстуры по запросу. По сути часть нагрузки переносится из памяти в вычисления на тензорных ядрах.
Канал Serverflow в MAX: Подписаться
This media is not supported in your browser
VIEW IN TELEGRAM
Новая модель Gemma 4 E2B от Google отлично работает на iPhone 17 Pro — скорость около 40 токенов в секунду с MLX-оптимизациями.
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
👍5😡1
ИИ-ускоритель Nvidia P100 на архитектуре Pascal вышел ровно 10 лет назад 🎉
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
🗓 Коротко о главных новостях за эту неделю
❗️ Выложили инструкцию по установке и запуску Comfy UI на Linux
❗️ Сравнили технологии vGPU, MIG и SR-IOV
❗️ Рассказали, чем знаменита IBM
❗️ Запилили гайд по запуску llama.cpp и VLLM в консоли
❗️ Google представила Gemma 4
❗️ Вышла vLLM v0.19.0
❗️ В открытый доступ вышла нейронка JoyAI-Image-Edit
❗️ Сделали гайд по разделению GPU в Proxmox в помощью Nvidia MIG
❗️ Выложили инструкцию по установке и запуску Comfy UI на Linux
❗️ Сравнили технологии vGPU, MIG и SR-IOV
❗️ Рассказали, чем знаменита IBM
❗️ Запилили гайд по запуску llama.cpp и VLLM в консоли
❗️ Google представила Gemma 4
❗️ Вышла vLLM v0.19.0
❗️ В открытый доступ вышла нейронка JoyAI-Image-Edit
❗️ Сделали гайд по разделению GPU в Proxmox в помощью Nvidia MIG
ServerFlow
Инструкция по установке и запуску Comfy UI на Linux | Блог Serverflow
👍6🌭2
ServerFlow | Новости и Железо 💾
Слегка отвлечемся от темы серверного оборудования, ведь прямо сейчас происходит одно из важнейших событий в истории человечества. NASA проводит миссию Artemis II — первый пилотируемый облет Луны за последние 50 лет. Четыре астронавта на корабле Orion совершат…
Тем временем, астронавты миссии Artemis II уже почти достигли луны. Им осталось лететь менее суток до нашего спутника, а землю практически невидно из иллюминатора.
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
🤯2👍1💩1