This media is not supported in your browser
VIEW IN TELEGRAM
А вы знали, что в Китае проводят соревнования по скоростному ремонту процессоров? 👀
🤯5
Энтузиасты нашли в поставочных декларациях упоминания новых чипов Intel Nova Lake-AX для топовых ноутбуков и компактных ИИ-ПК. Чип будет иметь iGPU с 48 блоками Xe3p, а также 256-битную шину памяти LPDDR5X-10667. Но интересны не столько характеристики, а сокет этих процессоров — LGA 4326 с размерами 37,5 × 56,5 мм. Сокеты подобных габаритов обычно используют в серверных системах, поэтому странно, что Intel решила использовать его в десктопе, но очевидно, что чип будет очень мощным.
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
👍2🤯1
Исследователи впервые показали полноценную RowHammer-атаку на дискретный GPU Nvidia с GDDR6, в качестве цели использовался NVIDIA RTX A6000. Атака получила название GPUHammer и позволяет вызывать bit flip в видеопамяти через многократные обращения к соседним строкам DRAM — раньше такие сценарии в основном ассоциировались с системной DDR-памятью.
Основной риск — системы vGPU, VDI и облачные ИИ-платформы, где несколько пользователей делят один ускоритель. NVIDIA в качестве меры защиты рекомендует включать ECC через nvidia-smi -e 1, хотя это дает до ~10% просадки производительности и уменьшает доступный объем VRAM примерно на 6.25%. При этом ИИ-ускорители вроде H100 и часть свежих GeForce уже лучше защищены за счет on-die ECC.
Канал Serverflow в MAX: Подписаться
Исследователям удалось добиться до 8 битовых ошибок в 4 банках памяти GDDR6, а самое неприятное — влияние на AI-нагрузки. В proof-of-concept один измененный бит в весах модели уронил точность классификации с ~80% до ~0.1%, то есть речь уже не просто о сбое памяти, а о реальной атаке на целостность ИИ-инференса и GPU-среды в облаке.
Основной риск — системы vGPU, VDI и облачные ИИ-платформы, где несколько пользователей делят один ускоритель. NVIDIA в качестве меры защиты рекомендует включать ECC через nvidia-smi -e 1, хотя это дает до ~10% просадки производительности и уменьшает доступный объем VRAM примерно на 6.25%. При этом ИИ-ускорители вроде H100 и часть свежих GeForce уже лучше защищены за счет on-die ECC.
Канал Serverflow в MAX: Подписаться
👍4
По данным инсайдеров, полученных из цепочки поставок, Intel может провести еще один раунд повышения цен в мае этого года, причем суммарный рост прайсов по отдельным потребительским линейкам за 2026 год уже обсуждается на уровне до 30%. Это уже не разовая коррекция, а продолжающаяся тенденция с учетом мартовского роста цен и старта продаж Arrow Lake Refresh выше фактической рекомендованной розничной цены.
Инсайдеры говорят, что причина роста в дефиците производственных мощностей, но на самом деле, Intel просто набивает себе значимость, чтобы выгодно выделиться на фоне решений AMD, которые активно захватывают рынок как десктопных, так и серверных CPU — якобы, раз цены растут, значит на чины спрос большой. Будем надеяться, что Intel одумается, но шансы на это невелики.
Канал Serverflow в MAX: Подписаться
Инсайдеры говорят, что причина роста в дефиците производственных мощностей, но на самом деле, Intel просто набивает себе значимость, чтобы выгодно выделиться на фоне решений AMD, которые активно захватывают рынок как десктопных, так и серверных CPU — якобы, раз цены растут, значит на чины спрос большой. Будем надеяться, что Intel одумается, но шансы на это невелики.
Канал Serverflow в MAX: Подписаться
Nvidia выпустила квантированную версию Gemma 4 31B в режиме NVFP4 на Hugging Face, сжав модель в 2 раза (с 62 ГБ до 32 ГБ) при менее чем 0,3% потери точности от уровня базовой версии. Запустить можно на GPU с 24 ГБ VRAM. Видимо, Хуанг решил показать всем, что NVFP4 — это must-have, а TurboQuant от Google — не конкрурент. Ждем ответ от DeepMind, борьба будет интересной 🫠
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
1👍6🤯2
К слову, топовую нейронку Google Gemma 4 31B уже успели крякнуть и сделать полностью открытую версию без цензуры 👀
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
1👍6
Не одной Sora едины — появилась утечка о новой модели генерации изображений GPT-Image-2. Похоже, что модель тестируют на LM Arena под кодовыми названиями maskingtape-alpha, gaffertape-alpha, packingtape-alpha. Судя по результатам генерации, которые привел инсайдер, у нейронки неплохой багаж знаний об окружающем мире и хорошие навыки визуализации текста.
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
1👍5🤯2
ServerFlow | Новости и Железо 💾
Не одной Sora едины — появилась утечка о новой модели генерации изображений GPT-Image-2. Похоже, что модель тестируют на LM Arena под кодовыми названиями maskingtape-alpha, gaffertape-alpha, packingtape-alpha. Судя по результатам генерации, которые привел…
Ну ладно, с визуализацией текста погорячились...или просто переборщили с цензурой? По крайней мере теперь понятно, что это не реальное изображение карты 👀
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
🤯6🌭3💩1 1
Пользователь Reddit утверждает, что сломанная видеокарта Radeon RX 6700 XT ожила после 12 минут в духовке при температуре 188 °C. Не повторяйте этого дома 🫠
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
🤯4 2🌭1
H.264 внезапно стал в 40,5 раз дороже для стриминговых платформ
Via Licensing Alliance, крупнейший в мире администратор патентных пулов, тихо изменил модель лицензирования H.264 / AVC для стриминговых сервисов: вместо прежнего потолка в $100 000 в год новые лицензии теперь идут по верхней планке до $4.5 млн в год. Важно, что действующих лицензиатов это не касается — старые контракты сохраняются, а рост затрагивает новые соглашения с 2026 года.
Тем не менее, после проблем с лицензированием H.265 рынок уже начал постепенно уходить в более предсказуемые модели лицензирования, и теперь рост стоимости H.264 может еще сильнее подтолкнуть гиперскелеров и видеохостинги к устоявшейся смене парадигмы.
Канал Serverflow в MAX: Подписаться
Via Licensing Alliance, крупнейший в мире администратор патентных пулов, тихо изменил модель лицензирования H.264 / AVC для стриминговых сервисов: вместо прежнего потолка в $100 000 в год новые лицензии теперь идут по верхней планке до $4.5 млн в год. Важно, что действующих лицензиатов это не касается — старые контракты сохраняются, а рост затрагивает новые соглашения с 2026 года.
H.264 — один из самых ббазовых кодеков, на котором до сих пор держится огромный объем live-стриминга, OTT и VOD-инфраструктуры. H.264 остается де-факто стандартом из-за широчайшей аппаратной поддержки в GPU, CPU, смартфонах, Smart TV и браузерах, поэтому быстро уйти на AV1 или VP9 для многих платформ будет сложно.
Тем не менее, после проблем с лицензированием H.265 рынок уже начал постепенно уходить в более предсказуемые модели лицензирования, и теперь рост стоимости H.264 может еще сильнее подтолкнуть гиперскелеров и видеохостинги к устоявшейся смене парадигмы.
Канал Serverflow в MAX: Подписаться
👍5🤯2
По прогнозу Counterpoint Research, к 2029 году до 90% ИИ-серверов будут использовать Arm-процессоры в роли хостов, а доля x86 и RISC-V составит около 10%. Речь прежде всего о серверах гиперскейлеров с собственными ускорителями, где CPU нужен как управляющий слой для подачи данных, оркестрации и работы с памятью.
Если прогноз сбудется, x86 сохранит позиции в универсальных enterprise-серверах, а системы гиперскелеров и ИИ-инфраструктура почти полностью уйдет в кастомный Arm-кремний. Судьба RISK-V в таком будущем остается неизвестной.
Канал Serverflow в MAX: Подписаться
Основной драйвер роста — выпуск собственных Arm-чипов AWS (Graviton), Google (Axion), Microsoft (Cobalt) и NVIDIA (Grace/Vera) под связку с ASIC-ускорителями их же разработки. Для инфраструктур гиперскелеров критична не столько пиковая производительность, сколько производительность на ватт, высокая плотность размещения в стойках и пропускная способность интерконнекта, и со всеми этими задачами Arm показывает себя превосходно.
Если прогноз сбудется, x86 сохранит позиции в универсальных enterprise-серверах, а системы гиперскелеров и ИИ-инфраструктура почти полностью уйдет в кастомный Arm-кремний. Судьба RISK-V в таком будущем остается неизвестной.
Канал Serverflow в MAX: Подписаться
🤯2
This media is not supported in your browser
VIEW IN TELEGRAM
Материнской плате Apple I, родоначальнику всех яблочных продуктов, сегодня исполняется 50 лет. Пора отдать честь 🫡
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
👍5
В линейке Arrow Lake-HX неожиданно появился Core Ultra 7 251HX — чип засветился в спецификациях Lenovo Legion 5i 2026 и MSI Raider 16 HX, хотя Intel официально его не анонсировала. По утечкам, это новый чип для сегмента высокопроизводительных игровых ноутбуков с дискретной графикой.
Пока подтверждены только базовая частота 2.9 ГГц и TDP 55 Вт. По логике позиционирования это, скорее всего, более доступная версия Core Ultra 7 255HX, которая в текущей линейке использует 20 ядер (8P + 12E). Есть версия, что 251HX — это более бюджетный вариант с немного сниженными boost-частотами или просто версия с отключенной встроенной графикой под ноутбуки, где все равно используется RTX 5070 / 5080 GPU.
Канал Serverflow в MAX: Подписаться
Пока подтверждены только базовая частота 2.9 ГГц и TDP 55 Вт. По логике позиционирования это, скорее всего, более доступная версия Core Ultra 7 255HX, которая в текущей линейке использует 20 ядер (8P + 12E). Есть версия, что 251HX — это более бюджетный вариант с немного сниженными boost-частотами или просто версия с отключенной встроенной графикой под ноутбуки, где все равно используется RTX 5070 / 5080 GPU.
Канал Serverflow в MAX: Подписаться
👍3
NVIDIA показала технологию Neural Texture Compression (NTC) для нейросеточного сжатия текстур. Только в демо система сократила использование видеопамяти с 6.5 ГБ до 970 МБ, то есть примерно на 85%. При этом в сравнении сцены визуальная разница практически не видна, а технология уже доступна через SDK, хотя в реальных играх ее пока никто массово не внедрил.
Вместо хранения готовых texel-данных в VRAM NTC сохраняет компактные latent-карты признаков, а затем маленькая нейросеть прямо на GPU восстанавливает итоговые текстуры по запросу. По сути часть нагрузки переносится из памяти в вычисления на тензорных ядрах.
Канал Serverflow в MAX: Подписаться
Вместо хранения готовых texel-данных в VRAM NTC сохраняет компактные latent-карты признаков, а затем маленькая нейросеть прямо на GPU восстанавливает итоговые текстуры по запросу. По сути часть нагрузки переносится из памяти в вычисления на тензорных ядрах.
Канал Serverflow в MAX: Подписаться
This media is not supported in your browser
VIEW IN TELEGRAM
Новая модель Gemma 4 E2B от Google отлично работает на iPhone 17 Pro — скорость около 40 токенов в секунду с MLX-оптимизациями.
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
👍5😡1
ИИ-ускоритель Nvidia P100 на архитектуре Pascal вышел ровно 10 лет назад 🎉
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
🗓 Коротко о главных новостях за эту неделю
❗️ Выложили инструкцию по установке и запуску Comfy UI на Linux
❗️ Сравнили технологии vGPU, MIG и SR-IOV
❗️ Рассказали, чем знаменита IBM
❗️ Запилили гайд по запуску llama.cpp и VLLM в консоли
❗️ Google представила Gemma 4
❗️ Вышла vLLM v0.19.0
❗️ В открытый доступ вышла нейронка JoyAI-Image-Edit
❗️ Сделали гайд по разделению GPU в Proxmox в помощью Nvidia MIG
❗️ Выложили инструкцию по установке и запуску Comfy UI на Linux
❗️ Сравнили технологии vGPU, MIG и SR-IOV
❗️ Рассказали, чем знаменита IBM
❗️ Запилили гайд по запуску llama.cpp и VLLM в консоли
❗️ Google представила Gemma 4
❗️ Вышла vLLM v0.19.0
❗️ В открытый доступ вышла нейронка JoyAI-Image-Edit
❗️ Сделали гайд по разделению GPU в Proxmox в помощью Nvidia MIG
ServerFlow
Инструкция по установке и запуску Comfy UI на Linux | Блог Serverflow
👍6🌭2