Релиз Qwen 3.6 Plus 🎉
Alibaba выпустила новейшую модель Qwen 3.6 Plus Preview, главный апгрейд — контекстное окно до 1 000 000 токенов для анализа больших кодовых репозиториев, длинных документов, логов и многоэтапных агентных рабочих нагрузок.
Qwen 3.6 Plus Preview базируется на гибридной архитектуре с комбинацией линейного внимания и MoE, что снижает вычислительные затраты и ускоряет выполнение операций на длинном контексте. За счёт этого модель может держать до 65 536 токенов в ответе и работать с внешними инструментами через вызовы и API.
Модель доступна бесплатно на OpenRouter на время тестирования. Ждем OpenSource-релиз!
Канал Serverflow в MAX: Подписаться
Alibaba выпустила новейшую модель Qwen 3.6 Plus Preview, главный апгрейд — контекстное окно до 1 000 000 токенов для анализа больших кодовых репозиториев, длинных документов, логов и многоэтапных агентных рабочих нагрузок.
Qwen 3.6 Plus Preview базируется на гибридной архитектуре с комбинацией линейного внимания и MoE, что снижает вычислительные затраты и ускоряет выполнение операций на длинном контексте. За счёт этого модель может держать до 65 536 токенов в ответе и работать с внешними инструментами через вызовы и API.
Модель доступна бесплатно на OpenRouter на время тестирования. Ждем OpenSource-релиз!
Канал Serverflow в MAX: Подписаться
👍8
This media is not supported in your browser
VIEW IN TELEGRAM
Компания Z.ai представила свою новую флагманскую мультимодальную модель GLM-5V-Turbo с функцией визуального кодирования, которая позволяет создавать пользовательские интерфейсы на основе представленных изображений. Также модель способна выполнять активные действия прямо на устройстве пользователя. GLM-5V-Turbo доступна в тарифных планах Z AI Chat и Coding. Прайс: $1.20 за 1 миллион входных и $4.00 за 1 миллион выходных токенов.
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
👍6
Google представила Gemma 4 — новое поколение открытых LLM, ориентированное на запуск на edge-устройствах и серверных GPU. Линейка включает модели E2B, E4B, 26B MoE и 31B Dense, при этом старшие версии уже позиционируют как модели с высочайшим уровнем производительности на уровне проприетарных нейронок при заметно меньших требованиях к железу.
Модель 31B Dense может работать на одном 80 ГБ H100, а 26B использует mixture-of-experts для снижения вычислительной нагрузки на токен по сравнению с классическим dense-стеком. Младшие E2B и E4B нацелены на ноутбуки, edge-устройства и embedded-платформы вроде Raspberry Pi и Jetson. Все семейство LLM доступно на Hugging Face.
Канал Serverflow в MAX: Подписаться
Модель 31B Dense может работать на одном 80 ГБ H100, а 26B использует mixture-of-experts для снижения вычислительной нагрузки на токен по сравнению с классическим dense-стеком. Младшие E2B и E4B нацелены на ноутбуки, edge-устройства и embedded-платформы вроде Raspberry Pi и Jetson. Все семейство LLM доступно на Hugging Face.
Канал Serverflow в MAX: Подписаться
👍4🌭1
Canonical без лишней шумихи обновила системные требования для Ubuntu Desktop 26.04 LTS: теперь минимальный объем оперативной памяти составляет 6 ГБ вместо 4 ГБ. Это первое повышение требований со времен Ubuntu 18.04, когда порог вырос с 1 до 4 ГБ.
Остальные требования почти не изменились — нужен 2-ядерный CPU от 2 ГГц и 25 ГБ свободного места на диске. Для серверной редакции планка заметно ниже: старт от 1.5 ГБ RAM. Это подчеркивает, что рост требований связан прежде всего с desktop-стеком — GNOME 50, современным Firefox и LibreOffice.
Канал Serverflow в MAX: Подписаться
Остальные требования почти не изменились — нужен 2-ядерный CPU от 2 ГГц и 25 ГБ свободного места на диске. Для серверной редакции планка заметно ниже: старт от 1.5 ГБ RAM. Это подчеркивает, что рост требований связан прежде всего с desktop-стеком — GNOME 50, современным Firefox и LibreOffice.
Канал Serverflow в MAX: Подписаться
👍3
Сооснователь SuperMicro И-Шян “Уолли” Ляо в федеральном суде Манхэттена заявил о непризнании вины по делу о незаконной переправке серверов с GPU NVIDIA в Китай. По версии прокуратуры, схема могла затрагивать поставки на сумму около $2.5 млрд, а сами системы шли через подставную компанию в Юго-Восточной Азии для обхода экспортных ограничений США.
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
👍4
This media is not supported in your browser
VIEW IN TELEGRAM
А вы знали, что в Китае проводят соревнования по скоростному ремонту процессоров? 👀
🤯5
Энтузиасты нашли в поставочных декларациях упоминания новых чипов Intel Nova Lake-AX для топовых ноутбуков и компактных ИИ-ПК. Чип будет иметь iGPU с 48 блоками Xe3p, а также 256-битную шину памяти LPDDR5X-10667. Но интересны не столько характеристики, а сокет этих процессоров — LGA 4326 с размерами 37,5 × 56,5 мм. Сокеты подобных габаритов обычно используют в серверных системах, поэтому странно, что Intel решила использовать его в десктопе, но очевидно, что чип будет очень мощным.
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
👍2🤯1
Исследователи впервые показали полноценную RowHammer-атаку на дискретный GPU Nvidia с GDDR6, в качестве цели использовался NVIDIA RTX A6000. Атака получила название GPUHammer и позволяет вызывать bit flip в видеопамяти через многократные обращения к соседним строкам DRAM — раньше такие сценарии в основном ассоциировались с системной DDR-памятью.
Основной риск — системы vGPU, VDI и облачные ИИ-платформы, где несколько пользователей делят один ускоритель. NVIDIA в качестве меры защиты рекомендует включать ECC через nvidia-smi -e 1, хотя это дает до ~10% просадки производительности и уменьшает доступный объем VRAM примерно на 6.25%. При этом ИИ-ускорители вроде H100 и часть свежих GeForce уже лучше защищены за счет on-die ECC.
Канал Serverflow в MAX: Подписаться
Исследователям удалось добиться до 8 битовых ошибок в 4 банках памяти GDDR6, а самое неприятное — влияние на AI-нагрузки. В proof-of-concept один измененный бит в весах модели уронил точность классификации с ~80% до ~0.1%, то есть речь уже не просто о сбое памяти, а о реальной атаке на целостность ИИ-инференса и GPU-среды в облаке.
Основной риск — системы vGPU, VDI и облачные ИИ-платформы, где несколько пользователей делят один ускоритель. NVIDIA в качестве меры защиты рекомендует включать ECC через nvidia-smi -e 1, хотя это дает до ~10% просадки производительности и уменьшает доступный объем VRAM примерно на 6.25%. При этом ИИ-ускорители вроде H100 и часть свежих GeForce уже лучше защищены за счет on-die ECC.
Канал Serverflow в MAX: Подписаться
👍4
По данным инсайдеров, полученных из цепочки поставок, Intel может провести еще один раунд повышения цен в мае этого года, причем суммарный рост прайсов по отдельным потребительским линейкам за 2026 год уже обсуждается на уровне до 30%. Это уже не разовая коррекция, а продолжающаяся тенденция с учетом мартовского роста цен и старта продаж Arrow Lake Refresh выше фактической рекомендованной розничной цены.
Инсайдеры говорят, что причина роста в дефиците производственных мощностей, но на самом деле, Intel просто набивает себе значимость, чтобы выгодно выделиться на фоне решений AMD, которые активно захватывают рынок как десктопных, так и серверных CPU — якобы, раз цены растут, значит на чины спрос большой. Будем надеяться, что Intel одумается, но шансы на это невелики.
Канал Serverflow в MAX: Подписаться
Инсайдеры говорят, что причина роста в дефиците производственных мощностей, но на самом деле, Intel просто набивает себе значимость, чтобы выгодно выделиться на фоне решений AMD, которые активно захватывают рынок как десктопных, так и серверных CPU — якобы, раз цены растут, значит на чины спрос большой. Будем надеяться, что Intel одумается, но шансы на это невелики.
Канал Serverflow в MAX: Подписаться
Nvidia выпустила квантированную версию Gemma 4 31B в режиме NVFP4 на Hugging Face, сжав модель в 2 раза (с 62 ГБ до 32 ГБ) при менее чем 0,3% потери точности от уровня базовой версии. Запустить можно на GPU с 24 ГБ VRAM. Видимо, Хуанг решил показать всем, что NVFP4 — это must-have, а TurboQuant от Google — не конкрурент. Ждем ответ от DeepMind, борьба будет интересной 🫠
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
1👍6🤯2
К слову, топовую нейронку Google Gemma 4 31B уже успели крякнуть и сделать полностью открытую версию без цензуры 👀
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
1👍6
Не одной Sora едины — появилась утечка о новой модели генерации изображений GPT-Image-2. Похоже, что модель тестируют на LM Arena под кодовыми названиями maskingtape-alpha, gaffertape-alpha, packingtape-alpha. Судя по результатам генерации, которые привел инсайдер, у нейронки неплохой багаж знаний об окружающем мире и хорошие навыки визуализации текста.
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
1👍5🤯2
ServerFlow | Новости и Железо 💾
Не одной Sora едины — появилась утечка о новой модели генерации изображений GPT-Image-2. Похоже, что модель тестируют на LM Arena под кодовыми названиями maskingtape-alpha, gaffertape-alpha, packingtape-alpha. Судя по результатам генерации, которые привел…
Ну ладно, с визуализацией текста погорячились...или просто переборщили с цензурой? По крайней мере теперь понятно, что это не реальное изображение карты 👀
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
🤯6🌭3💩1 1
Пользователь Reddit утверждает, что сломанная видеокарта Radeon RX 6700 XT ожила после 12 минут в духовке при температуре 188 °C. Не повторяйте этого дома 🫠
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
🤯4 2🌭1
H.264 внезапно стал в 40,5 раз дороже для стриминговых платформ
Via Licensing Alliance, крупнейший в мире администратор патентных пулов, тихо изменил модель лицензирования H.264 / AVC для стриминговых сервисов: вместо прежнего потолка в $100 000 в год новые лицензии теперь идут по верхней планке до $4.5 млн в год. Важно, что действующих лицензиатов это не касается — старые контракты сохраняются, а рост затрагивает новые соглашения с 2026 года.
Тем не менее, после проблем с лицензированием H.265 рынок уже начал постепенно уходить в более предсказуемые модели лицензирования, и теперь рост стоимости H.264 может еще сильнее подтолкнуть гиперскелеров и видеохостинги к устоявшейся смене парадигмы.
Канал Serverflow в MAX: Подписаться
Via Licensing Alliance, крупнейший в мире администратор патентных пулов, тихо изменил модель лицензирования H.264 / AVC для стриминговых сервисов: вместо прежнего потолка в $100 000 в год новые лицензии теперь идут по верхней планке до $4.5 млн в год. Важно, что действующих лицензиатов это не касается — старые контракты сохраняются, а рост затрагивает новые соглашения с 2026 года.
H.264 — один из самых ббазовых кодеков, на котором до сих пор держится огромный объем live-стриминга, OTT и VOD-инфраструктуры. H.264 остается де-факто стандартом из-за широчайшей аппаратной поддержки в GPU, CPU, смартфонах, Smart TV и браузерах, поэтому быстро уйти на AV1 или VP9 для многих платформ будет сложно.
Тем не менее, после проблем с лицензированием H.265 рынок уже начал постепенно уходить в более предсказуемые модели лицензирования, и теперь рост стоимости H.264 может еще сильнее подтолкнуть гиперскелеров и видеохостинги к устоявшейся смене парадигмы.
Канал Serverflow в MAX: Подписаться
👍5🤯2
По прогнозу Counterpoint Research, к 2029 году до 90% ИИ-серверов будут использовать Arm-процессоры в роли хостов, а доля x86 и RISC-V составит около 10%. Речь прежде всего о серверах гиперскейлеров с собственными ускорителями, где CPU нужен как управляющий слой для подачи данных, оркестрации и работы с памятью.
Если прогноз сбудется, x86 сохранит позиции в универсальных enterprise-серверах, а системы гиперскелеров и ИИ-инфраструктура почти полностью уйдет в кастомный Arm-кремний. Судьба RISK-V в таком будущем остается неизвестной.
Канал Serverflow в MAX: Подписаться
Основной драйвер роста — выпуск собственных Arm-чипов AWS (Graviton), Google (Axion), Microsoft (Cobalt) и NVIDIA (Grace/Vera) под связку с ASIC-ускорителями их же разработки. Для инфраструктур гиперскелеров критична не столько пиковая производительность, сколько производительность на ватт, высокая плотность размещения в стойках и пропускная способность интерконнекта, и со всеми этими задачами Arm показывает себя превосходно.
Если прогноз сбудется, x86 сохранит позиции в универсальных enterprise-серверах, а системы гиперскелеров и ИИ-инфраструктура почти полностью уйдет в кастомный Arm-кремний. Судьба RISK-V в таком будущем остается неизвестной.
Канал Serverflow в MAX: Подписаться
🤯2
This media is not supported in your browser
VIEW IN TELEGRAM
Материнской плате Apple I, родоначальнику всех яблочных продуктов, сегодня исполняется 50 лет. Пора отдать честь 🫡
Канал Serverflow в MAX: Подписаться
Канал Serverflow в MAX: Подписаться
👍5