ServerFlow | Новости и Железо 💾
4.23K subscribers
4.86K photos
386 videos
12 files
2.36K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
Сегодня Apple исполняется 50 лет 🎉

Канал Serverflow в MAX: Подписаться
🍾6💩31
Явка с повинной: объявился инженер, сливший исходный код Claude Code. Кевина Нотона уже уволили из Anthropic, но из-за чувства вины (или под давлением), он решил признаться в содеянном и объяснить, как это вообще произошло.

Желая улучшить процесс отладки для команды, он включить в релиз исходные кодовые базы Claude, что и стало причиной слива данных в общий доступ. Также он отметил, что он использовал некие “меры предосторожности”, разработанные Claude Code, но их оказалось недостаточно — похоже, что это очередной случай факапа ИИ-агента в бигтех компании.

Но не исключено, что это просто первоапрельская шутка...

Канал Serverflow в MAX: Подписаться
🤯3👍11
This media is not supported in your browser
VIEW IN TELEGRAM
Как восстанавливают поврежденную трассировку на плате 👀

Канал Serverflow в MAX: Подписаться
👍41
Raspberry Pi резко поднимает цены из-за памяти 📈

Raspberry Pi объявила о повышении цен на модели с 4 ГБ ОЗУ и выше после резкого роста стоимости LPDDR4 DRAM. По словам Эбена Аптона, цена памяти выросла примерно в 7 раз, поэтому удорожание затронуло Raspberry Pi 4, 5 и связанные продукты, а рост цен составляет от $25 до $100 в зависимости от конфигурации.

Одновременно с этим компания выпустила новую “антикризисную” версию Raspberry Pi 4 с 3 ГБ памяти по цене $83.75. На фоне новых цен топовые модели выглядят уже совсем не как “дешевые одноплатники” — например, Raspberry Pi 5 16 ГБ теперь стоит $305, а Raspberry Pi 500+ 16 ГБ доходит до $410.

Для плат такого класса память занимает заметную долю себестоимости, особенно в старших конфигурациях. При этом версии на 1-2 ГБ и часть 4 ГБ решений под повышение цен не попали, а компания обещает вернуть цены назад, если рынок DRAM стабилизируется.
💩6👍1
Слегка отвлечемся от темы серверного оборудования, ведь прямо сейчас происходит одно из важнейших событий в истории человечества.

NASA проводит миссию Artemis II — первый пилотируемый облет Луны за последние 50 лет. Четыре астронавта на корабле Orion совершат 10-дневное путешествие вокруг спутника Земли, не высаживаясь на поверхность. Миссия призвана проверить системы жизнеобеспечения перед высадкой людей на спутник.

NASA запустила прямую трансляцию выполнения миссии, за которой следят уже 300 000 человек. Присоединяйтесь!
👍11💩2🤯1🍾11
This media is not supported in your browser
VIEW IN TELEGRAM
В конце марта цены на оперативную память в Китае начали падать на $15 в сутки после выхода алгоритма сжатия LLM Google TurboQuant. На фоне этого, в сети начали появляться такие кадры прямиком из Поднебесной 👀

Канал Serverflow в MAX: Подписаться
🤯61
В свежей утечке засветилась мобильная серия процессоров Core Ultra 400HX (Nova Lake-HX), которая готовится как полноценная замена текущим Arrow Lake HX для игровых ноутбуков и мобильных рабочих станций. Главный акцент — заметный рост числа ядер: в топовой конфигурации фигурирует до 28 ядер, что уже выводит HX-сегмент ближе к десктопному классу производительности.

Ожидается гибридная схема на новых ядрах Coyote Cove P-cores и Arctic Wolf E-cores, плюс обновленный NPU и Xe-графика третьего поколения. По данным утечки, Intel готовит несколько конфигураций, включая 8P + 16E + 4 LP E для старших SKU, что особенно важно для сегмента высокопроизводительных ноутбуков, где критична многопоточность и поддержка ИИ-нагрузок.

Канал Serverflow в MAX: Подписаться
👍2
Релиз Qwen 3.6 Plus 🎉

Alibaba выпустила новейшую модель Qwen 3.6 Plus Preview, главный апгрейд — контекстное окно до 1 000 000 токенов для анализа больших кодовых репозиториев, длинных документов, логов и многоэтапных агентных рабочих нагрузок.

Qwen 3.6 Plus Preview базируется на гибридной архитектуре с комбинацией линейного внимания и MoE, что снижает вычислительные затраты и ускоряет выполнение операций на длинном контексте. За счёт этого модель может держать до 65 536 токенов в ответе и работать с внешними инструментами через вызовы и API.

Модель доступна бесплатно на OpenRouter на время тестирования. Ждем OpenSource-релиз!

Канал Serverflow в MAX: Подписаться
👍8
This media is not supported in your browser
VIEW IN TELEGRAM
Компания Z.ai представила свою новую флагманскую мультимодальную модель GLM-5V-Turbo с функцией визуального кодирования, которая позволяет создавать пользовательские интерфейсы на основе представленных изображений. Также модель способна выполнять активные действия прямо на устройстве пользователя. GLM-5V-Turbo доступна в тарифных планах Z AI Chat и Coding. Прайс: $1.20 за 1 миллион входных и $4.00 за 1 миллион выходных токенов.

Канал Serverflow в MAX: Подписаться
👍6
Google представила Gemma 4 — новое поколение открытых LLM, ориентированное на запуск на edge-устройствах и серверных GPU. Линейка включает модели E2B, E4B, 26B MoE и 31B Dense, при этом старшие версии уже позиционируют как модели с высочайшим уровнем производительности на уровне проприетарных нейронок при заметно меньших требованиях к железу.

Модель 31B Dense может работать на одном 80 ГБ H100, а 26B использует mixture-of-experts для снижения вычислительной нагрузки на токен по сравнению с классическим dense-стеком. Младшие E2B и E4B нацелены на ноутбуки, edge-устройства и embedded-платформы вроде Raspberry Pi и Jetson. Все семейство LLM доступно на Hugging Face.

Канал Serverflow в MAX: Подписаться
👍4🌭1
Canonical без лишней шумихи обновила системные требования для Ubuntu Desktop 26.04 LTS: теперь минимальный объем оперативной памяти составляет 6 ГБ вместо 4 ГБ. Это первое повышение требований со времен Ubuntu 18.04, когда порог вырос с 1 до 4 ГБ.

Остальные требования почти не изменились — нужен 2-ядерный CPU от 2 ГГц и 25 ГБ свободного места на диске. Для серверной редакции планка заметно ниже: старт от 1.5 ГБ RAM. Это подчеркивает, что рост требований связан прежде всего с desktop-стеком — GNOME 50, современным Firefox и LibreOffice.

Канал Serverflow в MAX: Подписаться
👍3
Сооснователь SuperMicro И-Шян “Уолли” Ляо в федеральном суде Манхэттена заявил о непризнании вины по делу о незаконной переправке серверов с GPU NVIDIA в Китай. По версии прокуратуры, схема могла затрагивать поставки на сумму около $2.5 млрд, а сами системы шли через подставную компанию в Юго-Восточной Азии для обхода экспортных ограничений США.

Канал Serverflow в MAX: Подписаться
👍4
This media is not supported in your browser
VIEW IN TELEGRAM
А вы знали, что в Китае проводят соревнования по скоростному ремонту процессоров? 👀
🤯5
Энтузиасты нашли в поставочных декларациях упоминания новых чипов Intel Nova Lake-AX для топовых ноутбуков и компактных ИИ-ПК. Чип будет иметь iGPU с 48 блоками Xe3p, а также 256-битную шину памяти LPDDR5X-10667. Но интересны не столько характеристики, а сокет этих процессоров — LGA 4326 с размерами 37,5 × 56,5 мм. Сокеты подобных габаритов обычно используют в серверных системах, поэтому странно, что Intel решила использовать его в десктопе, но очевидно, что чип будет очень мощным.

Канал Serverflow в MAX: Подписаться
👍2🤯1
Исследователи впервые показали полноценную RowHammer-атаку на дискретный GPU Nvidia с GDDR6, в качестве цели использовался NVIDIA RTX A6000. Атака получила название GPUHammer и позволяет вызывать bit flip в видеопамяти через многократные обращения к соседним строкам DRAM — раньше такие сценарии в основном ассоциировались с системной DDR-памятью.

Исследователям удалось добиться до 8 битовых ошибок в 4 банках памяти GDDR6, а самое неприятное — влияние на AI-нагрузки. В proof-of-concept один измененный бит в весах модели уронил точность классификации с ~80% до ~0.1%, то есть речь уже не просто о сбое памяти, а о реальной атаке на целостность ИИ-инференса и GPU-среды в облаке.


Основной риск — системы vGPU, VDI и облачные ИИ-платформы, где несколько пользователей делят один ускоритель. NVIDIA в качестве меры защиты рекомендует включать ECC через nvidia-smi -e 1, хотя это дает до ~10% просадки производительности и уменьшает доступный объем VRAM примерно на 6.25%. При этом ИИ-ускорители вроде H100 и часть свежих GeForce уже лучше защищены за счет on-die ECC.

Канал Serverflow в MAX: Подписаться
👍4
По данным инсайдеров, полученных из цепочки поставок, Intel может провести еще один раунд повышения цен в мае этого года, причем суммарный рост прайсов по отдельным потребительским линейкам за 2026 год уже обсуждается на уровне до 30%. Это уже не разовая коррекция, а продолжающаяся тенденция с учетом мартовского роста цен и старта продаж Arrow Lake Refresh выше фактической рекомендованной розничной цены.

Инсайдеры говорят, что причина роста в дефиците производственных мощностей, но на самом деле, Intel просто набивает себе значимость, чтобы выгодно выделиться на фоне решений AMD, которые активно захватывают рынок как десктопных, так и серверных CPU — якобы, раз цены растут, значит на чины спрос большой. Будем надеяться, что Intel одумается, но шансы на это невелики.

Канал Serverflow в MAX: Подписаться
4🌭1
Nvidia выпустила квантированную версию Gemma 4 31B в режиме NVFP4 на Hugging Face, сжав модель в 2 раза (с 62 ГБ до 32 ГБ) при менее чем 0,3% потери точности от уровня базовой версии. Запустить можно на GPU с 24 ГБ VRAM. Видимо, Хуанг решил показать всем, что NVFP4 — это must-have, а TurboQuant от Google — не конкрурент. Ждем ответ от DeepMind, борьба будет интересной 🫠

Канал Serverflow в MAX: Подписаться
1👍6🤯2
К слову, топовую нейронку Google Gemma 4 31B уже успели крякнуть и сделать полностью открытую версию без цензуры 👀

Канал Serverflow в MAX: Подписаться
1👍6