ServerFlow | Новости и Железо 💾
4.24K subscribers
4.91K photos
389 videos
12 files
2.39K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
🇨🇳 Мини-рабочие станции MS-R1 от Minisforum вышли в продажу!

Minisforum запустила продажи рабочей станции MS-R1 на базе 12-ядерного процессора с частотой 2,6 ГГц CIX P1 (CP8180, без многопоточки) на архитектуре Arm с ядрами Cortex-A720/A520 и встроенной графикой Immortalis-G720 MC10.

Да-да, конфиг как у смартфона под Clash of Clans, но не спешите с выводами.


Решение также имеет до 64 ГБ распаянных LPDDR5 5500 с поддержкой ECC, слот под SSD до 1 ТБ, 2 сетевых портов 10Gbase-T, 2 слотов M.2 (с переходником на U.2), 8 портов USB и 4 DisplayPort через USB-C. TDP 16-40 Вт. А еще можно накатить Debian.

Но самое главное — в нее можно установить низкопрофильную видюху в физические x8 линий PCIe Gen4 (всего x16). Добавить Nvidia L4 на 24 ГБ GDDR6 — и у вас уже неплохая ИИ-конфетка без всяких DGX Spark!


Цена стартует от ~500 USD за версию с 32 ГБ LPDDR5 и без SSD.

Для виртуализации, легких ИИ-задач или, например, мобильных ферм на Android — неплохой вариант.
👍5
💹 Sandisk подняла цены на NAND на 50 % — на рынке памяти бушует дефицит

По данным DigiTimes, в ноябре Sandisk увеличила контрактные цены на флэш-накопители NAND примерно на 50% из-за дефицита и взрывного спроса на память, вызванного требованиями ИИ-инфраструктуры.

Несколько производителей NAND, такие как Transcend, Innodisk и Apacer, приостановили поставки и прием новых заказов, чтобы пересчитать цены и обязательства перед клиентами.


С лета 2025 года цены на NAND уже успели удвоиться, а годовой рост ценников на DRAM достиг 172%. Transcend зафиксировала рост выручки до 4,11 млрд TWD (+63%) и чистой прибыли +334%, Innodisk — 3,8 млрд TWD (+64%), Apacer — 3,22 млрд TWD (+70%).

Ранее глава Phison Кэйн-Сенг Пуа предупреждал, что дефицит NAND может продлиться до конца десятилетия: отрасль переориентировалась на память HBM для обучения/инференса ИИ, тогда как NAND снова стала дефицитом.


Скоро в блоге ServerFlow выйдет новая статья, где мы подробно расскажем о причинах и последствиях кризиса памяти.
💩3🌭2
Firefox 145 вышел, но без 32-битной версии для Linux

Mozilla выпустила Firefox 145, но без привычных 32-битных сборок под Linux. Последними версиями с их поддержкой останутся Firefox 144 и Firefox 140 ESR — дальше браузер будет развиваться только в 64-битной ветке.

32-битные сборки все еще используются в сегменте edge-вычислений и на устройствах с малым объемом RAM, но с поддержкой 64-бит (Pentium 4 или Raspberry Pi 2 Model B) — это объясняется легковесностью таких сборок, что позволяет запускать их на слабых системах.


В релизе добавлена полноценная поддержка контейнера Matroska (MKV) для популярных кодеков — AVC, HEVC, VP8, VP9, AV1, AAC, Opus и Vorbis. Это упростит воспроизведение видео без внешних плагинов и снизит нагрузку на систему.

Переход на 64-битную сборку позволит Mozilla активнее внедрять новые функции безопасности и улучшать производительность, особенно при работе с мультимедиа и многопоточными вкладками.


Люди, застрявшие в 2011 году — соболезнуем 🕯
1👍3🌭1
This media is not supported in your browser
VIEW IN TELEGRAM
👟 Кроссовки с лого TSMC стали вирусными на Тайване

TSMC провела ежегодное спортивное соревнование, в котором принял участие даже Дженсен Хуанг, но внимание местных СМИ привлек совсем не он, а CEO TSMC Си Си Вэй, который пришел тряхнуть стариной вот в таких интересных подкрадулях.

Кроссы с лого TSMC были сделаны на заказ мастером из Гаосюна еще в 2017. После восьми лет собирания пыли на полке, они сохранились в идеальном состоянии. Вэй и производитель намекнули, что брендированные кроссовки TSMC могут появиться в официальном мерче компании.

Если это произойдёт, TSMC может пополнить список технокомпаний, запустивших обувные коллаборации — вроде Xbox × Adidas или PlayStation × Nike.


Рюкзак-сова, кстати, тоже весьма прикольный 🦉
1👍31
🥇 ТОП-10 лучших ИИ-ускорителей в 2025 году

Мы так много говорим о ИИ-ускорителях, но ни разу не делали рейтинг лучших решений для обучения/инференса нейронок.

Решили исправиться!

Вот кто реально задает темп в вычислениях для ИИ ☝️
👍5
⚒️ Bulldozer снова завелся: вышла новая прошивка с открытым кодом для старых платформ AMD

Проект 15h.org выпустил свежую open-source прошивку для процессоров AMD на базе старых архитектур Bulldozer и Piledriver.

Разработчики восстановили и улучшили старый код AGESA, добавив стабильную инициализацию памяти, терморегулирование, полноценную поддержку IOMMU и патчи для спекулятивного выполнения — теперь QubesOS и FreeBSD работают без ограничений.


Прошивка тестировалась на платах ASUS KGPE-D16 и SuperMicro H8SCM/H8SGL, поддерживает до 512 ГБ ОЗУ и до 6 карт PCIe/PIKE/PCI. Новая версия 2025.11.09-v4.11 улучшает работу HyperTransport, снижает энергопотребление и вводит защиту от перегрева.

Это редкий пример, когда устаревшие платформы получили новую жизнь благодаря сообществу, а не вендору.


Самое время вспомнить про легендарные AMD FX, и теперь вам даже не нужен жидкий азот ❄️
1👍4🌭1
🚀 vLLM теперь работает на Intel Arc Pro B

Команда vLLM добавила полную поддержку графических процессоров Intel Arc Pro серии B.

В тестах MLPerf v5.1 карта Arc Pro B60 с 24 ГБ GDDR6 (456 ГБ/с, 160 ИИ-ядр) показала 80% прирост эффективности при работе с архитектурами MoE, такими как Qwen3 и GPT-OSS.


При масштабировании на 8 GPU задержка генерации остается ниже 100 мс при работе с моделями с контекстным окном более 50 000 токенов.

Также добавили реали полную поддержку TP/PP/EP-масштабирования, аппаратное преобразование MXFP4 → BF16 (+ 30% к эффективности памяти) и динамическую балансировку нагрузки. Уже завезли готовый Docker-образ intel/vllm:0.10.2-xpu.


Похоже, Arc Pro B60 становится новой бюджетной платформой для локальных LLM, особенно, если ваша цель — максимум вычислений за минимум денег.
👍3
This media is not supported in your browser
VIEW IN TELEGRAM
👀 Отличия традиционных ИИ-трансформеров и трансформеров с MoE наглядно

В классических трансформерах каждая позиция текста обрабатывается одной большой нейросетью. В архитектуре Mixture of Experts (MoE) этот блок заменен на набор экспертовнебольших нейросетей, каждая из которых отвечает за отдельные типы данных или шаблоны.

При генерации модель активирует лишь часть экспертов (например, 2 из 8), что резко снижает вычислительную нагрузку и ускоряет вывод.


Ключевой элемент MoE — маршрутизатор, который решает, какие эксперты будут работать с конкретным токеном. Он оценивает вход через softmax, выбирает лучших экспертов и обучается совместно с моделью.

Чтобы избежать ситуации, когда один эксперт монополизирует обучение, добавляют шум и ограничивают число токенов, обрабатываемых каждым экспертом.


Такой подход делает модель масштабнее и эффективнее без пропорционального роста сложности вычислений.

Именно поэтому MoE стала де-факто стандартом в мире LLM 🦾
1👍3
⚡️ Flashtensors ускоряет инференс LLM в 10 раз

На GitHub релизнули Flashtensors — приложение, которое ускоряет инференс больших языковых моделей в 10 раз и позволяет запускать их всего на одном GPU. Благодаря Flashtensors данные из SSD подаются прямо в видеопамять, сокращая время загрузки до пары секунд.

Для использования Flashtensors нужны GPU NVIDIA с минимум 4 ГБ VRAM, а также 8 ГБ ОЗУ и SSD. Работает на Windows, macOS и Linux.


Весь секрет в механизме m_lock — он фиксирует сегменты VRAM и держит их в “теплом” состоянии: веса модели остаются на GPU даже после смены контекста, поэтому повторная загрузка занимает 1-2 секунды вместо десятков секунд.

Инструмент также удобен тем, что позволяет мгновенно переключать LLM без перезапуска среды всего за 2 секунды, а также работать с более чем со 100 ИИ-моделями одновременно с минимальной задержкой.


Must-have, если бесит долгая загрузка модели из SSD.
👍6
⚡️AMD раскрыла инфу о Zen 6 и Zen 7

AMD на конфе Financial Analyst Day 2025 раскрыла дорожную карту архитектур CPU следующего поколения.

Zen 6 выйдет в 2026 году и перейдет на 2-нм техпроцесс TSMC, а в линейку войдут как производительные ядра Zen 6, так и энергоэффективные ядра Zen 6C. Серверные чипы EPYC Venice станут дебютом архитектуры Zen 6 и получат интерфейсы PCIe 7.0, Infinity Fabric Gen 5, пропускную способность до 224 ГБ/с и новое межсоединение SerDes 64 ГБ/с.


Стойки Helios объединят Zen 6 с ускорителями MI400 на архитектуре CDNA 5 и сетевыми картами Polara и Vulcano. В настольном сегменте Zen 6 появятся чипы Olympic Ridge, а в мобильном — Medusa Point.

В 2027-м на смену придет Zen 7: архитектура с новым матричным блоком для выполнения ML-операций прямо в ядре и гибридным CPU+GPU-окружением. Уже известно, что в семейство Zen 7 войдут серверные CPU EPYC Verano.


AMD делает ставку на глубокую интеграцию ИИ в x86-ядра, где CPU и GPU работают как единая вычислительная машина.
👍3🍾1