🇨🇳 Мини-рабочие станции MS-R1 от Minisforum вышли в продажу!
Minisforum запустила продажи рабочей станции MS-R1 на базе 12-ядерного процессора с частотой 2,6 ГГц CIX P1 (CP8180, без многопоточки) на архитектуре Arm с ядрами Cortex-A720/A520 и встроенной графикой Immortalis-G720 MC10.
Решение также имеет до 64 ГБ распаянных LPDDR5 5500 с поддержкой ECC, слот под SSD до 1 ТБ, 2 сетевых портов 10Gbase-T, 2 слотов M.2 (с переходником на U.2), 8 портов USB и 4 DisplayPort через USB-C. TDP 16-40 Вт. А еще можно накатить Debian.
Цена стартует от ~500 USD за версию с 32 ГБ LPDDR5 и без SSD.
Для виртуализации, легких ИИ-задач или, например, мобильных ферм на Android — неплохой вариант.
Minisforum запустила продажи рабочей станции MS-R1 на базе 12-ядерного процессора с частотой 2,6 ГГц CIX P1 (CP8180, без многопоточки) на архитектуре Arm с ядрами Cortex-A720/A520 и встроенной графикой Immortalis-G720 MC10.
Да-да, конфиг как у смартфона под Clash of Clans, но не спешите с выводами.
Решение также имеет до 64 ГБ распаянных LPDDR5 5500 с поддержкой ECC, слот под SSD до 1 ТБ, 2 сетевых портов 10Gbase-T, 2 слотов M.2 (с переходником на U.2), 8 портов USB и 4 DisplayPort через USB-C. TDP 16-40 Вт. А еще можно накатить Debian.
Но самое главное — в нее можно установить низкопрофильную видюху в физические x8 линий PCIe Gen4 (всего x16). Добавить Nvidia L4 на 24 ГБ GDDR6 — и у вас уже неплохая ИИ-конфетка без всяких DGX Spark!
Цена стартует от ~500 USD за версию с 32 ГБ LPDDR5 и без SSD.
Для виртуализации, легких ИИ-задач или, например, мобильных ферм на Android — неплохой вариант.
👍5
💹 Sandisk подняла цены на NAND на 50 % — на рынке памяти бушует дефицит
По данным DigiTimes, в ноябре Sandisk увеличила контрактные цены на флэш-накопители NAND примерно на 50% из-за дефицита и взрывного спроса на память, вызванного требованиями ИИ-инфраструктуры.
С лета 2025 года цены на NAND уже успели удвоиться, а годовой рост ценников на DRAM достиг 172%. Transcend зафиксировала рост выручки до 4,11 млрд TWD (+63%) и чистой прибыли +334%, Innodisk — 3,8 млрд TWD (+64%), Apacer — 3,22 млрд TWD (+70%).
Скоро в блоге ServerFlow выйдет новая статья, где мы подробно расскажем о причинах и последствиях кризиса памяти.
По данным DigiTimes, в ноябре Sandisk увеличила контрактные цены на флэш-накопители NAND примерно на 50% из-за дефицита и взрывного спроса на память, вызванного требованиями ИИ-инфраструктуры.
Несколько производителей NAND, такие как Transcend, Innodisk и Apacer, приостановили поставки и прием новых заказов, чтобы пересчитать цены и обязательства перед клиентами.
С лета 2025 года цены на NAND уже успели удвоиться, а годовой рост ценников на DRAM достиг 172%. Transcend зафиксировала рост выручки до 4,11 млрд TWD (+63%) и чистой прибыли +334%, Innodisk — 3,8 млрд TWD (+64%), Apacer — 3,22 млрд TWD (+70%).
Ранее глава Phison Кэйн-Сенг Пуа предупреждал, что дефицит NAND может продлиться до конца десятилетия: отрасль переориентировалась на память HBM для обучения/инференса ИИ, тогда как NAND снова стала дефицитом.
Скоро в блоге ServerFlow выйдет новая статья, где мы подробно расскажем о причинах и последствиях кризиса памяти.
💩3🌭2
❌ Firefox 145 вышел, но без 32-битной версии для Linux
Mozilla выпустила Firefox 145, но без привычных 32-битных сборок под Linux. Последними версиями с их поддержкой останутся Firefox 144 и Firefox 140 ESR — дальше браузер будет развиваться только в 64-битной ветке.
В релизе добавлена полноценная поддержка контейнера Matroska (MKV) для популярных кодеков — AVC, HEVC, VP8, VP9, AV1, AAC, Opus и Vorbis. Это упростит воспроизведение видео без внешних плагинов и снизит нагрузку на систему.
Люди, застрявшие в 2011 году — соболезнуем 🕯
Mozilla выпустила Firefox 145, но без привычных 32-битных сборок под Linux. Последними версиями с их поддержкой останутся Firefox 144 и Firefox 140 ESR — дальше браузер будет развиваться только в 64-битной ветке.
32-битные сборки все еще используются в сегменте edge-вычислений и на устройствах с малым объемом RAM, но с поддержкой 64-бит (Pentium 4 или Raspberry Pi 2 Model B) — это объясняется легковесностью таких сборок, что позволяет запускать их на слабых системах.
В релизе добавлена полноценная поддержка контейнера Matroska (MKV) для популярных кодеков — AVC, HEVC, VP8, VP9, AV1, AAC, Opus и Vorbis. Это упростит воспроизведение видео без внешних плагинов и снизит нагрузку на систему.
Переход на 64-битную сборку позволит Mozilla активнее внедрять новые функции безопасности и улучшать производительность, особенно при работе с мультимедиа и многопоточными вкладками.
Люди, застрявшие в 2011 году — соболезнуем 🕯
1👍3🌭1
This media is not supported in your browser
VIEW IN TELEGRAM
👟 Кроссовки с лого TSMC стали вирусными на Тайване
TSMC провела ежегодное спортивное соревнование, в котором принял участие даже Дженсен Хуанг, но внимание местных СМИ привлек совсем не он, а CEO TSMC Си Си Вэй, который пришел тряхнуть стариной вот в таких интересных подкрадулях.
Кроссы с лого TSMC были сделаны на заказ мастером из Гаосюна еще в 2017. После восьми лет собирания пыли на полке, они сохранились в идеальном состоянии. Вэй и производитель намекнули, что брендированные кроссовки TSMC могут появиться в официальном мерче компании.
Рюкзак-сова, кстати, тоже весьма прикольный 🦉
TSMC провела ежегодное спортивное соревнование, в котором принял участие даже Дженсен Хуанг, но внимание местных СМИ привлек совсем не он, а CEO TSMC Си Си Вэй, который пришел тряхнуть стариной вот в таких интересных подкрадулях.
Кроссы с лого TSMC были сделаны на заказ мастером из Гаосюна еще в 2017. После восьми лет собирания пыли на полке, они сохранились в идеальном состоянии. Вэй и производитель намекнули, что брендированные кроссовки TSMC могут появиться в официальном мерче компании.
Если это произойдёт, TSMC может пополнить список технокомпаний, запустивших обувные коллаборации — вроде Xbox × Adidas или PlayStation × Nike.
Рюкзак-сова, кстати, тоже весьма прикольный 🦉
1👍3 1
⚒️ Bulldozer снова завелся: вышла новая прошивка с открытым кодом для старых платформ AMD
Проект 15h.org выпустил свежую open-source прошивку для процессоров AMD на базе старых архитектур Bulldozer и Piledriver.
Прошивка тестировалась на платах ASUS KGPE-D16 и SuperMicro H8SCM/H8SGL, поддерживает до 512 ГБ ОЗУ и до 6 карт PCIe/PIKE/PCI. Новая версия 2025.11.09-v4.11 улучшает работу HyperTransport, снижает энергопотребление и вводит защиту от перегрева.
Самое время вспомнить про легендарные AMD FX, и теперь вам даже не нужен жидкий азот ❄️
Проект 15h.org выпустил свежую open-source прошивку для процессоров AMD на базе старых архитектур Bulldozer и Piledriver.
Разработчики восстановили и улучшили старый код AGESA, добавив стабильную инициализацию памяти, терморегулирование, полноценную поддержку IOMMU и патчи для спекулятивного выполнения — теперь QubesOS и FreeBSD работают без ограничений.
Прошивка тестировалась на платах ASUS KGPE-D16 и SuperMicro H8SCM/H8SGL, поддерживает до 512 ГБ ОЗУ и до 6 карт PCIe/PIKE/PCI. Новая версия 2025.11.09-v4.11 улучшает работу HyperTransport, снижает энергопотребление и вводит защиту от перегрева.
Это редкий пример, когда устаревшие платформы получили новую жизнь благодаря сообществу, а не вендору.
Самое время вспомнить про легендарные AMD FX, и теперь вам даже не нужен жидкий азот ❄️
1👍4🌭1
🚀 vLLM теперь работает на Intel Arc Pro B
Команда vLLM добавила полную поддержку графических процессоров Intel Arc Pro серии B.
При масштабировании на 8 GPU задержка генерации остается ниже 100 мс при работе с моделями с контекстным окном более 50 000 токенов.
Похоже, Arc Pro B60 становится новой бюджетной платформой для локальных LLM, особенно, если ваша цель — максимум вычислений за минимум денег.
Команда vLLM добавила полную поддержку графических процессоров Intel Arc Pro серии B.
В тестах MLPerf v5.1 карта Arc Pro B60 с 24 ГБ GDDR6 (456 ГБ/с, 160 ИИ-ядр) показала 80% прирост эффективности при работе с архитектурами MoE, такими как Qwen3 и GPT-OSS.
При масштабировании на 8 GPU задержка генерации остается ниже 100 мс при работе с моделями с контекстным окном более 50 000 токенов.
Также добавили реали полную поддержку TP/PP/EP-масштабирования, аппаратное преобразование MXFP4 → BF16 (+ 30% к эффективности памяти) и динамическую балансировку нагрузки. Уже завезли готовый Docker-образ — intel/vllm:0.10.2-xpu.
Похоже, Arc Pro B60 становится новой бюджетной платформой для локальных LLM, особенно, если ваша цель — максимум вычислений за минимум денег.
👍3
This media is not supported in your browser
VIEW IN TELEGRAM
👀 Отличия традиционных ИИ-трансформеров и трансформеров с MoE наглядно
В классических трансформерах каждая позиция текста обрабатывается одной большой нейросетью. В архитектуре Mixture of Experts (MoE) этот блок заменен на набор экспертов — небольших нейросетей, каждая из которых отвечает за отдельные типы данных или шаблоны.
Ключевой элемент MoE — маршрутизатор, который решает, какие эксперты будут работать с конкретным токеном. Он оценивает вход через softmax, выбирает лучших экспертов и обучается совместно с моделью.
Такой подход делает модель масштабнее и эффективнее без пропорционального роста сложности вычислений.
Именно поэтому MoE стала де-факто стандартом в мире LLM 🦾
В классических трансформерах каждая позиция текста обрабатывается одной большой нейросетью. В архитектуре Mixture of Experts (MoE) этот блок заменен на набор экспертов — небольших нейросетей, каждая из которых отвечает за отдельные типы данных или шаблоны.
При генерации модель активирует лишь часть экспертов (например, 2 из 8), что резко снижает вычислительную нагрузку и ускоряет вывод.
Ключевой элемент MoE — маршрутизатор, который решает, какие эксперты будут работать с конкретным токеном. Он оценивает вход через softmax, выбирает лучших экспертов и обучается совместно с моделью.
Чтобы избежать ситуации, когда один эксперт монополизирует обучение, добавляют шум и ограничивают число токенов, обрабатываемых каждым экспертом.
Такой подход делает модель масштабнее и эффективнее без пропорционального роста сложности вычислений.
Именно поэтому MoE стала де-факто стандартом в мире LLM 🦾
1👍3
⚡️ Flashtensors ускоряет инференс LLM в 10 раз
На GitHub релизнули Flashtensors — приложение, которое ускоряет инференс больших языковых моделей в 10 раз и позволяет запускать их всего на одном GPU. Благодаря Flashtensors данные из SSD подаются прямо в видеопамять, сокращая время загрузки до пары секунд.
Весь секрет в механизме m_lock — он фиксирует сегменты VRAM и держит их в “теплом” состоянии: веса модели остаются на GPU даже после смены контекста, поэтому повторная загрузка занимает 1-2 секунды вместо десятков секунд.
Must-have, если бесит долгая загрузка модели из SSD.
На GitHub релизнули Flashtensors — приложение, которое ускоряет инференс больших языковых моделей в 10 раз и позволяет запускать их всего на одном GPU. Благодаря Flashtensors данные из SSD подаются прямо в видеопамять, сокращая время загрузки до пары секунд.
Для использования Flashtensors нужны GPU NVIDIA с минимум 4 ГБ VRAM, а также 8 ГБ ОЗУ и SSD. Работает на Windows, macOS и Linux.
Весь секрет в механизме m_lock — он фиксирует сегменты VRAM и держит их в “теплом” состоянии: веса модели остаются на GPU даже после смены контекста, поэтому повторная загрузка занимает 1-2 секунды вместо десятков секунд.
Инструмент также удобен тем, что позволяет мгновенно переключать LLM без перезапуска среды всего за 2 секунды, а также работать с более чем со 100 ИИ-моделями одновременно с минимальной задержкой.
Must-have, если бесит долгая загрузка модели из SSD.
👍6
⚡️AMD раскрыла инфу о Zen 6 и Zen 7
AMD на конфе Financial Analyst Day 2025 раскрыла дорожную карту архитектур CPU следующего поколения.
Стойки Helios объединят Zen 6 с ускорителями MI400 на архитектуре CDNA 5 и сетевыми картами Polara и Vulcano. В настольном сегменте Zen 6 появятся чипы Olympic Ridge, а в мобильном — Medusa Point.
AMD делает ставку на глубокую интеграцию ИИ в x86-ядра, где CPU и GPU работают как единая вычислительная машина.
AMD на конфе Financial Analyst Day 2025 раскрыла дорожную карту архитектур CPU следующего поколения.
Zen 6 выйдет в 2026 году и перейдет на 2-нм техпроцесс TSMC, а в линейку войдут как производительные ядра Zen 6, так и энергоэффективные ядра Zen 6C. Серверные чипы EPYC Venice станут дебютом архитектуры Zen 6 и получат интерфейсы PCIe 7.0, Infinity Fabric Gen 5, пропускную способность до 224 ГБ/с и новое межсоединение SerDes 64 ГБ/с.
Стойки Helios объединят Zen 6 с ускорителями MI400 на архитектуре CDNA 5 и сетевыми картами Polara и Vulcano. В настольном сегменте Zen 6 появятся чипы Olympic Ridge, а в мобильном — Medusa Point.
В 2027-м на смену придет Zen 7: архитектура с новым матричным блоком для выполнения ML-операций прямо в ядре и гибридным CPU+GPU-окружением. Уже известно, что в семейство Zen 7 войдут серверные CPU EPYC Verano.
AMD делает ставку на глубокую интеграцию ИИ в x86-ядра, где CPU и GPU работают как единая вычислительная машина.
👍3🍾1
⚡️ AMD Instinct MI400 и MI500: борьба с Nvidia началась
Помимо новых архитектур CPU, на Financial Analyst Day 2025 AMD также раскрыла планы по ИИ-ускорителям Instinct MI400 и MI500.
Также MI400 получат поддержку гибридных CPU+GPU-схем и сетевых протоколов UALoE, UAL, UEC.
AMD усиливает темп обновлений, планируя релизить новые решения ежегодно. MI400 станет реальным конкурентом Nvidia Vera Rubin, а MI500 готовит революцию в вычислительной мощности.
Помимо новых архитектур CPU, на Financial Analyst Day 2025 AMD также раскрыла планы по ИИ-ускорителям Instinct MI400 и MI500.
Серия MI400, которая выйдет в 2026 году, базируется на архитектуре CDNA 5 предложит до 432 ГБ HBM4 с пропускной способностью 19,6 ТБ/с — почти вдвое выше, чем у MI350. Флагман серии MI455X рассчитан на обучение и вывод ИИ, а MI430X — на HPC и ИИ-госпрограммы США. Производительность достигает 40 PFLOPS (FP4) и 20 PFLOPS (FP8) со структурной разреженностью.
Также MI400 получат поддержку гибридных CPU+GPU-схем и сетевых протоколов UALoE, UAL, UEC.
О следующем поколении MI500 известно мало. Возможно линейка перейдет на CDNA 6 и, скорее всего, в ней появится память HBM4e. MI500 войдут в новые серверные стойки для работы с LLM и генеративными ИИ.
AMD усиливает темп обновлений, планируя релизить новые решения ежегодно. MI400 станет реальным конкурентом Nvidia Vera Rubin, а MI500 готовит революцию в вычислительной мощности.
👍2🌭1