ServerFlow | Новости и Железо 💾
4.25K subscribers
4.97K photos
393 videos
12 files
2.43K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
🤭 Смешно, но ценники на оперативку у Apple теперь не выглядят как обдираловка.

Хотя, зная Тим Кука, скоро этот недочет быстро исправят…

А может, Apple просто предвидела кризис заранее? 🤔
👍3💩1💅1
⚒️ Intel обновила Compute Runtime 25.44.36015.5 с упором на Xe3 и Panther Lake

Вышла свежая версия Intel Compute Runtime 25.44.36015.5. Это регулярное обновление программного стека Level Zero и OpenCL для встроенной и дискретной графики Intel.

Основные нововведения сейчас связаны с подготовкой к запуску поколения графики Xe3 в процессорах Panther Lake и Wildcat Lake.


Добавили прототип OpenCL C через zeModuleCreate, ускорили компиляцию, расширили пулы USM и включили их для Lunar Lake, память для буферов теперь активнее выделяется из 2 МБ с выравниванием по 2 МБ, что снижает фрагментацию и немного повышает пропускную способность.

Плюс появилась поддержка Level Zero v1.14, от SPIR на GPU Xe2+ отказались.


Короче, Intel готовит функционал под будущие GPU и чистит устаревшие механизмы. Обновление доступно на GitHub.
👍2
⚡️ Seasonic готовит безвентиляторный блок питания на 1 000 Вт

Seasonic разрабатывает БП PRIME Fanless TX мощностью 1 000 Вт.

Это будет модульный блок питания с сертификатом 80 PLUS Titanium и гарантией на 12 лет.


Производитель пока не раскрывает детали по кабелям и спецификациям, но ставка делается на полностью пассивное охлаждение.

У конкурентов в том же сегменте уже есть Cooler Master X Silent Edge на 850 и 1 100 Вт. Они поддерживают ATX 3.1 и разъем 12V-2×6. Если Seasonic сохранит аналогичную совместимость, блок станет одним из самых мощных безвентиляторных решений для систем с топовыми GPU.


Это нишевая категория, но пассивные модели берут надежностью и нулевым шумом — в нем нечему ломаться и нечему гудеть.
👍3
⚒️ Плагины вместо форков: vLLM упростил кастомизацию движка

Разработчики проекта рассказали, как настраивать vLLM без форков — все благодаря интеграции плагинов.

Система плагинов позволяет делать точечные правки движка без изменения целых модулей кода.

Это можно делать на уровне классов через VLLMPatch и подключаться через vllm.general_plugins. Все изменения активируются переменной окружения.


vLLM обновляется раз в две недели, и форки быстро превращаются в боль из-за перебазировки и конфликтов. Плагины полностью решают эту проблему.

Один Docker-образ может обслуживать разные модели с разными патчами, а плагин подхватывается во всех процессах до старта инференса.


Это облегчает масштабирование и снижает риск поломки при обновлениях. По оценкам специалистов, даже приоритетный планировщик можно внедрить всего за 20 строк.
👍2
💸 DDR5 32 ГБ = RTX 5060

Ценники на плашки оперативки DDR5 по 32 ГБ почти выровнялись по стоимости с RTX 5060.

Народная видюха от Nvidia у дистрибьюторов обходится в среднем за 34-35 тысяч рублей, в то время как оперативка продолжает дорожать — некоторые плашки уже приближаются к отметке в 30 тысяч рублей.

Все из-за перебоев с поставками и удвоением цен всего за неделю — последствия дефицита памяти.

Это просто нонсенс, RAM по цене GPU.
👍4🤯2🌭1
🇨🇳 MAXSUN — новый партнер Intel

Китайская компания MAXSUN на форуме Intel Technology Innovation & Ecosystem Summit представила собственную конфигурацию Arc Pro B60 Dual 48 ГБ с однослотовым дизайном и водоблоком.

Компактный форм-фактор позволяет ставить до семи двухчиповых карт вплотную, а температура GPU остается около 61°C даже под нагрузкой благодаря водоблоку, масштабируя объем VRAM до 336 ГБ.


По заявлениям MAXSUN, одна карточка обойдется порядка ~$1 000 - $1 200.

А еще производитель подчеркнул курс на компактные и энергоэффективные системы, которые будут востребованы в клиентских платформах в 2026 году.


Этот релиз укрепляет позиции китайского бренда в OEM-секторе и упрощает выход новых видюх Intel на рынок.
1👍4
⚡️ Ноутбуки с NPU? Dell показала Pro Max 16 Plus с NPU Qualcomm

Dell выводит на рынок ноуты Pro Max 16 Plus с дискретным нейропроцессором Qualcomm AI-100 Ultra.

Решение выдает до 870 TOPS в INT8 при TDP около 150 Вт и обеспечивает 128 ГБ памяти LPDDR5X, что позволяет запускать локальные модели порядка 120 млрд параметров без обращения к VRAM.


Помимо NPU, внутри стоит Core Ultra 9 285HX vPro на 24 ядра, а дискретную графику полностью убрали.

За базовую графику отвечает встроенный GPU Arrow Lake-HX, поэтому работать с медиа или запускать игрушки не получится.


Ноутбуки с GPU уже прошлый век — реальные айтишники уже вставляют в свои аппараты полноценнын ИИ-чипы.
1👍4
🔧 Релиз vLLM 0.11.2: багфикс с упором на стабильность и масштабирование

Команда vLLM выпустила версию 0.11.2. Обновление закрывает ряд ошибок, из-за которых проседала производительность в больших конфигурациях и при сложных режимах декодирования.

Исправили сбои в multi-node beam search и конфликт при spec-decode со схемами вида [2,4,…] на TP>2. Также обновили асинхронное планирование для FlashAttntion MLA, а для сборок под NVIDIA SM100 добавили защитный макрос CUTLASS MoE.

В целом, это просто минорный апдейт для более плавного масштабирования и минимизации сбоев при работе в распределенных средах.
1👍4
🧑‍💻 FFmpeg переписывают на Rust — меньше сбоев и больше предсказуемости

Команда энтузиастов запустила проект по переносу FFmpeg на Rust.

Они считают, что привычный код на C накопил слишком много рисков: за 50 лет развития FFmpeg получил десятки миллионов строк, где ошибки управления памятью всплывают регулярно.

Набор библиотек FFmpeg лежит в основе стриминга, кодирования и транскодирования видео почти везде — от камер и медиасервисов до браузеров и видеохостинга.


Язык Rust дает строгую модель безопасности, поэтому команда рассчитывает снизить количество уязвимостей и сделать кодовую базу более предсказуемее.

Пока проект находится на ранней стадии развития. Но если он выстрелит, можно ожидать более стабильных сборок в экосистемах, которые сегодня завязаны на FFmpeg.
12
🚀 LangChain 1.0 уже здесь!

Вышло крупное обновление популярного RAG-движка LangChain v1.0!

Разработчики переработали модель создания агентов и добавили динамические подсказки, для передачи параметров теперь используется контекстная база вместо стандартных словарей.

Также новая версия лучше взаимодействует с графовой базой данных LangGraph и дает больше контроля над рабочими процессами.


Подключать RAG теперь можно как до, так и после запроса к модели, а еще внедрили state-классы для управления историей и политиками агента. Для старых проектов оставили пакет LangChain Classic.

С обновлением разработчики также получили более предсказуемую структуру инференса, более удобный выбор моделей для создания ИИ-агентов и доступ к токенам рассуждений через новый формат контента.


Все это должно упростить перенос оптимизированных ИИ-агентов в продакшен и позволит отвязаться от конкретных типов совместимых нейронок.
1👍3💅11
🇨🇳 Китайская CXMT вышла на рынок с DDR5 до 8 000 МТ/с и LPDDR5X до 10 667 МТ/с

CXMT официально показала свои первые чипы DDR5 и LPDDR5X. Линейка покрывает весь спектр форм-факторов: от UDIMM и SODIMM до RDIMM и даже TFF MRDIMM.

Новая память DDR5 доступна в вариантах на 16 и 24 ГБ и достигает скоростей ~8 000 МТ/с. Для ноутбуков и встраиваемых систем компания вывела LPDDR5X объемом до 16 ГБ и скоростью до 10 667 МТ/с.


DDR5 от CXMT уже используют в модулях ASGARD, King Bank и Gloway. LPDDR5X рассчитана на конфигурации до 32 ГБ и нацелена в том числе на сегмент ИИ.

Ценники на DDR5 от CXMT не маленькие — на серверные плашки RECC 3200 МГц 64 ГБ могут стоить 4699 юаней (~52 000 рублей). Тем не менее, на фоне дефицита DRAM, цены на китайских маркетплейсах кусаются не так уж и сильно.


Для КНР выход на рынок CXMT станет очень важным шагом по снижению зависимости от Samsung, SK hynix и Micron, а для всех остальных — появление достойной и менее дорого альтернативы популярным брендам DRAM.
👍3🌭1🍾1
ServerFlow | Новости и Железо 💾
🇨🇳 Китайская CXMT вышла на рынок с DDR5 до 8 000 МТ/с и LPDDR5X до 10 667 МТ/с CXMT официально показала свои первые чипы DDR5 и LPDDR5X. Линейка покрывает весь спектр форм-факторов: от UDIMM и SODIMM до RDIMM и даже TFF MRDIMM. Новая память DDR5 доступна…
👀 А вот, для сравнения, ценники на те же плашки DDR5 64 ГБ, но в западном сегменте рынка.

Сверху — всего $214 за плашку Corsair DDR5 6000 MHz 64 ГБ.

Снизу — те же самые модули, но спустя всего 2 НЕДЕЛИ, но уже за $1 220! 🤬

Молимся на CXMT и китайских братков 🙏
1👍2💩2🌭1
⚡️ Z.ai готовят компактную модель на 30 млрд параметров

Помните китайский ИИ-стартап Z.ai? Эти ребята выпустили топовые открытые ИИ-модели GLM-4.5 и GLM-4.6, которые дали фору даже флагманским нейронкам OpenAI, Google, Alibaba и DeepSeek.

Цзысюань Ли, директор по продуктам и стратегии стартапа, поделился планами и текущим направлением развития Z.ai.


По его словам, сейчас команда активно экспериментирует со своими нейронками, но ввиду их большого объема в 110-358 млрд параметров, проводить тесты и работать над новыми функциями весьма проблематично и дорого.

Ввиду этого, стартап начал работу над компактными моделями на 9 и 30 млрд параметров, которые можно легко развертывать локально, а для их обучения требуются меньше бюджеты.


Подробности о новых ИИ пока неизвестны, но есть мнение, что легкие версии GLM могут появиться до конца 2025 года. Если это произойдет, модели Z.ai с квантизацией можно будет развертывать даже на слабых ПК и ноутбуках с 12-16 ГБ VRAM.
3