ServerFlow | Новости и Железо 💾
4.25K subscribers
4.97K photos
393 videos
12 files
2.43K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
⚡️ Сбер выложил Kandinsky 5.0 в открытый доступ: полный ИИ-набор для генерации медиа

Сбер выложил в открытый доступ весь стек своих визуальных моделей Kandinsky 5.0 под MIT-лицензией.

Выложили Image Lite, Video Lite, Video Pro и автоэнкодеры K-VAE 1.0. Код и веса лежат на GitHub, Gitverse и Hugging Face.

🟢 Линейка Image Lite обучена на ~520 млн изображений и дообучена на 150 млн пар для редактирования. По SBS модели обходят FLUX.1 dev в текстовой генерации и держатся на уровне FLUX.1 Kontext в правках.

🟢2B-модель Video Lite обучена на 520 млн изображений и 120 млн видео, по метрикам заметно опережает более крупную Wan 2.1-14B в генерации видео.

🟢 Флагманская Video Pro обучена на 520 млн изображений и 250 млн видео, генерирует HD-видео до ~10 секунд, по SBS превосходит Wan 2.2-A14B и по визуалу близка к Veo 3.

🟢 Автоэнкодеры K-VAE 1.0 (2D/3D) дают сжатие 8×8 и 4×8×8 и восстанавливают сигнал лучше Hunyuan, Flux и Wan при той же компрессии.

Полноценный ИИ-завоз под ComfyUI от Сбер!
👍1
😮 CQDIMM от JEDEC 4 ранговая память до 128 ГБ для десктопов

JEDEC готовит новый стандарт CQDIMM для DDR5 CKD, который позволит увеличить плотность модулей памяти до 128 ГБ и повысить производительность будущих настольных платформ.

Первым устройством с поддержкой стандарта станут чипы Intel Arrow Lake-S Refresh, запуск которых намечен на начало 2026 года.


CQDIMM использует четырех ранговую конфигурацию вместо двухранговой CUDIMM, сохраняя высокие скорости работы CKD до 7200 М/с.

Производители материнских плат, включая MSI, Gigabyte и ASUS, уже тестируют поддержку таких модулей памяти на своих топовых платах для оверклокингаDual-DIMM Unify X, Tachyon ICE и Apex.


Первое время 128-ГБ модули будут очень дорогими, а широкое распространение CQDIMM ожидается ближе к выходу Nova Lake-S во второй половине 2026 года.
👍1
📹 Готовим ролик на YouTube со сборкой и тестами системы с EPYC 9374f + 3x rtx A5000 24GB + 384GB RAM.

Проверим пригодность работы на 3 видеокартах в рендере, видеомонтаже и SPECviewperf (Maya, NX, SolidWorks, 3ds Max бенчи). Ну и погоняем ComfyUI.

Если есть предложения по тестам, пишите в комментарии. Реализуем, и добавим в видео!
31👍5
🤣 Поставщики требуют вернуть DRAM из магазинов, чтобы отдать ее OpenAI

Инсайдер Moore’s Law Is Dead заявляет, что на рынке DRAM происходит настоящий дурдом.

По его заявлениям, OpenAI зарезервировала ~40% всей выпускаемой DDR5, а из-за мирового дефицита оперативки, поставщики пытаются вернуть DRAM из ритейла, чтобы выполнить контрактные обязательства перед крупной компанией.

Новые партии DDR5 обещают только к концу 2026 года, так что окно дефицита может растянуться.


Если поставщики действительно начнут отзывать память с полок, то это вызовет еще более взрывной рост цен, особенно на память для серверов и рабочих станций.

Единственный выход — запустить новые линии производства DRAM, но на сброс цен это повлияет еще не скоро.
👍1😡1
👀 А вот так выглядит тот TPU v7 Ironwood

Именно на таких чипиках обучалась свежая Gemini 3 Pro

Красивое 😍
1👍4
Собрались с мужичками почиллить, а заодно решить кризис DRAM.

А вы как проводите субботу?
1🌭3💩1💅1
🤭 Смешно, но ценники на оперативку у Apple теперь не выглядят как обдираловка.

Хотя, зная Тим Кука, скоро этот недочет быстро исправят…

А может, Apple просто предвидела кризис заранее? 🤔
👍3💩1💅1
⚒️ Intel обновила Compute Runtime 25.44.36015.5 с упором на Xe3 и Panther Lake

Вышла свежая версия Intel Compute Runtime 25.44.36015.5. Это регулярное обновление программного стека Level Zero и OpenCL для встроенной и дискретной графики Intel.

Основные нововведения сейчас связаны с подготовкой к запуску поколения графики Xe3 в процессорах Panther Lake и Wildcat Lake.


Добавили прототип OpenCL C через zeModuleCreate, ускорили компиляцию, расширили пулы USM и включили их для Lunar Lake, память для буферов теперь активнее выделяется из 2 МБ с выравниванием по 2 МБ, что снижает фрагментацию и немного повышает пропускную способность.

Плюс появилась поддержка Level Zero v1.14, от SPIR на GPU Xe2+ отказались.


Короче, Intel готовит функционал под будущие GPU и чистит устаревшие механизмы. Обновление доступно на GitHub.
👍2
⚡️ Seasonic готовит безвентиляторный блок питания на 1 000 Вт

Seasonic разрабатывает БП PRIME Fanless TX мощностью 1 000 Вт.

Это будет модульный блок питания с сертификатом 80 PLUS Titanium и гарантией на 12 лет.


Производитель пока не раскрывает детали по кабелям и спецификациям, но ставка делается на полностью пассивное охлаждение.

У конкурентов в том же сегменте уже есть Cooler Master X Silent Edge на 850 и 1 100 Вт. Они поддерживают ATX 3.1 и разъем 12V-2×6. Если Seasonic сохранит аналогичную совместимость, блок станет одним из самых мощных безвентиляторных решений для систем с топовыми GPU.


Это нишевая категория, но пассивные модели берут надежностью и нулевым шумом — в нем нечему ломаться и нечему гудеть.
👍3
⚒️ Плагины вместо форков: vLLM упростил кастомизацию движка

Разработчики проекта рассказали, как настраивать vLLM без форков — все благодаря интеграции плагинов.

Система плагинов позволяет делать точечные правки движка без изменения целых модулей кода.

Это можно делать на уровне классов через VLLMPatch и подключаться через vllm.general_plugins. Все изменения активируются переменной окружения.


vLLM обновляется раз в две недели, и форки быстро превращаются в боль из-за перебазировки и конфликтов. Плагины полностью решают эту проблему.

Один Docker-образ может обслуживать разные модели с разными патчами, а плагин подхватывается во всех процессах до старта инференса.


Это облегчает масштабирование и снижает риск поломки при обновлениях. По оценкам специалистов, даже приоритетный планировщик можно внедрить всего за 20 строк.
👍2
💸 DDR5 32 ГБ = RTX 5060

Ценники на плашки оперативки DDR5 по 32 ГБ почти выровнялись по стоимости с RTX 5060.

Народная видюха от Nvidia у дистрибьюторов обходится в среднем за 34-35 тысяч рублей, в то время как оперативка продолжает дорожать — некоторые плашки уже приближаются к отметке в 30 тысяч рублей.

Все из-за перебоев с поставками и удвоением цен всего за неделю — последствия дефицита памяти.

Это просто нонсенс, RAM по цене GPU.
👍4🤯2🌭1
🇨🇳 MAXSUN — новый партнер Intel

Китайская компания MAXSUN на форуме Intel Technology Innovation & Ecosystem Summit представила собственную конфигурацию Arc Pro B60 Dual 48 ГБ с однослотовым дизайном и водоблоком.

Компактный форм-фактор позволяет ставить до семи двухчиповых карт вплотную, а температура GPU остается около 61°C даже под нагрузкой благодаря водоблоку, масштабируя объем VRAM до 336 ГБ.


По заявлениям MAXSUN, одна карточка обойдется порядка ~$1 000 - $1 200.

А еще производитель подчеркнул курс на компактные и энергоэффективные системы, которые будут востребованы в клиентских платформах в 2026 году.


Этот релиз укрепляет позиции китайского бренда в OEM-секторе и упрощает выход новых видюх Intel на рынок.
1👍4
⚡️ Ноутбуки с NPU? Dell показала Pro Max 16 Plus с NPU Qualcomm

Dell выводит на рынок ноуты Pro Max 16 Plus с дискретным нейропроцессором Qualcomm AI-100 Ultra.

Решение выдает до 870 TOPS в INT8 при TDP около 150 Вт и обеспечивает 128 ГБ памяти LPDDR5X, что позволяет запускать локальные модели порядка 120 млрд параметров без обращения к VRAM.


Помимо NPU, внутри стоит Core Ultra 9 285HX vPro на 24 ядра, а дискретную графику полностью убрали.

За базовую графику отвечает встроенный GPU Arrow Lake-HX, поэтому работать с медиа или запускать игрушки не получится.


Ноутбуки с GPU уже прошлый век — реальные айтишники уже вставляют в свои аппараты полноценнын ИИ-чипы.
1👍4