ServerFlow | Новости и Железо 💾
4.25K subscribers
4.98K photos
394 videos
12 files
2.44K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
⚡️ Ноутбуки с NPU? Dell показала Pro Max 16 Plus с NPU Qualcomm

Dell выводит на рынок ноуты Pro Max 16 Plus с дискретным нейропроцессором Qualcomm AI-100 Ultra.

Решение выдает до 870 TOPS в INT8 при TDP около 150 Вт и обеспечивает 128 ГБ памяти LPDDR5X, что позволяет запускать локальные модели порядка 120 млрд параметров без обращения к VRAM.


Помимо NPU, внутри стоит Core Ultra 9 285HX vPro на 24 ядра, а дискретную графику полностью убрали.

За базовую графику отвечает встроенный GPU Arrow Lake-HX, поэтому работать с медиа или запускать игрушки не получится.


Ноутбуки с GPU уже прошлый век — реальные айтишники уже вставляют в свои аппараты полноценнын ИИ-чипы.
1👍4
🔧 Релиз vLLM 0.11.2: багфикс с упором на стабильность и масштабирование

Команда vLLM выпустила версию 0.11.2. Обновление закрывает ряд ошибок, из-за которых проседала производительность в больших конфигурациях и при сложных режимах декодирования.

Исправили сбои в multi-node beam search и конфликт при spec-decode со схемами вида [2,4,…] на TP>2. Также обновили асинхронное планирование для FlashAttntion MLA, а для сборок под NVIDIA SM100 добавили защитный макрос CUTLASS MoE.

В целом, это просто минорный апдейт для более плавного масштабирования и минимизации сбоев при работе в распределенных средах.
1👍4
🧑‍💻 FFmpeg переписывают на Rust — меньше сбоев и больше предсказуемости

Команда энтузиастов запустила проект по переносу FFmpeg на Rust.

Они считают, что привычный код на C накопил слишком много рисков: за 50 лет развития FFmpeg получил десятки миллионов строк, где ошибки управления памятью всплывают регулярно.

Набор библиотек FFmpeg лежит в основе стриминга, кодирования и транскодирования видео почти везде — от камер и медиасервисов до браузеров и видеохостинга.


Язык Rust дает строгую модель безопасности, поэтому команда рассчитывает снизить количество уязвимостей и сделать кодовую базу более предсказуемее.

Пока проект находится на ранней стадии развития. Но если он выстрелит, можно ожидать более стабильных сборок в экосистемах, которые сегодня завязаны на FFmpeg.
12
🚀 LangChain 1.0 уже здесь!

Вышло крупное обновление популярного RAG-движка LangChain v1.0!

Разработчики переработали модель создания агентов и добавили динамические подсказки, для передачи параметров теперь используется контекстная база вместо стандартных словарей.

Также новая версия лучше взаимодействует с графовой базой данных LangGraph и дает больше контроля над рабочими процессами.


Подключать RAG теперь можно как до, так и после запроса к модели, а еще внедрили state-классы для управления историей и политиками агента. Для старых проектов оставили пакет LangChain Classic.

С обновлением разработчики также получили более предсказуемую структуру инференса, более удобный выбор моделей для создания ИИ-агентов и доступ к токенам рассуждений через новый формат контента.


Все это должно упростить перенос оптимизированных ИИ-агентов в продакшен и позволит отвязаться от конкретных типов совместимых нейронок.
1👍3💅11
🇨🇳 Китайская CXMT вышла на рынок с DDR5 до 8 000 МТ/с и LPDDR5X до 10 667 МТ/с

CXMT официально показала свои первые чипы DDR5 и LPDDR5X. Линейка покрывает весь спектр форм-факторов: от UDIMM и SODIMM до RDIMM и даже TFF MRDIMM.

Новая память DDR5 доступна в вариантах на 16 и 24 ГБ и достигает скоростей ~8 000 МТ/с. Для ноутбуков и встраиваемых систем компания вывела LPDDR5X объемом до 16 ГБ и скоростью до 10 667 МТ/с.


DDR5 от CXMT уже используют в модулях ASGARD, King Bank и Gloway. LPDDR5X рассчитана на конфигурации до 32 ГБ и нацелена в том числе на сегмент ИИ.

Ценники на DDR5 от CXMT не маленькие — на серверные плашки RECC 3200 МГц 64 ГБ могут стоить 4699 юаней (~52 000 рублей). Тем не менее, на фоне дефицита DRAM, цены на китайских маркетплейсах кусаются не так уж и сильно.


Для КНР выход на рынок CXMT станет очень важным шагом по снижению зависимости от Samsung, SK hynix и Micron, а для всех остальных — появление достойной и менее дорого альтернативы популярным брендам DRAM.
👍3🌭1🍾1
ServerFlow | Новости и Железо 💾
🇨🇳 Китайская CXMT вышла на рынок с DDR5 до 8 000 МТ/с и LPDDR5X до 10 667 МТ/с CXMT официально показала свои первые чипы DDR5 и LPDDR5X. Линейка покрывает весь спектр форм-факторов: от UDIMM и SODIMM до RDIMM и даже TFF MRDIMM. Новая память DDR5 доступна…
👀 А вот, для сравнения, ценники на те же плашки DDR5 64 ГБ, но в западном сегменте рынка.

Сверху — всего $214 за плашку Corsair DDR5 6000 MHz 64 ГБ.

Снизу — те же самые модули, но спустя всего 2 НЕДЕЛИ, но уже за $1 220! 🤬

Молимся на CXMT и китайских братков 🙏
1👍2💩2🌭1
⚡️ Z.ai готовят компактную модель на 30 млрд параметров

Помните китайский ИИ-стартап Z.ai? Эти ребята выпустили топовые открытые ИИ-модели GLM-4.5 и GLM-4.6, которые дали фору даже флагманским нейронкам OpenAI, Google, Alibaba и DeepSeek.

Цзысюань Ли, директор по продуктам и стратегии стартапа, поделился планами и текущим направлением развития Z.ai.


По его словам, сейчас команда активно экспериментирует со своими нейронками, но ввиду их большого объема в 110-358 млрд параметров, проводить тесты и работать над новыми функциями весьма проблематично и дорого.

Ввиду этого, стартап начал работу над компактными моделями на 9 и 30 млрд параметров, которые можно легко развертывать локально, а для их обучения требуются меньше бюджеты.


Подробности о новых ИИ пока неизвестны, но есть мнение, что легкие версии GLM могут появиться до конца 2025 года. Если это произойдет, модели Z.ai с квантизацией можно будет развертывать даже на слабых ПК и ноутбуках с 12-16 ГБ VRAM.
3
🕸 Т-КОМ выводит 11 новых моделей отечественных коммутаторов

Сетевые коммутаторы Т-КОМ (дочка Росатома) включены в Единый реестр радиоэлектронной продукции Минпромторга РФ. Серийное производство уже запущено.

Начало поставок запланировано на 4 квартал 2025 года. Оборудование рассчитано на сегменты среднего и крупного бизнеса и критически важные объекты, включая инфраструктуры атомной энергетики Росатом.


Т-КОМ уже предлагает свыше 100 моделей коммутаторов, включая коммутаторы ядра, агрегации и доступа. Есть модели с поддержкой RoCE v2 для кластеризации, что будет крайне полезно для отечественного HPC-сектора. 11 новых моделей будут иметь CLI и графический интерфейс, поддержку SNMP, контроль доступа и защиту портов.

Напомним, что ранее еще одна дочка Росатом также выпустила линейку сетевых карт Альфа” со скоростью до 80 Гбит/с и поддержкой до 4096 узлов.


Росатом — двигатель развития сетевых решений в РФ 🇷🇺
1👍4
🧠 Может ли ИИ не забывать? Google тестирует вложенное обучение

Google Research представил статью с очень амбициозным названием “Attention Is All You Need v2”, где описан новый подход вложенного обучения ИИ-трансформеров.

Идея состоит в том, чтобы устранить проблему “катастрофического забывания”, которая возникает из-за постоянного обновления памяти ИИ с разной скоростью.

Новый метод под названием “вложенное обучение” способен полностью избавиться от этого недостатка, позволив моделям удерживать старые навыки во время изучения новых.


Google создала экспериментальную модель Hope, которая использует системы непрерывной памяти, обновляющиеся на нескольких уровнях.

В тестах Hope опережает рекуррентные модели в языковом моделировании и стабильнее работает на длинных контекстах, не забывая диалог.


Google вновь работает над революцией в мире ИИ — на этот раз нейронки смогут учиться поверх наложенных данных без полного переобучения 💡
👍1
🤖 Salesforce показала мультиагентную систему Enterprise Deep Research

Salesforce представила Enterprise Deep Research (EDR).

Это связка из нескольких ИИ-агентов, которые разбирают запрос, ищут данные в открытых источниках и корпоративных наборах данных, а затем собирают результат в отчет в реальном времени — проще говоря, продвинутый агентский RAG.

В EDR есть планировщик для разбиения задачи, четыре поисковых агента для веба, академических статей, GitHub и LinkedIn, визуализация данных и инструменты MCP для SQL, анализ файлов и внутренних процессов.


Механизм рефлексии отслеживает пробелы в знаниях и запрашивает уточнения у человека, когда нужна максимальная точность.

Система работает с моделями OpenAI, Anthropic, Google, DeepSeek, можно подключать через API от разных провайдеров.


Такой набор дает гибкий выбор моделей и сценариев, а сама платформа рассчитана на корпоративные деплойменты с потоковой выдачей и автоматической сборкой итоговых отчетов.

Ссылочка на GitHub.
👍1
⚡️ Zhongcheng Hualong HL100 — полностью китайский ИИ-чип для обучения и инференса

Zhongcheng Hualong представила HL100. Это первый чип для обучения и вывода, который, по заявлению компании, разработан с использованием только китайских компонентов — от логики и памяти до упаковки.

HL100 работает на собственной архитектуре GPGPU+NPU и рассчитан на интеграцию в крупные ИИ-кластеры.

Ускоритель обеспечивает до 256 TFLOPS в FP16, имеет 128 ГБ памяти LPDDR5 и предлагает энергоэффективность на уровне 3,41 TFLOPS/Вт.


HL100 поддерживает масштабирование до 1000 чипов на кластер и полностью совместим со стеком CUDA. Разработчики заявляют, что TCO решения примерно в четыре раза ниже, чем у решений с аналогичной мощностью.

У Zhongcheng Hualong уже есть полноценный Roadmap на 2026-2028 годы — линейка будет расширена моделями HL200, HL200Pro и HL400 с поддержкой форматов FP8 и даже FP4.


Компания продвигает серию новых ИИ-ускорителей как основу национальной инфраструктуры ИИ КНР, подвинув Huawei с позиции лидера.
3👍31
👀 Nano Banana Pro только вышла, а Alibaba уже готовит замену с поддержкой редактирования слоев.

Ждете Qwen-Image-Edit-2511?
2👍3💩1