ServerFlow | Новости и Железо 💾
4.25K subscribers
4.98K photos
394 videos
12 files
2.44K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
🇨🇳 Китайская CXMT вышла на рынок с DDR5 до 8 000 МТ/с и LPDDR5X до 10 667 МТ/с

CXMT официально показала свои первые чипы DDR5 и LPDDR5X. Линейка покрывает весь спектр форм-факторов: от UDIMM и SODIMM до RDIMM и даже TFF MRDIMM.

Новая память DDR5 доступна в вариантах на 16 и 24 ГБ и достигает скоростей ~8 000 МТ/с. Для ноутбуков и встраиваемых систем компания вывела LPDDR5X объемом до 16 ГБ и скоростью до 10 667 МТ/с.


DDR5 от CXMT уже используют в модулях ASGARD, King Bank и Gloway. LPDDR5X рассчитана на конфигурации до 32 ГБ и нацелена в том числе на сегмент ИИ.

Ценники на DDR5 от CXMT не маленькие — на серверные плашки RECC 3200 МГц 64 ГБ могут стоить 4699 юаней (~52 000 рублей). Тем не менее, на фоне дефицита DRAM, цены на китайских маркетплейсах кусаются не так уж и сильно.


Для КНР выход на рынок CXMT станет очень важным шагом по снижению зависимости от Samsung, SK hynix и Micron, а для всех остальных — появление достойной и менее дорого альтернативы популярным брендам DRAM.
👍3🌭1🍾1
ServerFlow | Новости и Железо 💾
🇨🇳 Китайская CXMT вышла на рынок с DDR5 до 8 000 МТ/с и LPDDR5X до 10 667 МТ/с CXMT официально показала свои первые чипы DDR5 и LPDDR5X. Линейка покрывает весь спектр форм-факторов: от UDIMM и SODIMM до RDIMM и даже TFF MRDIMM. Новая память DDR5 доступна…
👀 А вот, для сравнения, ценники на те же плашки DDR5 64 ГБ, но в западном сегменте рынка.

Сверху — всего $214 за плашку Corsair DDR5 6000 MHz 64 ГБ.

Снизу — те же самые модули, но спустя всего 2 НЕДЕЛИ, но уже за $1 220! 🤬

Молимся на CXMT и китайских братков 🙏
1👍2💩2🌭1
⚡️ Z.ai готовят компактную модель на 30 млрд параметров

Помните китайский ИИ-стартап Z.ai? Эти ребята выпустили топовые открытые ИИ-модели GLM-4.5 и GLM-4.6, которые дали фору даже флагманским нейронкам OpenAI, Google, Alibaba и DeepSeek.

Цзысюань Ли, директор по продуктам и стратегии стартапа, поделился планами и текущим направлением развития Z.ai.


По его словам, сейчас команда активно экспериментирует со своими нейронками, но ввиду их большого объема в 110-358 млрд параметров, проводить тесты и работать над новыми функциями весьма проблематично и дорого.

Ввиду этого, стартап начал работу над компактными моделями на 9 и 30 млрд параметров, которые можно легко развертывать локально, а для их обучения требуются меньше бюджеты.


Подробности о новых ИИ пока неизвестны, но есть мнение, что легкие версии GLM могут появиться до конца 2025 года. Если это произойдет, модели Z.ai с квантизацией можно будет развертывать даже на слабых ПК и ноутбуках с 12-16 ГБ VRAM.
3
🕸 Т-КОМ выводит 11 новых моделей отечественных коммутаторов

Сетевые коммутаторы Т-КОМ (дочка Росатома) включены в Единый реестр радиоэлектронной продукции Минпромторга РФ. Серийное производство уже запущено.

Начало поставок запланировано на 4 квартал 2025 года. Оборудование рассчитано на сегменты среднего и крупного бизнеса и критически важные объекты, включая инфраструктуры атомной энергетики Росатом.


Т-КОМ уже предлагает свыше 100 моделей коммутаторов, включая коммутаторы ядра, агрегации и доступа. Есть модели с поддержкой RoCE v2 для кластеризации, что будет крайне полезно для отечественного HPC-сектора. 11 новых моделей будут иметь CLI и графический интерфейс, поддержку SNMP, контроль доступа и защиту портов.

Напомним, что ранее еще одна дочка Росатом также выпустила линейку сетевых карт Альфа” со скоростью до 80 Гбит/с и поддержкой до 4096 узлов.


Росатом — двигатель развития сетевых решений в РФ 🇷🇺
1👍4
🧠 Может ли ИИ не забывать? Google тестирует вложенное обучение

Google Research представил статью с очень амбициозным названием “Attention Is All You Need v2”, где описан новый подход вложенного обучения ИИ-трансформеров.

Идея состоит в том, чтобы устранить проблему “катастрофического забывания”, которая возникает из-за постоянного обновления памяти ИИ с разной скоростью.

Новый метод под названием “вложенное обучение” способен полностью избавиться от этого недостатка, позволив моделям удерживать старые навыки во время изучения новых.


Google создала экспериментальную модель Hope, которая использует системы непрерывной памяти, обновляющиеся на нескольких уровнях.

В тестах Hope опережает рекуррентные модели в языковом моделировании и стабильнее работает на длинных контекстах, не забывая диалог.


Google вновь работает над революцией в мире ИИ — на этот раз нейронки смогут учиться поверх наложенных данных без полного переобучения 💡
👍1
🤖 Salesforce показала мультиагентную систему Enterprise Deep Research

Salesforce представила Enterprise Deep Research (EDR).

Это связка из нескольких ИИ-агентов, которые разбирают запрос, ищут данные в открытых источниках и корпоративных наборах данных, а затем собирают результат в отчет в реальном времени — проще говоря, продвинутый агентский RAG.

В EDR есть планировщик для разбиения задачи, четыре поисковых агента для веба, академических статей, GitHub и LinkedIn, визуализация данных и инструменты MCP для SQL, анализ файлов и внутренних процессов.


Механизм рефлексии отслеживает пробелы в знаниях и запрашивает уточнения у человека, когда нужна максимальная точность.

Система работает с моделями OpenAI, Anthropic, Google, DeepSeek, можно подключать через API от разных провайдеров.


Такой набор дает гибкий выбор моделей и сценариев, а сама платформа рассчитана на корпоративные деплойменты с потоковой выдачей и автоматической сборкой итоговых отчетов.

Ссылочка на GitHub.
👍1
⚡️ Zhongcheng Hualong HL100 — полностью китайский ИИ-чип для обучения и инференса

Zhongcheng Hualong представила HL100. Это первый чип для обучения и вывода, который, по заявлению компании, разработан с использованием только китайских компонентов — от логики и памяти до упаковки.

HL100 работает на собственной архитектуре GPGPU+NPU и рассчитан на интеграцию в крупные ИИ-кластеры.

Ускоритель обеспечивает до 256 TFLOPS в FP16, имеет 128 ГБ памяти LPDDR5 и предлагает энергоэффективность на уровне 3,41 TFLOPS/Вт.


HL100 поддерживает масштабирование до 1000 чипов на кластер и полностью совместим со стеком CUDA. Разработчики заявляют, что TCO решения примерно в четыре раза ниже, чем у решений с аналогичной мощностью.

У Zhongcheng Hualong уже есть полноценный Roadmap на 2026-2028 годы — линейка будет расширена моделями HL200, HL200Pro и HL400 с поддержкой форматов FP8 и даже FP4.


Компания продвигает серию новых ИИ-ускорителей как основу национальной инфраструктуры ИИ КНР, подвинув Huawei с позиции лидера.
3👍31
👀 Nano Banana Pro только вышла, а Alibaba уже готовит замену с поддержкой редактирования слоев.

Ждете Qwen-Image-Edit-2511?
2👍3💩1
This media is not supported in your browser
VIEW IN TELEGRAM
👀 ИИ-ускорители Nvidia VR200 еще не вышли, а Хуанг уже во всю отмечает скорый приток еще нескольких триллионов долларов, вкусно кушая хотпот.

А вы как провожаете уходящую неделю? Уже готовы во всю погрузиться в рабочие будни? 🧑‍💻🛠
2👍5💩1
🗓 Коротко о главных новостях за эту неделю

❗️Крупные компании начали закупать DRAM на спотовом рынке из-за кризиса

❗️Вышла долгожданная ИИ-модель Google Gemini 3 Pro

❗️Рейтинг лучших HPC-кластеров TOP500 обновился

❗️ В нашем блоге вышла статья о технологии IPMI

❗️ Consortium CXL выпустила новую версию интерфейса CXL 4.0

❗️ Samsung начала переводить фабрики NAND на выпуск DRAM

❗️ AllenAI представила новое поколение LLM OLMo 3

❗️ Сбер выложил полный стек ИИ-моделей Kandinsky 5.0

❗️ Мы сделали топовый обзор на идеальный NAS-сервер

❗️ CXMT начала выпускать DDR5 8000 MT/s

❗️ Google выпустила статью Attention Is All You Need v2

❗️ Мы выложили гайд о выборе сервер видеонаблюдения
1👍2
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ Релиз Cursor 2.1: мгновенный поиск и встроенный AI-ревью кода

Cursor обновился до версии 2.1.

Из главного: планировщик теперь задает уточняющие вопросы через UI, а поиск внутри готовых планов работает через Ctrl+F. В редактор добавили AI-проверку кода: ассистент показывает найденные проблемы прямо на боковой панели.


Еще появился мгновенный grep-поиск — команды отрабатывают без задержек и доступны всем моделям. Также улучшили работу терминалов, добавили проектные хуки и обновили API до уровня VS Code 1.105.1.

Для многопользовательского режима добавили новые ограничения на использование сторонних источников и расширений, а пользовательские режимы заменили на экспортируемые команды.


Много приятных мелочей внедрили в инетрфейс: в дифф-панели появилась кнопка commit+push, автопринятие изменений при коммите работает на уровне отдельных файлов.

А еще улучшили поддержку Cloud Agent для GitLab, GitHub Enterprise, Sentry и Plain.


В общем, разрабы неплохо подтянули удобство.
1👍1
⚡️ 650 Вт на сокет: Intel готовит платформу Johnson City для Xeon Diamond Rapids

В базе данных NBD нашли эталонные серверные материнские платы Johnson City — именно на них Intel тестирует следующее поколение Xeon Diamond Rapids.

В документах фигурируют процессоры с TDP от ~500 до 650 Вт, что намекает на интеграцию линейки Diamond Rapids, которая станет самой прожорливой линейкой чипов за всю историю Intel.


Партия плат отмечена как “материал для проверки”, то есть это ничто иное, как инженерные образцы.

Diamond Rapids интегрируются в крупный сокет LGA 9324, который заметно больше текущих сокетов LGA 7529 под Granite Rapids. По открытым данным, чипы делают на техпроцессе 18A и оснащают P-ядрами на архитектуре Panther Cove.


В конфигурациях ожидают до 192 ядер, а по утечкам — вплоть до 256 ядер. Платформа полностью перешла на 16-канальную память, а от прежних 8-канальных конфигураций отказались.

Diamond Rapids — задел под конкуренцию с AMD EPYC Venice, которые выйдут примерно в те же сроки.
2👍2