ServerFlow | Новости и Железо 💾
4.23K subscribers
4.87K photos
386 videos
12 files
2.36K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
Пока весь мир обсуждает судебные процессы по делу Эпштейна, в обнародованных файлах ФБР буквально вывалила весь технический стек, который юзала эта общественно-порицаемая личность.

🔴 Сервер HP DL380e Gen 8 (LGA 1356);

🔴 Сервер HP DL120 Gen 6 (LGA 1156);

🔴 Сервер HP DL360 Gen 5 (LGA 771);

🔴 Коммутаторы Cisco Catalyst 3560 и Ubiquiti UniFi Switch 24 Gen2 (неплохие универсальные свитчи, есть поддержка PoE для подключения камер);

🔴 HDD Western Digital Black 500 ГБ (самые топовые диски для своего времени);

🔴 HDD Western Digital Gold по 2 ТБ (более бюджетные, но надежные);

🔴 KVM-консоль ATEN.

Похоже, что серверы и диски покупали в одном комплекте. Железо, конечно, не самое новое даже для 2019 года, но Эпштейну, по всей видимости, было вполне достаточно.
15💩22
🕸 Cisco показала Silicon One G300 на 102,4 Тбит/с для ИИ-кластеров

Cisco анонсировала чип-коммутатор Silicon One G300 с пропускной способностью 102,4 Тбит/с, ориентированный на ИИ-кластеры гигаваттного масштаба.

По данным компании, архитектура чипа позволяет повысить утилизацию полосы пропускания примерно на треть и сократить время обучения моделей на 28% по сравнению с альтернативами на многопутевой доставке данных.


G300 имеет 512 SerDes по 200G и поддерживает объединение линий вплоть до портов 1,6 Тбит/с. Высокий radix позволяет собрать до 128 тыс. GPU примерно на 750 коммутаторах вместо ~2 500 ранее, а общий буфер пакетов, балансировка по путям и телеметрия работают как единая “коллективная” сеть между всеми G300.

На базе чипа представлены новые системы Nexus 9000 и Cisco 8000 с воздушным и жидкостным охлаждением.


Коммутаторы работают под управлением NX-OS, а линейка 8000 также поддерживает альтернативные NOS вроде SONiC.
4
🔥 В сети всплыл инженерный образец RTX 3080 Ti на 20 ГБ

На тематическом форуме показали редкий инженерный образец NVIDIA GeForce RTX 3080 Ti с 20 ГБ памяти, который официально так и не был выпущен. Экземпляр с GPU GA102-250 и ценником $200 за карту появился на вторичке, причем в фирменной упаковке со всеми серийниками.

Решение имеет 320-битную шину, 20 ГБ GDDR6X, гибридную печатную плату от RTX 3090 и жестко залоченную прошивку. В играх производительность близка к RTX 3080 12 ГБ, разгон возможен, но при вычислительных нагрузках фиксируются сбои, а для работы нужен особый драйвер.


Это типичный инженерный образец позднего Ampere, который, судя по косвенным данным, мог уйти на рынок малыми партиями еще в 2021 году. Как неплохой артефакт истории NVIDIA — сойдет.
👍4
💡 NPU Nova Lake-S на 74 TOPS тянет Copilot+ с запасом

Intel готовит Core Ultra Series 4 “Nova Lake-S” с нейронным ускорителем, производительность которого может дойти до 74 TOPS, что заметно выше порога Microsoft Copilot+ в 40 TOPS. Это может сделать Nova Lake-S первой настольной линейкой Intel с полноценной поддержкой Copilot+ на уровне железа.

Текущие Arrow Lake-S и ожидаемые Arrow Lake-S Refresh ограничены ~13 TOPS из-за NPU поколения Meteor Lake, тогда как Nova Lake получает обновленный блок NPU. Не все модели будут иметь 74 TOPS, но сегментация позволит даже младшим SKU выйти минимум на 40 TOPS и формально соответствовать требованиям для развертывания Copilot+.


При этом AMD тоже не стоит на месте и, по слухам, может выпустить Ryzen AI 400 “Gorgona” под AM5 раньше, чем появятся десктопные Nova Lake.
👍3
Пока весь мир трубит о технологическом прогрессе и массовой популяризации ИИ, реальная статистика говорит совсем об обратном. По данным компании Andreessen Horowitz, Американцы тратят больше денег на OnlyFans, нежели на подписки ChatGPT и The New York Times вместе взятые.
17🤯2😡2💩1🍾1
🔥 HBM5 и HBM6 уже в работе: до 8 ТБ/с на один стек

Пока NVIDIA и AMD готовят ускорители Vera Rubin и Instinct MI450 с HBM4, индустрия уже готовится к выпуску HBM5 и HBM6.

На Semicon 2026 в Корее покажут Wide TC Bonder для новых стеков, альтернативу Hybrid Bonder, с бесфлюсовым соединением и прицелом на массовое производство HBM4E, HBM5 и HBM6.


HBM5 нацелена на платформу NVIDIA Feynman и ожидается к 2029 году, заявлены 8 Гбит/с и шина 4096 бит с пропускной способностью до 4 ТБ/с на стек 16-Hi, объем до 80 ГБ и энергопотребление около 100 Вт на стек.

HBM6 удваивает скорость до 16 Гбит/с и до 8 ТБ/с, переходит к 16/20-Hi, давая 96-120 ГБ на стек при ~120 Вт.


Растет как плотность, так и тепловыделение, поэтому иммерсионное охлаждение и новые межсоединения станут не опцией, а базовым требованием для будущих ИИ-платформ.
👍3
🤔 CXMT нацелилась на HBM3: до 20% мощностей будут переведены с DRAM в 2026 году

Китайская CXMT, по данным отраслевых источников, планирует в 2026 году направить около 20% своих линий производства DRAM на выпуск HBM3. Компания планирует выпускать до 60 000 пластин в месяц при общей мощности около 300 000 wpm.

Сообщается, что массовое производство HBM3 уже стартовало, а локальная кооперация с Huawei может поддержать спрос на фоне ограничений поставок Micron, Samsung и SK hynix. Для рынка это сигнал, что Китай ускоряет локализацию ИИ-памяти, хотя по срокам и выходу годных чипов многое будет зависеть от зрелости техпроцесса.


Если планы подтвердятся, 2026 год станет точкой, когда HBM окончательно превратится в еще один стратегический ресурс Китая, прервав многолетний цикл дефицита высокоскоростной памяти в Поднебесной.
1👍5
This media is not supported in your browser
VIEW IN TELEGRAM
Китайский юзер заснял сомовоспламенение видеокарты Nvidia RTX 5090. Прошлобольше года с релиза видюхи, но проблему питания 12V-2x6 так и не решили...
👍4😡3💩2
🔥 Релиз GLM-5: модель доступна бесплатно в веб-интерфейсе Zhipu AI

Флагманская китайская нейронка базируется на архитектуре MoE с 744 млрд параметров, из которых 40 млрд активны, что вдвое больше, чем у GLM-4.7 с 360 миллиардов параметров.

В тестах модель уверенно достигает уровня топовых проприетарных LLM, а в некоторых задачах даже обходит их: в бенчмарке SWE-bench verified она набирает 77.8 баллов, в HLE производительность достигает 50.4 баллов, в BrowseComp модель обеспечивает 75.9 баллов.

Юзеры, которые уже опробовали нейронку, отмечают ее высочайшую эффективность в кодинге, агентских задачах и генерации текста.
14