ServerFlow | Новости и Железо 💾
🔥 SambaNova будет жить! Компания представила чип SN50 и будет сотрудничать с Intel SambaNova Systems представила новый ИИ-ускоритель SN50 для инференса и заявляет о пятикратном росте производительности на один чип относительно конкурентов. Компания привлекла…
На самом деле, интересные ребята эти SambaNova. И дело даже не в уникальности архитектуры RDU, а в том, как ее преподносят публике.
Компания утверждает, что SN50 превосходит чип SN40L предыдущего поколения аж в 5 раз — то есть с 638 TFLOPS в BF16 до 3,2 PFLOPS (без структурной разряженности), но уже в FP8. В FP16 прирост не так велик — лишь в 2,5 раза. То есть, SN50 в FP8 будет даже мощнее, чем Nvidia B200, у которого всего лишь 1,125 PFLOPS (без структурной разряженности) в том же режиме.
Возникает резонный вопрос: “А чем докажете то?”. Ну…есть один график, где SambaNova сравнивает SN50 с B200 при агентном инференсе Llama* 3.3 70B. Правда, каким-то магическим образом на высоких скоростях в “золотой зоне” SN50 отскакивает, увеличивая количество токенов/с, и еще долго сохраняет пропускную способность. Видно почерк Intel — и звучит, и выглядит как полный бред.
Конечно же, во всем остальном SN50 уступает B200 — 64 ГБ (HBM2e) против 192 ГБ (HBM3e) и 1,6 ТБ/с против 8 ТБ/с.
Компания утверждает, что SN50 превосходит чип SN40L предыдущего поколения аж в 5 раз — то есть с 638 TFLOPS в BF16 до 3,2 PFLOPS (без структурной разряженности), но уже в FP8. В FP16 прирост не так велик — лишь в 2,5 раза. То есть, SN50 в FP8 будет даже мощнее, чем Nvidia B200, у которого всего лишь 1,125 PFLOPS (без структурной разряженности) в том же режиме.
Возникает резонный вопрос: “А чем докажете то?”. Ну…есть один график, где SambaNova сравнивает SN50 с B200 при агентном инференсе Llama* 3.3 70B. Правда, каким-то магическим образом на высоких скоростях в “золотой зоне” SN50 отскакивает, увеличивая количество токенов/с, и еще долго сохраняет пропускную способность. Видно почерк Intel — и звучит, и выглядит как полный бред.
Конечно же, во всем остальном SN50 уступает B200 — 64 ГБ (HBM2e) против 192 ГБ (HBM3e) и 1,6 ТБ/с против 8 ТБ/с.
👍3
🎩 “Стимпанк” ПК из чугуна весом 99 кг
Небольшая компания Billet Labs собрала компьютер внутри настоящей чугунной батареи возрастом более 100 лет, превратив ее в корпус с кастомной системой жидкостного охлаждения. В контур помещается около 18 л охлаждающей жидкости, а общий вес готовой сборки достигает 99 кг.
Массив чугуна работает как гигантский пассивный радиатор с высокой теплоемкостью, поэтому пиковые температуры сглаживаются.
Небольшая компания Billet Labs собрала компьютер внутри настоящей чугунной батареи возрастом более 100 лет, превратив ее в корпус с кастомной системой жидкостного охлаждения. В контур помещается около 18 л охлаждающей жидкости, а общий вес готовой сборки достигает 99 кг.
Внутри: Ryzen 7 9800X3D, плата GIGABYTE B850I AORUS PRO, 32 ГБ ОЗУ и GeForce RTX 5080 с водоблоком Alphacool. По данным Billet Labs, в играх CPU и GPU держатся ниже 70 °C даже с отключенными вентиляторами, при суммарном энергопотреблении почти в 400 Вт.
Массив чугуна работает как гигантский пассивный радиатор с высокой теплоемкостью, поэтому пиковые температуры сглаживаются.
1👍7
AMD анонсировала новые серверный CPU EPYC 8005 Sorano.
Чипы ориентированы на задачи периферийных вычислений, IoT и vRAN инфраструктуры. Интеграция только в односокетные конфигурации.
Точные характеристики и модельный ряд неизвестны, однако AMD раскрыла, что чипы будут базироваться на архитектуре Zen 5c, будут иметь до 84 ядер и TDP до 225 Вт.
Продажи должны запустить уже в ближайшие месяцы. Очень ждем!
Чипы ориентированы на задачи периферийных вычислений, IoT и vRAN инфраструктуры. Интеграция только в односокетные конфигурации.
Точные характеристики и модельный ряд неизвестны, однако AMD раскрыла, что чипы будут базироваться на архитектуре Zen 5c, будут иметь до 84 ядер и TDP до 225 Вт.
Продажи должны запустить уже в ближайшие месяцы. Очень ждем!
1👍5🍾1
This media is not supported in your browser
VIEW IN TELEGRAM
MiniMax запустил MaxClaw — своего собственного управляемого ИИ-агента на базе OpenClaw и MiniMax M2.5. Система не требует развертывания, может работать 24/7, поддерживает интеграцию с Telegram / WhatsApp / Slack / Discord. Есть интегрированный инструмент MiniMax Expert и различные наборы функций для увеличения эффективности.
👍3
Инсайдеры снова получили информацию о DeepSeek v4.
Похоже, что у модели будет 2 версии: облегченная DeepSeek v4 Lite без размышления и полноразмерная DeepSeek v4 (предположительно, с размышлениями).
Больше всего информации о DeepSeek v4 Lite — модель может иметь до 1 миллиона токенов контекста, будет полностью мультимодальна и обойдет мощную веб-версию DeepSeek v3.2 в большинстве задач.
Похоже, что у модели будет 2 версии: облегченная DeepSeek v4 Lite без размышления и полноразмерная DeepSeek v4 (предположительно, с размышлениями).
Больше всего информации о DeepSeek v4 Lite — модель может иметь до 1 миллиона токенов контекста, будет полностью мультимодальна и обойдет мощную веб-версию DeepSeek v3.2 в большинстве задач.
🌭5
Появился новый повод для отмены Anthropic.
Неизвестная группа хакеров использовала Claude, чтобы украсть 150 ГБ данных Федерального Налогового Управления Мексики. Как же они написали вредоносное ПО. Возможно, использовали какие-то сложные скрипты для промпт-инъекции или манипуляции токенами?
Злоумышленники просто сказали Claude, что они белые хакеры и ищут баги за вознаграждение. Сначала Claude отказался помогать, но хакеры просто повторили просьбу и чат-бот начал искать уязвимости.
Вот какая она, хваленая защита Anthropic ☠️
Неизвестная группа хакеров использовала Claude, чтобы украсть 150 ГБ данных Федерального Налогового Управления Мексики. Как же они написали вредоносное ПО. Возможно, использовали какие-то сложные скрипты для промпт-инъекции или манипуляции токенами?
Злоумышленники просто сказали Claude, что они белые хакеры и ищут баги за вознаграждение. Сначала Claude отказался помогать, но хакеры просто повторили просьбу и чат-бот начал искать уязвимости.
Вот какая она, хваленая защита Anthropic ☠️
1 6💩2
К слову про Feynman
Как вы, возможно, знаете, начиная с 2006 года компания Nvidia называет новые поколения GPU (а с недавнего времени и CPU) в честь знаменитых ученых-физиков — от Tesla и Fermi до Blackwell и Vera Rubin. Исключением не станет и следующее поколение передовых ИИ-ускорителей Feynman, которые получили имя знаменитого ученого Ричарда Фейнмана.
Фейнман создал теорию, которая описывает взаимодействие света и материи, объединив квантовую механику и специальную теорию относительности, за что стал лауреатом Нобелевской премии 1965 года. Он же изобрел уникальный графический метод для визуализации и расчета взаимодействий между элементарными частицами, который получил название “диаграммы Фейнмана”.
К слову, он даже успел поучавстовать в Манхэттенском проекте. Да, да, тот самый проект по созданию ядерной бомбы в Лос-Аламосе во главе с Робертом Оппенгеймером, по которому сняли одноименный фильм.
Как вы, возможно, знаете, начиная с 2006 года компания Nvidia называет новые поколения GPU (а с недавнего времени и CPU) в честь знаменитых ученых-физиков — от Tesla и Fermi до Blackwell и Vera Rubin. Исключением не станет и следующее поколение передовых ИИ-ускорителей Feynman, которые получили имя знаменитого ученого Ричарда Фейнмана.
Фейнман создал теорию, которая описывает взаимодействие света и материи, объединив квантовую механику и специальную теорию относительности, за что стал лауреатом Нобелевской премии 1965 года. Он же изобрел уникальный графический метод для визуализации и расчета взаимодействий между элементарными частицами, который получил название “диаграммы Фейнмана”.
К слову, он даже успел поучавстовать в Манхэттенском проекте. Да, да, тот самый проект по созданию ядерной бомбы в Лос-Аламосе во главе с Робертом Оппенгеймером, по которому сняли одноименный фильм.
🤯2
🔥 Первые стойки VR200 Vera Rubin ушли заказчикам
NVIDIA сообщила в отчете за 2025 год о старте отгрузок инженерных образцов VR200 “Vera Rubin”, а массовые поставки запланированы на вторую половину 2026 года.
Каждый GPU Rubin выдает до 50 PFLOPS FP4, суперчип из двух GPU — около 100 PFLOPS, на борту 288 ГБ HBM4 на один GPU и 576 ГБ на суперчип, а CPU Vera получил 88 ядер Armv9.2 и до 1,5 ТБ LPDDR5X.
Если эти оценки подтвердятся в реальных кластерах, VR200 станет основой плотных, высокопроизводительных инфраструктур гиперскейлеров.
NVIDIA сообщила в отчете за 2025 год о старте отгрузок инженерных образцов VR200 “Vera Rubin”, а массовые поставки запланированы на вторую половину 2026 года.
Платформа объединяет CPU Vera, GPU Rubin, NVLink 6, ConnectX-9 SuperNIC, BlueField-4 и Spectrum-6 Ethernet и рассчитана на работу с ИИ-моделями с триллионами параметров.
Каждый GPU Rubin выдает до 50 PFLOPS FP4, суперчип из двух GPU — около 100 PFLOPS, на борту 288 ГБ HBM4 на один GPU и 576 ГБ на суперчип, а CPU Vera получил 88 ядер Armv9.2 и до 1,5 ТБ LPDDR5X.
В компании заявляют о четырехкратном сокращении числа GPU на стойку по сравнению с Blackwell и снижении стоимости инференса до 10 раз.
Если эти оценки подтвердятся в реальных кластерах, VR200 станет основой плотных, высокопроизводительных инфраструктур гиперскейлеров.
👍6