ServerFlow | Новости и Железо 💾
4.24K subscribers
4.88K photos
387 videos
12 files
2.37K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
К слову, после релиза DeepSeek V4.1 Flash, китайская ИИ-лаборатория должна также представить DeepSeek V4.1 Pro немногим позже 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾8
Мобильные версии Nova Lake с мощной графикой на 12 Xe-ядер, по данным инсайдера Golden Pig Upgrade Pack, могут официально поддерживать память DDR5-8000 через модельный форм-фактор CSO-DIMM. Это важное отличие от большинства современных процессоров для тонких ноутбуков, где LPDDR5X распаяна на плате и заменить или увеличить память после покупки нельзя.

CSO-DIMM сохраняет компактный формат модулей памяти для ноутбуков, но позволяет устанавливать и менять оперативную память почти как на ПК. Для сравнения, нынешний Panther Lake с 12 Xe официально DDR5 не поддерживает, хотя ASRock Industrial уже выпускает системы на Core Ultra X7 358H с двумя слотами DDR5-7200. У Nova Lake такой подход могут поднять скорость 8 000 MT/s, что особенно интересно для систем с мощной встроенной графикой, которая использует общую оперативную память.

При этом информация пока не подтверждена Intel.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
OpenAI заявила о совместной разработке ИИ-чипов следующего поколения с Samsung Electronics. Сейчас первый инференс-ускоритель компании Jalapeño производится на мощностях TSMC, а разработкой OpenAI занимается вместе с Broadcom. Если Samsung действительно станет вторым производственным партнером, OpenAI сможет распределить выпуск между двумя крупнейшими передовыми фабриками по выпуску чипов.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5
Компания Google DeepMind тестирует новую ИИ-модель Nano Banana 2.5 под кодовым названием “spicy-mayo” на Image Arena 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9🍾1
HP выпустила рабочую ИИ-станцию ZGX Fury на базе NVIDIA GB300. Система рассчитана на локальный инференс и дообучение ИИ, выдавая до 20 PFLOPS в FP4 и обеспечивая до 748 ГБ когерентной памяти. HP заявляет поддержку инференса моделей класса до 1 трлн параметров.

Внутри: 72-ядерный Arm Neoverse V2 Grace, Blackwell Ultra с 252 ГБ HBM3e с пропускной способностью памяти 7,1 ТБ/с, плюс 496 ГБ LPDDR5X в системе. Для хранения доступны слоты NVMe M.2, а также доступен слот PCIe 5.0 x16 для интеграции дополнительной RTX 6000 PRO. Для создания кластера в систему интегрирована сетевая карта Connect-X 8 с 2 портами по 400 Гбит/с.

HP также объединяет станцию с софтом Red Hat AI Factory, Red Hat Enterprise Linux и OpenShift, чтобы запускать модели и агентов локально, а затем управлять теми же рабочими процессами в гибридном облаке.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11
DeepSeek официально выпустила DeepSeek V4.1 Flash — младшую модель нового поколения нейронок с 552 млрд параметров против 284 млрд у предыдущей DeepSeek V4-Flash.

Модель получила нативное мультимодальное понимание изображений, контекст до 1 млн токенов и заметно усилилась в агентном программировании. На Terminal-Bench 4.0 она набирает 31,2% против 7% у V4-Flash-0731, а на DeepSWE v1.1 — 74,2% против 54,4%. При этом до более сильных моделей пока далеко: GPT-6 Astra показывает 57,9%, Claude Fable 5.1 — 55,8% на Terminal-Bench 4.0.

Вне пиковых часов миллион входных токенов без попадания в кэш API модели стоит $0,15, выходных — $0,60, а повторное чтение уже закэшированного контекста всего $0,003. Это на 57% дешевле предыдущего тарифа для кэширования.

DeepSeek заявляет, что V4.1 Flash превосходит V4 Pro по производительности, стоимости, скорости и общему времени выполнения задач. После запуска запросы к V4 Pro временно будут автоматически направляться на V4.1 Flash и оплачиваться по тарифу Flash, пока не выйдет V4.1 Pro.

DeepSeek V4.1 Flash уже доступна на Hugging Face.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10
Media is too big
VIEW IN TELEGRAM
Обзорщики начали получать топовые рабочие ИИ-станции на базе Nvidia GB300. Вот, например, коллеги из StorageReview показали свою систему XpertStation WS300 от MSI за $100 000+.

Удивительно наблюдать, в какую сторону концепция ПК начала меняться в 2026 году — теперь нейровкатунам нужны не видюхи, а суперкомпьютеры в настольном корпусе.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍16
JD Cloud объявила о планах создать кластер из 100 000 полнофункциональных GPU компании Moore Threads. Система будет использоваться для обучения и инференса крупных моделей, при этом вычислительные ресурсы планируют предоставлять компаниям из разных отраслей.

Какие именно GPU получит кластер, пока не раскрыто. Самый современный ускоритель Moore Threads — MTT S5000 на архитектуре PingHu с чипом PH100: он поддерживает вычисления от FP8 до FP64, рассчитан на обучение и инференс больших моделей и может объединяться в 8-GPU серверы через собственный интерконнект MTLink. Производитель также заявляет масштабирование до кластеров на 10 000 GPU с эффективностью до 95% от линейного масштабирования, но эти показатели получены в собственных тестах Moore Threads.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Nvidia снова попала под проверку антимонопольной службы — в этот раз Хуанг под прицелом из-за сделки о покупке Groq. Минюст США считает, что Nvidia могла оформить сделку так, чтобы это не нарушало антимонопольного законодательства и не требовало проверки соответствующих органов. Если подозрения подтвердятся, Nvidia ждут большие штрафы.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10
Как вы наверняка уже знаете, вчера Apple показала новое 18-ое поколение iPhone, и компания уделила большое внимание локальному нейро-функционалу своих передовых смартфонов.

В частности, наиболее важным ИИ-нововведением стал обновленный Neural Engine в чипе A20 Pro — теперь процессор поддерживает сразу 2 NPU по 32 ядра каждый, обеспечивая производительность 140 TFLOPS в FP8 (по 70 на каждый NPU). А это, на минуточку, почти 1/2 от ИИ-производительности Nvidia A100 с 312 TFLOPS в FP16 — то есть, если бы A100 поддерживал FP8 на аппаратном уровне, его эффективность была бы почти на одном уровне со смартфонным чипом.

Быстрой памяти у A20 Pro, конечно, немного (всего 12 ГБ LPDDR5X), но сам факт наличия такой производительности говорит о готовности Apple создавать “карманное” железо для ИИ-инференса.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍9💩1💅1
ServerFlow | Новости и Железо 💾
Обзорщики начали получать топовые рабочие ИИ-станции на базе Nvidia GB300. Вот, например, коллеги из StorageReview показали свою систему XpertStation WS300 от MSI за $100 000+. Удивительно наблюдать, в какую сторону концепция ПК начала меняться в 2026 году…
ASUS тоже подтянулась и выпустила свою вариацию Nvidia DGX Station GB300 — ExpertCenter Pro ET900N G3. По начинке все стандартно, но интересно, что каждый партнер Nvidia по выпуску Station по-разному справляется с охлаждением системы, и делает это действительно качественно. Тем временем, что мы видим в AMD Threadripper Halo Station? Сетевую карту, которая никак не охлаждается, 4 супергорячих GPU и не менее горячий CPU, посаженных на СЖО или вовсе на воздух.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5
ServerFlow | Новости и Железо 💾
Как вы наверняка уже знаете, вчера Apple показала новое 18-ое поколение iPhone, и компания уделила большое внимание локальному нейро-функционалу своих передовых смартфонов. В частности, наиболее важным ИИ-нововведением стал обновленный Neural Engine в чипе…
Кажется, Geekbench 6 переборщил с накруткой баллов для Apple A20 Pro — у нового яблочного процессора одноядерная производительность на 45% выше (4719 баллов), чем у самого быстрого потребительского процессора AMD Ryzen 9950X3D2 (3250 баллов).

А может, Apple A20 Pro действительно настолько хорош? Если среди вас будут (наверняка будут) счастливые обладатели iPhone 18, вы сможете проверить реальную производительность A20 Pro в нашем open-source бенчмарке SFBench.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
💅13
CUDA Toolkit 13.4 вышла с поддержкой Windows on Arm — так Nvidia готовится к грядущему старту продаж ноутбуков и ИИ-ПК на базе RTX Spark. Помимо этого, в релиз вошел превью-доступ к архитектуре Vera Rubin, новые оптимизации для матричных библиотек, новый инструмент Multi-Process Service V3 для слайсинга памяти GPU в контейнерных средах и другие нововведения для улучшения функционала ИИ-ускорителей Nvidia и ПО-экосистемы CUDA.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Компания LattePanda анонсировала комплект ИИ-разработчика Mu Ultra на базе процессора Intel Core Ultra 5 226V/Core Ultra 7 256V — по сути, аналог ИИ-модулей NVIDIA Jetson Nano на базе чипов Intel.

Система имеет 16 ГБ памяти LPDDR5X-8533, а ИИ-производительность может варьироваться от 97 до 115 TOPS в зависимости от конфигурации процессора. Периферийные подключения включают до трех пор дисплеев (HDMI / DisplayPort), USB 3.2 Gen 2, шесть USB 2.0, порт 2.5GbE, а также I2C и GPIO для подключения внешнего оборудования.

Доступен комплект с платой расширения и активным охлаждением. Цена стартует с $643 за Core Ultra 5 и $733 за Core Ultra 7.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7💅1