К слову, после релиза DeepSeek V4.1 Flash, китайская ИИ-лаборатория должна также представить DeepSeek V4.1 Pro немногим позже 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾8
Мобильные версии Nova Lake с мощной графикой на 12 Xe-ядер, по данным инсайдера Golden Pig Upgrade Pack, могут официально поддерживать память DDR5-8000 через модельный форм-фактор CSO-DIMM. Это важное отличие от большинства современных процессоров для тонких ноутбуков, где LPDDR5X распаяна на плате и заменить или увеличить память после покупки нельзя.
CSO-DIMM сохраняет компактный формат модулей памяти для ноутбуков, но позволяет устанавливать и менять оперативную память почти как на ПК. Для сравнения, нынешний Panther Lake с 12 Xe официально DDR5 не поддерживает, хотя ASRock Industrial уже выпускает системы на Core Ultra X7 358H с двумя слотами DDR5-7200. У Nova Lake такой подход могут поднять скорость 8 000 MT/s, что особенно интересно для систем с мощной встроенной графикой, которая использует общую оперативную память.
При этом информация пока не подтверждена Intel.
😅 Канал Serverflow в MAX: Подписаться
CSO-DIMM сохраняет компактный формат модулей памяти для ноутбуков, но позволяет устанавливать и менять оперативную память почти как на ПК. Для сравнения, нынешний Panther Lake с 12 Xe официально DDR5 не поддерживает, хотя ASRock Industrial уже выпускает системы на Core Ultra X7 358H с двумя слотами DDR5-7200. У Nova Lake такой подход могут поднять скорость 8 000 MT/s, что особенно интересно для систем с мощной встроенной графикой, которая использует общую оперативную память.
При этом информация пока не подтверждена Intel.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
OpenAI заявила о совместной разработке ИИ-чипов следующего поколения с Samsung Electronics. Сейчас первый инференс-ускоритель компании Jalapeño производится на мощностях TSMC, а разработкой OpenAI занимается вместе с Broadcom. Если Samsung действительно станет вторым производственным партнером, OpenAI сможет распределить выпуск между двумя крупнейшими передовыми фабриками по выпуску чипов.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5
Компания Google DeepMind тестирует новую ИИ-модель Nano Banana 2.5 под кодовым названием “spicy-mayo” на Image Arena 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9🍾1
HP выпустила рабочую ИИ-станцию ZGX Fury на базе NVIDIA GB300. Система рассчитана на локальный инференс и дообучение ИИ, выдавая до 20 PFLOPS в FP4 и обеспечивая до 748 ГБ когерентной памяти. HP заявляет поддержку инференса моделей класса до 1 трлн параметров.
Внутри: 72-ядерный Arm Neoverse V2 Grace, Blackwell Ultra с 252 ГБ HBM3e с пропускной способностью памяти 7,1 ТБ/с, плюс 496 ГБ LPDDR5X в системе. Для хранения доступны слоты NVMe M.2, а также доступен слот PCIe 5.0 x16 для интеграции дополнительной RTX 6000 PRO. Для создания кластера в систему интегрирована сетевая карта Connect-X 8 с 2 портами по 400 Гбит/с.
HP также объединяет станцию с софтом Red Hat AI Factory, Red Hat Enterprise Linux и OpenShift, чтобы запускать модели и агентов локально, а затем управлять теми же рабочими процессами в гибридном облаке.
😅 Канал Serverflow в MAX: Подписаться
Внутри: 72-ядерный Arm Neoverse V2 Grace, Blackwell Ultra с 252 ГБ HBM3e с пропускной способностью памяти 7,1 ТБ/с, плюс 496 ГБ LPDDR5X в системе. Для хранения доступны слоты NVMe M.2, а также доступен слот PCIe 5.0 x16 для интеграции дополнительной RTX 6000 PRO. Для создания кластера в систему интегрирована сетевая карта Connect-X 8 с 2 портами по 400 Гбит/с.
HP также объединяет станцию с софтом Red Hat AI Factory, Red Hat Enterprise Linux и OpenShift, чтобы запускать модели и агентов локально, а затем управлять теми же рабочими процессами в гибридном облаке.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11
DeepSeek официально выпустила DeepSeek V4.1 Flash — младшую модель нового поколения нейронок с 552 млрд параметров против 284 млрд у предыдущей DeepSeek V4-Flash.
Модель получила нативное мультимодальное понимание изображений, контекст до 1 млн токенов и заметно усилилась в агентном программировании. На Terminal-Bench 4.0 она набирает 31,2% против 7% у V4-Flash-0731, а на DeepSWE v1.1 — 74,2% против 54,4%. При этом до более сильных моделей пока далеко: GPT-6 Astra показывает 57,9%, Claude Fable 5.1 — 55,8% на Terminal-Bench 4.0.
Вне пиковых часов миллион входных токенов без попадания в кэш API модели стоит $0,15, выходных — $0,60, а повторное чтение уже закэшированного контекста всего $0,003. Это на 57% дешевле предыдущего тарифа для кэширования.
DeepSeek заявляет, что V4.1 Flash превосходит V4 Pro по производительности, стоимости, скорости и общему времени выполнения задач. После запуска запросы к V4 Pro временно будут автоматически направляться на V4.1 Flash и оплачиваться по тарифу Flash, пока не выйдет V4.1 Pro.
DeepSeek V4.1 Flash уже доступна на Hugging Face.
😅 Канал Serverflow в MAX: Подписаться
Модель получила нативное мультимодальное понимание изображений, контекст до 1 млн токенов и заметно усилилась в агентном программировании. На Terminal-Bench 4.0 она набирает 31,2% против 7% у V4-Flash-0731, а на DeepSWE v1.1 — 74,2% против 54,4%. При этом до более сильных моделей пока далеко: GPT-6 Astra показывает 57,9%, Claude Fable 5.1 — 55,8% на Terminal-Bench 4.0.
Вне пиковых часов миллион входных токенов без попадания в кэш API модели стоит $0,15, выходных — $0,60, а повторное чтение уже закэшированного контекста всего $0,003. Это на 57% дешевле предыдущего тарифа для кэширования.
DeepSeek заявляет, что V4.1 Flash превосходит V4 Pro по производительности, стоимости, скорости и общему времени выполнения задач. После запуска запросы к V4 Pro временно будут автоматически направляться на V4.1 Flash и оплачиваться по тарифу Flash, пока не выйдет V4.1 Pro.
DeepSeek V4.1 Flash уже доступна на Hugging Face.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10
Media is too big
VIEW IN TELEGRAM
Обзорщики начали получать топовые рабочие ИИ-станции на базе Nvidia GB300. Вот, например, коллеги из StorageReview показали свою систему XpertStation WS300 от MSI за $100 000+.
Удивительно наблюдать, в какую сторону концепция ПК начала меняться в 2026 году — теперь нейровкатунам нужны не видюхи, а суперкомпьютеры в настольном корпусе.
😅 Канал Serverflow в MAX: Подписаться
Удивительно наблюдать, в какую сторону концепция ПК начала меняться в 2026 году — теперь нейровкатунам нужны не видюхи, а суперкомпьютеры в настольном корпусе.
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍16
JD Cloud объявила о планах создать кластер из 100 000 полнофункциональных GPU компании Moore Threads. Система будет использоваться для обучения и инференса крупных моделей, при этом вычислительные ресурсы планируют предоставлять компаниям из разных отраслей.
Какие именно GPU получит кластер, пока не раскрыто. Самый современный ускоритель Moore Threads — MTT S5000 на архитектуре PingHu с чипом PH100: он поддерживает вычисления от FP8 до FP64, рассчитан на обучение и инференс больших моделей и может объединяться в 8-GPU серверы через собственный интерконнект MTLink. Производитель также заявляет масштабирование до кластеров на 10 000 GPU с эффективностью до 95% от линейного масштабирования, но эти показатели получены в собственных тестах Moore Threads.
😅 Канал Serverflow в MAX: Подписаться
Какие именно GPU получит кластер, пока не раскрыто. Самый современный ускоритель Moore Threads — MTT S5000 на архитектуре PingHu с чипом PH100: он поддерживает вычисления от FP8 до FP64, рассчитан на обучение и инференс больших моделей и может объединяться в 8-GPU серверы через собственный интерконнект MTLink. Производитель также заявляет масштабирование до кластеров на 10 000 GPU с эффективностью до 95% от линейного масштабирования, но эти показатели получены в собственных тестах Moore Threads.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Nvidia снова попала под проверку антимонопольной службы — в этот раз Хуанг под прицелом из-за сделки о покупке Groq. Минюст США считает, что Nvidia могла оформить сделку так, чтобы это не нарушало антимонопольного законодательства и не требовало проверки соответствующих органов. Если подозрения подтвердятся, Nvidia ждут большие штрафы.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10
Как вы наверняка уже знаете, вчера Apple показала новое 18-ое поколение iPhone, и компания уделила большое внимание локальному нейро-функционалу своих передовых смартфонов.
В частности, наиболее важным ИИ-нововведением стал обновленный Neural Engine в чипе A20 Pro — теперь процессор поддерживает сразу 2 NPU по 32 ядра каждый, обеспечивая производительность 140 TFLOPS в FP8 (по 70 на каждый NPU). А это, на минуточку, почти 1/2 от ИИ-производительности Nvidia A100 с 312 TFLOPS в FP16 — то есть, если бы A100 поддерживал FP8 на аппаратном уровне, его эффективность была бы почти на одном уровне со смартфонным чипом.
Быстрой памяти у A20 Pro, конечно, немного (всего 12 ГБ LPDDR5X), но сам факт наличия такой производительности говорит о готовности Apple создавать “карманное” железо для ИИ-инференса.
😅 Канал Serverflow в MAX: Подписаться
В частности, наиболее важным ИИ-нововведением стал обновленный Neural Engine в чипе A20 Pro — теперь процессор поддерживает сразу 2 NPU по 32 ядра каждый, обеспечивая производительность 140 TFLOPS в FP8 (по 70 на каждый NPU). А это, на минуточку, почти 1/2 от ИИ-производительности Nvidia A100 с 312 TFLOPS в FP16 — то есть, если бы A100 поддерживал FP8 на аппаратном уровне, его эффективность была бы почти на одном уровне со смартфонным чипом.
Быстрой памяти у A20 Pro, конечно, немного (всего 12 ГБ LPDDR5X), но сам факт наличия такой производительности говорит о готовности Apple создавать “карманное” железо для ИИ-инференса.
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍9💩1💅1
ServerFlow | Новости и Железо 💾
Обзорщики начали получать топовые рабочие ИИ-станции на базе Nvidia GB300. Вот, например, коллеги из StorageReview показали свою систему XpertStation WS300 от MSI за $100 000+. Удивительно наблюдать, в какую сторону концепция ПК начала меняться в 2026 году…
ASUS тоже подтянулась и выпустила свою вариацию Nvidia DGX Station GB300 — ExpertCenter Pro ET900N G3. По начинке все стандартно, но интересно, что каждый партнер Nvidia по выпуску Station по-разному справляется с охлаждением системы, и делает это действительно качественно. Тем временем, что мы видим в AMD Threadripper Halo Station? Сетевую карту, которая никак не охлаждается, 4 супергорячих GPU и не менее горячий CPU, посаженных на СЖО или вовсе на воздух.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5
ServerFlow | Новости и Железо 💾
Как вы наверняка уже знаете, вчера Apple показала новое 18-ое поколение iPhone, и компания уделила большое внимание локальному нейро-функционалу своих передовых смартфонов. В частности, наиболее важным ИИ-нововведением стал обновленный Neural Engine в чипе…
Кажется, Geekbench 6 переборщил с накруткой баллов для Apple A20 Pro — у нового яблочного процессора одноядерная производительность на 45% выше (4719 баллов), чем у самого быстрого потребительского процессора AMD Ryzen 9950X3D2 (3250 баллов).
А может, Apple A20 Pro действительно настолько хорош? Если среди вас будут (наверняка будут) счастливые обладатели iPhone 18, вы сможете проверить реальную производительность A20 Pro в нашем open-source бенчмарке SFBench.
😅 Канал Serverflow в MAX: Подписаться
А может, Apple A20 Pro действительно настолько хорош? Если среди вас будут (наверняка будут) счастливые обладатели iPhone 18, вы сможете проверить реальную производительность A20 Pro в нашем open-source бенчмарке SFBench.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
💅13
CUDA Toolkit 13.4 вышла с поддержкой Windows on Arm — так Nvidia готовится к грядущему старту продаж ноутбуков и ИИ-ПК на базе RTX Spark. Помимо этого, в релиз вошел превью-доступ к архитектуре Vera Rubin, новые оптимизации для матричных библиотек, новый инструмент Multi-Process Service V3 для слайсинга памяти GPU в контейнерных средах и другие нововведения для улучшения функционала ИИ-ускорителей Nvidia и ПО-экосистемы CUDA.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Компания LattePanda анонсировала комплект ИИ-разработчика Mu Ultra на базе процессора Intel Core Ultra 5 226V/Core Ultra 7 256V — по сути, аналог ИИ-модулей NVIDIA Jetson Nano на базе чипов Intel.
Система имеет 16 ГБ памяти LPDDR5X-8533, а ИИ-производительность может варьироваться от 97 до 115 TOPS в зависимости от конфигурации процессора. Периферийные подключения включают до трех пор дисплеев (HDMI / DisplayPort), USB 3.2 Gen 2, шесть USB 2.0, порт 2.5GbE, а также I2C и GPIO для подключения внешнего оборудования.
Доступен комплект с платой расширения и активным охлаждением. Цена стартует с $643 за Core Ultra 5 и $733 за Core Ultra 7.
😅 Канал Serverflow в MAX: Подписаться
Система имеет 16 ГБ памяти LPDDR5X-8533, а ИИ-производительность может варьироваться от 97 до 115 TOPS в зависимости от конфигурации процессора. Периферийные подключения включают до трех пор дисплеев (HDMI / DisplayPort), USB 3.2 Gen 2, шесть USB 2.0, порт 2.5GbE, а также I2C и GPIO для подключения внешнего оборудования.
Доступен комплект с платой расширения и активным охлаждением. Цена стартует с $643 за Core Ultra 5 и $733 за Core Ultra 7.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7💅1