ServerFlow | Новости и Железо 💾
4.24K subscribers
4.88K photos
387 videos
12 files
2.37K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
OpenAI выпустила GPT-Image 2.5 — свою самую передовую генеративную модель для создания высококачественных изображений. Из нововведений — скорость генерации увеличили на 50%, модель стала лучше справляться с деталями и стала лучше редактировать конкретные элементы контента. Еще добавили функцию “набросок”, которая позволяет рисовать черновики в качестве примера желаемого изображения, а также различные шаблоны. Нейронка уже доступна юзера ChatGPT.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8
This media is not supported in your browser
VIEW IN TELEGRAM
SemiAnalysis заявила, что AMD ускорила инференс ИИ-модели MiniMax M3 в vLLM в 11 раз при агентны нагрузках на серверном ИИ-ускорителе Instinct MI355X…аж за 19 дней. То есть, все это время скорость инференса нейронки была в 11 раз уже, чем могла бы быть изначально?

Конечно, назвать SemiAnalysis “непредвзятым” ресурсом вряд ли получится (компания ни раз слишком активно навалила Nvidia и упрекала AMD), однако при покупке топового серверного ИИ-ускорителя за сотни тысяч долларов (который, между прочим, продается только в OEM-формате в составе готовы серверов), хочется ведь сразу получить максимум возможностей от железа, верно?

Кто-то скажет, что AMD просто не раскрыла весь свой потенциал и продолжает оптимизировать софт с возможностями вывода, но с другой стороны — почему нельзя сразу сделать качественный продукт?

А вы что думаете по этому поводу?

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💅6👍4💩1
ASUS представила сервер ESC8000-E12P. на модульной архитектуре NVIDIA MGX с двумя процессорами Intel Xeon 6 Granite Rapids-SP. Система поддерживает до 8 ТБ DDR5-6400/5200 RDIMM/3DS RDIMM.

Система имеет 8 слотов PCIe 5.0 x16 для двухслотовых ИИ-ускорителей вроде NVIDIA H200 или RTX Pro 6000 Blackwell Server Edition. Еще 5 слото PCIe 5.0 x16 предназначены для сетевых карт или DPU, а для хранения предусмотрены 8 отсеков NVMe SFF с функцией горячей замены и два внутренних слота M.2 PCIe 5.0 x4.

За питание отвечают 4 БП по 3200 Вт с резервированием и сертификатом 80 PLUS Titanium. Все это помещается в корпус 4U, охлаждение полностью на воздухе. Цена не объявлена.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12🌭2
Тибо из OpenAI намекает, что ChatGPT может временно приостановить выдачу новых подписок Pro, если спрос на GPT-6 Astra продолжит расти.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7💩5
Qualcomm и Amazon заключили многолетнее соглашение о разработке нескольких поколений кастомных чипов для AWS, ориентированных прежде всего на крупномасштабный ИИ-инференс. Параллельно компании создадут оптические системы связи до 1,6 Тбит/с и выше, чтобы масштабировать обмен данными внутри будущих ИИ-кластеров.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5💩2
Соучредитель Google Сергей Брин оказывает все большее влияние на проект Gemini и настойчиво призывает команды работать быстрее, сокращать бюрократию и уделять больше внимания рекурсивному самосовершенствованию, пока Google стремится совершить качественный скачок в Gemini 4.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13💩1
По оценке портала KB Securities, складские запасы готовой памяти DDR, LPDDR и GDDR у Samsung и SK hynix в третьем квартале этого сократились ниже уровня 10 дней поставок. Ограниченное предложение памяти уже отражается на потребительской электронике, а дефицит может сохраниться и в 2027 году. При этом Samsung и SK hynix получают стимул отдавать производственные мощности под более дорогие HBM для ИИ-ускорителей, еще сильнее сокращая доступный объем обычной памяти.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯7😡5👍3💩2
Китайская CXMT столкнулась с серьезными проблемами при испытательном производстве 8-слойной HBM3. По данным корейского ChosunBiz, выход годных изделий на раннем этапе держится примерно на 25%, тогда как ориентир для массового производства в отрасли составляет около 80%. Для сравнения, SK hynix, выпускающая HBM3 с 2022 года, достигла показателя выше 90%. Эти цифры основаны на отраслевых источниках, а не на раскрытых данных самой CXMT.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1💅10👍2
По данным СМИ, ИИ-модель DeepSeek V4.1 Flash официально выйдет уже завтра 🎉

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍16🌭3
К слову, после релиза DeepSeek V4.1 Flash, китайская ИИ-лаборатория должна также представить DeepSeek V4.1 Pro немногим позже 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾8
Мобильные версии Nova Lake с мощной графикой на 12 Xe-ядер, по данным инсайдера Golden Pig Upgrade Pack, могут официально поддерживать память DDR5-8000 через модельный форм-фактор CSO-DIMM. Это важное отличие от большинства современных процессоров для тонких ноутбуков, где LPDDR5X распаяна на плате и заменить или увеличить память после покупки нельзя.

CSO-DIMM сохраняет компактный формат модулей памяти для ноутбуков, но позволяет устанавливать и менять оперативную память почти как на ПК. Для сравнения, нынешний Panther Lake с 12 Xe официально DDR5 не поддерживает, хотя ASRock Industrial уже выпускает системы на Core Ultra X7 358H с двумя слотами DDR5-7200. У Nova Lake такой подход могут поднять скорость 8 000 MT/s, что особенно интересно для систем с мощной встроенной графикой, которая использует общую оперативную память.

При этом информация пока не подтверждена Intel.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
OpenAI заявила о совместной разработке ИИ-чипов следующего поколения с Samsung Electronics. Сейчас первый инференс-ускоритель компании Jalapeño производится на мощностях TSMC, а разработкой OpenAI занимается вместе с Broadcom. Если Samsung действительно станет вторым производственным партнером, OpenAI сможет распределить выпуск между двумя крупнейшими передовыми фабриками по выпуску чипов.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5
Компания Google DeepMind тестирует новую ИИ-модель Nano Banana 2.5 под кодовым названием “spicy-mayo” на Image Arena 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9🍾1
HP выпустила рабочую ИИ-станцию ZGX Fury на базе NVIDIA GB300. Система рассчитана на локальный инференс и дообучение ИИ, выдавая до 20 PFLOPS в FP4 и обеспечивая до 748 ГБ когерентной памяти. HP заявляет поддержку инференса моделей класса до 1 трлн параметров.

Внутри: 72-ядерный Arm Neoverse V2 Grace, Blackwell Ultra с 252 ГБ HBM3e с пропускной способностью памяти 7,1 ТБ/с, плюс 496 ГБ LPDDR5X в системе. Для хранения доступны слоты NVMe M.2, а также доступен слот PCIe 5.0 x16 для интеграции дополнительной RTX 6000 PRO. Для создания кластера в систему интегрирована сетевая карта Connect-X 8 с 2 портами по 400 Гбит/с.

HP также объединяет станцию с софтом Red Hat AI Factory, Red Hat Enterprise Linux и OpenShift, чтобы запускать модели и агентов локально, а затем управлять теми же рабочими процессами в гибридном облаке.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11
DeepSeek официально выпустила DeepSeek V4.1 Flash — младшую модель нового поколения нейронок с 552 млрд параметров против 284 млрд у предыдущей DeepSeek V4-Flash.

Модель получила нативное мультимодальное понимание изображений, контекст до 1 млн токенов и заметно усилилась в агентном программировании. На Terminal-Bench 4.0 она набирает 31,2% против 7% у V4-Flash-0731, а на DeepSWE v1.1 — 74,2% против 54,4%. При этом до более сильных моделей пока далеко: GPT-6 Astra показывает 57,9%, Claude Fable 5.1 — 55,8% на Terminal-Bench 4.0.

Вне пиковых часов миллион входных токенов без попадания в кэш API модели стоит $0,15, выходных — $0,60, а повторное чтение уже закэшированного контекста всего $0,003. Это на 57% дешевле предыдущего тарифа для кэширования.

DeepSeek заявляет, что V4.1 Flash превосходит V4 Pro по производительности, стоимости, скорости и общему времени выполнения задач. После запуска запросы к V4 Pro временно будут автоматически направляться на V4.1 Flash и оплачиваться по тарифу Flash, пока не выйдет V4.1 Pro.

DeepSeek V4.1 Flash уже доступна на Hugging Face.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10