This media is not supported in your browser
VIEW IN TELEGRAM
OpenAI выпустила GPT-Image 2.5 — свою самую передовую генеративную модель для создания высококачественных изображений. Из нововведений — скорость генерации увеличили на 50%, модель стала лучше справляться с деталями и стала лучше редактировать конкретные элементы контента. Еще добавили функцию “набросок”, которая позволяет рисовать черновики в качестве примера желаемого изображения, а также различные шаблоны. Нейронка уже доступна юзера ChatGPT.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8
This media is not supported in your browser
VIEW IN TELEGRAM
SemiAnalysis заявила, что AMD ускорила инференс ИИ-модели MiniMax M3 в vLLM в 11 раз при агентны нагрузках на серверном ИИ-ускорителе Instinct MI355X…аж за 19 дней. То есть, все это время скорость инференса нейронки была в 11 раз уже, чем могла бы быть изначально?
Конечно, назвать SemiAnalysis “непредвзятым” ресурсом вряд ли получится (компания ни раз слишком активно навалила Nvidia и упрекала AMD), однако при покупке топового серверного ИИ-ускорителя за сотни тысяч долларов (который, между прочим, продается только в OEM-формате в составе готовы серверов), хочется ведь сразу получить максимум возможностей от железа, верно?
Кто-то скажет, что AMD просто не раскрыла весь свой потенциал и продолжает оптимизировать софт с возможностями вывода, но с другой стороны — почему нельзя сразу сделать качественный продукт?
А вы что думаете по этому поводу?
😅 Канал Serverflow в MAX: Подписаться
Конечно, назвать SemiAnalysis “непредвзятым” ресурсом вряд ли получится (компания ни раз слишком активно навалила Nvidia и упрекала AMD), однако при покупке топового серверного ИИ-ускорителя за сотни тысяч долларов (который, между прочим, продается только в OEM-формате в составе готовы серверов), хочется ведь сразу получить максимум возможностей от железа, верно?
Кто-то скажет, что AMD просто не раскрыла весь свой потенциал и продолжает оптимизировать софт с возможностями вывода, но с другой стороны — почему нельзя сразу сделать качественный продукт?
А вы что думаете по этому поводу?
Please open Telegram to view this post
VIEW IN TELEGRAM
💅6👍4💩1
ASUS представила сервер ESC8000-E12P. на модульной архитектуре NVIDIA MGX с двумя процессорами Intel Xeon 6 Granite Rapids-SP. Система поддерживает до 8 ТБ DDR5-6400/5200 RDIMM/3DS RDIMM.
Система имеет 8 слотов PCIe 5.0 x16 для двухслотовых ИИ-ускорителей вроде NVIDIA H200 или RTX Pro 6000 Blackwell Server Edition. Еще 5 слото PCIe 5.0 x16 предназначены для сетевых карт или DPU, а для хранения предусмотрены 8 отсеков NVMe SFF с функцией горячей замены и два внутренних слота M.2 PCIe 5.0 x4.
За питание отвечают 4 БП по 3200 Вт с резервированием и сертификатом 80 PLUS Titanium. Все это помещается в корпус 4U, охлаждение полностью на воздухе. Цена не объявлена.
😅 Канал Serverflow в MAX: Подписаться
Система имеет 8 слотов PCIe 5.0 x16 для двухслотовых ИИ-ускорителей вроде NVIDIA H200 или RTX Pro 6000 Blackwell Server Edition. Еще 5 слото PCIe 5.0 x16 предназначены для сетевых карт или DPU, а для хранения предусмотрены 8 отсеков NVMe SFF с функцией горячей замены и два внутренних слота M.2 PCIe 5.0 x4.
За питание отвечают 4 БП по 3200 Вт с резервированием и сертификатом 80 PLUS Titanium. Все это помещается в корпус 4U, охлаждение полностью на воздухе. Цена не объявлена.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12🌭2
Тибо из OpenAI намекает, что ChatGPT может временно приостановить выдачу новых подписок Pro, если спрос на GPT-6 Astra продолжит расти.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7💩5
Qualcomm и Amazon заключили многолетнее соглашение о разработке нескольких поколений кастомных чипов для AWS, ориентированных прежде всего на крупномасштабный ИИ-инференс. Параллельно компании создадут оптические системы связи до 1,6 Тбит/с и выше, чтобы масштабировать обмен данными внутри будущих ИИ-кластеров.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5💩2
Соучредитель Google Сергей Брин оказывает все большее влияние на проект Gemini и настойчиво призывает команды работать быстрее, сокращать бюрократию и уделять больше внимания рекурсивному самосовершенствованию, пока Google стремится совершить качественный скачок в Gemini 4.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13💩1
По оценке портала KB Securities, складские запасы готовой памяти DDR, LPDDR и GDDR у Samsung и SK hynix в третьем квартале этого сократились ниже уровня 10 дней поставок. Ограниченное предложение памяти уже отражается на потребительской электронике, а дефицит может сохраниться и в 2027 году. При этом Samsung и SK hynix получают стимул отдавать производственные мощности под более дорогие HBM для ИИ-ускорителей, еще сильнее сокращая доступный объем обычной памяти.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯7😡5👍3💩2
Китайская CXMT столкнулась с серьезными проблемами при испытательном производстве 8-слойной HBM3. По данным корейского ChosunBiz, выход годных изделий на раннем этапе держится примерно на 25%, тогда как ориентир для массового производства в отрасли составляет около 80%. Для сравнения, SK hynix, выпускающая HBM3 с 2022 года, достигла показателя выше 90%. Эти цифры основаны на отраслевых источниках, а не на раскрытых данных самой CXMT.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1💅10👍2
По данным СМИ, ИИ-модель DeepSeek V4.1 Flash официально выйдет уже завтра 🎉
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍16🌭3
К слову, после релиза DeepSeek V4.1 Flash, китайская ИИ-лаборатория должна также представить DeepSeek V4.1 Pro немногим позже 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾8
Мобильные версии Nova Lake с мощной графикой на 12 Xe-ядер, по данным инсайдера Golden Pig Upgrade Pack, могут официально поддерживать память DDR5-8000 через модельный форм-фактор CSO-DIMM. Это важное отличие от большинства современных процессоров для тонких ноутбуков, где LPDDR5X распаяна на плате и заменить или увеличить память после покупки нельзя.
CSO-DIMM сохраняет компактный формат модулей памяти для ноутбуков, но позволяет устанавливать и менять оперативную память почти как на ПК. Для сравнения, нынешний Panther Lake с 12 Xe официально DDR5 не поддерживает, хотя ASRock Industrial уже выпускает системы на Core Ultra X7 358H с двумя слотами DDR5-7200. У Nova Lake такой подход могут поднять скорость 8 000 MT/s, что особенно интересно для систем с мощной встроенной графикой, которая использует общую оперативную память.
При этом информация пока не подтверждена Intel.
😅 Канал Serverflow в MAX: Подписаться
CSO-DIMM сохраняет компактный формат модулей памяти для ноутбуков, но позволяет устанавливать и менять оперативную память почти как на ПК. Для сравнения, нынешний Panther Lake с 12 Xe официально DDR5 не поддерживает, хотя ASRock Industrial уже выпускает системы на Core Ultra X7 358H с двумя слотами DDR5-7200. У Nova Lake такой подход могут поднять скорость 8 000 MT/s, что особенно интересно для систем с мощной встроенной графикой, которая использует общую оперативную память.
При этом информация пока не подтверждена Intel.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
OpenAI заявила о совместной разработке ИИ-чипов следующего поколения с Samsung Electronics. Сейчас первый инференс-ускоритель компании Jalapeño производится на мощностях TSMC, а разработкой OpenAI занимается вместе с Broadcom. Если Samsung действительно станет вторым производственным партнером, OpenAI сможет распределить выпуск между двумя крупнейшими передовыми фабриками по выпуску чипов.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5
Компания Google DeepMind тестирует новую ИИ-модель Nano Banana 2.5 под кодовым названием “spicy-mayo” на Image Arena 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9🍾1
HP выпустила рабочую ИИ-станцию ZGX Fury на базе NVIDIA GB300. Система рассчитана на локальный инференс и дообучение ИИ, выдавая до 20 PFLOPS в FP4 и обеспечивая до 748 ГБ когерентной памяти. HP заявляет поддержку инференса моделей класса до 1 трлн параметров.
Внутри: 72-ядерный Arm Neoverse V2 Grace, Blackwell Ultra с 252 ГБ HBM3e с пропускной способностью памяти 7,1 ТБ/с, плюс 496 ГБ LPDDR5X в системе. Для хранения доступны слоты NVMe M.2, а также доступен слот PCIe 5.0 x16 для интеграции дополнительной RTX 6000 PRO. Для создания кластера в систему интегрирована сетевая карта Connect-X 8 с 2 портами по 400 Гбит/с.
HP также объединяет станцию с софтом Red Hat AI Factory, Red Hat Enterprise Linux и OpenShift, чтобы запускать модели и агентов локально, а затем управлять теми же рабочими процессами в гибридном облаке.
😅 Канал Serverflow в MAX: Подписаться
Внутри: 72-ядерный Arm Neoverse V2 Grace, Blackwell Ultra с 252 ГБ HBM3e с пропускной способностью памяти 7,1 ТБ/с, плюс 496 ГБ LPDDR5X в системе. Для хранения доступны слоты NVMe M.2, а также доступен слот PCIe 5.0 x16 для интеграции дополнительной RTX 6000 PRO. Для создания кластера в систему интегрирована сетевая карта Connect-X 8 с 2 портами по 400 Гбит/с.
HP также объединяет станцию с софтом Red Hat AI Factory, Red Hat Enterprise Linux и OpenShift, чтобы запускать модели и агентов локально, а затем управлять теми же рабочими процессами в гибридном облаке.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11
DeepSeek официально выпустила DeepSeek V4.1 Flash — младшую модель нового поколения нейронок с 552 млрд параметров против 284 млрд у предыдущей DeepSeek V4-Flash.
Модель получила нативное мультимодальное понимание изображений, контекст до 1 млн токенов и заметно усилилась в агентном программировании. На Terminal-Bench 4.0 она набирает 31,2% против 7% у V4-Flash-0731, а на DeepSWE v1.1 — 74,2% против 54,4%. При этом до более сильных моделей пока далеко: GPT-6 Astra показывает 57,9%, Claude Fable 5.1 — 55,8% на Terminal-Bench 4.0.
Вне пиковых часов миллион входных токенов без попадания в кэш API модели стоит $0,15, выходных — $0,60, а повторное чтение уже закэшированного контекста всего $0,003. Это на 57% дешевле предыдущего тарифа для кэширования.
DeepSeek заявляет, что V4.1 Flash превосходит V4 Pro по производительности, стоимости, скорости и общему времени выполнения задач. После запуска запросы к V4 Pro временно будут автоматически направляться на V4.1 Flash и оплачиваться по тарифу Flash, пока не выйдет V4.1 Pro.
DeepSeek V4.1 Flash уже доступна на Hugging Face.
😅 Канал Serverflow в MAX: Подписаться
Модель получила нативное мультимодальное понимание изображений, контекст до 1 млн токенов и заметно усилилась в агентном программировании. На Terminal-Bench 4.0 она набирает 31,2% против 7% у V4-Flash-0731, а на DeepSWE v1.1 — 74,2% против 54,4%. При этом до более сильных моделей пока далеко: GPT-6 Astra показывает 57,9%, Claude Fable 5.1 — 55,8% на Terminal-Bench 4.0.
Вне пиковых часов миллион входных токенов без попадания в кэш API модели стоит $0,15, выходных — $0,60, а повторное чтение уже закэшированного контекста всего $0,003. Это на 57% дешевле предыдущего тарифа для кэширования.
DeepSeek заявляет, что V4.1 Flash превосходит V4 Pro по производительности, стоимости, скорости и общему времени выполнения задач. После запуска запросы к V4 Pro временно будут автоматически направляться на V4.1 Flash и оплачиваться по тарифу Flash, пока не выйдет V4.1 Pro.
DeepSeek V4.1 Flash уже доступна на Hugging Face.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10