Nvidia объявила, что ИИ-стойки Groq 3 LPX запущены в серийное производство 🎉
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10💩3🤯2
Когда-нибудь видели Blade-серверы с процессорами Apple M5? Теперь видели… Кажется, в Китае есть кастомы буквально с любыми процами.
Кстати, для работы системы требуется отдельный ИИ-ПК Mac Studio — он выполняет роль центра программного управления.
😅 Канал Serverflow в MAX: Подписаться
Кстати, для работы системы требуется отдельный ИИ-ПК Mac Studio — он выполняет роль центра программного управления.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯27💩4👍1😡1
Intel раскрыла больше деталей о новом ИИ-ускорителе Crescent Island для инференса и агентных нагрузок.
В основе GPU лежит архитектура Xe3P — 4 вычислительных блока по 8 Xe-ядер, всего 32 ядра, 256 векторных блоков и 256 XMX-движков. Каждый Xe Core получает 8 векторных движков и 8 XMX, а вся карта работает как GPGPU, само собой без блоков для обычной 3D-график.
Векторные движки поддерживают вычисления FP4, FP8 и FP64, а XMX могут работать с FP16. На каждое Xe-ядро также приходится 1 МБ GRF, дополнительно есть 512 КБ L1 на Xe Core, то есть 16 МБ L1 и 32 МБ L2.
Но самое интересное — память. Intel Crescent Island базируется не на HBM, а на LPDDR5X, причем, объем OEM-версии достигает ошеломительные 480 ГБ, тогда как референсная PCIe-карта получит только 160 ГБ. За счет использования энергоэффективной LPDDR5X, PCIe-версия с воздушным охлаждением будет иметь TDP около 350 Вт.
С ПО в этот раз проблем не будет — Intel заявляет о поддержке vLLM, SGLang, llm-d и NVIDIA Dynamo, на карточке можно будет запускать языковые, размышляющие, мультимодальные и диффузионные нейронки.
😅 Канал Serverflow в MAX: Подписаться
В основе GPU лежит архитектура Xe3P — 4 вычислительных блока по 8 Xe-ядер, всего 32 ядра, 256 векторных блоков и 256 XMX-движков. Каждый Xe Core получает 8 векторных движков и 8 XMX, а вся карта работает как GPGPU, само собой без блоков для обычной 3D-график.
Векторные движки поддерживают вычисления FP4, FP8 и FP64, а XMX могут работать с FP16. На каждое Xe-ядро также приходится 1 МБ GRF, дополнительно есть 512 КБ L1 на Xe Core, то есть 16 МБ L1 и 32 МБ L2.
Но самое интересное — память. Intel Crescent Island базируется не на HBM, а на LPDDR5X, причем, объем OEM-версии достигает ошеломительные 480 ГБ, тогда как референсная PCIe-карта получит только 160 ГБ. За счет использования энергоэффективной LPDDR5X, PCIe-версия с воздушным охлаждением будет иметь TDP около 350 Вт.
С ПО в этот раз проблем не будет — Intel заявляет о поддержке vLLM, SGLang, llm-d и NVIDIA Dynamo, на карточке можно будет запускать языковые, размышляющие, мультимодальные и диффузионные нейронки.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8
Инсайдеры обнаружили новые ИИ-модели Anthropic под кодовым названием Claude Marshmallow и Melon.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8
Сетевая нода NVIDIA Spectrum-X CPO на выставке Hot Chips 2026 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🤯5
SpaceX в партнерстве с Nvidia разработала оптимизированную для использования в космосе систему Vera Rubin NVL72, которая будет запущена на орбиту в четвертом квартале 2027 года.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8🌭2💩1
На Ebay обнаружили ранний инженерный образец процессоров AMD Zen с платой ASUS Arica AM4 2016 года выпуска. Продают почти за 300 евро — оправдано ли за железо 10-летней давности?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1💩9🌭3
Microsoft тестирует в экспериментальной сборке Windows 11 функцию IntelligentCarveout, которая позволяет резервировать часть унифицированной памяти отдельно для GPU. В системе с такой архитектурой память одновременно используется CPU и GPU, а после резервирования указанный объем становится недоступен другим приложениям. На это указывает компонент SettingsHandlers_UnifiedMemory.dll, обнаруженный в сборке от 17 августа.
Функция особенно актуальна для NVIDIA RTX Spark, где до 128 ГБ LPDDR5X используется как общая память. Пользователь сможет определить, сколько памяти отдать графическому процессору под игры и ИИ-нагрузки, вместо полностью автоматического распределения Windows. Аналогичный подход уже есть у AMD Ryzen AI Max+ 395: его драйвер позволяет резервировать до 96 ГБ из 128 ГБ общей памяти под GPU.
😅 Канал Serverflow в MAX: Подписаться
Функция особенно актуальна для NVIDIA RTX Spark, где до 128 ГБ LPDDR5X используется как общая память. Пользователь сможет определить, сколько памяти отдать графическому процессору под игры и ИИ-нагрузки, вместо полностью автоматического распределения Windows. Аналогичный подход уже есть у AMD Ryzen AI Max+ 395: его драйвер позволяет резервировать до 96 ГБ из 128 ГБ общей памяти под GPU.
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯7💩1