😵💫 Nvidia выпустила драйверы v595.71: ограничение напряжения и падение частот в RTX 50
После релиза NVIDIA GeForce 595.71 WHQL появились сообщения, что на картах GeForce RTX 50 наблюдаются ограничения напряжения и частот. По данным тестов пользователей, после установки этого драйвера частоты GPU перестают подниматься выше примерно ~2,9-3,0 ГГц, а напряжение фиксируется на уровне ~0,95-0,98 В, что делает стандартный разгон недоступным под нагрузкой в 3D-приложениях.
Пользователи, столкнувшиеся с новыми ограничениями, отмечают, что после отката драйвера частота и напряжение возвращаются к ожидаемым значениям, а лимит влияет на разгон и производительность под тяжелой 3D-нагрузкой
После релиза NVIDIA GeForce 595.71 WHQL появились сообщения, что на картах GeForce RTX 50 наблюдаются ограничения напряжения и частот. По данным тестов пользователей, после установки этого драйвера частоты GPU перестают подниматься выше примерно ~2,9-3,0 ГГц, а напряжение фиксируется на уровне ~0,95-0,98 В, что делает стандартный разгон недоступным под нагрузкой в 3D-приложениях.
Что по официальным данным: сам релиз v595.71 официально исправляет серьезные косяки предыдущей версии 595.59, в том числе проблемы с контролем вентиляторов и баги в играх на сериях RTX 30/40/50.
Пользователи, столкнувшиеся с новыми ограничениями, отмечают, что после отката драйвера частота и напряжение возвращаются к ожидаемым значениям, а лимит влияет на разгон и производительность под тяжелой 3D-нагрузкой
🤯2
ServerFlow | Новости и Железо 💾
Готовим для вас серию постов про самые жесткие провалы Intel ☠️
❌ Intel пыталась #1 — Intel Xeon Max
В 2022 году компания Intel выпустила серьезную заявочку на захват рынка HPC и ИИ — серверные CPU семейства Intel Xeon Max на архитектуре Sapphire Rapids.
Чипы имели до 56 ядер / 112 потоков, до 8 каналов DDR5-4800 (до 4 ТБ), 80 линий PCIe 5.0, поддерживались технологии Intel Deep Learning Boost, AVX-512 и Intel Speed Select Technology, и все это под сокет LGA 4677.
Но главная изюминка заключалась в том, что Xeon Max имели…встроенную память HBM2e в объеме 64 ГБ и контроллер на 1 ТБ/с. Да, это буквально топовая GPU память, распаянная на CPU, что давало чипам огромную производительность.
Эти передовые CPU применялись в суперкомпьютерном кластере Aurora, который долгое время занимал 2-е место в рейтинге TOP500.
Однако, казалось бы, здравая идея, провалилась — эти чипы стоили безумных денег в 2022 году ($12 980 за чип), имели огромный TDP в 350 Вт, а их настройка занимала огромное количество человеко-часов. Широкого распространения Intel Xeon Max так и не получили.
В 2022 году компания Intel выпустила серьезную заявочку на захват рынка HPC и ИИ — серверные CPU семейства Intel Xeon Max на архитектуре Sapphire Rapids.
Чипы имели до 56 ядер / 112 потоков, до 8 каналов DDR5-4800 (до 4 ТБ), 80 линий PCIe 5.0, поддерживались технологии Intel Deep Learning Boost, AVX-512 и Intel Speed Select Technology, и все это под сокет LGA 4677.
Но главная изюминка заключалась в том, что Xeon Max имели…встроенную память HBM2e в объеме 64 ГБ и контроллер на 1 ТБ/с. Да, это буквально топовая GPU память, распаянная на CPU, что давало чипам огромную производительность.
Эти передовые CPU применялись в суперкомпьютерном кластере Aurora, который долгое время занимал 2-е место в рейтинге TOP500.
Однако, казалось бы, здравая идея, провалилась — эти чипы стоили безумных денег в 2022 году ($12 980 за чип), имели огромный TDP в 350 Вт, а их настройка занимала огромное количество человеко-часов. Широкого распространения Intel Xeon Max так и не получили.
1👍5
Arm-серверы — это больше не диковинка крупных облачных гиперскейлеров, ведь Supermicro вывела линейку новых серверов на базе центральных процессоров Nvidia Grace: ARS-111L-FR, ARS-221GL-NR и ARS-111GL-NHR.
Сервер ARS-111L-FR — это миниатюрная 1U-система (43x437x429 мм) вмещает в себя топовый CPU Grace с 72 ядрами Arm Neoverse V2 и памятью 240 ГБ LPDDR5X. Чип занимает половину материнки, но это не мешает интеграции 2x NVIDIA L4. Система работает на БП до 800 Вт, есть PCIe 5.0 и NVMe.
Сервер ARS-111GL-NHR — еще одна 1U-конфигурация (43x438x35 мм) с чипом GH200 с 72 Arm-ядрами, 144 ГБ HBM3e и 480 ГБ LPDDR5X, поддерживает 8x E1.S NVMe и питается по 2x БП 2000 Вт.
Сервер ARS-221GL-NR — более крупная 2U-система (88x438x900 мм) на базе Grace Superchip, который дает аж 144 Arm-ядра, 960 ГБ LPDDR5X. Поддерживает E1.S NVMe и до 5x карт PCIe 5.0 x16, питание по 3x БП 2000 Вт.
Компания говорит, что решения подойдут для AI-RAN, но по факту — это топовые энергоэффективные серверы для локального ИИ и виртуализации.
Сервер ARS-111L-FR — это миниатюрная 1U-система (43x437x429 мм) вмещает в себя топовый CPU Grace с 72 ядрами Arm Neoverse V2 и памятью 240 ГБ LPDDR5X. Чип занимает половину материнки, но это не мешает интеграции 2x NVIDIA L4. Система работает на БП до 800 Вт, есть PCIe 5.0 и NVMe.
Сервер ARS-111GL-NHR — еще одна 1U-конфигурация (43x438x35 мм) с чипом GH200 с 72 Arm-ядрами, 144 ГБ HBM3e и 480 ГБ LPDDR5X, поддерживает 8x E1.S NVMe и питается по 2x БП 2000 Вт.
Сервер ARS-221GL-NR — более крупная 2U-система (88x438x900 мм) на базе Grace Superchip, который дает аж 144 Arm-ядра, 960 ГБ LPDDR5X. Поддерживает E1.S NVMe и до 5x карт PCIe 5.0 x16, питание по 3x БП 2000 Вт.
Компания говорит, что решения подойдут для AI-RAN, но по факту — это топовые энергоэффективные серверы для локального ИИ и виртуализации.
1👍5
🍏 M5 Pro и M5 Max: до 128 ГБ памяти и 614 ГБ/с в ноутбучных чипах
Apple обновила линейку MacBook Pro чипами M5 Pro и M5 Max с новой архитектурой Fusion, где два 3-нм кристалла объединены в один SoC с унифицированной памятью и низкой задержкой. Оба решения получили 18-ядерный CPU блок, а прирост производительности в профессиональных задачах составил 30% относительно прошлого поколения.
Apple наращивает не только частоты, но и ширину памяти, что важно для LLM и сложных сцен 3D без внешних eGPU. Предзаказы стартуют завтра, розничные продажи начнутся 11 марта.
Apple обновила линейку MacBook Pro чипами M5 Pro и M5 Max с новой архитектурой Fusion, где два 3-нм кристалла объединены в один SoC с унифицированной памятью и низкой задержкой. Оба решения получили 18-ядерный CPU блок, а прирост производительности в профессиональных задачах составил 30% относительно прошлого поколения.
M5 Pro предлагает до 64 ГБ унифицированной памяти с пропускной способностью до 307 ГБ/с и GPU до 20 ядер, тогда как M5 Max масштабируется до 128 ГБ и 614 ГБ/с с графикой до 40 ядер. В обоих случаях используется аппаратная трассировка лучей третьего поколения, динамическое кэширование, 16-ядерный Neural Engine и Media Engine с поддержкой кодека AV1, а порты Thunderbolt 5 работают через отдельные контроллеры.
Apple наращивает не только частоты, но и ширину памяти, что важно для LLM и сложных сцен 3D без внешних eGPU. Предзаказы стартуют завтра, розничные продажи начнутся 11 марта.
🌭2
💾 Micron начала поставки 256 ГБ SOCAMM2 с рекордной плотностью LPDDR5X
Micron объявила о начале поставок модулей памяти 256 ГБ SOCAMM2 — решения с максимальным объемом LPDRAM для серверов и ИИ-ЦОД. Новые 256 ГБ модули SOCAMM2 базируются на монолитных кристаллах по 32 ГБ и предлагают на ~33% больше памяти в одном DIMM, чем предыдущие 192 ГБ версии. В 8-канальных конфигурациях с такими модулями может получить до ~2 ТБ LPDRAM, что полезно для LLM с длинным контекстом, работы с KV-кэшем и плотного инференса без перехода на HBM.
Micron объявила о начале поставок модулей памяти 256 ГБ SOCAMM2 — решения с максимальным объемом LPDRAM для серверов и ИИ-ЦОД. Новые 256 ГБ модули SOCAMM2 базируются на монолитных кристаллах по 32 ГБ и предлагают на ~33% больше памяти в одном DIMM, чем предыдущие 192 ГБ версии. В 8-канальных конфигурациях с такими модулями может получить до ~2 ТБ LPDRAM, что полезно для LLM с длинным контекстом, работы с KV-кэшем и плотного инференса без перехода на HBM.
🎉 Релиз GPT-5.3 Instant
OpenAI выпустила GPT-5.3 Instant — новую флагманскую ИИ-модель, доступную в вебе, приложении и через API. Компания заявляет о снижении числа необоснованных отказов в генерации, более нативном стиле ведения диалога и улучшенной работе с веб-поиском.
Фокус релиза не в новых функциях, а в корректировке поведения модели и качестве взаимодействия с юзерами, поэтому никаких приростов по бенчмаркам не ждите.
OpenAI выпустила GPT-5.3 Instant — новую флагманскую ИИ-модель, доступную в вебе, приложении и через API. Компания заявляет о снижении числа необоснованных отказов в генерации, более нативном стиле ведения диалога и улучшенной работе с веб-поиском.
Новая версия меньше склонна воспринимать нейтральные запросы юзеров за нежелательные, а также реже грешит избыточностью ответов с нагромождениями текста. Функция веб-поиска теперь не сводится к простому пересказу ссылок, а коррелируется напрямую с базой знаний модели, делая ответ более релевантным. GPT-5.2 Instant переведена в раздел Legacy и останется у платных пользователей до 3 июня 2026 года, обновления Thinking и Pro обещаны позже.
Фокус релиза не в новых функциях, а в корректировке поведения модели и качестве взаимодействия с юзерами, поэтому никаких приростов по бенчмаркам не ждите.
🍾3 2
This media is not supported in your browser
VIEW IN TELEGRAM
OpenAI готовится выпустить Codex на Windows 👀
💽 44 ТБ на диск: Seagate вывела Mozaic 4+ с HAMR в прод
Seagate объявила о запуске новых HDD линейки Mozaic 4+ нового поколения с емкостью до 44 ТБ. Решение построено на базе технологии HAMR и уже используется в продакшене у двух крупных гиперскейлеров.
При развертывании инфраструктуры с 1 экзабайтом данных Mozaic 4+ дает до ~47 % выигрыша по эффективности по сравнению с HDD на 30 ТБ, сокращая площадь примерно на 100 кв. футов и снижая годовое энергопотребление на ~0,8 млн кВт·ч.
Seagate объявила о запуске новых HDD линейки Mozaic 4+ нового поколения с емкостью до 44 ТБ. Решение построено на базе технологии HAMR и уже используется в продакшене у двух крупных гиперскейлеров.
Новая архитектура и обновленная SoC обеспечивают запись при более высокой плотности без потери корпоративной надежности. Компания планирует поэтапно нарастить плотность с текущих 4+ ТБ на пластину до 10 ТБ в ближайшем будущем, что теоретически открывает путь к созданию накопителей емкостью до 100 ТБ.
При развертывании инфраструктуры с 1 экзабайтом данных Mozaic 4+ дает до ~47 % выигрыша по эффективности по сравнению с HDD на 30 ТБ, сокращая площадь примерно на 100 кв. футов и снижая годовое энергопотребление на ~0,8 млн кВт·ч.
👍5🤯3
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️
Сегодня на обзоре YOLO26 – одна из редких моделей, которая все еще работает на архитектуре сверточных нейросетей!
Это и многое другое вы узнаете в новом видео!
Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://www.youtube.com/watch?v=eviMbOz34-Y
Сегодня на обзоре YOLO26 – одна из редких моделей, которая все еще работает на архитектуре сверточных нейросетей!
- Сегментация большого количества объектов
- Детекция даже в ночное время суток
- Сравнение с RT-DETR (которая работает на архитектуре трансформеров)
Это и многое другое вы узнаете в новом видео!
Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://www.youtube.com/watch?v=eviMbOz34-Y
1👍4
ServerFlow | Новости и Железо 💾
Привет! 👋 Мы расширяемся и ищем в команду сервисного инженера по гарантии серверного оборудования. Нужен общительный человек, который разбирается в ПК и комплектующих. Коротко о главном: * Работа очно в офисе в Санкт-Петербурге * Понимание компьютерного…
Кстати, мы все еще в поисках сервисного инженера по гарантии серверного оборудования 😅 (город Санкт-Петербург)
Заработная плата – от 110 000 рублей!
Мы ищем:
Если увидели в этом описании себя – пишите в личные сообщения канала, а если под критерии подходит Ваш знакомый, то смело направляйте ему :)
Заработная плата – от 110 000 рублей!
Мы ищем:
Специалиста с глубоким пониманием схемотехники материнских плат: назначение и принципы работы конденсаторов, дросселей, транзисторов и других компонентов, умение видеть причинно-следственные связи при неисправностях.
Человека с уверенными навыками пайки: SMD-компонентов (паяльный фен, паста, ручной монтаж). силовых компонентов мощным паяльником. Будет плюсом опыт пайки BGA-микросхем, работы с ИК-паяльной станцией и нижним подогревом.
Специалиста, способного к аналитическому (дедуктивному) подходу при поиске неисправностей.
Человека, умеющего программировать BIOS-микросхемы: выпайка, подбор микросхемы, работа с программатором, поиск и анализ корректных прошивок с учётом конфигурации системы.
Коммуникабельного специалиста, готового работать как с клиентами, так и с менеджерами по продажам.
Умение грамотно оформлять результаты диагностики: чётко описывать проведённые тесты, выявленные симптомы и аргументированно подтверждать наличие или отсутствие неисправности.
Приветствуется профильное техническое образование и понимание принципов работы электронной компонентной базы серверного оборудования.
Если увидели в этом описании себя – пишите в личные сообщения канала, а если под критерии подходит Ваш знакомый, то смело направляйте ему :)
3👍7🌭5💩3 2
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 Gemini 3.1 Flash-Lite: всего $0.25 за миллион токенов
Google решила поджать OpenAI разу после релиза GPT-5.3 Instant, представила свою новую модель Gemini 3.1 Flash-Lite, которая стала самой доступной нейронкой в линейке Gemini 3.
Помимо бюджетного прайса, Gemini 3.1 Flash-Lite обеспечивает минимальные задержки генерации и выдерживает контекст даже в длинных диалогах. Доступна настройка глубины размышлений для адаптации под разные сценарии использования.
Google решила поджать OpenAI разу после релиза GPT-5.3 Instant, представила свою новую модель Gemini 3.1 Flash-Lite, которая стала самой доступной нейронкой в линейке Gemini 3.
Стоимость — всего $0.25 за 1 млн входных токенов и $1.50 за 1 млн выходных токенов, модель уже доступна через Gemini API и в Google AI Studio.
Помимо бюджетного прайса, Gemini 3.1 Flash-Lite обеспечивает минимальные задержки генерации и выдерживает контекст даже в длинных диалогах. Доступна настройка глубины размышлений для адаптации под разные сценарии использования.
1👍3
ServerFlow | Новости и Железо 💾
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️ Сегодня на обзоре YOLO26 – одна из редких моделей, которая все еще работает на архитектуре сверточных нейросетей! - Сегментация большого количества объектов - Детекция даже в ночное время суток - Сравнение с RT-DETR (которая работает…
Вот примеры использования, например если вам по какой-то причине нужно заблюрить мячик и стакан, или наоборот важно подсветить что-то :)
23👍6🤯1 1