Похоже, рынок памяти все же начал понемногу остывать: спотовая цена DDR4 16 ГБ за последний месяц просела примерно на 5%, и это первое заметное снижение почти за год. На фоне прошлогоднего скачка более чем на 2 200%, снижение минимальное, но оно все равно свидетельствует о положительной динамике. При этом DDR5 тоже показывает локальную коррекцию, местами до 30% на 32 ГБ киты.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3 1
Это Грейс Хоппер — ученая, в честь которой Хуанг назвал свои архитектуры центральных и графических процессоров прошлого поколения. Грейс стала одним из первых программистов в истории и изобрела первый в мире компилятор, получила докторскую степень по математике, помогала в разработке IBM COBOL и даже дослужилась до звания контр-адмирала ВМС США.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6 2🤯1🌭1
В Китае начали продавать Intel Xeon Max 9470C — чип имеет 52 ядра/104 потока, частоту 2,0-3,5 ГГц, 105 МБ L3-кэша, TDP 350 Вт и 64 ГБ высокоскоростной памяти HBM2E (да-да, такая же память, как в ИИ-ускорителях). Интересно, сколько такой чип сможет выдать токенов?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Amazon рассматривает возможность продажи ИИ-чипов Trainium сторонним заказчикам. Гендиректор компании Энди Джасси уже предложил эту идею акционерам, отметив высокий спрос на ИИ-чипы внутренней разработки — при начале продаж, выручка компании может составить дополнительные $50 млрд.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯3
ServerFlow | Новости и Железо 💾
Пользователи сообщают, что ИИ-модель Claude Opus 4.6 от Anthropic в последнее время стала хуже работать — написанный код все чаще не работает или генерируется с множеством дыр. Многие считают, что компания готовится к выходу новых нейронок и намеренно режет…
Глава ИИ-отела AMD Стелла Лоренцо подтвердила, что с начала марта качество работы Claude Code от Anthropic значительно снизилось. По ее словам, анализ более 6800 сессий и 234 000 вызовов инструмента показал, что модель стала проявлять “лень”, выполняя рассуждения более поверхностно, пропуская проверки кода и не доделывая поставленные задачи.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
История с влиянием керамики Toto повторяется — обнаружено еще одно узкое место ИИ-рынка, и это вновь не ускорители, а ABF-пленка для продвинутой упаковки чипов, которую выпускает компания Ajinomoto Co., Inc., известная в первую очередь по пищевым добавкам и приправам. Ajinomoto создает так называемый Ajinomoto Build-up Film — ключевой изоляционный материал между кристаллом, интерпозером и печатной платой, без которого современные ускорители с HBM просто невозможно создать. Спрос на Ajinomoto Build-up Film растет быстрее, чем мощности по производству, поэтому дефицит уже начинает влиять на поставки серверных ускорителей и сроки ввода новых ИИ-кластеров.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Китайская MiniMax официально открыла веса MiniMax M2.7. Модель построена на MoE-архитектуре с 229 млрд параметров, при этом на токен активируется только 10–15 млрд, а контекстное окно достигает 204 800 токенов, что позволяет держать в памяти целые кодовые базы, длинные логи и крупные спецификации.
Модель уверенно чувствует себя в бенчмарках: 56,22% в SWE-Pro, 55,6% в VIBE-Pro и до 78% в SWE-bench Verified — MiniMax M2.7 уже выходит на уровень топовых закрытых решений для инженерных задач, вроде GPT-5.4 и Claude Opus 4.6. Единственный спорный момент — лицензия: несмотря на open-source подачу, коммерческое использование, как сообщается, требует отдельного согласования с разработчиками, поэтому для корпоративных проектов MiniMax M2.7 вряд ли подойдет.
😅 Канал Serverflow в MAX: Подписаться
Модель имеет 256 экспертов, из которых одновременно работают 8, а также есть гибридная схема внимания для длинного контекста и нативная поддержка инвертированного размышления, когда модель анализирует результаты между вызовами инструментов и сама выстраивает следующий шаг. Это делает ее особенно сильной в длинных агентных рабочих процессах, мультиагентных командах и автономной оптимизации пайплайнов. В BF16 для запуска требуется около 457 ГБ памяти, но квантизованные сборки уже можно развернуть на системах со 128 ГБ памяти.
Модель уверенно чувствует себя в бенчмарках: 56,22% в SWE-Pro, 55,6% в VIBE-Pro и до 78% в SWE-bench Verified — MiniMax M2.7 уже выходит на уровень топовых закрытых решений для инженерных задач, вроде GPT-5.4 и Claude Opus 4.6. Единственный спорный момент — лицензия: несмотря на open-source подачу, коммерческое использование, как сообщается, требует отдельного согласования с разработчиками, поэтому для корпоративных проектов MiniMax M2.7 вряд ли подойдет.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8
С 2-нм техпроцессом GAA от Samsung что-то явно не так — выход годных чипов зафиксировался на уровне 60% и не увеличивается уже продолжительное время. При этом один из первых заказчиков Samsung 2-нм Qualcomm требует как минимум 70% выхода рабочих процессоров, а в будущем мощности будут запрашивать такие техногиганты, как Nvidia и AMD. Похоже, что диверсификация производства отменяется, и компаниям снова придется пользоваться услугами одной лишь TSMC.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
🗓 Коротко о главных новостях за эту неделю
❗️ Z.ai выпустила GLM-5.1 в open-source
❗️ Anthropic приоткрыла завесу тайны о Claude Mythos Preview
❗️ Broadcom выпустила RAID-контроллеры MegaRAID 9760W-32i и MegaRAID 9760W-16i
❗️ Meta* представила флагманскую модель Muse Spark
❗️ Thermalright представила ИИ-ПК AI HydroNous R1 на базе APU AMD Strix Halo
❗️ MiniMax выпустила модель M2.7 в open-source
❗️ Z.ai выпустила GLM-5.1 в open-source
❗️ Anthropic приоткрыла завесу тайны о Claude Mythos Preview
❗️ Broadcom выпустила RAID-контроллеры MegaRAID 9760W-32i и MegaRAID 9760W-16i
❗️ Meta* представила флагманскую модель Muse Spark
❗️ Thermalright представила ИИ-ПК AI HydroNous R1 на базе APU AMD Strix Halo
❗️ MiniMax выпустила модель M2.7 в open-source
ServerFlow
Z.ai выпустила open-source модель GLM-5.1: автономная работа до 8 часов и лицензия MIT | Новость ServerFlow
Z.ai выпустила GLM-5.1 в open-source: модель способна автономно работать до 8 часов
🍾5 2👍1
Новая модель Anthropic Capybara (что-то между Opus и Mythos) замечена во внутреннем коде API 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5
Одноплатные компьютеры Rubik Pi 3 на базе 8-ядерного Qualcomm Dragonwing QCS6490 и Arduino Uno Q на базе 4-ядерного Qualcomm Dragonwing QRB2210 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
В текущий кризисный период, многие всерьез рассматривают возможность покупки инженерных образцов оперативной памяти. Вот, например, тестовые плашки DDR5 RDIMM на 96 ГБ от Micron. А вы бы купили такое?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8
ServerFlow | Новости и Железо 💾
Компания Anthropic ведет переговоры с партнерами о разработке собственных ИИ-чипов, чтобы снизить зависимость от Nvidia. 😅 Канал Serverflow в MAX: Подписаться
Сейчас почти все крупные ИИ-компании рассматривают возможность разработки собственных ИИ-чипов. Такими темпами, к 2030 году Хуангу придется переключиться на другие способы заработка...
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM