🔥 AMD Zen 7 Grimlock — до 264 ядер и FP512 в новой архитектуре
Датамайнер Moore’s Law Is Dead вновь выпустил интересный инсайд. По его данным, AMD активно готовит новую архитектуру Zen 7 (Grimlock): вычислительные кристаллы CCD будут изготавливаться по техпроцессу TSMC A14, а модули с V-Cache — по N4P. Один CCD площадью ~98 мм² вмещает до 16 ядер, каждое с 2 МБ L2 и 4 МБ L3.
Если утечки верны, Zen 7 станет крупнейшим скачком AMD по эффективности и масштабируемости за всю историю линейки процессоров.
Датамайнер Moore’s Law Is Dead вновь выпустил интересный инсайд. По его данным, AMD активно готовит новую архитектуру Zen 7 (Grimlock): вычислительные кристаллы CCD будут изготавливаться по техпроцессу TSMC A14, а модули с V-Cache — по N4P. Один CCD площадью ~98 мм² вмещает до 16 ядер, каждое с 2 МБ L2 и 4 МБ L3.
Серверные чипы EPYC на Zen 7 могут насчитывать до 264 ядер и 2122 МБ L3-кэша (без 3D Cache). Варианты X3D получат 160 МБ дополнительного кэша и дают прирост 20–36% к Zen 6 при энергопотреблении всего 312 Вт на ядро. Поддержка FP512 (аналог AVX-512) подтверждает, что чипы будут сделаны с фокусом на HPC и ИИ-нагрузках(как будто и так было непонятно) .
Если утечки верны, Zen 7 станет крупнейшим скачком AMD по эффективности и масштабируемости за всю историю линейки процессоров.
👍4💩1🌭1
🎧 Step-Audio-EditX: открыта 3b аудиомодель с точным управлением звуком
Исследователи из Stepfun AI открыли исходный код Step-Audio-EditX — LLM-модели c 3 миллиардов параметров для редактирования речи и синтеза голоса.
Модель требует GPU с 32 ГБ памяти (тестировалась на NVIDIA L40S) и работает на PyTorch 2.4. В основе — трехкомпонентная архитектура с двойным аудиотокенизатором, LLM-ядром и аудиодекодером, выполняющим обратное преобразование токенов в звук.
Веса уже доступны на GitHub и ModelScope.
Исследователи из Stepfun AI открыли исходный код Step-Audio-EditX — LLM-модели c 3 миллиардов параметров для редактирования речи и синтеза голоса.
Она умеет менять эмоции, стиль и паралингвистику (смех, дыхание, удивление) без дополнительного обучения, а также выполнять Text-to-Speech с нуля, правда, пока только для английского, мандаринского и диалектов, включая сычуаньский и кантонский, но этот вопрос решается дообучением.
Модель требует GPU с 32 ГБ памяти (тестировалась на NVIDIA L40S) и работает на PyTorch 2.4. В основе — трехкомпонентная архитектура с двойным аудиотокенизатором, LLM-ядром и аудиодекодером, выполняющим обратное преобразование токенов в звук.
Step-Audio-EditX показывает, как аудио-LLM-подходы выходят за рамки TTS, приближая синтетическую речь к естественной выразительности человека.
Веса уже доступны на GitHub и ModelScope.
👍1
⚛️ NVQLink? А может лучше…EPYC? IBM запустила квантовый алгоритм на чипах AMD
Пока Хуанг рассказывает, что у Nvidia есть крутой интерконнект для подключения QPU и GPU, AMD без лишнего пафоса запускает квантовые алгоритмы для коррекции ошибок на обычных серверных чипах EPYC.
IBM планирует завершить квантовый компьютер Starling к 2029 году, но уже сейчас компания заявляет, что работа по интеграции с классическим оборудованием идет с опережением графика на год.
Пока Хуанг рассказывает, что у Nvidia есть крутой интерконнект для подключения QPU и GPU, AMD без лишнего пафоса запускает квантовые алгоритмы для коррекции ошибок на обычных серверных чипах EPYC.
Никаких дополнительных надстроек, никаких сложных межсоединений и интерконнектов — только голое железо с большой вычислительной мощностью. Все благодаря программируемым вентильным матрицам AMD, на которых алгоритм IBM заработал в 10 раз быстрее, чем было нужно по расчетам.
IBM планирует завершить квантовый компьютер Starling к 2029 году, но уже сейчас компания заявляет, что работа по интеграции с классическим оборудованием идет с опережением графика на год.
👍3
🤖 OpenAI готовит к выпуску модели GPT-5.1?
В OpenAI Enterprise нашли интересную информацию, согласно которой уже 24 ноября может выйти серия моделей GPT-5.1: базовая, размышляющая и Pro-версия.
Если это не фейк и даты указаны верно, то OpenAI снова идет по пути пакетного обновления — когда новая архитектура выходит сразу в нескольких конфигурациях для выполнения разных задач и удовлетворения разных типов пользователей.
Скорее всего, GPT-5.1 станет первым релизом с унифицированной reasoning-архитектурой, но это не точно.
В OpenAI Enterprise нашли интересную информацию, согласно которой уже 24 ноября может выйти серия моделей GPT-5.1: базовая, размышляющая и Pro-версия.
Следы моделей нашли в коде RBAC-настроек, которые обычно обновляются за несколько недель до нового релиза.
Если это не фейк и даты указаны верно, то OpenAI снова идет по пути пакетного обновления — когда новая архитектура выходит сразу в нескольких конфигурациях для выполнения разных задач и удовлетворения разных типов пользователей.
Скорее всего, GPT-5.1 станет первым релизом с унифицированной reasoning-архитектурой, но это не точно.
👍2
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️
Гоокси! Аналог Supermicro. Детально смотрим на достижение китайской народной промышленности.
https://youtu.be/ChsnkUwV8Ck
Гоокси! Аналог Supermicro. Детально смотрим на достижение китайской народной промышленности.
Пока SM, соблюдают санкции и не особо горят желанием импортировать в РФ свои "пустые корпуса". Ребята из Gooxi момент не упускают!
https://youtu.be/ChsnkUwV8Ck
YouTube
Китайцы скопировали Supermicro и сделали лучше? Обзор Gooxi!
Gooxi RMC2112-695-NV - китайское серверное шасси, которое удивляет! По сути, это аналог Supermicro 826, но с рядом улучшений: поддержка NVMe бекплейнов, более мощные блоки питания и возможность спокойно купить без сложностей с поставками.
В этом видео мы…
В этом видео мы…
👍2 1
💼 AMD захантила топ-менеджера Intel
Саураб Кулкарни, вице-президент Intel по управлению продуктами искусственного интеллекта для дата-центров, уходит из компании и, по сообщениям, присоединится к AMD. Руководить направлением временно будет Анил Нандури.
Кулкарни курировал развитие ИИ-направления Intel, в частности, принимал участие в разработке Gaudi 3 и фотонных межсоединений. До Intel он работал в Graphcore, Lucata и Microsoft Azure.
Для Intel это уже второй крупный переход за год: ранее подразделение DCAI покинул Джастин Хотар, ставший новым CEO Nokia.
Саураб Кулкарни, вице-президент Intel по управлению продуктами искусственного интеллекта для дата-центров, уходит из компании и, по сообщениям, присоединится к AMD. Руководить направлением временно будет Анил Нандури.
Кулкарни курировал развитие ИИ-направления Intel, в частности, принимал участие в разработке Gaudi 3 и фотонных межсоединений. До Intel он работал в Graphcore, Lucata и Microsoft Azure.
Уход совпал с активным набором AMD специалистов по ИИ — компания усиливает разработку учкорителей Instinct и ждет роста доходов от ИИ-направления до десятков миллиардов к 2027 году.
Для Intel это уже второй крупный переход за год: ранее подразделение DCAI покинул Джастин Хотар, ставший новым CEO Nokia.
👍3
❌ Дефицит GDDR7 грозит срывом релиза RTX 50 SUPER
По данным инсайдеров, NVIDIA может отложить или вовсе отменить серию видеокарт GeForce RTX 50 SUPER из-за нехватки видеопамяти GDDR7.
В стандартной линейке RTX 50 используется более доступная GDDR7 на 2 ГБ, тогда как версии SUPER задумывались с приростом памяти до 18-24 ГБ. Релиз планировали на CES 2026, но теперь приоритет, по слухам, смещен в сторону серверных ускорителей Blackwell и Rubin CPX.
Если дефицит сохранится, NVIDIA, скорее всего, ограничится базовыми картами RTX 50, а чипы SUPER останутся на бумаге, либо их релиз перенесут на третий квартал 2026.
По данным инсайдеров, NVIDIA может отложить или вовсе отменить серию видеокарт GeForce RTX 50 SUPER из-за нехватки видеопамяти GDDR7.
Эти модели, включая RTX 5070 SUPER и RTX 5080 SUPER, должны были получить более плотные модули по 3 ГБ каждый — но их массовое производство буксует на месте.
В стандартной линейке RTX 50 используется более доступная GDDR7 на 2 ГБ, тогда как версии SUPER задумывались с приростом памяти до 18-24 ГБ. Релиз планировали на CES 2026, но теперь приоритет, по слухам, смещен в сторону серверных ускорителей Blackwell и Rubin CPX.
Ранее подобная ситуация наблюдалась при выпуске видеокарт RTX 4000, когда из-за дефицита чипов GDDR6X Nvidia рассматривала переход на GDDR6.
Если дефицит сохранится, NVIDIA, скорее всего, ограничится базовыми картами RTX 50, а чипы SUPER останутся на бумаге, либо их релиз перенесут на третий квартал 2026.
👍3
🤑 Ryzen 9800X3D и 7800X3D продаются лучше, чем все процессоры Intel
AMD снова утерла нос Intel: по данным Amazon, за октябрь суммарные продажи Ryzen 9800X3D и 7800X3D превысили 16 000 штук, тогда как весь ассортимент процессоров Intel — едва 10 000.
Процессоры основаны на Zen 4 (7800X3D) и Zen 5 (9800X3D) с 3D V-Cache и считаются эталоном игровой производительности. Даже бюджетный шестиядерник Ryzen 5 5500 занимает третье место, опережая Core i3-12100 и 14100F.
Покупатели, судя по цифрам, выбирают либо максимум FPS за любые деньги, либо честный бюджетный баланс. И пока X3D-серия остается лучшим, что может предложить рынок обычным юзерам.
AMD снова утерла нос Intel: по данным Amazon, за октябрь суммарные продажи Ryzen 9800X3D и 7800X3D превысили 16 000 штук, тогда как весь ассортимент процессоров Intel — едва 10 000.
При этом X3D-чипы уже несколько месяцев подряд удерживают топ-10 лучших CPU по продажам без единого представителя семейств чипов Intel.
Процессоры основаны на Zen 4 (7800X3D) и Zen 5 (9800X3D) с 3D V-Cache и считаются эталоном игровой производительности. Даже бюджетный шестиядерник Ryzen 5 5500 занимает третье место, опережая Core i3-12100 и 14100F.
Интеловские Raptor Lake Refresh держатся лишь за счет огромных скидок, но не конкурируют по пользовательскому интересу.
Покупатели, судя по цифрам, выбирают либо максимум FPS за любые деньги, либо честный бюджетный баланс. И пока X3D-серия остается лучшим, что может предложить рынок обычным юзерам.
1👍4
⚙️ Топ-GPU не нужны: Китайские модели учатся работать на старых GPU
После запрета на закупку топовых видеокарт NVIDIA китайские разработчики пошли другим путем: теперь ИИ-модели вроде Kimi K2-Thinking обучаются для эффективной работы на дешевых GPU с поддержкой BF16 и INT4, без необходимости в FP4 и других передовых функциях Blackwell.
Вместо PTQ (квантование после обучения) используется QAT, при котором ошибки компенсируются прямо во время тренировки. Такой подход особенно важен для масштабирования длинных цепочек рассуждений.
Похоже, квантование окончательно перестало быть компромиссом — теперь это фундамент локального инференса.
После запрета на закупку топовых видеокарт NVIDIA китайские разработчики пошли другим путем: теперь ИИ-модели вроде Kimi K2-Thinking обучаются для эффективной работы на дешевых GPU с поддержкой BF16 и INT4, без необходимости в FP4 и других передовых функциях Blackwell.
В нейронках серии K2 применяется квантование W4A16 — веса в 4 бита, активации в 16. Это снижает задержку при сохранении качества и делает модель совместимой с более доступными картами.
Вместо PTQ (квантование после обучения) используется QAT, при котором ошибки компенсируются прямо во время тренировки. Такой подход особенно важен для масштабирования длинных цепочек рассуждений.
Инженеры Kimi отмечают, что INT4 не просто ускоряет вывод, но и ускоряет само обучение RL на 10-20 %. А главное — снижает аппаратные барьеры: модели можно запускать даже на A100 или L40S.
Похоже, квантование окончательно перестало быть компромиссом — теперь это фундамент локального инференса.
1👍1
🎮 Крипто-консольный Франкенштейн за $120 запускает GTA V и Cyberpunk
Бывшая майнинговая плата AMD BC250, созданная на базе APU от PlayStation 5, внезапно стала находкой для бюджетных геймеров.
Внутри урезанный чип от PS5 (AMD BC250 APU) — 6 ядер Zen 2 до 3,5 ГГц и графика RDNA 2 с 24 CU, 16 ГБ GDDR6 на общей шине (8 системных + 8 видеопамяти). Плата запитывается через PCIe 8 pin, есть разъемы USB, DisplayPort и Ethernet, но нет разъема PCIe x16.
Производительность уровня Radeon RX 6600 по цене офисной затычки выглядит заманчиво. Главное — не забыть про охлаждение: подобные экс-майнеры изначально рассчитаны на стойки с мощным охлаждением, а не на домашний ПК-корпус.
Бывшая майнинговая плата AMD BC250, созданная на базе APU от PlayStation 5, внезапно стала находкой для бюджетных геймеров.
За ~120 $ на eBay и AliExpress продаются рабочие экземпляры, которые, после небольшой доработки, превращаются в мини-ПК под Linux и тянут GTA V (1440p, 65 fps) и Cyberpunk 2077 (1080p, 40 fps).
Внутри урезанный чип от PS5 (AMD BC250 APU) — 6 ядер Zen 2 до 3,5 ГГц и графика RDNA 2 с 24 CU, 16 ГБ GDDR6 на общей шине (8 системных + 8 видеопамяти). Плата запитывается через PCIe 8 pin, есть разъемы USB, DisplayPort и Ethernet, но нет разъема PCIe x16.
Производительность уровня Radeon RX 6600 по цене офисной затычки выглядит заманчиво. Главное — не забыть про охлаждение: подобные экс-майнеры изначально рассчитаны на стойки с мощным охлаждением, а не на домашний ПК-корпус.
1👍3💅1
🗓 Коротко о главных новостях за эту неделю
❗️ В блоге ServerFlow вышла новая статья о набирающем популярность ИИ-движке SGLang.
❗️ Мы также сделали подробный обзор свежей версии дистрибутива Linux Ubuntu 25.10 Questing Quokka.
❗️ Moonshot AI представила новую ИИ-модель Kimi K2 Thinking, которая обходит GPT-5 и Claude 4.5 Sonnet.
❗️ Google объявила о выходе в продакшен передовых TPU Ironwood и CPU Axion.
❗️ Разработчики из команды LMSYS выпустили ИИ-движок диффузионных моделей SGLang Diffusion.
❗️ Мы запилили новое видео с обзором на необычное китайское серверное шасси Gooxi.
Это новая рубрика на нашем канале, поддержите реакциями!
❗️ В блоге ServerFlow вышла новая статья о набирающем популярность ИИ-движке SGLang.
❗️ Мы также сделали подробный обзор свежей версии дистрибутива Linux Ubuntu 25.10 Questing Quokka.
❗️ Moonshot AI представила новую ИИ-модель Kimi K2 Thinking, которая обходит GPT-5 и Claude 4.5 Sonnet.
❗️ Google объявила о выходе в продакшен передовых TPU Ironwood и CPU Axion.
❗️ Разработчики из команды LMSYS выпустили ИИ-движок диффузионных моделей SGLang Diffusion.
❗️ Мы запилили новое видео с обзором на необычное китайское серверное шасси Gooxi.
ServerFlow
SGLang vs vLLM: новый движок инференса LLM и почему он быстрее TensorRT-LLM | Блог Serverflow
2👍9 2💅1
🦘 Intel Arc Pro И60 внезапно вышли в розницу в Австралии
Вслед за выходом в продажу в Европе, профессиональные видеокарты Intel Arc Pro B60, в том числе версия с пассивным охлаждением от ASRock, которая ранее числилась “только для бизнеса”, заметили в интернет-магазинах Австралии.
Напомним, что Arc Pro B60 относится к серии Battlemage, имеет 24 ГБ GDDR6 на 192 бит и четыре DisplayPort 2.1, форм-фактор — однослотовый. У решения есть и версия с активным охлаждением Arc Pro B60 Creator, а также двухчиповая вариация Maxsun Arc Pro B60 Dual 48G Turbo (48 ГБ GDDR6) под рабочие станции и ИИ-задачи.
Цены на Intel Arc Pro B60 — от ~$531 до $1 534 (в пересчете с автралийских долларов).
Вслед за выходом в продажу в Европе, профессиональные видеокарты Intel Arc Pro B60, в том числе версия с пассивным охлаждением от ASRock, которая ранее числилась “только для бизнеса”, заметили в интернет-магазинах Австралии.
В частности, магазин Scorptec открыл розничные заказы Arc Pro B60, а первые поставки обещаны к концу ноября.
Напомним, что Arc Pro B60 относится к серии Battlemage, имеет 24 ГБ GDDR6 на 192 бит и четыре DisplayPort 2.1, форм-фактор — однослотовый. У решения есть и версия с активным охлаждением Arc Pro B60 Creator, а также двухчиповая вариация Maxsun Arc Pro B60 Dual 48G Turbo (48 ГБ GDDR6) под рабочие станции и ИИ-задачи.
Возможно, эти решения также поступят в открытую продажу, что коррелирует с релизом в Европе и Австралии.
Цены на Intel Arc Pro B60 — от ~$531 до $1 534 (в пересчете с автралийских долларов).
👍2
This media is not supported in your browser
VIEW IN TELEGRAM
🔥 Теперь понятно, как Nvidia стала самой дорогой компанией в мире
Молодой Дженсен еще в 2009 году поучаствовал в интервью, где сделал несколько судьбоносных пророчеств похлеще любой Ванги.
Спустя 16 лет все произошло именно так, как предсказывал Хуанг — GPU действительно стали фундаментом современных вычислений, а ванильные CPU ушли на второй план.
Но в чем-то Хуанг был не прав — Nvidia все-таки начала производить собственные CPU Grace и разрабатывая грядущие Vera, в каком-то роде став полноценным конкурентом Intel, превзойдя синих даже в этом секторе, уже не говоря о направлении GPU.
И нет, Дженсен не владеет никакой древней китайской магией 🔮 — только четкий расчет и умение видеть перспективные ниши. С таким CEO любая компания может стать лидером рынка.
Молодой Дженсен еще в 2009 году поучаствовал в интервью, где сделал несколько судьбоносных пророчеств похлеще любой Ванги.
Спустя 16 лет все произошло именно так, как предсказывал Хуанг — GPU действительно стали фундаментом современных вычислений, а ванильные CPU ушли на второй план.
Но в чем-то Хуанг был не прав — Nvidia все-таки начала производить собственные CPU Grace и разрабатывая грядущие Vera, в каком-то роде став полноценным конкурентом Intel, превзойдя синих даже в этом секторе, уже не говоря о направлении GPU.
И нет, Дженсен не владеет никакой древней китайской магией 🔮 — только четкий расчет и умение видеть перспективные ниши. С таким CEO любая компания может стать лидером рынка.
1👍5
❌ Производство Baikal M сворачивают в Калининграде
В Калининградской области на фабрике GS Nanotech три года испытывали корпусирование SoC Baikal M. Удалось добиться 74-85% рабочих чипов на этапе финальной сборки, когда кристалл помещают в корпус и припаивают контакты.
Из-за это было принято решение приостановить проект, и теперь ждать массовых поставок Baikal M в ближайшее время точно не стоит.
Тем не менее, генеральный директор “Байкал Электроникс” Андрей Евдокимов считает эксперимент удачным и называет его “шагом вперед”.
В Калининградской области на фабрике GS Nanotech три года испытывали корпусирование SoC Baikal M. Удалось добиться 74-85% рабочих чипов на этапе финальной сборки, когда кристалл помещают в корпус и припаивают контакты.
Несмотря на то, что на эту фабрики возлагали большие надежды, для серийного выпуска с КПД ~98% требовалось в разы больше кристаллов, которых просто нет — ранее их изготавливали на заводах TSMC, но из-за санкционных ограничений кристаллы делать перестали, а производство так и не переехало.
Из-за это было принято решение приостановить проект, и теперь ждать массовых поставок Baikal M в ближайшее время точно не стоит.
Напомним, что Baikal M — это серия центральных Arm-процессоров, предназначенных для интеграции в десктопные системы потребительского и коммерческого сегмента рынка РФ.
Тем не менее, генеральный директор “Байкал Электроникс” Андрей Евдокимов считает эксперимент удачным и называет его “шагом вперед”.
1👍4🌭1