🤔 CXMT нацелилась на HBM3: до 20% мощностей будут переведены с DRAM в 2026 году
Китайская CXMT, по данным отраслевых источников, планирует в 2026 году направить около 20% своих линий производства DRAM на выпуск HBM3. Компания планирует выпускать до 60 000 пластин в месяц при общей мощности около 300 000 wpm.
Если планы подтвердятся, 2026 год станет точкой, когда HBM окончательно превратится в еще один стратегический ресурс Китая, прервав многолетний цикл дефицита высокоскоростной памяти в Поднебесной.
Китайская CXMT, по данным отраслевых источников, планирует в 2026 году направить около 20% своих линий производства DRAM на выпуск HBM3. Компания планирует выпускать до 60 000 пластин в месяц при общей мощности около 300 000 wpm.
Сообщается, что массовое производство HBM3 уже стартовало, а локальная кооперация с Huawei может поддержать спрос на фоне ограничений поставок Micron, Samsung и SK hynix. Для рынка это сигнал, что Китай ускоряет локализацию ИИ-памяти, хотя по срокам и выходу годных чипов многое будет зависеть от зрелости техпроцесса.
Если планы подтвердятся, 2026 год станет точкой, когда HBM окончательно превратится в еще один стратегический ресурс Китая, прервав многолетний цикл дефицита высокоскоростной памяти в Поднебесной.
1👍5
This media is not supported in your browser
VIEW IN TELEGRAM
Китайский юзер заснял сомовоспламенение видеокарты Nvidia RTX 5090. Прошлобольше года с релиза видюхи, но проблему питания 12V-2x6 так и не решили...
👍4😡3💩2
🔥 Релиз GLM-5: модель доступна бесплатно в веб-интерфейсе Zhipu AI
Флагманская китайская нейронка базируется на архитектуре MoE с 744 млрд параметров, из которых 40 млрд активны, что вдвое больше, чем у GLM-4.7 с 360 миллиардов параметров.
В тестах модель уверенно достигает уровня топовых проприетарных LLM, а в некоторых задачах даже обходит их: в бенчмарке SWE-bench verified она набирает 77.8 баллов, в HLE производительность достигает 50.4 баллов, в BrowseComp модель обеспечивает 75.9 баллов.
Юзеры, которые уже опробовали нейронку, отмечают ее высочайшую эффективность в кодинге, агентских задачах и генерации текста.
Флагманская китайская нейронка базируется на архитектуре MoE с 744 млрд параметров, из которых 40 млрд активны, что вдвое больше, чем у GLM-4.7 с 360 миллиардов параметров.
В тестах модель уверенно достигает уровня топовых проприетарных LLM, а в некоторых задачах даже обходит их: в бенчмарке SWE-bench verified она набирает 77.8 баллов, в HLE производительность достигает 50.4 баллов, в BrowseComp модель обеспечивает 75.9 баллов.
Юзеры, которые уже опробовали нейронку, отмечают ее высочайшую эффективность в кодинге, агентских задачах и генерации текста.
1 4
ServerFlow | Новости и Железо 💾
🔥 Релиз GLM-5: модель доступна бесплатно в веб-интерфейсе Zhipu AI Флагманская китайская нейронка базируется на архитектуре MoE с 744 млрд параметров, из которых 40 млрд активны, что вдвое больше, чем у GLM-4.7 с 360 миллиардов параметров. В тестах модель…
К слову, вот ценники GLM-5 в API. Всего $1 за млн входных и $3,2 за млн выходных токенов. Также есть немного более дорогой вариант GLM-5 Code с упором на программирование и агентские сценарии. Выходит в 8 раз дешевле, чем за новый Claude Opus 4.6 💸
1👍8
Похоже, что начался парад ИИ из Поднебесной в честь Китайского Нового года — пользователи сообщают, что DeepSeek запустила тест своей новой, флагманской LLM DeepSeek V4 в мобильном приложении. Модель сама подтверждает, что она является самой актуальной версией с расширенным контекстным окном в 1 млн токенов и обновленной базой знаний до мая 2025 года.
1🤯5🍾2😡1
🔍 Что внутри NVIDIA RTX 6000D?
Это особая линейка профессиональных видеокарт Nvidia для китайского рынка с урезанными характеристиками — объем памяти и количество вычислительных блоков было снижено, чтобы обойти экспортные ограничения.
За охлаждение отвечает медный радиатор, который продувается мощными вентиляторами, что характерно для серверного ускорителя. Имеется 28 чипов GDDR7 по 3 ГБ, суммарно обеспечивающие 84 ГБ (вместо 96 у оригинала) с шиной 448 бит. Ядер CUDA у чипа всего 19 968 против 24 064 ядер у полной версии.
Это особая линейка профессиональных видеокарт Nvidia для китайского рынка с урезанными характеристиками — объем памяти и количество вычислительных блоков было снижено, чтобы обойти экспортные ограничения.
NVIDIA RTX 6000D в КНР пользуются огромным спросом, поэтому никому не приходило в головую разобрать эту видюху и показать ее начинку. Однако компания GINNSOD все же решила показать, что же это за зверь такой и из чего он состоит.
За охлаждение отвечает медный радиатор, который продувается мощными вентиляторами, что характерно для серверного ускорителя. Имеется 28 чипов GDDR7 по 3 ГБ, суммарно обеспечивающие 84 ГБ (вместо 96 у оригинала) с шиной 448 бит. Ядер CUDA у чипа всего 19 968 против 24 064 ядер у полной версии.
1👍2
⚒️ openSIL вместо AGESA: прошивка AMD уже доступна для AM5
Инженеры портировали открытый программный стек openSIL на плату MSI PRO B850-P с сокетом AM5, запустив Coreboot с новой инициализацией процессоров AMD. Код выложен на GitHub, и это первая демонстрация openSIL на массовой AM5-платформе в преддверии Zen 6.
Для экосистемы это шаг к более прозрачной и модульной прошивке на x86, хотя до массовых релизов Zen 6 практической пользы немного.
Инженеры портировали открытый программный стек openSIL на плату MSI PRO B850-P с сокетом AM5, запустив Coreboot с новой инициализацией процессоров AMD. Код выложен на GitHub, и это первая демонстрация openSIL на массовой AM5-платформе в преддверии Zen 6.
Проект openSIL анонсировали в 2023 году как замену закрытого стека AGESA. openSIL построен как набор библиотек на C17 для инициализации кремния и платформы. Обычно открытая прошивка появляется примерно через квартал после релиза CPU, но AMD решила сделать все наоборот, что свидетельствует о скором выходе процессоров на новой архитектуре.
Для экосистемы это шаг к более прозрачной и модульной прошивке на x86, хотя до массовых релизов Zen 6 практической пользы немного.
1👍2
👕 FLEXI: гибкий чип для “умной одежды” дешевле $1
Китайские исследователи представили FLEXI — гибкий чип на базе технологии In-Memory Computing, где обработка данных идет прямо в ячейках памяти.
Частота FLEXI достигает 12,5 МГц при энергопотреблении около 2,52 мВт, а гибкость позволяет использовать его в области “умной одежды” и периферийных IoT для медицины с батарейным питанием. Перенос вычислений в память снижает трафик между логикой и DRAM, что дает выигрыш по задержкам.
Китайские исследователи представили FLEXI — гибкий чип на базе технологии In-Memory Computing, где обработка данных идет прямо в ячейках памяти.
Сообщается, что устройство изготовлено без использования высокотемпературной литографии на пластиковой подложке, он стоит менее $1 и выдерживает более 40 000 циклов сгибания с сохранением надежности до шести месяцев.
Частота FLEXI достигает 12,5 МГц при энергопотреблении около 2,52 мВт, а гибкость позволяет использовать его в области “умной одежды” и периферийных IoT для медицины с батарейным питанием. Перенос вычислений в память снижает трафик между логикой и DRAM, что дает выигрыш по задержкам.
1👍3
Сегодня у нас на обзоре Voxtral Mini 4B Real-Time – STT модель, которая работает в Live режиме!
- Задержка вывода текста с речи менее, чем за 500 миллисекунд
- Поддержка 13 языков (включая русский!)
- Создание субтитров в прямом эфире
Это и многое другое вы узнаете в новом видео!
Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://www.youtube.com/watch?v=RLEnh-cv-_4
Please open Telegram to view this post
VIEW IN TELEGRAM
YouTube
Voxtral Mini 4B Real-Time: STT модель работающая в Live режиме. Полный гайд по установке и тесты.
В данном ролике рассмотрим Voxtral Mini 4B Real-Time. Это новинка от компании Mistral, speech to text мультиязычная модель, работающая в режиме реального времени с задержкой менее 500 мс.
Выполним поэтапную установку модели, а после посмотрим, как хорошо…
Выполним поэтапную установку модели, а после посмотрим, как хорошо…
1👍4
Облачная модель MiniMax 2.5 вышла в релиз, и сразу стала одной из самых продвинутых моделей для кодинга, анализа данных Excel, глубоких исследований и других востребованных задачах. При эквивалентной производительности, она даже обошла свежую Claude Opus 4.6 в скорости — китайский флагман работает в 3 раза быстрее, и при этом полностью бесплатен для юзеров. По цене в API тоже все отлично $0,3 за миллион входных и $1,2 за миллион выходных токенов (в 20 раз дешевле, чем у Opus 4.6).
👍5 1
Media is too big
VIEW IN TELEGRAM
💡 Gemini 3 Deep Think для науки и инженерии
Google представила обновление Gemini 3 Deep Think — специализированного режима для сложных задач в науке и R&D. Доступ уже открыт подписчикам Google AI Ultra в приложении Gemini, а также ограниченному кругу пользователей через Gemini API по программе раннего доступа.
Акцент сделан на задачах с неполными или противоречивыми данными, где нет единственно верного ответа: от математических исследований до моделирования физических систем в коде.
Google представила обновление Gemini 3 Deep Think — специализированного режима для сложных задач в науке и R&D. Доступ уже открыт подписчикам Google AI Ultra в приложении Gemini, а также ограниченному кругу пользователей через Gemini API по программе раннего доступа.
По заявлению компании, модель показывает 48,4% на бенчмарке Humanity's Last Exam без инструментов, 84,6 % на ARC-AGI-2, рейтинг 3455 Elo на Codeforces и уровень золотой медали на IMO 2025. В физике и химии сообщается о результатах на уровне золотых медалей профильных олимпиад 2025 года, а на CMT-Benchmark по теоретической физике — 50,5%.
Акцент сделан на задачах с неполными или противоречивыми данными, где нет единственно верного ответа: от математических исследований до моделирования физических систем в коде.