Новый режим Ultrafast замечен в логах Codex. Судя по всему, скоро OpenAI сделает сверхбыстрый инференс GPT-5.6 на мощностях Cerebras массово доступным.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🤯2💅1
Дженсен Хуанг заявил, что если бы не инвестиции SEGA в размере $5 миллионов, Nvidia, возможно, не существовала бы сегодня. В 1996 году Nvidia оказалась на грани банкротства из-за провального релиза своего первого графического процессора NV1 — GPU использовал непривычную на тот момент квадратичную технологию рендеринга (вместо традиционной треугольной), не имел поддержку DirectX и был несовместим с популярными системами.
Ситуацию спасла Sega, инвестирующая круглую сумму в молодую компанию, тем самым позволив команде Хуанга начать разработку следующего поколения графических чипов — NV3, более известных как RIVA 128, которые принесли Nvidia долгожданный коммерческих успех. С тех пор Nvidia, которая переросла своего спасителя, поддерживает компанию Sega, а Хуанг до сих пор благодарен японской корпорации и, в частности, ее бывшему генеральному директору Сеитиро Иримадзири.
😅 Канал Serverflow в MAX: Подписаться
Ситуацию спасла Sega, инвестирующая круглую сумму в молодую компанию, тем самым позволив команде Хуанга начать разработку следующего поколения графических чипов — NV3, более известных как RIVA 128, которые принесли Nvidia долгожданный коммерческих успех. С тех пор Nvidia, которая переросла своего спасителя, поддерживает компанию Sega, а Хуанг до сих пор благодарен японской корпорации и, в частности, ее бывшему генеральному директору Сеитиро Иримадзири.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍23💅2🤯1😡1
В YAML-файле в официальном GitHub репозитории AMD в разделе "клиенты" нашли упоминание Anthropic. Похоже, ИИ-компания планирует диверсифицировать свои вычислительные мощности, разбавив ИИ-ускорители Nvidia и Google решениями AMD. Хуангу вряд ли это понравится.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11 3💅2🤯1💩1
По данным китайских СМИ, компания CXMT начала выпускать огромные 600-мм кремниевые слитки для процессорных пластин аналогичного диаметра. При этом, компания TSMC планировала начать производство 600-мм слитков лишь в 2028-2029 годах. Китай — впереди планеты всей.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯13 6👍4💩1💅1
По данным Bloomberg, Apple отказывается от производства линейки ИИ-станций Mac Pro. Ранее инженеры Apple активно разрабатывали новые Mac Pro на базе чипов M2 Extreme и M3 Extreme, Mac Pro под кодовым названием J170 на базе x86-чипов Intel и ИИ-станцию из той же линейки на базе процессоров M3 Ultra, но ни одно из устройств так и не вышло — компания прекратило производство ИИ-ПК этого семейства в марте 2026. Скорее всего, Apple перебросит все усилия на разработку нового поколения процессоров M Ultra для решений линейки Mac Studio, а Mac Pro отправится в долгий ящик или вовсе сойдет с конвейеров навсегда.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5🍾2 2🌭1
ServerFlow | Новости и Железо 💾
💡 LLM прямо на кремний? Стартап Taalas привлек $169 млн инвестиций Стартап Taalas закрыл первый раунд финансирования на $169 млн долларов. Суммарно компания привлекла более $200 млн благодаря своим ускорителям, заточенным под конкретные ИИ-модели Дебютный…
По данным The Information, Google разрабатывает новый тип ИИ-чипов, подобный решениям компании Taalas, где веса ИИ-модели и поддержка нейросети обеспечивается на аппаратном уровне, что позволяет запускать даже крупные LLM с огромной скоростью инференса.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10 2💅1
Твиттерский поставил на свою на RTX 4060 огромный 2.5 килограмовый алюминиевый радиатор, чтобы отводить 115 Вт тепла. Зато не шумит 🫠
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍20🤯6💩2💅1
По данным инсайдеров, Apple наняла Линь Цзюньяна и его команду (первые разработчики ИИ-моделей Qwen) для адаптации платформ Apple Intelligence под китайский рынок, интегрировав Qwen вместо Gemini.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾11 5🌭1😡1
Microsoft планирует добавить Kimi K3 в Copilot и облако Azure, чтобы протестировать функциональность китайской LLM и сравнить ее возможности с решениями OpenAI и Anthropic.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍15🍾7💅2 1
ServerFlow | Новости и Железо 💾
Китайцы начали делать материнские платы для Intel Xeon Max. На фото модель Kontron K9051-C741 ATX. Идея отличная, вот только жаль, что Xeon Max стоят целое состояние... 😅 Канал Serverflow в MAX: Подписаться
Передовые центральные процессоры Intel Xeon Max с интегрированной памятью HBM2E объемом 64 ГБ определенно пользуются спросом в КНР. Помимо оригинальных чипов и материнских плат местного производства, в Китае начали выплывать даже инженерные образцы необычных CPU. Судя по всему, это ранняя версия топового чипа Intel Xeon Max 9480 с повышенной базовой тактовой частотой до 2.3 ГГц (вместо 1.9 ГГц), ввиду чего чип по характеристикам больше напоминает флагманский Platinum 8480+, с которым Xeon Max делит одну архитектуру Sapphire Rapids. По всей видимости, чипы активно используются в суперкомпьютерной и ИИ-инфраструктуре Поднебесной.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍14🤯3
Энтузиаст нашел на Ebay доисторическое ископаемое — Intel Data Center Max GPU, полноценные ИИ-ускорители от Intel на архитектуре Ponte Vecchio, выпущенные в 2023 году. GPU имели до 128 ГБ VRAM HBM2E с пропускной способностью 3,28 ТБ/с на шине 1024 бит, 408 МБ встроенной SRAM-памяти на уровне L2-кэша, 128 Xe-ядер и частоту до 1,6 ГГц. Ускорители обеспечивали до 52 TFLOPS в FP32, 210 TFLOPS в FP16 и 420 TFLOPS в INT8 (поддержка FP8 отсутствовала), что на порядок меньше, чем у Nvidia A100, которые вышли на несколько лет раньше — такое внушительное отставание, а также высокая стоимость корпоративных GPU Intel ($15 000 на выходе), буквально похоронили эту линейку, ввиду чего синяя компания надолго отложила планы о разработке новой High-End графики.
Энтузиаст решил препарировать ускоритель, чтобы добраться до GPU-чипа. Он отмечает, что Intel не пожалела припоя, ввиду чего теплораспределительную крышку пришлось буквально отрывать, и это нарушило подачу питания.
😅 Канал Serverflow в MAX: Подписаться
Энтузиаст решил препарировать ускоритель, чтобы добраться до GPU-чипа. Он отмечает, что Intel не пожалела припоя, ввиду чего теплораспределительную крышку пришлось буквально отрывать, и это нарушило подачу питания.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10 8💅4🤯2
Энтузиасты из команд MSI Afterburner, RTSS и HWINFO создали софт для отслеживания температуры чипов GDDR7 в видеокартах RTX 50 — датчики для отслеживания этих данных были заблокированы Nvidia на аппаратном уровне. Пока что ПО не показывает расположение греющихся чипов памяти, а на некоторых GPU телеметрия выводится парно сразу на два модуля GDDR, но скоро это исправят.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯16🍾7👍2 2
По данным Bloomberg, китайская компания Z.ai завершила строительство дата-центра мощностью 1 ГВт, который работает полностью на отечественных ИИ-ускорителях (предположительно, Huawei Ascend) без использования GPU NVIDIA. Z.ai уже эксплуатирует несколько вычислительных кластеров с более чем 10 000 ускорителей в каждом, при этом реальная производительность этих систем пока не раскрыта. Есть предположения, что следующее поколение ИИ-моделей компании (GLM-5.3 или GLM-5.5) будет обучено на мощностях именно этого ЦОД.
🍾19👍9🤯8
По данным китайских СМИ, министерство торговли Китая в данный момент активно обсуждает с ИИ-компаниями, в том числе с Alibaba, ByteDance и Z.ai, возможность прекращения публикации открытых весов флагманских ИИ-моделей, при этом сохранив доступ к использованию нейронок через API и облачные интерфейсы. Надеемся, что товарищ Си сжалится и не станет идти на такие меры...
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯19💩9💅1 1
Идентификатор "gemini-3.6-flash-tiered" появился в логах Antigravity. Забудьте про Gemini 3.5 Pro, похоже, нас ждет релиз совершенно новой модели 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12🤯3🍾2 2💅1