Тибо из OpenAI намекает, что ChatGPT может временно приостановить выдачу новых подписок Pro, если спрос на GPT-6 Astra продолжит расти.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7💩5
Qualcomm и Amazon заключили многолетнее соглашение о разработке нескольких поколений кастомных чипов для AWS, ориентированных прежде всего на крупномасштабный ИИ-инференс. Параллельно компании создадут оптические системы связи до 1,6 Тбит/с и выше, чтобы масштабировать обмен данными внутри будущих ИИ-кластеров.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5💩2
Соучредитель Google Сергей Брин оказывает все большее влияние на проект Gemini и настойчиво призывает команды работать быстрее, сокращать бюрократию и уделять больше внимания рекурсивному самосовершенствованию, пока Google стремится совершить качественный скачок в Gemini 4.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13💩1
По оценке портала KB Securities, складские запасы готовой памяти DDR, LPDDR и GDDR у Samsung и SK hynix в третьем квартале этого сократились ниже уровня 10 дней поставок. Ограниченное предложение памяти уже отражается на потребительской электронике, а дефицит может сохраниться и в 2027 году. При этом Samsung и SK hynix получают стимул отдавать производственные мощности под более дорогие HBM для ИИ-ускорителей, еще сильнее сокращая доступный объем обычной памяти.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯7😡5👍3💩2
Китайская CXMT столкнулась с серьезными проблемами при испытательном производстве 8-слойной HBM3. По данным корейского ChosunBiz, выход годных изделий на раннем этапе держится примерно на 25%, тогда как ориентир для массового производства в отрасли составляет около 80%. Для сравнения, SK hynix, выпускающая HBM3 с 2022 года, достигла показателя выше 90%. Эти цифры основаны на отраслевых источниках, а не на раскрытых данных самой CXMT.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1💅10👍2
По данным СМИ, ИИ-модель DeepSeek V4.1 Flash официально выйдет уже завтра 🎉
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍16🌭3
К слову, после релиза DeepSeek V4.1 Flash, китайская ИИ-лаборатория должна также представить DeepSeek V4.1 Pro немногим позже 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾8
Мобильные версии Nova Lake с мощной графикой на 12 Xe-ядер, по данным инсайдера Golden Pig Upgrade Pack, могут официально поддерживать память DDR5-8000 через модельный форм-фактор CSO-DIMM. Это важное отличие от большинства современных процессоров для тонких ноутбуков, где LPDDR5X распаяна на плате и заменить или увеличить память после покупки нельзя.
CSO-DIMM сохраняет компактный формат модулей памяти для ноутбуков, но позволяет устанавливать и менять оперативную память почти как на ПК. Для сравнения, нынешний Panther Lake с 12 Xe официально DDR5 не поддерживает, хотя ASRock Industrial уже выпускает системы на Core Ultra X7 358H с двумя слотами DDR5-7200. У Nova Lake такой подход могут поднять скорость 8 000 MT/s, что особенно интересно для систем с мощной встроенной графикой, которая использует общую оперативную память.
При этом информация пока не подтверждена Intel.
😅 Канал Serverflow в MAX: Подписаться
CSO-DIMM сохраняет компактный формат модулей памяти для ноутбуков, но позволяет устанавливать и менять оперативную память почти как на ПК. Для сравнения, нынешний Panther Lake с 12 Xe официально DDR5 не поддерживает, хотя ASRock Industrial уже выпускает системы на Core Ultra X7 358H с двумя слотами DDR5-7200. У Nova Lake такой подход могут поднять скорость 8 000 MT/s, что особенно интересно для систем с мощной встроенной графикой, которая использует общую оперативную память.
При этом информация пока не подтверждена Intel.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
OpenAI заявила о совместной разработке ИИ-чипов следующего поколения с Samsung Electronics. Сейчас первый инференс-ускоритель компании Jalapeño производится на мощностях TSMC, а разработкой OpenAI занимается вместе с Broadcom. Если Samsung действительно станет вторым производственным партнером, OpenAI сможет распределить выпуск между двумя крупнейшими передовыми фабриками по выпуску чипов.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5
Компания Google DeepMind тестирует новую ИИ-модель Nano Banana 2.5 под кодовым названием “spicy-mayo” на Image Arena 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9🍾1
HP выпустила рабочую ИИ-станцию ZGX Fury на базе NVIDIA GB300. Система рассчитана на локальный инференс и дообучение ИИ, выдавая до 20 PFLOPS в FP4 и обеспечивая до 748 ГБ когерентной памяти. HP заявляет поддержку инференса моделей класса до 1 трлн параметров.
Внутри: 72-ядерный Arm Neoverse V2 Grace, Blackwell Ultra с 252 ГБ HBM3e с пропускной способностью памяти 7,1 ТБ/с, плюс 496 ГБ LPDDR5X в системе. Для хранения доступны слоты NVMe M.2, а также доступен слот PCIe 5.0 x16 для интеграции дополнительной RTX 6000 PRO. Для создания кластера в систему интегрирована сетевая карта Connect-X 8 с 2 портами по 400 Гбит/с.
HP также объединяет станцию с софтом Red Hat AI Factory, Red Hat Enterprise Linux и OpenShift, чтобы запускать модели и агентов локально, а затем управлять теми же рабочими процессами в гибридном облаке.
😅 Канал Serverflow в MAX: Подписаться
Внутри: 72-ядерный Arm Neoverse V2 Grace, Blackwell Ultra с 252 ГБ HBM3e с пропускной способностью памяти 7,1 ТБ/с, плюс 496 ГБ LPDDR5X в системе. Для хранения доступны слоты NVMe M.2, а также доступен слот PCIe 5.0 x16 для интеграции дополнительной RTX 6000 PRO. Для создания кластера в систему интегрирована сетевая карта Connect-X 8 с 2 портами по 400 Гбит/с.
HP также объединяет станцию с софтом Red Hat AI Factory, Red Hat Enterprise Linux и OpenShift, чтобы запускать модели и агентов локально, а затем управлять теми же рабочими процессами в гибридном облаке.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11
DeepSeek официально выпустила DeepSeek V4.1 Flash — младшую модель нового поколения нейронок с 552 млрд параметров против 284 млрд у предыдущей DeepSeek V4-Flash.
Модель получила нативное мультимодальное понимание изображений, контекст до 1 млн токенов и заметно усилилась в агентном программировании. На Terminal-Bench 4.0 она набирает 31,2% против 7% у V4-Flash-0731, а на DeepSWE v1.1 — 74,2% против 54,4%. При этом до более сильных моделей пока далеко: GPT-6 Astra показывает 57,9%, Claude Fable 5.1 — 55,8% на Terminal-Bench 4.0.
Вне пиковых часов миллион входных токенов без попадания в кэш API модели стоит $0,15, выходных — $0,60, а повторное чтение уже закэшированного контекста всего $0,003. Это на 57% дешевле предыдущего тарифа для кэширования.
DeepSeek заявляет, что V4.1 Flash превосходит V4 Pro по производительности, стоимости, скорости и общему времени выполнения задач. После запуска запросы к V4 Pro временно будут автоматически направляться на V4.1 Flash и оплачиваться по тарифу Flash, пока не выйдет V4.1 Pro.
DeepSeek V4.1 Flash уже доступна на Hugging Face.
😅 Канал Serverflow в MAX: Подписаться
Модель получила нативное мультимодальное понимание изображений, контекст до 1 млн токенов и заметно усилилась в агентном программировании. На Terminal-Bench 4.0 она набирает 31,2% против 7% у V4-Flash-0731, а на DeepSWE v1.1 — 74,2% против 54,4%. При этом до более сильных моделей пока далеко: GPT-6 Astra показывает 57,9%, Claude Fable 5.1 — 55,8% на Terminal-Bench 4.0.
Вне пиковых часов миллион входных токенов без попадания в кэш API модели стоит $0,15, выходных — $0,60, а повторное чтение уже закэшированного контекста всего $0,003. Это на 57% дешевле предыдущего тарифа для кэширования.
DeepSeek заявляет, что V4.1 Flash превосходит V4 Pro по производительности, стоимости, скорости и общему времени выполнения задач. После запуска запросы к V4 Pro временно будут автоматически направляться на V4.1 Flash и оплачиваться по тарифу Flash, пока не выйдет V4.1 Pro.
DeepSeek V4.1 Flash уже доступна на Hugging Face.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10
Media is too big
VIEW IN TELEGRAM
Обзорщики начали получать топовые рабочие ИИ-станции на базе Nvidia GB300. Вот, например, коллеги из StorageReview показали свою систему XpertStation WS300 от MSI за $100 000+.
Удивительно наблюдать, в какую сторону концепция ПК начала меняться в 2026 году — теперь нейровкатунам нужны не видюхи, а суперкомпьютеры в настольном корпусе.
😅 Канал Serverflow в MAX: Подписаться
Удивительно наблюдать, в какую сторону концепция ПК начала меняться в 2026 году — теперь нейровкатунам нужны не видюхи, а суперкомпьютеры в настольном корпусе.
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍16
JD Cloud объявила о планах создать кластер из 100 000 полнофункциональных GPU компании Moore Threads. Система будет использоваться для обучения и инференса крупных моделей, при этом вычислительные ресурсы планируют предоставлять компаниям из разных отраслей.
Какие именно GPU получит кластер, пока не раскрыто. Самый современный ускоритель Moore Threads — MTT S5000 на архитектуре PingHu с чипом PH100: он поддерживает вычисления от FP8 до FP64, рассчитан на обучение и инференс больших моделей и может объединяться в 8-GPU серверы через собственный интерконнект MTLink. Производитель также заявляет масштабирование до кластеров на 10 000 GPU с эффективностью до 95% от линейного масштабирования, но эти показатели получены в собственных тестах Moore Threads.
😅 Канал Serverflow в MAX: Подписаться
Какие именно GPU получит кластер, пока не раскрыто. Самый современный ускоритель Moore Threads — MTT S5000 на архитектуре PingHu с чипом PH100: он поддерживает вычисления от FP8 до FP64, рассчитан на обучение и инференс больших моделей и может объединяться в 8-GPU серверы через собственный интерконнект MTLink. Производитель также заявляет масштабирование до кластеров на 10 000 GPU с эффективностью до 95% от линейного масштабирования, но эти показатели получены в собственных тестах Moore Threads.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Nvidia снова попала под проверку антимонопольной службы — в этот раз Хуанг под прицелом из-за сделки о покупке Groq. Минюст США считает, что Nvidia могла оформить сделку так, чтобы это не нарушало антимонопольного законодательства и не требовало проверки соответствующих органов. Если подозрения подтвердятся, Nvidia ждут большие штрафы.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10