🤖 Релиз GPT-5.4: больше контекста, выше бенчмарки, новые функции
OpenAI представила новую флагманскую модель GPT-5.4, объединив возможности универсальной GPT-5.2 и GPT-5.3-Codex для кодинга.
Главная фищка — режим computer use: модель может взаимодействовать с программами через GUI, читать скриншоты, заполнять формы и выполнять действия на компьютере как агент. GPT-5.4 уже стала моделью по умолчанию в ChatGPT и API, а версия GPT-5.4-pro доступна подписчикам платной подписки.
Также добавили режим рассуждений xhigh для сложных задач и систему tool search, где модель динамически выбирает нужные инструменты вместо подключения всего набора сразу.
OpenAI представила новую флагманскую модель GPT-5.4, объединив возможности универсальной GPT-5.2 и GPT-5.3-Codex для кодинга.
Главная фищка — режим computer use: модель может взаимодействовать с программами через GUI, читать скриншоты, заполнять формы и выполнять действия на компьютере как агент. GPT-5.4 уже стала моделью по умолчанию в ChatGPT и API, а версия GPT-5.4-pro доступна подписчикам платной подписки.
Контекст вырос до 1,05 млн токенов, а агентные сценарии заметно ускорились. В OSWorld-Verified точность поднялась с 47,3% до 75%, в BrowseComp — с 65,8% до 82,7%, в GDPval — до 83%, при этом на SWE-Bench Pro рост более умеренный.
Также добавили режим рассуждений xhigh для сложных задач и систему tool search, где модель динамически выбирает нужные инструменты вместо подключения всего набора сразу.
👍3 1 1
ServerFlow | Новости и Железо 💾
🤖 Релиз GPT-5.4: больше контекста, выше бенчмарки, новые функции OpenAI представила новую флагманскую модель GPT-5.4, объединив возможности универсальной GPT-5.2 и GPT-5.3-Codex для кодинга. Главная фищка — режим computer use: модель может взаимодействовать…
Media is too big
VIEW IN TELEGRAM
К слову, юзеры уже активно демонстрируют возможности нейронки в кодинге, и они ничем не уступают GPT-5.3-Codex. Всего за 24 минуты энтузиаст смог нагенерить код играбельного клона Minecraft с минимальными доработками.
👍7 3
Хуанг планирует свернуть поставки H200 в Китай, так и не продав ни одного ускорителя 🤣
Судя по последним данным, CEO Nvidia уже отдал приказ о приостановке производства новых H200, так как все выпущенные и зарезервированные КНР ускорители просто пылятся на складе.
Причины все те же: Трамп дал добро на возобновление экспорта, но торговая комиссия США не выдала лицензию, а Китай тем временем давит на свои компании, призывая использовать отечественные ИИ-чипы.
Судя по последним данным, CEO Nvidia уже отдал приказ о приостановке производства новых H200, так как все выпущенные и зарезервированные КНР ускорители просто пылятся на складе.
Причины все те же: Трамп дал добро на возобновление экспорта, но торговая комиссия США не выдала лицензию, а Китай тем временем давит на свои компании, призывая использовать отечественные ИИ-чипы.
1🤯4 2
This media is not supported in your browser
VIEW IN TELEGRAM
Вот такое интересное видео опубликовали Nvidia в X, отметив Dell. Как думаете, что же там?
👍2 2
🍏 Apple под шумок убрала Mac Studio с 512 ГБ и подняла ценник на версии с 256 ГБ
Apple убрала из конфигуратора Mac Studio M3 Ultra вариант с 512 ГБ унифицированной памяти. Теперь максимальная доступная конфигурация — 256 ГБ RAM. Ранее апгрейд до 512 ГБ стоил около $4 000, но теперь эта конфигурация исчезла, а версии с 256 ГБ памяти стали дороже примерно на $400 (с $3 499 до $3 899).
Apple убрала из конфигуратора Mac Studio M3 Ultra вариант с 512 ГБ унифицированной памяти. Теперь максимальная доступная конфигурация — 256 ГБ RAM. Ранее апгрейд до 512 ГБ стоил около $4 000, но теперь эта конфигурация исчезла, а версии с 256 ГБ памяти стали дороже примерно на $400 (с $3 499 до $3 899).
🤯5 3 1
This media is not supported in your browser
VIEW IN TELEGRAM
🔐 OpenAI запускает Codex Security — ИИ-агент для поиска уязвимостей в коде
Сэм Альтман, ни разу не подсмотрев идею у Anthropic, создал нового ИИ-агента Codex Security, который помогает искать дыры в программном обеспечении. Система сама анализирует репозиторий, строит контекст проекта, ищет сложные уязвимости в коде, проверяет их, приоритезирует и предлагает патчи для исправления.
Подозрительные баги она может проверять в изолированной среде, чтобы отличить реальные уязвимости от ложных срабатываний, а затем предлагает исправления, учитывающие архитектуру системы.
В тестовой группе за последние 30 дней Codex Security просканировал более 1,2 млн коммитов, обнаружив 792 критические уязвимости и 10 561 проблемы высокой серьезности. При этом критические баги встречались менее чем в 0,1% проверенных изменений.
Сейчас продукт запущен в режиме research preview для пользователей ChatGPT Enterprise, Business и Education.
Сэм Альтман, ни разу не подсмотрев идею у Anthropic, создал нового ИИ-агента Codex Security, который помогает искать дыры в программном обеспечении. Система сама анализирует репозиторий, строит контекст проекта, ищет сложные уязвимости в коде, проверяет их, приоритезирует и предлагает патчи для исправления.
Подозрительные баги она может проверять в изолированной среде, чтобы отличить реальные уязвимости от ложных срабатываний, а затем предлагает исправления, учитывающие архитектуру системы.
В тестовой группе за последние 30 дней Codex Security просканировал более 1,2 млн коммитов, обнаружив 792 критические уязвимости и 10 561 проблемы высокой серьезности. При этом критические баги встречались менее чем в 0,1% проверенных изменений.
Сейчас продукт запущен в режиме research preview для пользователей ChatGPT Enterprise, Business и Education.
Хуанг решил в очередной раз покичиться, насколько крута архитектура Blackwell в инференсе ИИ. Чтобы доказать это всему миру, он сравнил показатели инференса DeepSeek‑V3.2 + TensorRT LLM на ИИ-ускорителях Nvidia GB200 NVFP4/FP8 в стойке NVL72 с…(барабанная дробь 🥁) Nvidia H200 FP8, торжественно отчитавшись о 16-кратном приросте пропускной способности и снижении задержек в 2,5 раз. Может кто-нибудь уже скажет ему, что Nvidia H200 вышли 2 года назад?
1 3
🎉 Релиз vLLM 0.17.0: FlashAttention 4, поддержка Qwen3.5 и многое другое
Команда vLLM выпустила версию 0.17.0 — одно из крупнейших обновлений движка инференса.
Главные изменения: интеграция FlashAttention 4, поддержка моделей Qwen3.5 с архитектурой Gated Delta Networks и масштабная переработка системы Model Runner V2 с параллельным конвейером и декодированием контекста.
Добавили новый флаг режима работы: balanced, latency-oriented или throughput-oriented. QLoRA-адаптеры теперь можно загружать напрямую без дополнительной сборки. Отдельно обновили стек до PyTorch 2.10 и добавили новые модели, включая Qwen3.5, Nemotron-embedding, Ovis 2.6 и потоковые ASR-модели.
Команда vLLM выпустила версию 0.17.0 — одно из крупнейших обновлений движка инференса.
Главные изменения: интеграция FlashAttention 4, поддержка моделей Qwen3.5 с архитектурой Gated Delta Networks и масштабная переработка системы Model Runner V2 с параллельным конвейером и декодированием контекста.
Добавлены оптимизации под новые GPU поколения NVIDIA SM100 и SM120 с поддержкой MXFP8 и FP8 GEMM, а для AMD объединен стек ROCm + AITER. В ядре появились FlashInfer Sparse MLA, Triton-ядра для top-k/top-p выборки и ускоренный маршрутизатор TRTLLM DSV3 GEMM, который дает около +6% производительности при пакетной обработке.
Добавили новый флаг режима работы: balanced, latency-oriented или throughput-oriented. QLoRA-адаптеры теперь можно загружать напрямую без дополнительной сборки. Отдельно обновили стек до PyTorch 2.10 и добавили новые модели, включая Qwen3.5, Nemotron-embedding, Ovis 2.6 и потоковые ASR-модели.
👍2 1
⚡️ CXL захватывает ЦОД: SK Telecom готовит новую архитектуру ИИ-кластеров
SK Telecom (входит в SK Group) и разработчик интерконнект-решений Panmnesia договорились создать новую архитектуру ИИ-дата-центров, полностью состояющую из решений CXL (Compute Express Link). Партнерство было официально подписано на MWC 2026, цель — кратно повысить эффективность ИИ=инфраструктуры без наращивания количества GPU.
Архитектуру планируют протестировать на реальных ИИ-нагрузках до конца года, после чего возможен переход к пилотным внедрениям.
SK Telecom (входит в SK Group) и разработчик интерконнект-решений Panmnesia договорились создать новую архитектуру ИИ-дата-центров, полностью состояющую из решений CXL (Compute Express Link). Партнерство было официально подписано на MWC 2026, цель — кратно повысить эффективность ИИ=инфраструктуры без наращивания количества GPU.
Компании предлагается отказаться от жесткой серверной схемы и разделить ресурсы на уровне стойки. CPU, GPU и память будут объединяться через CXL Fabric Switch, а не фиксироваться внутри одного сервера. Это позволит динамически распределять память и мощности ускорителей между задачами, повышая полезную нагрузку на железо и снижая эксплуатационные расходы на инфраструктуру. Еще один ключевой момент — замена сетевых обменов между GPU на прямые CXL-соединения.
Архитектуру планируют протестировать на реальных ИИ-нагрузках до конца года, после чего возможен переход к пилотным внедрениям.
👍3 1
Anthropic рассказала, какие профессии сможет заменить искусственный интеллект уже в ближайшее время. В зоне особого риска: программисты, финансовые аналитики и специалисты по работе с клиентами. Рабочие профессии, вроде инженеров, архитекторов, логистов и обслуживающего персонала. К слову, статистику собирали по запросам к Claude Code. Верим?
🇨🇳 YMTC представила новый SSD PC550 со скоростью до 10,5 ГБ/с
Китайский производитель памяти YMTC анонсировал новый потребительский SSD PC550 с интерфейсом PCIe 5.0 x4. Накопитель выходит в версиях 512 ГБ, 1 ТБ и 2 ТБ и рассчитан на массовый рынок ПК. Прайсы пока неизвестны.
PC550 использует собственную флеш-память YMTC и является вторым потребительским PCIe 5.0 SSD компании. Накопители поставляются в стандартном форм-факторе M.2 и рассчитаны на современные платформы с поддержкой PCIe 5.0, например новые поколения чипсетов AMD и Intel.
Китайский производитель памяти YMTC анонсировал новый потребительский SSD PC550 с интерфейсом PCIe 5.0 x4. Накопитель выходит в версиях 512 ГБ, 1 ТБ и 2 ТБ и рассчитан на массовый рынок ПК. Прайсы пока неизвестны.
Заявленная скорость достигает 10,5 ГБ/с на чтение и до 10 ГБ/с на запись, что заметно быстрее PCIe 4.0-решений, но ниже топовых PCIe 5.0 SSD, которые уже приближаются к ~14-15 ГБ/с.
PC550 использует собственную флеш-память YMTC и является вторым потребительским PCIe 5.0 SSD компании. Накопители поставляются в стандартном форм-факторе M.2 и рассчитаны на современные платформы с поддержкой PCIe 5.0, например новые поколения чипсетов AMD и Intel.
🤯2🌭1
🫡 “Я люблю ограничения”: глава NVIDIA объяснил, почему дефицит выгоден Nvidia
Дженсен Хуанг заявил, что текущие ограничения в цепочках поставок для индустрии ИИ на самом деле играют на руку Nvidia (а то мы не знали). По его словам, в условиях дефицита памяти, энергии и других критически важных ресурсов, компании вынуждены выбирать самые эффективные решения, а не экспериментировать с аналогичным оборудованием.
Дженсен Хуанг заявил, что текущие ограничения в цепочках поставок для индустрии ИИ на самом деле играют на руку Nvidia (а то мы не знали). По его словам, в условиях дефицита памяти, энергии и других критически важных ресурсов, компании вынуждены выбирать самые эффективные решения, а не экспериментировать с аналогичным оборудованием.
💩5👍1