ServerFlow | Новости и Железо 💾
4.24K subscribers
4.92K photos
390 videos
12 files
2.4K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
ServerFlow | Новости и Железо 💾
🤖 Релиз GPT-5.4: больше контекста, выше бенчмарки, новые функции OpenAI представила новую флагманскую модель GPT-5.4, объединив возможности универсальной GPT-5.2 и GPT-5.3-Codex для кодинга. Главная фищка — режим computer use: модель может взаимодействовать…
Media is too big
VIEW IN TELEGRAM
К слову, юзеры уже активно демонстрируют возможности нейронки в кодинге, и они ничем не уступают GPT-5.3-Codex. Всего за 24 минуты энтузиаст смог нагенерить код играбельного клона Minecraft с минимальными доработками.
👍73
Хуанг планирует свернуть поставки H200 в Китай, так и не продав ни одного ускорителя 🤣

Судя по последним данным, CEO Nvidia уже отдал приказ о приостановке производства новых H200, так как все выпущенные и зарезервированные КНР ускорители просто пылятся на складе.

Причины все те же: Трамп дал добро на возобновление экспорта, но торговая комиссия США не выдала лицензию, а Китай тем временем давит на свои компании, призывая использовать отечественные ИИ-чипы.
1🤯42
This media is not supported in your browser
VIEW IN TELEGRAM
Вот такое интересное видео опубликовали Nvidia в X, отметив Dell. Как думаете, что же там?
👍22
🍏 Apple под шумок убрала Mac Studio с 512 ГБ и подняла ценник на версии с 256 ГБ

Apple убрала из конфигуратора Mac Studio M3 Ultra вариант с 512 ГБ унифицированной памяти. Теперь максимальная доступная конфигурация — 256 ГБ RAM. Ранее апгрейд до 512 ГБ стоил около $4 000, но теперь эта конфигурация исчезла, а версии с 256 ГБ памяти стали дороже примерно на $400 (с $3 499 до $3 899).
🤯531
This media is not supported in your browser
VIEW IN TELEGRAM
🔐 OpenAI запускает Codex Security — ИИ-агент для поиска уязвимостей в коде

Сэм Альтман, ни разу не подсмотрев идею у Anthropic, создал нового ИИ-агента Codex Security, который помогает искать дыры в программном обеспечении. Система сама анализирует репозиторий, строит контекст проекта, ищет сложные уязвимости в коде, проверяет их, приоритезирует и предлагает патчи для исправления.

Подозрительные баги она может проверять в изолированной среде, чтобы отличить реальные уязвимости от ложных срабатываний, а затем предлагает исправления, учитывающие архитектуру системы.

В тестовой группе за последние 30 дней Codex Security просканировал более 1,2 млн коммитов, обнаружив 792 критические уязвимости и 10 561 проблемы высокой серьезности. При этом критические баги встречались менее чем в 0,1% проверенных изменений.

Сейчас продукт запущен в режиме research preview для пользователей ChatGPT Enterprise, Business и Education.
2
Хуанг решил в очередной раз покичиться, насколько крута архитектура Blackwell в инференсе ИИ. Чтобы доказать это всему миру, он сравнил показатели инференса DeepSeek‑V3.2 + TensorRT LLM на ИИ-ускорителях Nvidia GB200 NVFP4/FP8 в стойке NVL72 с…(барабанная дробь 🥁) Nvidia H200 FP8, торжественно отчитавшись о 16-кратном приросте пропускной способности и снижении задержек в 2,5 раз. Может кто-нибудь уже скажет ему, что Nvidia H200 вышли 2 года назад?
13
🎉 Релиз vLLM 0.17.0: FlashAttention 4, поддержка Qwen3.5 и многое другое

Команда vLLM выпустила версию 0.17.0 — одно из крупнейших обновлений движка инференса.

Главные изменения: интеграция FlashAttention 4, поддержка моделей Qwen3.5 с архитектурой Gated Delta Networks и масштабная переработка системы Model Runner V2 с параллельным конвейером и декодированием контекста.

Добавлены оптимизации под новые GPU поколения NVIDIA SM100 и SM120 с поддержкой MXFP8 и FP8 GEMM, а для AMD объединен стек ROCm + AITER. В ядре появились FlashInfer Sparse MLA, Triton-ядра для top-k/top-p выборки и ускоренный маршрутизатор TRTLLM DSV3 GEMM, который дает около +6% производительности при пакетной обработке.


Добавили новый флаг режима работы: balanced, latency-oriented или throughput-oriented. QLoRA-адаптеры теперь можно загружать напрямую без дополнительной сборки. Отдельно обновили стек до PyTorch 2.10 и добавили новые модели, включая Qwen3.5, Nemotron-embedding, Ovis 2.6 и потоковые ASR-модели.
👍21
⚡️ CXL захватывает ЦОД: SK Telecom готовит новую архитектуру ИИ-кластеров

SK Telecom (входит в SK Group) и разработчик интерконнект-решений Panmnesia договорились создать новую архитектуру ИИ-дата-центров, полностью состояющую из решений CXL (Compute Express Link). Партнерство было официально подписано на MWC 2026, цель — кратно повысить эффективность ИИ=инфраструктуры без наращивания количества GPU.

Компании предлагается отказаться от жесткой серверной схемы и разделить ресурсы на уровне стойки. CPU, GPU и память будут объединяться через CXL Fabric Switch, а не фиксироваться внутри одного сервера. Это позволит динамически распределять память и мощности ускорителей между задачами, повышая полезную нагрузку на железо и снижая эксплуатационные расходы на инфраструктуру. Еще один ключевой момент — замена сетевых обменов между GPU на прямые CXL-соединения.


Архитектуру планируют протестировать на реальных ИИ-нагрузках до конца года, после чего возможен переход к пилотным внедрениям.
👍31
Anthropic рассказала, какие профессии сможет заменить искусственный интеллект уже в ближайшее время. В зоне особого риска: программисты, финансовые аналитики и специалисты по работе с клиентами. Рабочие профессии, вроде инженеров, архитекторов, логистов и обслуживающего персонала. К слову, статистику собирали по запросам к Claude Code. Верим?
3
На китайских форумах активно обсуждают интересную тему вокруг DeepSeek. Юзеры повсеместно отмечают заметные улучшения возможностей веб-версии модели и мобильного приложения DeepSeek в программировании и математических задачах. Может, DeepSeek V4 уже вышел, а мы даже и не в курсе?
👍5
🇨🇳 YMTC представила новый SSD PC550 со скоростью до 10,5 ГБ/с

Китайский производитель памяти YMTC анонсировал новый потребительский SSD PC550 с интерфейсом PCIe 5.0 x4. Накопитель выходит в версиях 512 ГБ, 1 ТБ и 2 ТБ и рассчитан на массовый рынок ПК. Прайсы пока неизвестны.

Заявленная скорость достигает 10,5 ГБ/с на чтение и до 10 ГБ/с на запись, что заметно быстрее PCIe 4.0-решений, но ниже топовых PCIe 5.0 SSD, которые уже приближаются к ~14-15 ГБ/с.


PC550 использует собственную флеш-память YMTC и является вторым потребительским PCIe 5.0 SSD компании. Накопители поставляются в стандартном форм-факторе M.2 и рассчитаны на современные платформы с поддержкой PCIe 5.0, например новые поколения чипсетов AMD и Intel.
🤯2🌭1
🫡 “Я люблю ограничения”: глава NVIDIA объяснил, почему дефицит выгоден Nvidia

Дженсен Хуанг заявил, что текущие ограничения в цепочках поставок для индустрии ИИ на самом деле играют на руку Nvidia (а то мы не знали). По его словам, в условиях дефицита памяти, энергии и других критически важных ресурсов, компании вынуждены выбирать самые эффективные решения, а не экспериментировать с аналогичным оборудованием.
💩5👍1
Intel добавила новую видеокарту Arc Pro B70 на свой официальный сайт. Неужели скоро релиз нового профессионального GPU?
👍21
Изнутри нового Panther Lake-H 👀

В сети появились фото нового ноутбучного чипа Intel Core Ultra Series 3. В топовой конфигурации кристалл имеет 16 ядер (4 P-core Cougar Cove + 8 E-core Darkmont + 4 LP-E), интегрированную графику Arc Xe3-LPG до 12 Xe-ядер, а также отдельный NPU до 50 TOPS для локальных ИИ-задач. Поддерживаются LPDDR5X-9600 или DDR5-7200, до 128 ГБ памяти и до 20 линий PCIe в H-серии.
👍2