ServerFlow | Новости и Железо 💾
4.24K subscribers
4.91K photos
389 videos
12 files
2.39K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
💡 HBM4E выходит на новый уровень: Rambus представила контроллер с 16 Гбит/с на контакт

Компания Rambus Inc. анонсировала контроллер памяти HBM4E для ИИ-ускорителей следующего поколения. Решение рассчитано на скорость до 16 Гбит/с на контакт, что дает около 4,1 ТБ/с пропускной способности на один стек памяти.

При конфигурации с 8-стековыми HBM4E модулями суммарная пропускная способность может превышать 32 ТБ/с, что напрямую нацелено на задачи обучения и инференса больших моделей ИИ. Поддерживается интеграция в 2.5D и 3D-упаковке вместе с PHY-решениями и TSV-интерконнектами.


Реальные ИИ-ускорители с HBM4E появятся значительно позже, когда производители интегрируют этот контроллер в свое топовые железо. Решение уже доступно партнерам по программе раннего доступа.
👍1
Помните, как Sora от OpenAI стала хитом в области генеративного ИИ? Чтож, эти времена прошло, теперь балом правят открытые диффузионки из КНР.
51
TypeScript обошел Python и JavaScript и стал самым популярным языком программирования на GitHub. Все благодаря его универсальности — он подходит для бэкенда, фронтенда, мобильных приложений и, конечно же, его активно юзают для создания ИИ-агентов.
👍61
🔥 RTX 3060 может вернуться на рынок: NVIDIA готовит новые поставки GPU

По данным каналов поставок, компания NVIDIA планирует вновь запустить производство видеокарты GeForce RTX 3060. Ожидается, что новые партии GPU начнут поступать партнерам уже в середине марта 2026 года.

Пока не уточняется, какая именно версия вернется в продажу. Речь может идти как об оригинальной модели с 12 ГБ памяти GDDR6 и 192-битной шиной, так и о более поздней версии с 8 ГБ и 128-битной шиной памяти.

RTX 3060 была представлена в 2021 году и основана на архитектуре Ampere. Несмотря на возраст, карта остается одной из самых популярных моделей среднего сегмента, поэтому ее возвращение может быть связано с сохраняющимся спросом на доступные GPU.

Партнеры NVIDIA по производству видеокарт, вероятно, займутся выпуском собственных версий на основе новых поставок GPU и памяти. При этом ключевым фактором для успеха перезапуска станет цена, поскольку на рынке уже присутствуют более современные поколения видеокарт.
3👍1
Это Готфрид Свартольм, один из соучредителей The Pirate Bay — крупнейшего в мире BitTorrent-индексатора. Иногда гениальные (хоть и сомнительные) идеи рождаются в самой неожиданной обстановке.
17👍2
👿 ОС, написанная через ИИ, не справилась с главным тестом гиков — запуском Doom

В сети протестировали экспериментальную операционную систему Vib-OS, написанную с помощью вайб-кодинга с минимальными ручными доработками. Проверка показала неожиданный результат: система еле проходит базовые тесты и даже не может воспроизвести культовый тест для ОС и железа — игру Doom.

Vib-OS позиционируют как Unix-подобную систему с самописным ядром и поддержкой ARM64 и x86_64. Но на практике выяснилось, что сеть не работает, браузер по сути открывает только изображения, а ряд заявленных функций просто отсутствуют.


В итоге из девяти базовых проверок система набрала примерно 5 из 9, формально работает, но скорее как техническая демонстрация.
🤯6💩1🍾1
🤖 Релиз GPT-5.4: больше контекста, выше бенчмарки, новые функции

OpenAI представила новую флагманскую модель GPT-5.4, объединив возможности универсальной GPT-5.2 и GPT-5.3-Codex для кодинга.

Главная фищка — режим computer use: модель может взаимодействовать с программами через GUI, читать скриншоты, заполнять формы и выполнять действия на компьютере как агент. GPT-5.4 уже стала моделью по умолчанию в ChatGPT и API, а версия GPT-5.4-pro доступна подписчикам платной подписки.

Контекст вырос до 1,05 млн токенов, а агентные сценарии заметно ускорились. В OSWorld-Verified точность поднялась с 47,3% до 75%, в BrowseComp — с 65,8% до 82,7%, в GDPval — до 83%, при этом на SWE-Bench Pro рост более умеренный.


Также добавили режим рассуждений xhigh для сложных задач и систему tool search, где модель динамически выбирает нужные инструменты вместо подключения всего набора сразу.
👍311
ServerFlow | Новости и Железо 💾
🤖 Релиз GPT-5.4: больше контекста, выше бенчмарки, новые функции OpenAI представила новую флагманскую модель GPT-5.4, объединив возможности универсальной GPT-5.2 и GPT-5.3-Codex для кодинга. Главная фищка — режим computer use: модель может взаимодействовать…
Media is too big
VIEW IN TELEGRAM
К слову, юзеры уже активно демонстрируют возможности нейронки в кодинге, и они ничем не уступают GPT-5.3-Codex. Всего за 24 минуты энтузиаст смог нагенерить код играбельного клона Minecraft с минимальными доработками.
👍73
Хуанг планирует свернуть поставки H200 в Китай, так и не продав ни одного ускорителя 🤣

Судя по последним данным, CEO Nvidia уже отдал приказ о приостановке производства новых H200, так как все выпущенные и зарезервированные КНР ускорители просто пылятся на складе.

Причины все те же: Трамп дал добро на возобновление экспорта, но торговая комиссия США не выдала лицензию, а Китай тем временем давит на свои компании, призывая использовать отечественные ИИ-чипы.
1🤯42
This media is not supported in your browser
VIEW IN TELEGRAM
Вот такое интересное видео опубликовали Nvidia в X, отметив Dell. Как думаете, что же там?
👍22
🍏 Apple под шумок убрала Mac Studio с 512 ГБ и подняла ценник на версии с 256 ГБ

Apple убрала из конфигуратора Mac Studio M3 Ultra вариант с 512 ГБ унифицированной памяти. Теперь максимальная доступная конфигурация — 256 ГБ RAM. Ранее апгрейд до 512 ГБ стоил около $4 000, но теперь эта конфигурация исчезла, а версии с 256 ГБ памяти стали дороже примерно на $400 (с $3 499 до $3 899).
🤯531
This media is not supported in your browser
VIEW IN TELEGRAM
🔐 OpenAI запускает Codex Security — ИИ-агент для поиска уязвимостей в коде

Сэм Альтман, ни разу не подсмотрев идею у Anthropic, создал нового ИИ-агента Codex Security, который помогает искать дыры в программном обеспечении. Система сама анализирует репозиторий, строит контекст проекта, ищет сложные уязвимости в коде, проверяет их, приоритезирует и предлагает патчи для исправления.

Подозрительные баги она может проверять в изолированной среде, чтобы отличить реальные уязвимости от ложных срабатываний, а затем предлагает исправления, учитывающие архитектуру системы.

В тестовой группе за последние 30 дней Codex Security просканировал более 1,2 млн коммитов, обнаружив 792 критические уязвимости и 10 561 проблемы высокой серьезности. При этом критические баги встречались менее чем в 0,1% проверенных изменений.

Сейчас продукт запущен в режиме research preview для пользователей ChatGPT Enterprise, Business и Education.
2
Хуанг решил в очередной раз покичиться, насколько крута архитектура Blackwell в инференсе ИИ. Чтобы доказать это всему миру, он сравнил показатели инференса DeepSeek‑V3.2 + TensorRT LLM на ИИ-ускорителях Nvidia GB200 NVFP4/FP8 в стойке NVL72 с…(барабанная дробь 🥁) Nvidia H200 FP8, торжественно отчитавшись о 16-кратном приросте пропускной способности и снижении задержек в 2,5 раз. Может кто-нибудь уже скажет ему, что Nvidia H200 вышли 2 года назад?
13
🎉 Релиз vLLM 0.17.0: FlashAttention 4, поддержка Qwen3.5 и многое другое

Команда vLLM выпустила версию 0.17.0 — одно из крупнейших обновлений движка инференса.

Главные изменения: интеграция FlashAttention 4, поддержка моделей Qwen3.5 с архитектурой Gated Delta Networks и масштабная переработка системы Model Runner V2 с параллельным конвейером и декодированием контекста.

Добавлены оптимизации под новые GPU поколения NVIDIA SM100 и SM120 с поддержкой MXFP8 и FP8 GEMM, а для AMD объединен стек ROCm + AITER. В ядре появились FlashInfer Sparse MLA, Triton-ядра для top-k/top-p выборки и ускоренный маршрутизатор TRTLLM DSV3 GEMM, который дает около +6% производительности при пакетной обработке.


Добавили новый флаг режима работы: balanced, latency-oriented или throughput-oriented. QLoRA-адаптеры теперь можно загружать напрямую без дополнительной сборки. Отдельно обновили стек до PyTorch 2.10 и добавили новые модели, включая Qwen3.5, Nemotron-embedding, Ovis 2.6 и потоковые ASR-модели.
👍21
⚡️ CXL захватывает ЦОД: SK Telecom готовит новую архитектуру ИИ-кластеров

SK Telecom (входит в SK Group) и разработчик интерконнект-решений Panmnesia договорились создать новую архитектуру ИИ-дата-центров, полностью состояющую из решений CXL (Compute Express Link). Партнерство было официально подписано на MWC 2026, цель — кратно повысить эффективность ИИ=инфраструктуры без наращивания количества GPU.

Компании предлагается отказаться от жесткой серверной схемы и разделить ресурсы на уровне стойки. CPU, GPU и память будут объединяться через CXL Fabric Switch, а не фиксироваться внутри одного сервера. Это позволит динамически распределять память и мощности ускорителей между задачами, повышая полезную нагрузку на железо и снижая эксплуатационные расходы на инфраструктуру. Еще один ключевой момент — замена сетевых обменов между GPU на прямые CXL-соединения.


Архитектуру планируют протестировать на реальных ИИ-нагрузках до конца года, после чего возможен переход к пилотным внедрениям.
👍31
Anthropic рассказала, какие профессии сможет заменить искусственный интеллект уже в ближайшее время. В зоне особого риска: программисты, финансовые аналитики и специалисты по работе с клиентами. Рабочие профессии, вроде инженеров, архитекторов, логистов и обслуживающего персонала. К слову, статистику собирали по запросам к Claude Code. Верим?
3