🔥 RTX 3060 может вернуться на рынок: NVIDIA готовит новые поставки GPU
По данным каналов поставок, компания NVIDIA планирует вновь запустить производство видеокарты GeForce RTX 3060. Ожидается, что новые партии GPU начнут поступать партнерам уже в середине марта 2026 года.
Пока не уточняется, какая именно версия вернется в продажу. Речь может идти как об оригинальной модели с 12 ГБ памяти GDDR6 и 192-битной шиной, так и о более поздней версии с 8 ГБ и 128-битной шиной памяти.
RTX 3060 была представлена в 2021 году и основана на архитектуре Ampere. Несмотря на возраст, карта остается одной из самых популярных моделей среднего сегмента, поэтому ее возвращение может быть связано с сохраняющимся спросом на доступные GPU.
Партнеры NVIDIA по производству видеокарт, вероятно, займутся выпуском собственных версий на основе новых поставок GPU и памяти. При этом ключевым фактором для успеха перезапуска станет цена, поскольку на рынке уже присутствуют более современные поколения видеокарт.
По данным каналов поставок, компания NVIDIA планирует вновь запустить производство видеокарты GeForce RTX 3060. Ожидается, что новые партии GPU начнут поступать партнерам уже в середине марта 2026 года.
Пока не уточняется, какая именно версия вернется в продажу. Речь может идти как об оригинальной модели с 12 ГБ памяти GDDR6 и 192-битной шиной, так и о более поздней версии с 8 ГБ и 128-битной шиной памяти.
RTX 3060 была представлена в 2021 году и основана на архитектуре Ampere. Несмотря на возраст, карта остается одной из самых популярных моделей среднего сегмента, поэтому ее возвращение может быть связано с сохраняющимся спросом на доступные GPU.
Партнеры NVIDIA по производству видеокарт, вероятно, займутся выпуском собственных версий на основе новых поставок GPU и памяти. При этом ключевым фактором для успеха перезапуска станет цена, поскольку на рынке уже присутствуют более современные поколения видеокарт.
👿 ОС, написанная через ИИ, не справилась с главным тестом гиков — запуском Doom
В сети протестировали экспериментальную операционную систему Vib-OS, написанную с помощью вайб-кодинга с минимальными ручными доработками. Проверка показала неожиданный результат: система еле проходит базовые тесты и даже не может воспроизвести культовый тест для ОС и железа — игру Doom.
В итоге из девяти базовых проверок система набрала примерно 5 из 9, формально работает, но скорее как техническая демонстрация.
В сети протестировали экспериментальную операционную систему Vib-OS, написанную с помощью вайб-кодинга с минимальными ручными доработками. Проверка показала неожиданный результат: система еле проходит базовые тесты и даже не может воспроизвести культовый тест для ОС и железа — игру Doom.
Vib-OS позиционируют как Unix-подобную систему с самописным ядром и поддержкой ARM64 и x86_64. Но на практике выяснилось, что сеть не работает, браузер по сути открывает только изображения, а ряд заявленных функций просто отсутствуют.
В итоге из девяти базовых проверок система набрала примерно 5 из 9, формально работает, но скорее как техническая демонстрация.
🤯6💩1🍾1
🤖 Релиз GPT-5.4: больше контекста, выше бенчмарки, новые функции
OpenAI представила новую флагманскую модель GPT-5.4, объединив возможности универсальной GPT-5.2 и GPT-5.3-Codex для кодинга.
Главная фищка — режим computer use: модель может взаимодействовать с программами через GUI, читать скриншоты, заполнять формы и выполнять действия на компьютере как агент. GPT-5.4 уже стала моделью по умолчанию в ChatGPT и API, а версия GPT-5.4-pro доступна подписчикам платной подписки.
Также добавили режим рассуждений xhigh для сложных задач и систему tool search, где модель динамически выбирает нужные инструменты вместо подключения всего набора сразу.
OpenAI представила новую флагманскую модель GPT-5.4, объединив возможности универсальной GPT-5.2 и GPT-5.3-Codex для кодинга.
Главная фищка — режим computer use: модель может взаимодействовать с программами через GUI, читать скриншоты, заполнять формы и выполнять действия на компьютере как агент. GPT-5.4 уже стала моделью по умолчанию в ChatGPT и API, а версия GPT-5.4-pro доступна подписчикам платной подписки.
Контекст вырос до 1,05 млн токенов, а агентные сценарии заметно ускорились. В OSWorld-Verified точность поднялась с 47,3% до 75%, в BrowseComp — с 65,8% до 82,7%, в GDPval — до 83%, при этом на SWE-Bench Pro рост более умеренный.
Также добавили режим рассуждений xhigh для сложных задач и систему tool search, где модель динамически выбирает нужные инструменты вместо подключения всего набора сразу.
👍3 1 1
ServerFlow | Новости и Железо 💾
🤖 Релиз GPT-5.4: больше контекста, выше бенчмарки, новые функции OpenAI представила новую флагманскую модель GPT-5.4, объединив возможности универсальной GPT-5.2 и GPT-5.3-Codex для кодинга. Главная фищка — режим computer use: модель может взаимодействовать…
Media is too big
VIEW IN TELEGRAM
К слову, юзеры уже активно демонстрируют возможности нейронки в кодинге, и они ничем не уступают GPT-5.3-Codex. Всего за 24 минуты энтузиаст смог нагенерить код играбельного клона Minecraft с минимальными доработками.
👍7 3
Хуанг планирует свернуть поставки H200 в Китай, так и не продав ни одного ускорителя 🤣
Судя по последним данным, CEO Nvidia уже отдал приказ о приостановке производства новых H200, так как все выпущенные и зарезервированные КНР ускорители просто пылятся на складе.
Причины все те же: Трамп дал добро на возобновление экспорта, но торговая комиссия США не выдала лицензию, а Китай тем временем давит на свои компании, призывая использовать отечественные ИИ-чипы.
Судя по последним данным, CEO Nvidia уже отдал приказ о приостановке производства новых H200, так как все выпущенные и зарезервированные КНР ускорители просто пылятся на складе.
Причины все те же: Трамп дал добро на возобновление экспорта, но торговая комиссия США не выдала лицензию, а Китай тем временем давит на свои компании, призывая использовать отечественные ИИ-чипы.
1🤯4 2
This media is not supported in your browser
VIEW IN TELEGRAM
Вот такое интересное видео опубликовали Nvidia в X, отметив Dell. Как думаете, что же там?
👍2 2
🍏 Apple под шумок убрала Mac Studio с 512 ГБ и подняла ценник на версии с 256 ГБ
Apple убрала из конфигуратора Mac Studio M3 Ultra вариант с 512 ГБ унифицированной памяти. Теперь максимальная доступная конфигурация — 256 ГБ RAM. Ранее апгрейд до 512 ГБ стоил около $4 000, но теперь эта конфигурация исчезла, а версии с 256 ГБ памяти стали дороже примерно на $400 (с $3 499 до $3 899).
Apple убрала из конфигуратора Mac Studio M3 Ultra вариант с 512 ГБ унифицированной памяти. Теперь максимальная доступная конфигурация — 256 ГБ RAM. Ранее апгрейд до 512 ГБ стоил около $4 000, но теперь эта конфигурация исчезла, а версии с 256 ГБ памяти стали дороже примерно на $400 (с $3 499 до $3 899).
🤯5 3 1
This media is not supported in your browser
VIEW IN TELEGRAM
🔐 OpenAI запускает Codex Security — ИИ-агент для поиска уязвимостей в коде
Сэм Альтман, ни разу не подсмотрев идею у Anthropic, создал нового ИИ-агента Codex Security, который помогает искать дыры в программном обеспечении. Система сама анализирует репозиторий, строит контекст проекта, ищет сложные уязвимости в коде, проверяет их, приоритезирует и предлагает патчи для исправления.
Подозрительные баги она может проверять в изолированной среде, чтобы отличить реальные уязвимости от ложных срабатываний, а затем предлагает исправления, учитывающие архитектуру системы.
В тестовой группе за последние 30 дней Codex Security просканировал более 1,2 млн коммитов, обнаружив 792 критические уязвимости и 10 561 проблемы высокой серьезности. При этом критические баги встречались менее чем в 0,1% проверенных изменений.
Сейчас продукт запущен в режиме research preview для пользователей ChatGPT Enterprise, Business и Education.
Сэм Альтман, ни разу не подсмотрев идею у Anthropic, создал нового ИИ-агента Codex Security, который помогает искать дыры в программном обеспечении. Система сама анализирует репозиторий, строит контекст проекта, ищет сложные уязвимости в коде, проверяет их, приоритезирует и предлагает патчи для исправления.
Подозрительные баги она может проверять в изолированной среде, чтобы отличить реальные уязвимости от ложных срабатываний, а затем предлагает исправления, учитывающие архитектуру системы.
В тестовой группе за последние 30 дней Codex Security просканировал более 1,2 млн коммитов, обнаружив 792 критические уязвимости и 10 561 проблемы высокой серьезности. При этом критические баги встречались менее чем в 0,1% проверенных изменений.
Сейчас продукт запущен в режиме research preview для пользователей ChatGPT Enterprise, Business и Education.
Хуанг решил в очередной раз покичиться, насколько крута архитектура Blackwell в инференсе ИИ. Чтобы доказать это всему миру, он сравнил показатели инференса DeepSeek‑V3.2 + TensorRT LLM на ИИ-ускорителях Nvidia GB200 NVFP4/FP8 в стойке NVL72 с…(барабанная дробь 🥁) Nvidia H200 FP8, торжественно отчитавшись о 16-кратном приросте пропускной способности и снижении задержек в 2,5 раз. Может кто-нибудь уже скажет ему, что Nvidia H200 вышли 2 года назад?
1 3
🎉 Релиз vLLM 0.17.0: FlashAttention 4, поддержка Qwen3.5 и многое другое
Команда vLLM выпустила версию 0.17.0 — одно из крупнейших обновлений движка инференса.
Главные изменения: интеграция FlashAttention 4, поддержка моделей Qwen3.5 с архитектурой Gated Delta Networks и масштабная переработка системы Model Runner V2 с параллельным конвейером и декодированием контекста.
Добавили новый флаг режима работы: balanced, latency-oriented или throughput-oriented. QLoRA-адаптеры теперь можно загружать напрямую без дополнительной сборки. Отдельно обновили стек до PyTorch 2.10 и добавили новые модели, включая Qwen3.5, Nemotron-embedding, Ovis 2.6 и потоковые ASR-модели.
Команда vLLM выпустила версию 0.17.0 — одно из крупнейших обновлений движка инференса.
Главные изменения: интеграция FlashAttention 4, поддержка моделей Qwen3.5 с архитектурой Gated Delta Networks и масштабная переработка системы Model Runner V2 с параллельным конвейером и декодированием контекста.
Добавлены оптимизации под новые GPU поколения NVIDIA SM100 и SM120 с поддержкой MXFP8 и FP8 GEMM, а для AMD объединен стек ROCm + AITER. В ядре появились FlashInfer Sparse MLA, Triton-ядра для top-k/top-p выборки и ускоренный маршрутизатор TRTLLM DSV3 GEMM, который дает около +6% производительности при пакетной обработке.
Добавили новый флаг режима работы: balanced, latency-oriented или throughput-oriented. QLoRA-адаптеры теперь можно загружать напрямую без дополнительной сборки. Отдельно обновили стек до PyTorch 2.10 и добавили новые модели, включая Qwen3.5, Nemotron-embedding, Ovis 2.6 и потоковые ASR-модели.
👍2 1
⚡️ CXL захватывает ЦОД: SK Telecom готовит новую архитектуру ИИ-кластеров
SK Telecom (входит в SK Group) и разработчик интерконнект-решений Panmnesia договорились создать новую архитектуру ИИ-дата-центров, полностью состояющую из решений CXL (Compute Express Link). Партнерство было официально подписано на MWC 2026, цель — кратно повысить эффективность ИИ=инфраструктуры без наращивания количества GPU.
Архитектуру планируют протестировать на реальных ИИ-нагрузках до конца года, после чего возможен переход к пилотным внедрениям.
SK Telecom (входит в SK Group) и разработчик интерконнект-решений Panmnesia договорились создать новую архитектуру ИИ-дата-центров, полностью состояющую из решений CXL (Compute Express Link). Партнерство было официально подписано на MWC 2026, цель — кратно повысить эффективность ИИ=инфраструктуры без наращивания количества GPU.
Компании предлагается отказаться от жесткой серверной схемы и разделить ресурсы на уровне стойки. CPU, GPU и память будут объединяться через CXL Fabric Switch, а не фиксироваться внутри одного сервера. Это позволит динамически распределять память и мощности ускорителей между задачами, повышая полезную нагрузку на железо и снижая эксплуатационные расходы на инфраструктуру. Еще один ключевой момент — замена сетевых обменов между GPU на прямые CXL-соединения.
Архитектуру планируют протестировать на реальных ИИ-нагрузках до конца года, после чего возможен переход к пилотным внедрениям.
👍3 1
Anthropic рассказала, какие профессии сможет заменить искусственный интеллект уже в ближайшее время. В зоне особого риска: программисты, финансовые аналитики и специалисты по работе с клиентами. Рабочие профессии, вроде инженеров, архитекторов, логистов и обслуживающего персонала. К слову, статистику собирали по запросам к Claude Code. Верим?