ServerFlow | Новости и Железо 💾
5.19K subscribers
5.35K photos
420 videos
12 files
2.72K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
Nvidia GeForce RTX исполняется 8 лет. Легендарные RTX 2080 Ti и RTX 2080 вышли в сентябре 2018 года. Как быстро летит время…

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾19💩3
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾12👍8💅1
ARM Vera 🆚 x86 Xeon 6900P

Nvidia продолжает пытаться доказывать всем, что их новейший CPU Vera на архитектуре ARM лучше x86 решений конкурентов. В прошлый раз компания проверяла свой топовый чип в общих процессорных бенчмарках, а в этот раз дело дошло до производительности в базах данных. В качестве x86-конкурента взяли 96-ядерный Intel Xeon 6952P Granite Rapids (судя по характеристикам, в сравнении не указан конкретный чип). Давайте ознакомимся с характеристиками этих процессоров:

🚗 NVIDIA Vera (88c/176t, до 4.0GHz, 250-450W)

😎 Intel Xeon 6952P (96c/192t, 2.1GHz-3.9GHz, 400W)

Nvidia до сих пор не раскрыла тактовой частоты Nvidia Vera, но очевидно, что она никак не может быть меньше частоты Grace (3.1-3.6 ГГц), поэтому можно предположить, что ядра Vera будут работать как минимум в диапазоне 3.1-4.0 ГГц, и это априори ставит Nvidia в выгодное положение относительно Intel Xeon 6952P, ведь именно от базовой тактовой частоты зависит производительность чипа в СУБД.

Производительность меряли по двум версиям СУБД DuckDB (1.5.5 и 2.0.0-alpha) в тесте TPC-H, который проверяет производительность систем на сложных аналитических запросах и обработке больших массивов данных. 

Конечно, не самый популярный выбор базы данных, и многих скорее интересует производительность Vera в MySQL, PostgreSQL или Microsoft SQL Server, но Nvidia намеренно выбрала эту базу данных.


DuckDB — это очень специфичная СУБД, которая подходит скорее для задач аналитики больших объемов данных, нежели для более приземленных сценариев, для подключения 1С или к сайту она точно не подойдет. Это СУБД для BigData-инфраструктур, а не для бизнеса, и это вносит свою лепту.

Обе системы имели технологию многопоточности (Spatial Multithreading у Nvidia / Hyper-Threading у Intel), имели по 768 ГБ оперативной памяти (LPDDR5X у Nvidia / DDR5 у Intel), SSD объемом более 3 ТБ и работали под управлением Ubuntu 26.04. Итак, какие результаты?

🦆 В стабильной DuckDB 1.5.5 — 2,48 млн баллов у Vera против 1,67 млн баллов у Xeon, преимущество Nvidia составило около 48%.

🦆 В тестовой DuckDB 2.0.0-alpha — 3,07 млн баллов у Vera против 2,11 млн баллов у Xeon, преимущество Nvidia составило около 46%.

Важно, что это не официальный сертифицированный результат TPC-H: тестирование проводилось при сотрудничестве DuckDB и NVIDIA, а при официальной аудированной публикации TPC.


То есть, Nvidia взяла далеко не самый высокочастотный чип Intel, взяла крайне специфичный тест и СУБД, и провела тестирование, гордо заявляя о превосходстве ARM Vera над x86 Intel Xeon 6. Браво, Хуанг!

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14🍾5💅3
AMD начала подготовку открытого Linux-драйвера к видеокартам с GDDR7. В свежих патчах AMDGPU появился отдельный идентификатор GDDR7, а вместе с ним — поддержка новых аппаратных блоков, которые связаны с будущей архитектурой RDNA 5. Пока это не означает анонс конкретных видеокарт — AMD лишь постепенно добавляет поддержку будущего железа в ядро Linux, но уже очевидно, что грядущее поколение Radeon обзаведется топовыми чипами VRAM.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍22🌭4💅2
MSI представила EdgeMesa N AI+ — компактный ИИ-ПК на базеNVIDIA RTX Spark N1X. Внутри 20-процессорных ядер от Grace, GPU Blackwell на 6144 CUDA-ядер и 128 ГБ унифицированной памяти LPDDR5X.

MSI оснастила EdgeMesa N AI+ накопителем NVMe до 4 ТБ, набором портов, включающим 4x USB-C 20 Гбит/с, причем 3 из них поддерживают DisplayPort 1.4 Alt Mode, а также HDMI 2.1b и встроенный 10GbE. Для беспроводной связи предусмотрены Wi-Fi 7 и Bluetooth 5.4. Охлаждение базируется на одной испарительной камере и тихом вентиляторе.

MSI пока не раскрыла цену, точные конфигурации памяти и дату начала продаж EdgeMesa N AI+.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯8👍5🍾1
Alibaba на конференции Apsara официально анонсировала новое поколение ИИ-моделей Qwen4-27B, Qwen4-Flash, Qwen4-Max и Qwen4-Plus. Все нейронки, по заявлению компании, выйдут в ближайшее время.

Компания также планирует увеличить количество параметров до 5-10 триллионов в поколениях Qwen 4.5 и Qwen 5.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍25🤯6🍾5💅2
Компания T-Head (дочка Alibaba) представила Zhenwu V900 — свой новый ИИ-ускоритель подразделения, который компания называет самым мощным китайским чипом для ИИ на сегодняшний день. По заявлению T-Head, V900 примерно в 3 раза производительнее Zhenwu M890, предыдущего ускорителя компании.

Внутри V900 установлено 216 ГБ HBM-памяти местного производства, а сам ускоритель поддерживает вычисления в форматах FP8 и FP4. Для связи между чипами предусмотрен межчиповый интерконнект с пропускной способностью 1,2 ТБ/с. Пока полные характеристики чипа неизвестны, но их должны раскрыть в ближайшее время.

Серийное производство и выход V900 на рынок запланированы на первый квартал 2027 года. Alibaba также рассчитывает строить на его основе крупные кластеры — конфигурации могут включать до 500 000 ускорителей.

Одновременно T-Head уже раскрыла следующий этап развития линейки. Ускоритель Zhenwu J900 должен появиться в третьем квартале 2028 года. Параллельно компания готовит собственные серверные CPU Yitian 720 и Yitian 730, ориентированные на агентный ИИ. Их выпуск ожидается в 2027 году, причем Yitian 730 должен стать первым процессором T-Head на собственной микроархитектуре.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9🌭4🤯1
В логах Microsoft Azure появились ИИ-модели GPT 6 Sol, GPT 6 Luna и GPT 6 Astra Minor 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💅15👍5🤯1
Сообщается, что Micron прекращает производство 2-ГБ микросхем GDDR7, используемых в видеокартах GeForce RTX 50. Возможно, это связано с перебросом ресурсов на выпуск памяти HBM. Выпуск 3-ГБ чипов GDDR7 при этом прдолжается.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯12👍2💅1
Anthropic представила Claude Opus 5.5 — свою новую флагманскую ИИ-модель семейства Opus, которая превосходит даже решения семейства Claude Fable, при этом стоит значительно дешевле своего старшего собрата.

В тестах Claude Opus 5.5 набрала 66,4% в Terminal-Bench 4.0, против 55,8% у Fable 5.1, 52,3% у Opus 5, 57,9% у GPT-6 Astra и 37,3% у GPT-5.6 Sol. В FrontierCode v1.1 результат составил 54,4% против 50,3% у Fable 5.1, 48,0% у Opus 5, 53,3% у GPT-6 Astra и 47,5% у GPT-5.6 Sol.

В задачах профессиональной работы Opus 5.5 получила 1846 Elo в GDPval-AA v2.1, где Fable 5.1 набрала 1735, Opus 5 — 1708, GPT-6 Astra — 1542, а GPT-5.6 Sol — 1588. В AutomationBench результат составил 40,0% против 31,4% у Fable 5.1, 26,9% у Opus 5, 41,4% у GPT-6 Astra и 28,8% у GPT-5.6 Sol.

Цена на Claude Opus 5.5 в API: $4 за млн входных и $20 за млн выходных токенов. Для Claude Code и платформы Claude также доступен быстрый режим Opus 5.5 с ускорением до 2,5 раза, который стоит стоит $8 за млн входных и $40 за млн выходных токенов.

В ближайшие недели Anthropic также планирует представить Claude Sonnet 5.5 и Claude Haiku 5.5.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12💩4🌭1🍾1
GPT-6 Sol и Luna уже появились в селекторе ChatGPT и Codex 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7
Claude Opus 5.5 занимает первое место в рейтинге Artificial Analysis 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9
This media is not supported in your browser
VIEW IN TELEGRAM
OpenAI представила GPT-6 Sol и GPT-6 Luna — две новейшие ИИ-модели семейства GPT-6, которые переносят возможности недавно вышедшей GPT-6 Astra в более дешевые и быстрые нейронки.

☀️ GPT-6 Sol ориентирована на сложную профессиональную работу, программирование, агентские сценарии и работу с компьютером. На AutomationBench модель при максимальном уровне рассуждений набирает 33,2% при стоимости около $0,27 за задачу, а на Agents’ Last Exam — 56,4%. В программировании GPT-6 Sol по DeepSWE v1.1 достигает 68,8%, всего на 1,1 п.п. ниже результата Claude Fable 5 при этом примерно на 80% дешевле за задачу.

🌙 GPT-6 Luna рассчитана на массовые и более дешёвые сценарии. На OSWorld 2.0 она при максимальном усилии достигает 60,5%, практически сравниваясь с Claude Opus 5 на среднем уровне (60,3%), но примерно за 20% стоимости. При этом API-цены обеих моделей снизились на 50% относительно промо-цен GPT-5.6: Sol стоит $2 за 1 млн входных токенов и $10 за 1 млн выходных, Luna — $0,10 и $0,50 соответственно.

Изменения затронули и стиль общения. Sol и Luna унаследовали от Astra более точную подачу: меньше лишнего жаргона, повторов и ненужных деталей, при этом ответы должны оставаться содержательными.

GPT-6 Sol и GPT-6 Luna уже доступны в API как gpt-6-sol и gpt-6-luna, а также постепенно появляются в ChatGPT Work и Codex. GPT-6 Astra при этом остаётся флагманом семейства для задач, где требуется максимальный уровень возможностей.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🤯4💅1
Китайский регулятор в сфере интернета проводит расследование в отношении DeepSeek и Moonshot AI после того, как компания Anthropic заявила, что эти компании тайно перенаправляли запросы клиентов на Claude, потенциально отправляя конфиденциальные китайские данные на серверы в США, сообщает The Information.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯21👍4💅1
Apple запустила продажи Mac Mini на базе M6 и Mac Studio на базе M5 Max/M5 Ultra 🎉

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍17🤯5🌭4
В новой MacOS 27 для Mac Mini/Mac Studio появилась настройка RDMA over Thunderbolt в инструментах разработчика.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾17🤯3👍1💩1