PCI-SIG раньше срока выпустила черновую версию стандарта PCIe 8.0 и уже раздала спецификацию PCIe 8.0.0.5 партнерам. Новый интерфейс должен обеспечить 1 Тбайт/с двусторонней пропускной способности в конфигурации x16, а финальная версия стандарта должна выйти к 2028 году. PCIe 8.0 снова удваивает скорость относительно PCIe 7.0, который сам пока даже не дошел до массового рынка. Главный сценарий использования — ИИ-кластеры, HPC и сверхбыстрые сетевые адаптеры, где уже сейчас появляются узкие места при работе с HBM, CXL и GPU-пулами. PCI-SIG также упоминает новые коннекторы, улучшение энергоэффективности и сохранение обратной совместимости с предыдущими поколениями PCIe.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯4
Media is too big
VIEW IN TELEGRAM
Рассматриваем приз поближе 👀
На кону материнская плата Supermicro X10SDV-4C-TLN2F 🔥
Всё, что нужно для победы - ваш креатив в комментариях под закреплённым постом с розыгрышем.
Успейте поучаствовать до 11 мая!
😅 Канал Serverflow в MAX: Подписаться
На кону материнская плата Supermicro X10SDV-4C-TLN2F 🔥
Всё, что нужно для победы - ваш креатив в комментариях под закреплённым постом с розыгрышем.
Успейте поучаствовать до 11 мая!
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍6 4🤯1 1
Anthropic добавила функцию “мечтания” для своих ИИ-агентов. Активировав “мечтание”, нейронки начнут самообучаться, используя свои прошлые ответы для оптимизации последующих результатов. Функция уже доступна в Claude Console в режиме предварительного тестирования.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍3
Илон Маск объявил, что xAI прекратит существование как отдельная компания и будет объединена с SpaceX, образовав единую компанию SpaceXAI.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Anthropic и SpaceX заключили партнерство , в рамках которого ИИ-компания получит более 300 МВт дополнительных мощностей от дата-центра Colossus 1 Илона Маска. На радостях от этого события, Anthropic тут же объявила об удвоении 5-часовых лимитов Claude Code для тарифных планов Pro, Max и Team, отмене ограничения по количеству часов использования Claude Code для тарифных планов Pro и Max и значительном увеличении лимитов на использование API для моделей Opus. У вайбкодеров сегодня праздник.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
AMD готовит еще один 8-ядерный Zen 5 для корпоративных AM5-систем. В базе PassMark засветился Ryzen 7 PRO 9755 с 8 ядрами и 16 потоками, который должен встать выше уже представленного Ryzen 7 PRO 9745. По первым тестам чип набрал около 38 100 баллов по многопоточной производительности и 4 604 по однопоточной производительности. У Ryzen 7 PRO 9755 заявлено 8 МБ L2 и 32 МБ L3-кэша, то есть конфигурация полностью совпадает с другими 8-ядерными чипами Zen 5 на AM5. Пока неизвестны частоты и TDP, но утечка намекает на легкий рефреш PRO-линейки с повышенными boost-частотами.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2 2
Компания ZyphraAI представила новую открытую ИИ-модель ZAYA1-8B, полностью обученную на решениях AMD. Нейронка имеет 8 млрд общих и всего 0,7 млрд активных параметров, при этом по эффективности она приближается к показателям DeepSeek-V3.2 и GPT-5-High.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾3
This media is not supported in your browser
VIEW IN TELEGRAM
Если бы вы в 2025 году вложили $25 000 в Sandisk, то сейчас вы бы заработали $1 000 000. Акции компании выросли на 4000% всего за год 💸
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍5💅1😡1
Intel поделилась новой дорожной картой центральных процессоров для массового рынка на два года вперед. Ближайших релиз — Nova Lake с гибридной архитектурой Coyote Cove P-Core и Arctic Wolf E-Core с рекордным количеством ядер до 52 штук и 288 МБ кэш памяти. Затем в 2027 году нас ждет релиз чипов Razor Lake, в 2028 году появятся Titan Lake (возможно со встройкой Nvidia RTX), а еще позднее выйдут Moon Lake, о которых сейчас совершенно ничего неизвестно.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1💩2🍾1
Работники завода Samsung по производству чипов отказались от единовременной премии в размере $340 000 и потребовали ежегодных выплат, как у SK hynix, в размере $900 000. Рабочие хотят получить свою долю от сверхприбыли компании от поставок памяти для ИИ-систем. Забастовка может обойтись Samsung в $11,7 миллиардов.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯8👍4
❗️СРОЧНЫЕ НОВОСТИ❗️
AMD анонсировала выход нового ИИ-ускорителя Instinct MI350P с интерфейсом подключения PCIe 5.0 x16 — это первый PCIe-ускоритель компании за 4 года со времен релиза Instinct MI210.
Эта карточка — вдвое урезанная версия Instinct MI350X на базе CDNA 4 для OEM и SXM систем. Объем памяти достигает 144 ГБ HBM3E c пропускной способностью 4 ТБ/с, ИИ-производительность до 1150 TFLOPS в режиме FP16, 2300 TFLOPS в режиме FP8 и 4600 TFLOPS в режиме FP4 без структурной разряженности — вдвое больше, чем у RTX PRO 6000 Blackwell Server Edition и почти в 1,5 раз больше, чем у H200 NVL.
Форм-фактор — двухслотовая полнопрофильная карта с пассивной системой охлаждения, мощность варьируется от 450 Вт до 600 Вт в пике.
В общем, Instinct MI350X — это самый мощный ИИ-ускоритель с интерфейсом PCIe на данный момент, у решения буквально нет конкурентов, так как Nvidia не выпускала аналогичных решений на архитектуре Blackwell и Blackwell Ultra, сконцентрировавшись на решениях по стандарту OEM и SXM. Но очевидно, что Nvidia не будет терять рынок PCIe, так что ответка от Хуанга не за горами.
😅 Канал Serverflow в MAX: Подписаться
AMD анонсировала выход нового ИИ-ускорителя Instinct MI350P с интерфейсом подключения PCIe 5.0 x16 — это первый PCIe-ускоритель компании за 4 года со времен релиза Instinct MI210.
Эта карточка — вдвое урезанная версия Instinct MI350X на базе CDNA 4 для OEM и SXM систем. Объем памяти достигает 144 ГБ HBM3E c пропускной способностью 4 ТБ/с, ИИ-производительность до 1150 TFLOPS в режиме FP16, 2300 TFLOPS в режиме FP8 и 4600 TFLOPS в режиме FP4 без структурной разряженности — вдвое больше, чем у RTX PRO 6000 Blackwell Server Edition и почти в 1,5 раз больше, чем у H200 NVL.
Форм-фактор — двухслотовая полнопрофильная карта с пассивной системой охлаждения, мощность варьируется от 450 Вт до 600 Вт в пике.
В общем, Instinct MI350X — это самый мощный ИИ-ускоритель с интерфейсом PCIe на данный момент, у решения буквально нет конкурентов, так как Nvidia не выпускала аналогичных решений на архитектуре Blackwell и Blackwell Ultra, сконцентрировавшись на решениях по стандарту OEM и SXM. Но очевидно, что Nvidia не будет терять рынок PCIe, так что ответка от Хуанга не за горами.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍13🍾5
ServerFlow | Новости и Железо 💾
❗️СРОЧНЫЕ НОВОСТИ❗️ AMD анонсировала выход нового ИИ-ускорителя Instinct MI350P с интерфейсом подключения PCIe 5.0 x16 — это первый PCIe-ускоритель компании за 4 года со времен релиза Instinct MI210. Эта карточка — вдвое урезанная версия Instinct MI350X…
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8 5
Тайваньский стартап Skymizer показал PCIe-карту HTX301, которая, по заявлению компании, способна запускать LLM до 700B параметров локально без огромных GPU-кластеров. Внутри одной карты размещаются 6 специализированных ИИ-чипов и LPDDR4/LPDDR5-память, а ставка делается на инференс-нагрузки.
HTX301 использует архитектуру HyperThought и собственные LPU-ядра для ускорения стадии декодирования при генерации токенов, тогда как префилл остается за обычными GPU. Компания заявляет до 1 200 токенов/с для Llama* 2 7B при масштабировании нескольких чипов, а энергопотребление одной карты составляет около 240 Вт.
*LLAMA — проект Meta Platforms Inc.**, деятельность которой в России признана экстремистской и запрещена
**Деятельность Meta Platforms Inc. в России признана экстремистской и запрещена
😅 Канал Serverflow в MAX: Подписаться
HTX301 использует архитектуру HyperThought и собственные LPU-ядра для ускорения стадии декодирования при генерации токенов, тогда как префилл остается за обычными GPU. Компания заявляет до 1 200 токенов/с для Llama* 2 7B при масштабировании нескольких чипов, а энергопотребление одной карты составляет около 240 Вт.
*LLAMA — проект Meta Platforms Inc.**, деятельность которой в России признана экстремистской и запрещена
**Деятельность Meta Platforms Inc. в России признана экстремистской и запрещена
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7
ServerFlow | Новости и Железо 💾
❗️СРОЧНЫЕ НОВОСТИ❗️ AMD анонсировала выход нового ИИ-ускорителя Instinct MI350P с интерфейсом подключения PCIe 5.0 x16 — это первый PCIe-ускоритель компании за 4 года со времен релиза Instinct MI210. Эта карточка — вдвое урезанная версия Instinct MI350X…
Не успела AMD анонсировать MI350P, как Supermicro сразу же представила новые 5U GPU-серверы AS-5126GS-TNRT и TNRT2, расчитанные на корпоративный ИИ-инференс и интеграцию в ЦОД без масштабной перестройки инфраструктуры. Системы поддерживают до 10 ускорителей MI350P PCIe и два AMD EPYC 9005. Серверы используют либо прямое CPU-to-GPU подключение x16 для 8 GPU, либо PCIe-свичи для подключения 10 GPU. Ставка делается на инференс, агентный ИИ и RAG-системы, где важна производительность на токен.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍3
Media is too big
VIEW IN TELEGRAM
OpenAI представила GPT-Realtime-2 — новейшее семейство моделей компании для генерации голоса и построения голосовых ИИ-агентов. В семейство входят нейронки GPT-Realtime-Translate и GPT-Realtime-Whisper, обе доступны в API, поддерживают 70 языков ввода и 13 языковы вывода.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍6
This media is not supported in your browser
VIEW IN TELEGRAM
Google выпустила Gemini 3.1 Flash-Lite — самую экономичную модель семейства Gemini 3.1, оптимизированную для выполнения агентских задач, перевода и легкой обработки данных со сверхнизкими задержками.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍4