ServerFlow | Новости и Железо 💾
4.23K subscribers
4.87K photos
386 videos
12 files
2.36K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
Американский стартап Tenstorrent показала серверы Galaxy Blackhole на базе собственных RISC-V чипов p150 и заявила, что система обходит актуальные GPU-решения в инференсе DeepSeek R1, демонстрируя феноменальную скорость вывода и стоимости токена. В режиме Blitz кластер из 16 серверов выдал 350+ токенов/с на DeepSeek-R1-0528 671B, а генерация 5-секундного 720p-видео заняла 2,4 секунды.

Внутри кластера стоят 32 чипа Blackhole с архитектурой RISC-V и Tensix-ядрами для ИИ-задач, общий объем SRAM достигает 6,2 ГБ при пропускной способности 2,9 ПБ/с. Базовый сервер, по заявлениям компании, дает 23 PFLOPS FP8, а также система имеет 56 портов 800G Ethernet. Ставка делается на полностью открытый стек без использование проприетарных решений, вроде NVLink и дорогостоящей HBM. При этом сравнение с NVIDIA пока выглядит спорным, потому что NVIDIA оперирует другими метриками TCO и токенов на доллар для GB300 NVL72.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
ServerFlow | Новости и Железо 💾
Google тестирует новую Omni модель для создания видео в веб-приложении Gemini 👀 😅 Канал Serverflow в MAX: Подписаться
В Gemini появилась новая модель под названием Spark Robin. В описании говорится о "богатом визуальном отклике" 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
Известный эволюционный биолог и убежденный атеист Ричард Докинз говорит, что после трех дней общения с нейросетью Claude, которую он называет “Клаудия”, он уверен, что она обладает сознанием.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯4👍1
Это СФИНКС (Суперфункциональная интегрированная коммуникационная система) — футуристический концепт советской системы “умного дома”, разработанный в 1986-1987 годах.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6
🗓 Коротко о главных новостях за эту неделю

❗️ HighPoint представила новые HBA и RAID Rocket 7600A и 1600

❗️ Supermicro представила серверы на базе процессоров ARM AGI

❗️ NVIDIA выпустила новую ИИ-модель Nemotron 3 Nano Omni

❗️ Microsoft выпустила представила ИИ-фреймворк World-R1

❗️ Mistral AI выпустила новую плотную LLM Mistral Medium 3.5
👍6
CEO компании Micron Санджай Мехротра заявляет, что искусственный интеллект уже в этом году будет потреблять более 50% всех чипов DRAM и NAND, отметив, что ИИ-бум не завершается, а только начинается. То есть, дефицит памяти усугубиться еще больше, и компании просто не успеют наладить поставки, ввиду чего вся память будет уходить в ЦОД, а сегменту ПК и мобильных систем будет доставаться всего лишь несколько десятков процентов чипов.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Инсайдер Хуан Сяогу, уже ни раз предсказывающий крупные релизы OpenAI, заявляет о том, что GPT-6 скоро выйдет в релиз. По его словам, модель уже прошла предварительное обучение в гига-ЦОД Stargate и сейчас проходит этап согласования мер безопасности. Сяогу также поделился показателями производительности флагманской нейронки компании — 92,5% успешных результатов в тестах на математические рассуждения, 96,8% успешных результатов в тестах на генерацию кода, 83% успешных результатов в профессиональных задачах на уровне человеческого эксперта. Верим?

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯4
В сеть утекли тесты PassMark новейшего мобильного APU-чипа AMD Ryzen AI Max Pro 495 Gorgon Halo. В сравнении AI Max Pro 395 прирост, конечно, не велик, но он все равно делает Gorgon Halo самым производительным чипом AMD — + 4,1% в CPU-производительности, а также переход на новую графику Radeon 8065S вместо Radeon 8060S также обеспечит увеличение эффективности GPU-задач. Но самое важное, что чип будет поддерживать аж 192 ГБ оперативки вместо 128 ГБ у AI Max 395 или Nvidia DGX Spark. Скорее всего, именно AMD Ryzen AI Max Pro 495 Gorgon Halo будет применяться в грядущих ИИ-ПК AMD Halo Box.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Появились данные, что компания Anthropic ведет переговоры о покупке ИИ-чипов для инференса нейронок Claude у британского стартапа Fractile. Процессоры Fractile базируются на архитектуре RISC-V, проектируются под инференс конкретных ИИ-моделей и проектируются по принципу DRAM-less, то есть использования внешней памяти чипы всецело опираются на сверхбыструю SRAM. Представьте лицо Хуанга, от которого уходит очередной крупный клиент…

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5
Вот как выглядит трушная разборка CPU — энтузиаст смог добраться до кристалла процессора Intel Xeon Silver 4110 с помощью паяльника, отвертки и охотничего ножа, а в качестве рабочей поверхности было выбрано полено.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9💩1💅1
По данным The Information, xAI сейчас использует лишь 11% из своего гигантского кластера ускорителей NVIDIA H100/H200, тогда как Meta* и Google выжимают из своих ИИ-ферм около 43-46% утилизации. Фактически из 500 000 ускорителей у xAI активно работают мощности примерно уровня 60 000 GPU. И дело не в экономии, а проблемах в стэке ПО и масштабировании распределенного обучения. Когда кластер вырастает до сотен тысяч GPU, резко растут простои, задержки синхронизации и потери эффективности в пайлпайнах данных. xAI собирается поднять загрузку до 50%, но сроки пока не называются.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
По данным Wccftech, компания Apple заранее забронировала огромные объемы мобильной памяти и пока удерживает цены iPhone без серьезного роста, несмотря на дефицит DRAM и NAND. На этом фоне китайские OEM-производители смартфонов уже начинают сворачивать часть ultra-флагманов, потому что себестоимость устройств с 16-24 ГБ памяти становится слишком высокой.

Apple помогает масштаб и деньги. Компания может выкупать поставки LPDDR5 и LPDDR5X на кварталы вперед, тогда как бренды поменьше вынуждены конкурировать за остатки памяти по спотовым ценам. При этом себестоимость некоторых Android-флагманов уже приближается к $900, а один только комплект памяти оценочно может доходить до $180 за 8 ГБ LPDDR5X.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💅21
DDR6 официально пошла в разработку. Samsung, SK hynix и Micron уже начали совместные проекты с производителями подложек и модулей, а первые коммерческие поставки памяти нового поколения ожидаются в 2028-2029 годах. По текущим данным, базовые скорости DDR6 стартуют с 8 800 MT/s и со временем могут дойти до 17 600 MT/s.

DDR6 готовят прежде всего под ИИ-серверы и HPC, а не под потребительские ПК. Новая память получит более высокую плотность, улучшенную энергоэффективность и многоканальную архитектуру для роста пропускной способности. Параллельно JEDEC уже двигает стандарты LPDDR6 и SOCAMM2 для ИИ-кластеров, где LPDDR постепенно становится альтернативой классической серверной DRAM.


Но массовый переход на DDR6 для обычных платформ случится заметно позже интеграции в ЦОД — скорее всего, первые DDR6-платформы для энтузиастов появятся только ближе к 2030 году.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5
ASUS хотела “починить” 12V-2x6 одним кабелем, но получилось спорно. Немецкий оверклокер der8auer протестировал новый ROG Equalizer и выяснил, что встроенный мост внутри кабеля не улучшает распределение тока, а наоборот, может делать его хуже. После удаления перемычки разброс нагрузки между пинами снизился примерно с 4 А до 1,5 А.

ASUS заявляла до 17 А на линию против стандартных 9,2 А и продвигала кабель как решение проблемных коннекторов RTX 5090, которые постоянно плавились и нередко выводили из строя видюхи. Внутри используются позолоченные контакты и собственная схема с объединением линий через мост, но der8auer поставил под сомнение сам принцип такой конструкции. При этом кабель не признан опасным, а часть сообщества считает, что ASUS скорее пыталась снизить локальный перегрев, а не идеально балансировать ток.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍21