ServerFlow | Новости и Железо 💾
4.23K subscribers
4.85K photos
385 videos
12 files
2.35K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
Южнокорейский стартап HyperAccel показал Bertha 500, специализированный ускоритель для ИИ-инференса. Чип выпускается по 4-нм техпроцессу Samsung и объединяет 32 LPU-ядра, 256 МБ SRAM и 128 ГБ LPDDR5X с пропускной способностью 546 ГБ/с. Заявленная производительность достигает 768 TFLOPS в FP8 и 384 TFLOPS в FP16 при TDP 250 Вт.

HyperAccel использует архитектуру Streamlined Dataflow, где движение данных и вычисления подстраиваются под структуру LLM, поэтому компания заявляет около 90% загрузки аппаратных ресурсов даже при инференсе. По внутренним тестам Bertha 500 выдает до 1 645 токенов/с против 804 токенов/с у H100, а по эффективности на доллар и ватт заявлено преимущество до 19 и 12 раз соответственно. Это не подтверждено независимыми тестами, поэтому воспринимать их как реальные цифры не стоит.

Вторая модель, Bertha 100, рассчитана уже на агентный и мультимодальный ИИ. Это M.2-ускоритель с 16 ГБ LPDDR5X, пропускной способностью 64 ГБ/с и 32,8 TFLOPS FP8, рассчитанный на обработку мультимодальных данных ИИ. Обе платформы поддерживают PyTorch, ONNX и vLLM, а массовое производство Bertha 500 намечено на начало 2027 года, тогда как первые тестовые образцы Bertha 100 ожидаются в четвертом квартале 2026-го.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍9
Samsung Electronics, по данным корейских СМИ, направляет около 50% производственных мощностей 4-нм техпроцесса SF4 на выпуск базовых кристаллов для HBM4. Производство идет на линиях S5 и S6 в кампусах P2 и P3 в Пхентхэке, причем рост загрузки связан не только с внешними ASIC-заказами, но и с резко увеличившимся спросом на HBM4.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩3💅1
Угадайте, что это за память 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤯22👍2💩2💅2
На китайском вторичном рынке всплыли модифицированные NVIDIA Tesla M60 примерно за 400 юаней ($60). Серверную видюху оснастили металлическим кожухом и сразу тремя вентиляторами, превратив пассивный ускоритель в решение для стандартных системных корпусов.

Внутри M60 находятся сразу два GPU Maxwell GM204, каждый с 2048 CUDA-ядер, то есть суммарно 4096 CUDA-ядер. По памяти установлено всего 16 ГБ GDDR5, по два независимых пула по 8 ГБ, и один GPU не способен напрямую обращаться к памяти второго.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯12💩4👍3
MazeBench — интересный бенчмарк, в котором ИИ-модели проверяются на способности к логическому мышлению при выстраивании лабиринтов. Чем сложнее лабиринт, тем лучше модель логически мыслит. Как можете видеть, GPT-6 Astra на две головы превосходит Claude Fable 5.1.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11
This media is not supported in your browser
VIEW IN TELEGRAM
GPT-6 Astra — идеальный ИИ-компаньон для Minecraft. Энтузиаст сделать бота на базе топовой нейронки OpenAI и дал ему задачу добыть алмаз, после чего ушел отдыхать. В итоге нейросеть успешно создала все необходимые инструменты, выкопала шахту и добыла ресурс. Плагин можно скачать по ссылке.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭14🤯8
Media is too big
VIEW IN TELEGRAM
А еще Astra без ошибок проходит 48 уровней капчи. Ну, теперь это точно AGI.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯9👍7💅4
Вывеска на въезде в головной офис VMware. Видимо, решили перенести ESXi на Rust…

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1💅14👍2🌭1
Испанский стартап iPronics из Валенсии привлек $125 млн в раунде Series B, одним из участников которого стала NVIDIA. Общий объем финансирования компании достиг $177 млн, а новые средства пойдут на коммерческое масштабирование iPronics Optical Networking Engine (ONE) — программируемого оптического коммутатора для ИИ-кластеров.

В основе ONE лежит кремниевая фотоника и Optical Circuit Switching (OCS). Вместо постоянной фиксированной топологии сеть может программно перестраивать соединения между вычислительными узлами под конкретную нагрузку обучения или инференса. Управление, телеметрия и API интегрированы непосредственно в платформу, поэтому изменения топологии можно выполнять в реальном времени.

Ключевая особенность этой технологии — скорость переконфигурации менее 1 мс. Для огромных AI-кластеров это особенно важно из-за роста количества отказов: когда в инфраструктуре работают сотни тысяч чипов, выход отдельных ускорителей из строя становится не исключением, а штатной ситуацией. Оптическая фабрика может перестроить маршруты и сохранить работоспособность кластера вместо того, чтобы ждать восстановления конкретного узла.

Пока один коммутаторный чип ONE поддерживает 32 порта, но iPronics уже разрабатывает варианты на 72 и 144 порта. За счет компактности кремниевой фотоники компания рассчитывает объединять несколько чипов и довести плотность до 720 пар портов в одном 1U-шасси.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯5💅2
По данным TrendForce, во втором квартале 2026 года мировая выручка производителей DRAM достигла почти $154,73 млрд, увеличившись сразу на 59,5% в сравнении с первым кварталом 2026 года.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩9🌭2
Китайская CXMT фактически подтвердила, что ведет переговоры с зарубежными крупными заказчиками, заявив о готовности "изучать возможности сотрудничества с ведущими клиентами по всему миру". Прямого упоминания Apple компания не сделала, однако заявление появилось на фоне сообщений о том, что Apple рассматривает CXMT как дополнительного поставщика памяти.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭5
По данным DIGITIMES, Intel планирует в начале октября поднять цены на процессоры для ПК еще примерно на 10%. Это продолжение серии подорожаний, которая идет с конца 2025 года: в первом квартале 2026 года цены уже выросли примерно на 10%, а в июле подорожали отдельные потребительские и серверные модели. Intel, судя по всему, делает ставку не на захват рынка, а на увеличение валовой прибыли на фоне ожидаемого снижения мировых поставок ПК с 260 до примерно 250 млн устройств в 2027 году.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩8🤯3
Компания Mistral AI привлекла 3 миллиарда евро в рамках раунда инвестиций серии D 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯7👍2
Ходят слухи, что OpenAI, возможно, решила задачу Навье — Стокса, одну из “7 задач тысячелетия”. Если это подтвердится официальным заявлением OpenAI, это станет историческим математическим прорывом.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯20👍4💅2💩1
Новая модель DeepSeek V4.1-Flash тестируется на API 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭9
По данным портала Phoronix, в новых патчах для ядра Linux появилось упоминание нового, ранее неизвестного x86-процессора. Процессор работает только в 64-битном PM64-режиме и использует 5-уровневую адресацию PML5, полностью отказываясь от старых 16 и 32-битных режимов. Это фактически тот путь развития x86S, от которого Intel отказалась в 2024 году.

По архитектуре проект выглядит очень необычно. APX увеличивает число регистров общего назначения с 16 до 32, FRED упрощает обработку системных событий и переходов между уровнями привилегий, а AMX/ACE может использовать конфигурации на 16 и 32 тайлов-регистра против 8 в актуальных Intel Xeon. Последнее особенно интересно для матричных вычислений и ИИ-нагрузок, хотя реальная производительность неизвестна: публичных тестов и даже точных характеристик самого CPU пока нет.

Кто разработал чип, неизвестно. Среди возможных кандидатов называют китайские Zhaoxin и Hygon, а также стартап RosaicLabs, которому, по сообщениям, Intel предоставила доступ к технологиям Atom. Связь с любой из этих компаний пока не подтверждена.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10
DeepSeek V4.1 Flash появилась в Vercel AI Gateway в формате бета-тестирования. Нейронка имеет контекстное окно в 1 миллион токенов и нативную поддержку мультимодального ввода изображений.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9