Южнокорейский стартап HyperAccel показал Bertha 500, специализированный ускоритель для ИИ-инференса. Чип выпускается по 4-нм техпроцессу Samsung и объединяет 32 LPU-ядра, 256 МБ SRAM и 128 ГБ LPDDR5X с пропускной способностью 546 ГБ/с. Заявленная производительность достигает 768 TFLOPS в FP8 и 384 TFLOPS в FP16 при TDP 250 Вт.
HyperAccel использует архитектуру Streamlined Dataflow, где движение данных и вычисления подстраиваются под структуру LLM, поэтому компания заявляет около 90% загрузки аппаратных ресурсов даже при инференсе. По внутренним тестам Bertha 500 выдает до 1 645 токенов/с против 804 токенов/с у H100, а по эффективности на доллар и ватт заявлено преимущество до 19 и 12 раз соответственно. Это не подтверждено независимыми тестами, поэтому воспринимать их как реальные цифры не стоит.
Вторая модель, Bertha 100, рассчитана уже на агентный и мультимодальный ИИ. Это M.2-ускоритель с 16 ГБ LPDDR5X, пропускной способностью 64 ГБ/с и 32,8 TFLOPS FP8, рассчитанный на обработку мультимодальных данных ИИ. Обе платформы поддерживают PyTorch, ONNX и vLLM, а массовое производство Bertha 500 намечено на начало 2027 года, тогда как первые тестовые образцы Bertha 100 ожидаются в четвертом квартале 2026-го.
😅 Канал Serverflow в MAX: Подписаться
HyperAccel использует архитектуру Streamlined Dataflow, где движение данных и вычисления подстраиваются под структуру LLM, поэтому компания заявляет около 90% загрузки аппаратных ресурсов даже при инференсе. По внутренним тестам Bertha 500 выдает до 1 645 токенов/с против 804 токенов/с у H100, а по эффективности на доллар и ватт заявлено преимущество до 19 и 12 раз соответственно. Это не подтверждено независимыми тестами, поэтому воспринимать их как реальные цифры не стоит.
Вторая модель, Bertha 100, рассчитана уже на агентный и мультимодальный ИИ. Это M.2-ускоритель с 16 ГБ LPDDR5X, пропускной способностью 64 ГБ/с и 32,8 TFLOPS FP8, рассчитанный на обработку мультимодальных данных ИИ. Обе платформы поддерживают PyTorch, ONNX и vLLM, а массовое производство Bertha 500 намечено на начало 2027 года, тогда как первые тестовые образцы Bertha 100 ожидаются в четвертом квартале 2026-го.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍9
Samsung Electronics, по данным корейских СМИ, направляет около 50% производственных мощностей 4-нм техпроцесса SF4 на выпуск базовых кристаллов для HBM4. Производство идет на линиях S5 и S6 в кампусах P2 и P3 в Пхентхэке, причем рост загрузки связан не только с внешними ASIC-заказами, но и с резко увеличившимся спросом на HBM4.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩3💅1
На китайском вторичном рынке всплыли модифицированные NVIDIA Tesla M60 примерно за 400 юаней ($60). Серверную видюху оснастили металлическим кожухом и сразу тремя вентиляторами, превратив пассивный ускоритель в решение для стандартных системных корпусов.
Внутри M60 находятся сразу два GPU Maxwell GM204, каждый с 2048 CUDA-ядер, то есть суммарно 4096 CUDA-ядер. По памяти установлено всего 16 ГБ GDDR5, по два независимых пула по 8 ГБ, и один GPU не способен напрямую обращаться к памяти второго.
😅 Канал Serverflow в MAX: Подписаться
Внутри M60 находятся сразу два GPU Maxwell GM204, каждый с 2048 CUDA-ядер, то есть суммарно 4096 CUDA-ядер. По памяти установлено всего 16 ГБ GDDR5, по два независимых пула по 8 ГБ, и один GPU не способен напрямую обращаться к памяти второго.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯12💩4👍3
MazeBench — интересный бенчмарк, в котором ИИ-модели проверяются на способности к логическому мышлению при выстраивании лабиринтов. Чем сложнее лабиринт, тем лучше модель логически мыслит. Как можете видеть, GPT-6 Astra на две головы превосходит Claude Fable 5.1.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11
This media is not supported in your browser
VIEW IN TELEGRAM
GPT-6 Astra — идеальный ИИ-компаньон для Minecraft. Энтузиаст сделать бота на базе топовой нейронки OpenAI и дал ему задачу добыть алмаз, после чего ушел отдыхать. В итоге нейросеть успешно создала все необходимые инструменты, выкопала шахту и добыла ресурс. Плагин можно скачать по ссылке.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭14🤯8
Media is too big
VIEW IN TELEGRAM
А еще Astra без ошибок проходит 48 уровней капчи. Ну, теперь это точно AGI.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯9👍7💅4
Вывеска на въезде в головной офис VMware. Видимо, решили перенести ESXi на Rust…
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1💅14👍2🌭1
Испанский стартап iPronics из Валенсии привлек $125 млн в раунде Series B, одним из участников которого стала NVIDIA. Общий объем финансирования компании достиг $177 млн, а новые средства пойдут на коммерческое масштабирование iPronics Optical Networking Engine (ONE) — программируемого оптического коммутатора для ИИ-кластеров.
В основе ONE лежит кремниевая фотоника и Optical Circuit Switching (OCS). Вместо постоянной фиксированной топологии сеть может программно перестраивать соединения между вычислительными узлами под конкретную нагрузку обучения или инференса. Управление, телеметрия и API интегрированы непосредственно в платформу, поэтому изменения топологии можно выполнять в реальном времени.
Ключевая особенность этой технологии — скорость переконфигурации менее 1 мс. Для огромных AI-кластеров это особенно важно из-за роста количества отказов: когда в инфраструктуре работают сотни тысяч чипов, выход отдельных ускорителей из строя становится не исключением, а штатной ситуацией. Оптическая фабрика может перестроить маршруты и сохранить работоспособность кластера вместо того, чтобы ждать восстановления конкретного узла.
Пока один коммутаторный чип ONE поддерживает 32 порта, но iPronics уже разрабатывает варианты на 72 и 144 порта. За счет компактности кремниевой фотоники компания рассчитывает объединять несколько чипов и довести плотность до 720 пар портов в одном 1U-шасси.
😅 Канал Serverflow в MAX: Подписаться
В основе ONE лежит кремниевая фотоника и Optical Circuit Switching (OCS). Вместо постоянной фиксированной топологии сеть может программно перестраивать соединения между вычислительными узлами под конкретную нагрузку обучения или инференса. Управление, телеметрия и API интегрированы непосредственно в платформу, поэтому изменения топологии можно выполнять в реальном времени.
Ключевая особенность этой технологии — скорость переконфигурации менее 1 мс. Для огромных AI-кластеров это особенно важно из-за роста количества отказов: когда в инфраструктуре работают сотни тысяч чипов, выход отдельных ускорителей из строя становится не исключением, а штатной ситуацией. Оптическая фабрика может перестроить маршруты и сохранить работоспособность кластера вместо того, чтобы ждать восстановления конкретного узла.
Пока один коммутаторный чип ONE поддерживает 32 порта, но iPronics уже разрабатывает варианты на 72 и 144 порта. За счет компактности кремниевой фотоники компания рассчитывает объединять несколько чипов и довести плотность до 720 пар портов в одном 1U-шасси.
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯5💅2
По данным TrendForce, во втором квартале 2026 года мировая выручка производителей DRAM достигла почти $154,73 млрд, увеличившись сразу на 59,5% в сравнении с первым кварталом 2026 года.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩9🌭2
Китайская CXMT фактически подтвердила, что ведет переговоры с зарубежными крупными заказчиками, заявив о готовности "изучать возможности сотрудничества с ведущими клиентами по всему миру". Прямого упоминания Apple компания не сделала, однако заявление появилось на фоне сообщений о том, что Apple рассматривает CXMT как дополнительного поставщика памяти.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭5
ServerFlow | Новости и Железо 💾
Несмотря на успехи, GPT-6 Astra не смогла подвинуть Fable 5.1, Opus 5 и даже Muse Spark 1.3 в рейтинге Artificial Analysis 👀 😅 Канал Serverflow в MAX: Подписаться
Artificial Analysis обновила свой рейтинг Intelligence Index до версии 4.3, и теперь GPT-6 Astra делит первое место с Claude Fable 5.1
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩15👍5
По данным DIGITIMES, Intel планирует в начале октября поднять цены на процессоры для ПК еще примерно на 10%. Это продолжение серии подорожаний, которая идет с конца 2025 года: в первом квартале 2026 года цены уже выросли примерно на 10%, а в июле подорожали отдельные потребительские и серверные модели. Intel, судя по всему, делает ставку не на захват рынка, а на увеличение валовой прибыли на фоне ожидаемого снижения мировых поставок ПК с 260 до примерно 250 млн устройств в 2027 году.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩8🤯3
Компания Mistral AI привлекла 3 миллиарда евро в рамках раунда инвестиций серии D 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯7👍2
Ходят слухи, что OpenAI, возможно, решила задачу Навье — Стокса, одну из “7 задач тысячелетия”. Если это подтвердится официальным заявлением OpenAI, это станет историческим математическим прорывом.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯20👍4💅2💩1
По данным портала Phoronix, в новых патчах для ядра Linux появилось упоминание нового, ранее неизвестного x86-процессора. Процессор работает только в 64-битном PM64-режиме и использует 5-уровневую адресацию PML5, полностью отказываясь от старых 16 и 32-битных режимов. Это фактически тот путь развития x86S, от которого Intel отказалась в 2024 году.
По архитектуре проект выглядит очень необычно. APX увеличивает число регистров общего назначения с 16 до 32, FRED упрощает обработку системных событий и переходов между уровнями привилегий, а AMX/ACE может использовать конфигурации на 16 и 32 тайлов-регистра против 8 в актуальных Intel Xeon. Последнее особенно интересно для матричных вычислений и ИИ-нагрузок, хотя реальная производительность неизвестна: публичных тестов и даже точных характеристик самого CPU пока нет.
Кто разработал чип, неизвестно. Среди возможных кандидатов называют китайские Zhaoxin и Hygon, а также стартап RosaicLabs, которому, по сообщениям, Intel предоставила доступ к технологиям Atom. Связь с любой из этих компаний пока не подтверждена.
😅 Канал Serverflow в MAX: Подписаться
По архитектуре проект выглядит очень необычно. APX увеличивает число регистров общего назначения с 16 до 32, FRED упрощает обработку системных событий и переходов между уровнями привилегий, а AMX/ACE может использовать конфигурации на 16 и 32 тайлов-регистра против 8 в актуальных Intel Xeon. Последнее особенно интересно для матричных вычислений и ИИ-нагрузок, хотя реальная производительность неизвестна: публичных тестов и даже точных характеристик самого CPU пока нет.
Кто разработал чип, неизвестно. Среди возможных кандидатов называют китайские Zhaoxin и Hygon, а также стартап RosaicLabs, которому, по сообщениям, Intel предоставила доступ к технологиям Atom. Связь с любой из этих компаний пока не подтверждена.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10
DeepSeek V4.1 Flash появилась в Vercel AI Gateway в формате бета-тестирования. Нейронка имеет контекстное окно в 1 миллион токенов и нативную поддержку мультимодального ввода изображений.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9