ServerFlow | Новости и Железо 💾
4.25K subscribers
4.97K photos
393 videos
12 files
2.43K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
Google отчиталась о запуске Gemma 4 31B на вычислительных мощностях чипов Cerebras WSE-3. Получилось добиться феноменальной скорости вывода в 1800 токенов/с. Нейронка уже доступна для предварительного тестирования в облаке Cerebras ⚡️

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6🌭2💅1
Anthropic наконец-то перевыпустила свою флагманскую нейронку Fable 5! С сегодняшнего дня модель доступна для всех юзеров, а в качестве моральной компенсации, компания снизила ограничения по недельным лимитам на 50% до 7 июля. Чтобы удовлетворить надзорные органы США, в нейрону зашили еще больше алгоритмов безопасности, так что принудительных переключений на Claude Opus 4.8 будет больше.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6💩3🌭2🍾2
Команда OGS установила новый рекорд разгона, первой преодолев отметку 4 ГГц на GALAX GeForce RTX 5090D HOF OC Lab с 36-фазной VRM, двумя 16-контактными разъемами питания и охлаждением жидким азотом. В тесте GPUPI 3.3 (32B) видеокарта достигла 4002 МГц, заняв первое место в рейтинге HWBOT.

Для достижения рекорда оверклокеры заменили штатный 27-МГц генератор на внешнюю плату Elmor ECB, подняв базовую частоту до 28,7 МГц (+6,3%). Это позволило увеличить частоты не только GPU, но и памяти GDDR7 — до 1860 МГц (около 30 Гбит/с против штатных 28 Гбит/с). По словам команды, с использованием ECB память можно разгонять вплоть до 2400 МГц (38,4 Гбит/с).

Предыдущий максимум для Blackwell составлял около 3,88 ГГц. Абсолютный рекорд частоты GPU по-прежнему принадлежит AMD — 4,769 ГГц, установленный ранее на Radeon RX 9060 XT.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🤯1💅1
Meta* планирует создать облачное отделение для продажи излишков вычислительных мощностей для искусственного интеллекта. Похоже, что компания выходит из ИИ-гонки, и мощности для обучения/инференса нейронок Llama** больше не нужны, либо это просто отчаянный шаг, чтобы хоть как-то окупить инвестиции в ЦОД.

**LLAMA — проект Meta Platforms Inc.**, деятельность которой в России признана экстремистской и запрещена

*Деятельность Meta Platforms Inc. в России признана экстремистской и запрещена


😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯4👍1💅1
Инсайдеры составили предполагаемую дорожную карту TPU-ускорителей Google 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5🤯1💅1
AMD вынесла видеокарты на архитектурах RDNA 1 и RDNA 2 (серии Radeon RX 5000 и RX 6000) в отдельную ветку драйверов для Windows. Начиная с версии 25.30.17.02, новые драйверы и расширения Vulkan API выпускаются только для более современных GPU, а старые поколения перестали получать функциональные обновления. Из-за отсутствия поддержки возможностей Vulkan 1.4 видеокарты RDNA 1/2 потеряли полноценную совместимость с DXVK 3.0. Вместо современных механизмов используется более медленный способ привязки ресурсов, что может снижать производительность в играх и приложениях. Разработчики DXVK рекомендуют владельцам таких GPU оставаться на ветке DXVK 2.x либо использовать Linux, где поддержка развивается независимо от драйверов Windows.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
6👍3💅1😡1
Сотрудники Meta* за один месяц потратили 73,7 триллиона ИИ-токенов — это примерно $221 миллион в месяц и около $2,65 миллиарда в год. "Выгодность" ИИ-фикации на лицо.

*Деятельность Meta Platforms Inc. в России признана экстремистской и запрещена

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾6
Компания Z.ai выпустила ZCode — фирменную IDE для работы с моделями GLM. Среда разработки доступна для Windows, macOS и Linux. В честь этого компания увеличила лимит использования GLM Coding Plan в 1,5 раза при работе через ZCode. Также появилась поддержка BYOK (Bring Your Own Key) — можно подключить уже существующую подписку или собственный API-ключ без перехода на новый тариф.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍6🤯1🍾1
Объявился новый убийца Nvidia — американский Etched официально представил свои ИИ-системы Frontier Inference Clusters для инференса, над которыми работали более 400 инженеров, ранее трудившихся в NVIDIA, Google, TSMC, Broadcom, SK hynix и других компаниях. Etched уже привлекла $800 млн инвестиций, успешно выпустила первый чип A0 по нормам техпроцесса TSMC N4P, а предварительный спрос на систему, по словам представителей, превысил $1 млрд.

В основе платформы лежат две новые технологии:

📍Low-Voltage Inference (LVI) позволяет выполнять вычисления при вдвое меньшем напряжении, сохраняя до 80% пиковой производительности без теплового троттлинга даже на многотриллионных ИИ-моделях.

📍Cluster Scale Memory (CSM) объединяет преимущества HBM и SRAM, предлагая одновременно высокую пропускную способность, низкие задержки, большую емкость памяти и более высокую энергоэффективность для задач инференса.

Для масштабирования компания уже построила собственный 2-МВт дата-центр,
открыла инженерную площадку на Тайване и готовится к массовому производству своих систем. Более подробные результаты производительности и дорожную карту развития Etched обещает раскрыть уже этим летом.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🌭2🍾2