ServerFlow | Новости и Железо 💾
Anthropic представила Sonnet 5 — новую флагманскую нейронку с производительностью на уровне Opus 4.8, но с вдвое меньшими ценами за токены. На SWE-bench Pro модель набрала 63,2% против 58,1% у Sonnet 4.6 (Opus 4.8 — 69,2%). В TerminalBench 2.1 результат вырос…
Всего через 5 часов после релиза Sonnet 5, ИИ-энтузиасты смогли довести новую модель Anthropic до “джеилбрейка”. Похоже, что как бы компании ни пытались напичкать нейронку алгоритмами безопасности, удержать ее в узде не получится никогда. Будем надеяться, что Sonnet 5 не забанят из-за этого…
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯5💅2👍1
Tesla наняла Гэри Цзяна, ветерана производства полупроводников, проработавшего почти 18 лет в Intel, на должность директора проекта по производству чипов на фабрике Terafab в Остине. Гэри Цзян был одним из ключевых разработчиков техпроцесса Intel 18A.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4💅2🌭1
ServerFlow | Новости и Железо 💾
Anthropic представила Sonnet 5 — новую флагманскую нейронку с производительностью на уровне Opus 4.8, но с вдвое меньшими ценами за токены. На SWE-bench Pro модель набрала 63,2% против 58,1% у Sonnet 4.6 (Opus 4.8 — 69,2%). В TerminalBench 2.1 результат вырос…
Кстати, “бюджетный” Sonnet 5 оказался в 1,2 раза дороже Opus 4.8 Max и в 2 раза дороже GPT-5.5-xhigh при расчете цены токенов на решенную задачу. Кроме того, многие пользователи жалуются, что модель не показывает высокой производительности в агентных задачах и программировании, и даже заявляют, что открытая GLM-5.2 выглядит на фоне флагмана Anthropic в разы лучше.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8🌭1💅1
Google отчиталась о запуске Gemma 4 31B на вычислительных мощностях чипов Cerebras WSE-3. Получилось добиться феноменальной скорости вывода в 1800 токенов/с. Нейронка уже доступна для предварительного тестирования в облаке Cerebras ⚡️
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6🌭2💅1
Anthropic наконец-то перевыпустила свою флагманскую нейронку Fable 5! С сегодняшнего дня модель доступна для всех юзеров, а в качестве моральной компенсации, компания снизила ограничения по недельным лимитам на 50% до 7 июля. Чтобы удовлетворить надзорные органы США, в нейрону зашили еще больше алгоритмов безопасности, так что принудительных переключений на Claude Opus 4.8 будет больше.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6💩3🌭2🍾2
Команда OGS установила новый рекорд разгона, первой преодолев отметку 4 ГГц на GALAX GeForce RTX 5090D HOF OC Lab с 36-фазной VRM, двумя 16-контактными разъемами питания и охлаждением жидким азотом. В тесте GPUPI 3.3 (32B) видеокарта достигла 4002 МГц, заняв первое место в рейтинге HWBOT.
Для достижения рекорда оверклокеры заменили штатный 27-МГц генератор на внешнюю плату Elmor ECB, подняв базовую частоту до 28,7 МГц (+6,3%). Это позволило увеличить частоты не только GPU, но и памяти GDDR7 — до 1860 МГц (около 30 Гбит/с против штатных 28 Гбит/с). По словам команды, с использованием ECB память можно разгонять вплоть до 2400 МГц (38,4 Гбит/с).
Предыдущий максимум для Blackwell составлял около 3,88 ГГц. Абсолютный рекорд частоты GPU по-прежнему принадлежит AMD — 4,769 ГГц, установленный ранее на Radeon RX 9060 XT.
😅 Канал Serverflow в MAX: Подписаться
Для достижения рекорда оверклокеры заменили штатный 27-МГц генератор на внешнюю плату Elmor ECB, подняв базовую частоту до 28,7 МГц (+6,3%). Это позволило увеличить частоты не только GPU, но и памяти GDDR7 — до 1860 МГц (около 30 Гбит/с против штатных 28 Гбит/с). По словам команды, с использованием ECB память можно разгонять вплоть до 2400 МГц (38,4 Гбит/с).
Предыдущий максимум для Blackwell составлял около 3,88 ГГц. Абсолютный рекорд частоты GPU по-прежнему принадлежит AMD — 4,769 ГГц, установленный ранее на Radeon RX 9060 XT.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🤯1💅1
ServerFlow | Новости и Железо 💾
Anthropic представила Sonnet 5 — новую флагманскую нейронку с производительностью на уровне Opus 4.8, но с вдвое меньшими ценами за токены. На SWE-bench Pro модель набрала 63,2% против 58,1% у Sonnet 4.6 (Opus 4.8 — 69,2%). В TerminalBench 2.1 результат вырос…
GLM-5.2 vs Sonnet 5. Зачем платить больше за менее чем 3% прироста, и то не во всех задачах? Зачем вообще платить, если у GLM-5.2 открытый исходный код? Дарио, open-source — все еще обман?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯9👍4🌭3💅2
Meta* планирует создать облачное отделение для продажи излишков вычислительных мощностей для искусственного интеллекта. Похоже, что компания выходит из ИИ-гонки, и мощности для обучения/инференса нейронок Llama** больше не нужны, либо это просто отчаянный шаг, чтобы хоть как-то окупить инвестиции в ЦОД.
**LLAMA — проект Meta Platforms Inc.**, деятельность которой в России признана экстремистской и запрещена
*Деятельность Meta Platforms Inc. в России признана экстремистской и запрещена
😅 Канал Serverflow в MAX: Подписаться
*Деятельность Meta Platforms Inc. в России признана экстремистской и запрещена
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯4👍1💅1
Инсайдеры составили предполагаемую дорожную карту TPU-ускорителей Google 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5🤯1💅1
AMD вынесла видеокарты на архитектурах RDNA 1 и RDNA 2 (серии Radeon RX 5000 и RX 6000) в отдельную ветку драйверов для Windows. Начиная с версии 25.30.17.02, новые драйверы и расширения Vulkan API выпускаются только для более современных GPU, а старые поколения перестали получать функциональные обновления. Из-за отсутствия поддержки возможностей Vulkan 1.4 видеокарты RDNA 1/2 потеряли полноценную совместимость с DXVK 3.0. Вместо современных механизмов используется более медленный способ привязки ресурсов, что может снижать производительность в играх и приложениях. Разработчики DXVK рекомендуют владельцам таких GPU оставаться на ветке DXVK 2.x либо использовать Linux, где поддержка развивается независимо от драйверов Windows.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Сотрудники Meta* за один месяц потратили 73,7 триллиона ИИ-токенов — это примерно $221 миллион в месяц и около $2,65 миллиарда в год. "Выгодность" ИИ-фикации на лицо.
*Деятельность Meta Platforms Inc. в России признана экстремистской и запрещена
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🍾6
Компания Z.ai выпустила ZCode — фирменную IDE для работы с моделями GLM. Среда разработки доступна для Windows, macOS и Linux. В честь этого компания увеличила лимит использования GLM Coding Plan в 1,5 раза при работе через ZCode. Также появилась поддержка BYOK (Bring Your Own Key) — можно подключить уже существующую подписку или собственный API-ключ без перехода на новый тариф.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍6🤯1🍾1
Объявился новый убийца Nvidia — американский Etched официально представил свои ИИ-системы Frontier Inference Clusters для инференса, над которыми работали более 400 инженеров, ранее трудившихся в NVIDIA, Google, TSMC, Broadcom, SK hynix и других компаниях. Etched уже привлекла $800 млн инвестиций, успешно выпустила первый чип A0 по нормам техпроцесса TSMC N4P, а предварительный спрос на систему, по словам представителей, превысил $1 млрд.
В основе платформы лежат две новые технологии:
📍Low-Voltage Inference (LVI) позволяет выполнять вычисления при вдвое меньшем напряжении, сохраняя до 80% пиковой производительности без теплового троттлинга даже на многотриллионных ИИ-моделях.
📍Cluster Scale Memory (CSM) объединяет преимущества HBM и SRAM, предлагая одновременно высокую пропускную способность, низкие задержки, большую емкость памяти и более высокую энергоэффективность для задач инференса.
Для масштабирования компания уже построила собственный 2-МВт дата-центр,
открыла инженерную площадку на Тайване и готовится к массовому производству своих систем. Более подробные результаты производительности и дорожную карту развития Etched обещает раскрыть уже этим летом.
😅 Канал Serverflow в MAX: Подписаться
В основе платформы лежат две новые технологии:
📍Low-Voltage Inference (LVI) позволяет выполнять вычисления при вдвое меньшем напряжении, сохраняя до 80% пиковой производительности без теплового троттлинга даже на многотриллионных ИИ-моделях.
📍Cluster Scale Memory (CSM) объединяет преимущества HBM и SRAM, предлагая одновременно высокую пропускную способность, низкие задержки, большую емкость памяти и более высокую энергоэффективность для задач инференса.
Для масштабирования компания уже построила собственный 2-МВт дата-центр,
открыла инженерную площадку на Тайване и готовится к массовому производству своих систем. Более подробные результаты производительности и дорожную карту развития Etched обещает раскрыть уже этим летом.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🌭2🍾2