ServerFlow | Новости и Железо 💾
4.23K subscribers
4.85K photos
386 videos
12 files
2.35K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
AMD представила ROCm 10.0 — первое за долгое время крупное обновление ПО-стэка AMD после ветки 7.x. Теперь весь стек собирается через систему TheRock: библиотеки, примитивы и фреймворки проходят общую проверку и выпускаются из одного конвейера.

Главное нововведение в этой версии — ROCm.AI, среда разработки на базе ИИ, которая была ранее анонсирована на конференции Advancing AI 2026. Система автоматизирует процесс разработки софта для графических ускорителей, позволив разработчикам перенести часть рабочих процессов на плечи нейросетей.

В систему ROCm.AI входят такие инструменты, как ROCm CLI, AMD Skills и Hyperloom. ROCm CLI позволяет одной командой устанавливать, проверять и обслуживать окружение для ИИ, AMD Skills дают Claude, Cursor и Codex готовые инструкции для настройки ROCm и запуска моделей на Instinct или EPYC, а Hyperloom самостоятельно выполняет циклы профилирования, анализа, оптимизации и проверки софта. AMD заявляет, что такая автоматизация сокращает работу, занимавшую недели ручной настройки, до нескольких часов.

Изменился и сам вычислительный стек. ROCm 10.0 добавляет готовые контейнеры vLLM для Instinct, Radeon и Ryzen, локальную тонкую настройку LLM через Unsloth и LoRA/QLoRA на Ryzen AI MAX, оптимизации ComfyUI для генерации изображений и видео, а RCCL получил крупное обновление для мульти-GPU систем: запуск ускорен на сотнях GPU, появилась инициированная самим GPU передача данных по сети и расширились коллективные операции. На Windows отдельный HIP SDK теперь заменен единым ROCm Core SDK.

Апдейты для ROCm 10.0 будут выходить примерно раз в шесть недель, стек будет поддерживаться на решениях Instinct, Radeon и Ryzen AI, а также в системах на базе Linux и Windows.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13
Дождались — вместо вездесущих кластеров из DGX Spark твиттерские начали хвастаться кластерами из AMD Strix Halo (в версии от MINISFORUM). Выглядит стильно.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍23
К слову про AMD Strix Halo — энтузиасты во всю кичатся результатами инференса Qwen3.8-27B с 4-битной квантизацией на AMD Halo Box, достигая скорости 65,6 ток/с. Но ИИ-ПК тут не при чем — такого выдающегося результата удалось добиться благодаря запуску нейронки через llama.cpp с адаптивным спекулятивным декодированием DFlash + предсказанием следующих токенов MTP.

Кстати, счастливые обладатели AMD Halo Box, делитесь своими результатами тестов топовых нейронок и рецептами запуска инференса LLM на компактном железе от AMD!

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍7
Media is too big
VIEW IN TELEGRAM
Hugging Face представила Microduck — компактного робота с ПО на базе открытого исходного кода и ИИ. Microduck стоит $399, его высота всего лишь 25 см, а вес не превышает 1 кг. У него есть камера, микрофон, динамик, Wi-Fi, Bluetooth и LiDAR, а также подвижный клюв для захвата предметов. Суть в том, что благодаря ИИ, робота можно обучать новым действиям с помощью обучения с подкреплением, а также программировать его на Python и JavaScript, но и из коробки Microduck может выполнять базовые операции.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍21🌭3
ServerFlow | Новости и Железо 💾
ИИ-энтузиасты начали массово скупать майнинговые ускорители NVIDIA CMP 170HX на базе урезанного чипа A100, из-за чего прайс на некогда невостребованное оборудование подскочил со $100 до $2000. Ажиотаж произошел на фоне релиза софта CMPUnlocker с октрытым исходным…
Майнинговые ускорители Nvidia CMP 170HX продолжают пользоваться огромным спросом, а энтузиасты все чаще делятся успешными запусками LLM на столь необычном железе. Некоторые юзеры отмечают, что им удалось добиться скорости в 212 ток/с при инференсе Qwen3.8-27B, опять же используя DFlash и vLLM. Доказательства они, конечно, не приводят, но при разблокировке всех 64 ГБ HBM2E и работоспособности всех ядер A100, это может смахивать на правду.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯11
Китайская YMTC поставила цель обойти Samsung и SK hynix по объёму производства NAND к концу 2027 года. Сейчас компания занимает около 14% мировых поставок NAND, тогда как Samsung контролирует примерно 25%, а SK hynix вместе с Solidigm около 22%. Для достижения цели YMTC фактически придётся почти удвоить свою долю рынка примерно за 16 месяцев.

Компания уже активно наращивает производство. В первом квартале 2026 года YMTC получила 47,04 млрд юаней выручки и 33,38 млрд юаней чистой прибыли, а загрузка её производственных линий достигла 98,02%. Валовая маржа выросла с 35,3% в 2025 году до 76,77% в первом квартале 2026-го. Теперь YMTC готовит размещение на Шанхайской бирже примерно на $4,9 млрд, из которых 20,8 млрд юаней направят на модернизацию массового производства, а ещё 12,2 млрд юаней на разработку новых технологий.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12
По данным Business Insider, новая ИИ-модель Gemini 3.8 Flash проходит внутреннее тестирование в Google. Кажется, Gemini 3.5 Pro окончательно ушла в забытье, а компания в очередной раз нарушит свое обещание о релизе...

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍5🤯2
По данным инсайдера Moore’s Law Is Dead, новое поколение видеокарт AMD на архитектуре RDNA 5 получит в 3-4 раза больше графических блоков и в 4 раза большую пропускную способность памяти, чем текущий флагман RX 9070 XT. За счет перехода на более совершенный 3-нм техпроцесс TSMC, TDP видюшек не превысит 450 Вт, а графическая производительность будет на 30-60% выше Nvidia RTX 5090 при сопоставимой или меньшей стоимости, что выведет AMD в лидеры игрового сегмента.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍26🤯6🍾3
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️

В новом ролике тестируем Unsloth Studio — единую оболочку для локальных ИИ-моделей, которая объединяет запуск LLM, RAG, обучение, датасеты и генерацию изображений в одном интерфейсе.

-Запуск локальной Qwen с Web Search и Code
-Генерация изображений: Create, Transform, Inpaint и Extend
-LoRA-дообучение на собственном датасете и RAG по PDF


Это и многое другое вы узнаете в новом видео!

🤖 Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)

🔔 Смотреть тут

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍26🍾3💅2
Z.ai представила GLM-5.3 — новую ИИ-модель с открытым исходным кодом, которая заменит предыдущее поколение GLM-5.2. Базовая модель нейронки не поменялась — Все улучшения получили исключительно за счет более эффективной пост-тренировки, а основной прирост пришелся на сложные задачи программирования, длинные автономные задачи и кибербезопасность. Базовая архитектура семейства также использует DeepSeek Sparse Attention (DSA) для снижения стоимости работы с длинным контекстом.

Общий объем модели составляет около 753 млрд параметров, из которых примерно 40 млрд активируются на каждом токене. Модель получила контекстное окно до 1 млн токенов и поддерживает генерацию до 128K токенов. Это позволяет использовать GLM-5.3 не только для обычного чата или генерации отдельных функций, но и для больших кодовых баз, продолжительных agentic-сессий и задач, где модель должна сохранять огромное количество промежуточного контекста.

На внутреннем Z.ai Code Bench прирост относительно GLM-5.2 составил около 50%. На Terminal-Bench 3.0 результат вырос с 4,6% до 28,3%, на DeepSWE — с 46,2% до 66,9%, а на SWE-Marathon — с 19,4% до 42,5%. Отдельно Z.ai отмечает резкий рост возможностей в кибербезопасности. На CyberGym GLM-5.3 получила 84,5%, против 77,2% у GLM-5.2. На ExploitBench результат вырос с 24,4% до 54,4%, а в ExploitGym модель выполняет 105 задач за 2 часа и 130 за 6 часов против 29/39 у предыдущей версии.

Модель уже доступна на Hugging Face.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🤯1🌭1
По данным корейских СМИ, с 1 по 20 августа средняя экспортная цена DRAM достигла $92 183 за килограмм микросхем. За год стоимость выросла на 401%, а относительно января 2023 года стала выше в 12,5 раз. Для сравнения, 620 граммов золота 24 карат в Корее стоят примерно столько же. Причина роста цен прежняя, но масштаб уже другой: производители памяти не успевают наращивать выпуск вслед за спросом со стороны ИИ-инфраструктуры, где одновременно растет потребность в DRAM, HBM, NAND и других видах памяти.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6💅1
Сотрудники SK Hynix в конце 90-х пользовались вот такими учебниками о принципах работы CMOS-схем.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1🌭19👍5
Компания Anthropic выбрала контрольную точку Melon в качестве следующего кандидата на выпуск модели Claude. При тестировании контрольная точка Melon показала лучшие результаты, чем вариант Marshmallow.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯9💩2
OpenAI прекращает многолетнее сотрудничество с Cursor после того, как компания была приобретена SpaceX. По некоторым данным, конфликт между компаниями произошел на фоне долгих личных и судебных разбирательств между Альтманом и Маском, а также заявлений последнего о том, что xAI дистиллировала свои ИИ-модели на мощностях OpenAI GPT. С 12 ноября доступ к моделям GPT через Cursor будет приостановлен.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8😡4🤯3
Мам, купи Nvidia HGX.

Нет, у нас есть Nvidia HGX дома.

Nvidia HGX дома:

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍31🤯8💅2