Линус Торвальдс заявил, что поиск ошибки в драйвере Intel GFX для Linux был “адской сессией отладки”. Когда он задействовал ИИ для фикса, нейронка назвала задачу “невыполнимой” и предлагала просто сделать отчет. После 24 отладочных патчей ошибка все же нашлась: функция round_up() должна была быть round_down(). Вот тебе и ИИ в кодинге…
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍44💅10🤯3😡2
Друзья, у нас возникла идея, как разнообразить контент в нашем ТГ-канале и заодно, возможно, завести новую рубрику — как только на рынок будет выходить новая знаковая ИИ-модель, мы в кратчайшие сроки будем делать список ИИ-ускорителей и связок из нескольких GPU, которые подойдут для запуска свежей LLM.
Итак, начнем! Перед вами — 6 передовых графических решений, которые подойдут для локального инференса топовой модели Qwen3.8-Flash-Next-GGUF в квантизации Q4_K_XL 👀
Если вам придется по вкусу такой формат, мы продолжим выпускать такие топы на релизе новых нейронок. Делитесь своим мнением и рекомендациями в комментариях!
😅 Канал Serverflow в MAX: Подписаться
Итак, начнем! Перед вами — 6 передовых графических решений, которые подойдут для локального инференса топовой модели Qwen3.8-Flash-Next-GGUF в квантизации Q4_K_XL 👀
Если вам придется по вкусу такой формат, мы продолжим выпускать такие топы на релизе новых нейронок. Делитесь своим мнением и рекомендациями в комментариях!
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍83🍾5💅5💩1
NVIDIA выпустит последний драйвер GeForce Game Ready, поддерживающий Windows 10, в октябре 2026 года. С ноября 2026 года NVIDIA будет требовать установки Windows 11.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩34👍5😡5
Помимо GLM-5.3-Flash, компания Z.ai также готовится выпустить стандартную версию GLM-5.3 с открытыми весами. Релиз уже завтра 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍18
ServerFlow | Новости и Железо 💾
Apple внезапно показала сразу два новых процессора для линейки Mac: M6 для ноутбуков и ИИ-ПК на базе 2-нм техпроцесса и, что самое главное, долгожданный M5 Ultra для рабочих станций Mac Studio с архитектурой на базе 4 чиплетов. Apple M6 получил 12-ядерный…
Предзаказы на Apple Mac Studio уже стартовали — цена за версию с чипом M5 Ultra, 256 ГБ унифицированной памяти и накопитель на 16 ТБ достигает астрономических $18 299. Тем временем, Nvidia DGX Spark стоит более чем в 3 раза дешевле. Будет ли M5 Ultra настолько хорош, что переплюнет даже детище Хуанга? (тестов, само собой, пока нет). И только представьте, сколько будет стоить версия с 512 ГБ оперативки…
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯21👍2💩2🌭2
AMD в своем портале с технической информацией официально засветила следующую линейку Ryzen на архитектуре Zen 6. Для настольных AM5 указаны два семейства Olympic Ridge и Medusa1.
Olympic Ridge рассчитано на массовые и высокопроизводительные настольные ПК. В линейке ожидаются процессоры до 24 ядер, при этом один CCD сможет содержать до 12 ядер Zen 6. Также заявлена поддержка большого объёма кеша и 3D V-Cache, а теплопакет отдельных моделей должен находиться в диапазоне 65-170 Вт. Семейство будет работать как на существующих, так и на новых материнских платах AM5.
Medusa1 займёт другую нишу. Это гибридные процессоры с ядрами Zen 6 и обновлённой встроенной графикой, которые должны прийти на смену Ryzen 8000G. AMD также готовит мобильные Medusa, где количество ядер может достигать 22. При этом сама компания пока не раскрыла точные характеристики Zen 6, частоты и сроки выхода серийных чипов.
😅 Канал Serverflow в MAX: Подписаться
Olympic Ridge рассчитано на массовые и высокопроизводительные настольные ПК. В линейке ожидаются процессоры до 24 ядер, при этом один CCD сможет содержать до 12 ядер Zen 6. Также заявлена поддержка большого объёма кеша и 3D V-Cache, а теплопакет отдельных моделей должен находиться в диапазоне 65-170 Вт. Семейство будет работать как на существующих, так и на новых материнских платах AM5.
Medusa1 займёт другую нишу. Это гибридные процессоры с ядрами Zen 6 и обновлённой встроенной графикой, которые должны прийти на смену Ryzen 8000G. AMD также готовит мобильные Medusa, где количество ядер может достигать 22. При этом сама компания пока не раскрыла точные характеристики Zen 6, частоты и сроки выхода серийных чипов.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🍾5
На рынке оперативки активизировались мошенники, продающие модули DDR5 с микросхемами DDR4 с поддельной маркировкой и без PMIC-контроллера. Более дешевые чипы просто напаивали на текстолит более дорогих плашек. При этом, качество подделок оставляет желать лучшего, так как все производится кустарным путем.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10🤯1
В новом отчете Nvidia за второй квартал 2027 финансового года компания полностью убрала упоминания брендов GeForce, Gaming и DLSS — игровые решения Nvidia вообще не фигурируют в информации для инвесторов, хотя ранее компания лишь перенесла их сегмент периферийных технологий.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩26👍4
AMD представила ROCm 10.0 — первое за долгое время крупное обновление ПО-стэка AMD после ветки 7.x. Теперь весь стек собирается через систему TheRock: библиотеки, примитивы и фреймворки проходят общую проверку и выпускаются из одного конвейера.
Главное нововведение в этой версии — ROCm.AI, среда разработки на базе ИИ, которая была ранее анонсирована на конференции Advancing AI 2026. Система автоматизирует процесс разработки софта для графических ускорителей, позволив разработчикам перенести часть рабочих процессов на плечи нейросетей.
В систему ROCm.AI входят такие инструменты, как ROCm CLI, AMD Skills и Hyperloom. ROCm CLI позволяет одной командой устанавливать, проверять и обслуживать окружение для ИИ, AMD Skills дают Claude, Cursor и Codex готовые инструкции для настройки ROCm и запуска моделей на Instinct или EPYC, а Hyperloom самостоятельно выполняет циклы профилирования, анализа, оптимизации и проверки софта. AMD заявляет, что такая автоматизация сокращает работу, занимавшую недели ручной настройки, до нескольких часов.
Изменился и сам вычислительный стек. ROCm 10.0 добавляет готовые контейнеры vLLM для Instinct, Radeon и Ryzen, локальную тонкую настройку LLM через Unsloth и LoRA/QLoRA на Ryzen AI MAX, оптимизации ComfyUI для генерации изображений и видео, а RCCL получил крупное обновление для мульти-GPU систем: запуск ускорен на сотнях GPU, появилась инициированная самим GPU передача данных по сети и расширились коллективные операции. На Windows отдельный HIP SDK теперь заменен единым ROCm Core SDK.
Апдейты для ROCm 10.0 будут выходить примерно раз в шесть недель, стек будет поддерживаться на решениях Instinct, Radeon и Ryzen AI, а также в системах на базе Linux и Windows.
😅 Канал Serverflow в MAX: Подписаться
Главное нововведение в этой версии — ROCm.AI, среда разработки на базе ИИ, которая была ранее анонсирована на конференции Advancing AI 2026. Система автоматизирует процесс разработки софта для графических ускорителей, позволив разработчикам перенести часть рабочих процессов на плечи нейросетей.
В систему ROCm.AI входят такие инструменты, как ROCm CLI, AMD Skills и Hyperloom. ROCm CLI позволяет одной командой устанавливать, проверять и обслуживать окружение для ИИ, AMD Skills дают Claude, Cursor и Codex готовые инструкции для настройки ROCm и запуска моделей на Instinct или EPYC, а Hyperloom самостоятельно выполняет циклы профилирования, анализа, оптимизации и проверки софта. AMD заявляет, что такая автоматизация сокращает работу, занимавшую недели ручной настройки, до нескольких часов.
Изменился и сам вычислительный стек. ROCm 10.0 добавляет готовые контейнеры vLLM для Instinct, Radeon и Ryzen, локальную тонкую настройку LLM через Unsloth и LoRA/QLoRA на Ryzen AI MAX, оптимизации ComfyUI для генерации изображений и видео, а RCCL получил крупное обновление для мульти-GPU систем: запуск ускорен на сотнях GPU, появилась инициированная самим GPU передача данных по сети и расширились коллективные операции. На Windows отдельный HIP SDK теперь заменен единым ROCm Core SDK.
Апдейты для ROCm 10.0 будут выходить примерно раз в шесть недель, стек будет поддерживаться на решениях Instinct, Radeon и Ryzen AI, а также в системах на базе Linux и Windows.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13
Дождались — вместо вездесущих кластеров из DGX Spark твиттерские начали хвастаться кластерами из AMD Strix Halo (в версии от MINISFORUM). Выглядит стильно.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍23
К слову про AMD Strix Halo — энтузиасты во всю кичатся результатами инференса Qwen3.8-27B с 4-битной квантизацией на AMD Halo Box, достигая скорости 65,6 ток/с. Но ИИ-ПК тут не при чем — такого выдающегося результата удалось добиться благодаря запуску нейронки через llama.cpp с адаптивным спекулятивным декодированием DFlash + предсказанием следующих токенов MTP.
Кстати, счастливые обладатели AMD Halo Box, делитесь своими результатами тестов топовых нейронок и рецептами запуска инференса LLM на компактном железе от AMD!
😅 Канал Serverflow в MAX: Подписаться
Кстати, счастливые обладатели AMD Halo Box, делитесь своими результатами тестов топовых нейронок и рецептами запуска инференса LLM на компактном железе от AMD!
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍7
Media is too big
VIEW IN TELEGRAM
Hugging Face представила Microduck — компактного робота с ПО на базе открытого исходного кода и ИИ. Microduck стоит $399, его высота всего лишь 25 см, а вес не превышает 1 кг. У него есть камера, микрофон, динамик, Wi-Fi, Bluetooth и LiDAR, а также подвижный клюв для захвата предметов. Суть в том, что благодаря ИИ, робота можно обучать новым действиям с помощью обучения с подкреплением, а также программировать его на Python и JavaScript, но и из коробки Microduck может выполнять базовые операции.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍21🌭3
ServerFlow | Новости и Железо 💾
ИИ-энтузиасты начали массово скупать майнинговые ускорители NVIDIA CMP 170HX на базе урезанного чипа A100, из-за чего прайс на некогда невостребованное оборудование подскочил со $100 до $2000. Ажиотаж произошел на фоне релиза софта CMPUnlocker с октрытым исходным…
Майнинговые ускорители Nvidia CMP 170HX продолжают пользоваться огромным спросом, а энтузиасты все чаще делятся успешными запусками LLM на столь необычном железе. Некоторые юзеры отмечают, что им удалось добиться скорости в 212 ток/с при инференсе Qwen3.8-27B, опять же используя DFlash и vLLM. Доказательства они, конечно, не приводят, но при разблокировке всех 64 ГБ HBM2E и работоспособности всех ядер A100, это может смахивать на правду.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯11
Китайская YMTC поставила цель обойти Samsung и SK hynix по объёму производства NAND к концу 2027 года. Сейчас компания занимает около 14% мировых поставок NAND, тогда как Samsung контролирует примерно 25%, а SK hynix вместе с Solidigm около 22%. Для достижения цели YMTC фактически придётся почти удвоить свою долю рынка примерно за 16 месяцев.
Компания уже активно наращивает производство. В первом квартале 2026 года YMTC получила 47,04 млрд юаней выручки и 33,38 млрд юаней чистой прибыли, а загрузка её производственных линий достигла 98,02%. Валовая маржа выросла с 35,3% в 2025 году до 76,77% в первом квартале 2026-го. Теперь YMTC готовит размещение на Шанхайской бирже примерно на $4,9 млрд, из которых 20,8 млрд юаней направят на модернизацию массового производства, а ещё 12,2 млрд юаней на разработку новых технологий.
😅 Канал Serverflow в MAX: Подписаться
Компания уже активно наращивает производство. В первом квартале 2026 года YMTC получила 47,04 млрд юаней выручки и 33,38 млрд юаней чистой прибыли, а загрузка её производственных линий достигла 98,02%. Валовая маржа выросла с 35,3% в 2025 году до 76,77% в первом квартале 2026-го. Теперь YMTC готовит размещение на Шанхайской бирже примерно на $4,9 млрд, из которых 20,8 млрд юаней направят на модернизацию массового производства, а ещё 12,2 млрд юаней на разработку новых технологий.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12
По данным Business Insider, новая ИИ-модель Gemini 3.8 Flash проходит внутреннее тестирование в Google. Кажется, Gemini 3.5 Pro окончательно ушла в забытье, а компания в очередной раз нарушит свое обещание о релизе...
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍5🤯2
По данным инсайдера Moore’s Law Is Dead, новое поколение видеокарт AMD на архитектуре RDNA 5 получит в 3-4 раза больше графических блоков и в 4 раза большую пропускную способность памяти, чем текущий флагман RX 9070 XT. За счет перехода на более совершенный 3-нм техпроцесс TSMC, TDP видюшек не превысит 450 Вт, а графическая производительность будет на 30-60% выше Nvidia RTX 5090 при сопоставимой или меньшей стоимости, что выведет AMD в лидеры игрового сегмента.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍26🤯6🍾3
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️
В новом ролике тестируем Unsloth Studio — единую оболочку для локальных ИИ-моделей, которая объединяет запуск LLM, RAG, обучение, датасеты и генерацию изображений в одном интерфейсе.
Это и многое другое вы узнаете в новом видео!
🤖 Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
🔔 Смотреть тут
😅 Канал Serverflow в MAX: Подписаться
В новом ролике тестируем Unsloth Studio — единую оболочку для локальных ИИ-моделей, которая объединяет запуск LLM, RAG, обучение, датасеты и генерацию изображений в одном интерфейсе.
-Запуск локальной Qwen с Web Search и Code
-Генерация изображений: Create, Transform, Inpaint и Extend
-LoRA-дообучение на собственном датасете и RAG по PDF
Это и многое другое вы узнаете в новом видео!
🤖 Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Please open Telegram to view this post
VIEW IN TELEGRAM
👍26🍾3💅2