⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️
Сегодня у нас обзор Huawei Atlas 300i Duo - запускаем и квантизуем Qwen3 на Ascend NPU!
Это и многое другое вы узнаете в новом видео!
Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://youtu.be/O16C0HGbgyU?si=qVreLBpQSvVDy8Gk
Канал Serverflow в MAX: Подписаться
Сегодня у нас обзор Huawei Atlas 300i Duo - запускаем и квантизуем Qwen3 на Ascend NPU!
- Установка драйверов, firmware и CANN
- Квантизация Qwen3 32B и Qwen3-30B-A3B
- Запуск моделей через MindIE и тесты в OpenWebUI
- Сравнение скорости до и после квантизации
- Разбор возможностей Huawei Atlas 300i Duo для локального запуска LLM
Это и многое другое вы узнаете в новом видео!
Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://youtu.be/O16C0HGbgyU?si=qVreLBpQSvVDy8Gk
Канал Serverflow в MAX: Подписаться
YouTube
Запуск Qwen-30B-A3B Q8 на Huawei Atlas 300i Duo - но есть нюанс😆
В этом видео смотрим на Huawei Atlas 300i Duo 96GB и показываем, как устроен запуск нейросетей на ускорителях Huawei Ascend. Проходим весь путь от установки драйверов, обновления firmware и установки CANN до запуска моделей через MindIE в Docker.
Главная…
Главная…
1👍7🤯4🌭3
Qwen 3.5 вышел🏃♂️
В СерверФлоу вышел гайд по квантизации Qwen3 ✅
———-
Atlas 350 вышел🏃♂️
В СерверФлоу вышел гайд по Atlas 300i duo ✅
Честно хотел в коммент написать, получился перебор метаиронии в рамках поста)
P.S Qwen 3.5 на Huawei Atlas 300i Duo не запустился даже на свежих драйверах. По логам было видно, что текущая версия MindIE пока просто не распознаёт архитектуру Qwen 3.5 как поддерживаемый тип модели
В СерверФлоу вышел гайд по квантизации Qwen3 ✅
———-
Atlas 350 вышел🏃♂️
В СерверФлоу вышел гайд по Atlas 300i duo ✅
Честно хотел в коммент написать, получился перебор метаиронии в рамках поста)
P.S Qwen 3.5 на Huawei Atlas 300i Duo не запустился даже на свежих драйверах. По логам было видно, что текущая версия MindIE пока просто не распознаёт архитектуру Qwen 3.5 как поддерживаемый тип модели
3 5
Intel Core Ultra 9 290K Plus засветился в новых тестах Geekbench с результатом около 3 535 баллов в одноядерном производительности (по более ранним прогонам ~3 450-3 500). Это примерно +10% к предыдущему 285K и фактически выводит чип в лидеры среди настольных CPU в этом бенчмарке. В многопотоке прирост тоже +10-11%, но в играх ситуация, скорее всего, останется прежней
Конфигурация осталась прежней — 24 ядра (8P + 16E), но добавили частоты (до ~5,8 ГГц в бусте) и слегка подтянули скорость интерконнекта с памятью. В тестах использовалась DDR5-6800/8000, что тоже влияет на результат, но ключевой прирост — именно за счет частот и оптимизаций архитектуры Arrow Lake Refresh. Тем не менее, Ryzen X3D от AMD все еще впереди за счет большого объема кеша.
😅 Канал Serverflow в MAX: Подписаться
Конфигурация осталась прежней — 24 ядра (8P + 16E), но добавили частоты (до ~5,8 ГГц в бусте) и слегка подтянули скорость интерконнекта с памятью. В тестах использовалась DDR5-6800/8000, что тоже влияет на результат, но ключевой прирост — именно за счет частот и оптимизаций архитектуры Arrow Lake Refresh. Тем не менее, Ryzen X3D от AMD все еще впереди за счет большого объема кеша.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
ServerFlow | Новости и Железо 💾
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️ Сегодня у нас обзор Huawei Atlas 300i Duo - запускаем и квантизуем Qwen3 на Ascend NPU! - Установка драйверов, firmware и CANN - Квантизация Qwen3 32B и Qwen3-30B-A3B - Запуск моделей через MindIE и тесты в OpenWebUI - Сравнение…
Инфа для тех кто пришел с видеоролика #atlas300iduo
Прикладываем файлы:
Сегодня еще допишем текстовый гайд по запуску квантизации, позже отправим ссылку.
Вот ссылка на ftp для скачивания файлов
Файлы в посте ниже👇
Прикладываем файлы:
- Калибровочные json файлы для запуска скрипта
- Python скрипт для квантизации MoE модели
Сегодня еще допишем текстовый гайд по запуску квантизации, позже отправим ссылку.
Вот ссылка на ftp для скачивания файлов
Файлы в посте ниже👇
👍1
Nvidia официально зарелизила NemoClaw, но пока только в собственной веб-среде NVIDIA Brev Launchable. Хуанг говорил, что NemoClaw будет открытым и бесплатным, но не уточнял когда...
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🌭1
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭2 1
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic добавила функцию использования компьютера в Claude. Нейронка теперь может открывать приложения, управлять браузером, заполняит электронные таблицы и выполнять другие действия прямо на вашем устройстве. Функция доступна в Claude Cowork и Claude Code по тарифам Pro и Max, пока что только для macOS. Да, теперь Claude — это буквально платный OpenClaw.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Марк Цукерберг заявил, что его команда работает над ИИ-агентом, который будет выполнять его работу на посту CEO Meta*. На самом деле, вряд ли кто-то почувствует разницу, но будем иметь ввиду...
*Деятельность Meta Platforms Inc. в России признана экстремистской и запрещена
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯1 1
Сэм Альтман планирует добавить в ChatGPT “взрослый режим”, который отключает ограничители нейронки на генерацию изображений характера 18+. Многие сотрудники OpenAI встретили такие планы с большой критикой — они обеспокоены, что у пользователей чат-бота появится нездоровая зависимость от общения с GPT. Эти опасения более чем оправданы — по статистике, уже 10-14 млн человек проводят в ChatGPT более 4-5 часов в день для удовлетворения потребности в общении и заполнении “эмоциональной пустоты”, постепенно отдаляясь от других людей и реального мира, что уже неоднократно приводило к трагическому исходу с последующими судебными тяжбами для OpenAI.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯2
Завтра выходит ARC-AGI-3 — первый интерактивный бенчмарк для оценки способности к логическому мышлению, созданный для тестирования искусственного интеллекта на уровне человеческого интеллекта. Тест включает 1000 уровней в более чем 150 нишах, требующих исследования, обучения, планирования и адаптации.
Наивысший результат на ARC-AGI-1 на данный момент — 98 % у Gemini 3.1 Pro, а на ARC-AGI-2 — 84,6 % у Gemini 3 Deep Think, но скоро вскроется их реальная производительность в самом сложном тесте.
😅 Канал Serverflow в MAX: Подписаться
Наивысший результат на ARC-AGI-1 на данный момент — 98 % у Gemini 3.1 Pro, а на ARC-AGI-2 — 84,6 % у Gemini 3 Deep Think, но скоро вскроется их реальная производительность в самом сложном тесте.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
🔥 Arm выходит на рынок CPU с собственным чипом для ИИ
Arm представила первый центральный процессор под своей маркой. Чип получил название Arm AGI и он ориентирован на агентный искусственный интеллект.
Чип построен на 136 ядрах Neoverse V3 на кристалл, тактовая частота достигает ~3,7 ГГц, кэш L2 в 2 МБ на ядро. Используется двухкристальная компоновка, техпроцесс 3 нм TSMC, есть поддержка памяти DDR5‑8800, 96 линий PCIe 6.0 и CXL 3.0 — все для масштабирования высокопараллельных ИИ-задач и больших объемов памяти на сокет.
AGI CPU будет использоваться гиперскелерами для выполнения высокопроизводительных ИИ‑вычислений вместе с GPU и другими ИИ-ускорителями. Начало производства намечено на вторую половину 2026 года.
😅 Канал Serverflow в MAX: Подписаться
Arm представила первый центральный процессор под своей маркой. Чип получил название Arm AGI и он ориентирован на агентный искусственный интеллект.
Чип построен на 136 ядрах Neoverse V3 на кристалл, тактовая частота достигает ~3,7 ГГц, кэш L2 в 2 МБ на ядро. Используется двухкристальная компоновка, техпроцесс 3 нм TSMC, есть поддержка памяти DDR5‑8800, 96 линий PCIe 6.0 и CXL 3.0 — все для масштабирования высокопараллельных ИИ-задач и больших объемов памяти на сокет.
Это стратегический сдвиг: компания перестает только лицензировать энергоэффективную архитектуру CPU и начинает предлагать собственные чипы для серверов и ИИ‑вычислений.
AGI CPU будет использоваться гиперскелерами для выполнения высокопроизводительных ИИ‑вычислений вместе с GPU и другими ИИ-ускорителями. Начало производства намечено на вторую половину 2026 года.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
⚛️ Норвежский стартап привлек $40 млн на атомную литографию
Норвежская компания Lace Lithography собрала $40 млн инвестиций в первом раунде финансирования при поддержке Microsoft для разработки нового класса литографического оборудования, которое делает чипы на кремнии не светом, а пучком нейтральных атомов гелия. Такой подход обещает разрешение порядка 0,1 нм, что примерно в 135 раз уже длины волны EUV‑света ASML (13,5 нм).
Такой инструмент потенциально позволил бы создавать структуры в 10x меньше, чем современные EUV‑машины, что важно для создания сверхплотных транзисторов и будущих вычислительных чипов. Однако между лабораторной демонстрацией и массовым внедрением остается большая инженерная работа.
😅 Канал Serverflow в MAX: Подписаться
Норвежская компания Lace Lithography собрала $40 млн инвестиций в первом раунде финансирования при поддержке Microsoft для разработки нового класса литографического оборудования, которое делает чипы на кремнии не светом, а пучком нейтральных атомов гелия. Такой подход обещает разрешение порядка 0,1 нм, что примерно в 135 раз уже длины волны EUV‑света ASML (13,5 нм).
Традиционная фотолитография сейчас ограничена длиной волны света, поэтому переход на нейтральные атомы устраняет это бутылочное горлышко — атомы не испытывают эффекта дифракции, характерного для фотонов. Lace Lithography называет свой метод “BEUV” (Beyond EUV) и выпустит свою первую установку в пилотной фабрике к 2029 году.
Такой инструмент потенциально позволил бы создавать структуры в 10x меньше, чем современные EUV‑машины, что важно для создания сверхплотных транзисторов и будущих вычислительных чипов. Однако между лабораторной демонстрацией и массовым внедрением остается большая инженерная работа.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5