⚡️Вышел SGLang для диффузионных ИИ-моделей Diffusion
Разработчики команды LMSYS представил свою инновационную разработку — движок инференса диффузионных моделей на базе SGLang, ускоряющий вывод нейронок и уже поддерживающий топовые ИИ.
Система построена с использованием открытого фреймворка FastVideo для создания полноценной экосистемы диффузии. А еще SGLang Diffusion глубоко оптимизирована для работы под ускорители NVIDIA (и даже DGX Spark) благодаря чему достигается высокая производительность при генерации изображений и обработке видео.
Скоро про ComfyUI можно будет забыть.
Разработчики команды LMSYS представил свою инновационную разработку — движок инференса диффузионных моделей на базе SGLang, ускоряющий вывод нейронок и уже поддерживающий топовые ИИ.
SGLang Diffusion выполняет вывод моделей в 5,9 раза быстрее, чем аналогичные движки, поддерживает передовые открытые модели Wan, Hunyuan, Qwen‑Image, Qwen‑Image‑Edit и Flux, а также полностью совместим с OpenAI API и Python API.
Система построена с использованием открытого фреймворка FastVideo для создания полноценной экосистемы диффузии. А еще SGLang Diffusion глубоко оптимизирована для работы под ускорители NVIDIA (и даже DGX Spark) благодаря чему достигается высокая производительность при генерации изображений и обработке видео.
Но запустить SGLang Diffusion также можно на GPU AMD, CPU Intel и даже TPU от Google за счет поддержки проприетарных программных стеков.
Скоро про ComfyUI можно будет забыть.
1👍2
🍊 Orange Pi 6 Plus: 12 ядер и 45 TOPS на ладони
Orange Pi показала новый одноплатный компьютер 6 Plus с 12-ядерным процессором и встроенным NPU на 45 TOPS.
Orange Pi 6 Plus поддерживает до 64 ГБ LPDDR5-5500 (128-бит), 2 слота M.2 2280 под SSD NVMe и отдельный M.2 для сетевой карты. Еще есть 2 порта USB-C 3.0, 2 USB 3.0, 2 USB 2.0, DisplayPort 1.4, HDMI 1.4, двойной 5 Gigabit Ethernet, microSD и GPIO на 40 контактов.
Мини-сервер размером с ладонь, идеально для DIY-сборок и краевых ИИ-проектов.
Orange Pi показала новый одноплатный компьютер 6 Plus с 12-ядерным процессором и встроенным NPU на 45 TOPS.
В корпусе 115 × 100 мм и весом 132 г разместились 4 ядра Cortex-A720 2,8 ГГц, 4 ядра A720 2,4 ГГц и 4 ядра A520 1,8 ГГц, а также графика Immortalis-G720 MC10.
Orange Pi 6 Plus поддерживает до 64 ГБ LPDDR5-5500 (128-бит), 2 слота M.2 2280 под SSD NVMe и отдельный M.2 для сетевой карты. Еще есть 2 порта USB-C 3.0, 2 USB 3.0, 2 USB 2.0, DisplayPort 1.4, HDMI 1.4, двойной 5 Gigabit Ethernet, microSD и GPIO на 40 контактов.
Решение поддерживает Debian, Ubuntu, Android и Windows. Версия Orange Pi 6 Plus с 64 ГБ ОЗУ оценивается в ~$600$.
Мини-сервер размером с ладонь, идеально для DIY-сборок и краевых ИИ-проектов.
1👍4
This media is not supported in your browser
VIEW IN TELEGRAM
⚙️ AWS запустила инстансы EC2 R8a C AMD EPYC Turin и приростом до 30%
Amazon представила новые инстансы EC2 R8a на базе серверных процессоров AMD EPYC 9005 (Turin). Производительность выросла на ~30% по сравнению с R7a, а соотношение цены и эффективности — на 19%.
Решения отлично подходят для высокопроизводительных рабочих нагрузок, требующих большого объема памяти, вроде баз данных SQL/NoSQL, in-memory-кэшей и EDA-нагрузок. Сертификация SAP подтверждена, R8a дает +38 % SAPS против R7a.
Пока R8a доступны в трех регионах США (Вирджиния, Огайо и Орегон) по тарифам On-Demand, Reserved и Spot.
Amazon представила новые инстансы EC2 R8a на базе серверных процессоров AMD EPYC 9005 (Turin). Производительность выросла на ~30% по сравнению с R7a, а соотношение цены и эффективности — на 19%.
Пропускная способность памяти увеличена на 45 %, работа GroovyJVM показывает +60% прироста. Новые инстансы используют платформу AWS Nitro v6 для еще большего увеличения эффективности и безопасности.
Решения отлично подходят для высокопроизводительных рабочих нагрузок, требующих большого объема памяти, вроде баз данных SQL/NoSQL, in-memory-кэшей и EDA-нагрузок. Сертификация SAP подтверждена, R8a дает +38 % SAPS против R7a.
Пока R8a доступны в трех регионах США (Вирджиния, Огайо и Орегон) по тарифам On-Demand, Reserved и Spot.
1👍4
📦 Завтра на канале выходит необычный обзор!
Мы нашли шасси от Gooxi, которое по сути является аналогом Supermicro CSE-826, но...
⚡️ с NVMe бекплейном,
⚡️ с более мощными блоками питания,
⚡️ и самое приятное - его реально можно купить
Ролик выйдет уже завтра!
Мы нашли шасси от Gooxi, которое по сути является аналогом Supermicro CSE-826, но...
Если вы подбираете корпус под мощную систему с материнкой в форм-факторе ATX или E-ATX, возможно Gooxi окажется интереснее, чем "ехегате")))
Ролик выйдет уже завтра!
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🌭1🍾1
🔥 AMD Zen 7 Grimlock — до 264 ядер и FP512 в новой архитектуре
Датамайнер Moore’s Law Is Dead вновь выпустил интересный инсайд. По его данным, AMD активно готовит новую архитектуру Zen 7 (Grimlock): вычислительные кристаллы CCD будут изготавливаться по техпроцессу TSMC A14, а модули с V-Cache — по N4P. Один CCD площадью ~98 мм² вмещает до 16 ядер, каждое с 2 МБ L2 и 4 МБ L3.
Если утечки верны, Zen 7 станет крупнейшим скачком AMD по эффективности и масштабируемости за всю историю линейки процессоров.
Датамайнер Moore’s Law Is Dead вновь выпустил интересный инсайд. По его данным, AMD активно готовит новую архитектуру Zen 7 (Grimlock): вычислительные кристаллы CCD будут изготавливаться по техпроцессу TSMC A14, а модули с V-Cache — по N4P. Один CCD площадью ~98 мм² вмещает до 16 ядер, каждое с 2 МБ L2 и 4 МБ L3.
Серверные чипы EPYC на Zen 7 могут насчитывать до 264 ядер и 2122 МБ L3-кэша (без 3D Cache). Варианты X3D получат 160 МБ дополнительного кэша и дают прирост 20–36% к Zen 6 при энергопотреблении всего 312 Вт на ядро. Поддержка FP512 (аналог AVX-512) подтверждает, что чипы будут сделаны с фокусом на HPC и ИИ-нагрузках(как будто и так было непонятно) .
Если утечки верны, Zen 7 станет крупнейшим скачком AMD по эффективности и масштабируемости за всю историю линейки процессоров.
👍4💩1🌭1
🎧 Step-Audio-EditX: открыта 3b аудиомодель с точным управлением звуком
Исследователи из Stepfun AI открыли исходный код Step-Audio-EditX — LLM-модели c 3 миллиардов параметров для редактирования речи и синтеза голоса.
Модель требует GPU с 32 ГБ памяти (тестировалась на NVIDIA L40S) и работает на PyTorch 2.4. В основе — трехкомпонентная архитектура с двойным аудиотокенизатором, LLM-ядром и аудиодекодером, выполняющим обратное преобразование токенов в звук.
Веса уже доступны на GitHub и ModelScope.
Исследователи из Stepfun AI открыли исходный код Step-Audio-EditX — LLM-модели c 3 миллиардов параметров для редактирования речи и синтеза голоса.
Она умеет менять эмоции, стиль и паралингвистику (смех, дыхание, удивление) без дополнительного обучения, а также выполнять Text-to-Speech с нуля, правда, пока только для английского, мандаринского и диалектов, включая сычуаньский и кантонский, но этот вопрос решается дообучением.
Модель требует GPU с 32 ГБ памяти (тестировалась на NVIDIA L40S) и работает на PyTorch 2.4. В основе — трехкомпонентная архитектура с двойным аудиотокенизатором, LLM-ядром и аудиодекодером, выполняющим обратное преобразование токенов в звук.
Step-Audio-EditX показывает, как аудио-LLM-подходы выходят за рамки TTS, приближая синтетическую речь к естественной выразительности человека.
Веса уже доступны на GitHub и ModelScope.
👍1
⚛️ NVQLink? А может лучше…EPYC? IBM запустила квантовый алгоритм на чипах AMD
Пока Хуанг рассказывает, что у Nvidia есть крутой интерконнект для подключения QPU и GPU, AMD без лишнего пафоса запускает квантовые алгоритмы для коррекции ошибок на обычных серверных чипах EPYC.
IBM планирует завершить квантовый компьютер Starling к 2029 году, но уже сейчас компания заявляет, что работа по интеграции с классическим оборудованием идет с опережением графика на год.
Пока Хуанг рассказывает, что у Nvidia есть крутой интерконнект для подключения QPU и GPU, AMD без лишнего пафоса запускает квантовые алгоритмы для коррекции ошибок на обычных серверных чипах EPYC.
Никаких дополнительных надстроек, никаких сложных межсоединений и интерконнектов — только голое железо с большой вычислительной мощностью. Все благодаря программируемым вентильным матрицам AMD, на которых алгоритм IBM заработал в 10 раз быстрее, чем было нужно по расчетам.
IBM планирует завершить квантовый компьютер Starling к 2029 году, но уже сейчас компания заявляет, что работа по интеграции с классическим оборудованием идет с опережением графика на год.
👍3
🤖 OpenAI готовит к выпуску модели GPT-5.1?
В OpenAI Enterprise нашли интересную информацию, согласно которой уже 24 ноября может выйти серия моделей GPT-5.1: базовая, размышляющая и Pro-версия.
Если это не фейк и даты указаны верно, то OpenAI снова идет по пути пакетного обновления — когда новая архитектура выходит сразу в нескольких конфигурациях для выполнения разных задач и удовлетворения разных типов пользователей.
Скорее всего, GPT-5.1 станет первым релизом с унифицированной reasoning-архитектурой, но это не точно.
В OpenAI Enterprise нашли интересную информацию, согласно которой уже 24 ноября может выйти серия моделей GPT-5.1: базовая, размышляющая и Pro-версия.
Следы моделей нашли в коде RBAC-настроек, которые обычно обновляются за несколько недель до нового релиза.
Если это не фейк и даты указаны верно, то OpenAI снова идет по пути пакетного обновления — когда новая архитектура выходит сразу в нескольких конфигурациях для выполнения разных задач и удовлетворения разных типов пользователей.
Скорее всего, GPT-5.1 станет первым релизом с унифицированной reasoning-архитектурой, но это не точно.
👍2
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️
Гоокси! Аналог Supermicro. Детально смотрим на достижение китайской народной промышленности.
https://youtu.be/ChsnkUwV8Ck
Гоокси! Аналог Supermicro. Детально смотрим на достижение китайской народной промышленности.
Пока SM, соблюдают санкции и не особо горят желанием импортировать в РФ свои "пустые корпуса". Ребята из Gooxi момент не упускают!
https://youtu.be/ChsnkUwV8Ck
YouTube
Китайцы скопировали Supermicro и сделали лучше? Обзор Gooxi!
Gooxi RMC2112-695-NV - китайское серверное шасси, которое удивляет! По сути, это аналог Supermicro 826, но с рядом улучшений: поддержка NVMe бекплейнов, более мощные блоки питания и возможность спокойно купить без сложностей с поставками.
В этом видео мы…
В этом видео мы…
👍2 1
💼 AMD захантила топ-менеджера Intel
Саураб Кулкарни, вице-президент Intel по управлению продуктами искусственного интеллекта для дата-центров, уходит из компании и, по сообщениям, присоединится к AMD. Руководить направлением временно будет Анил Нандури.
Кулкарни курировал развитие ИИ-направления Intel, в частности, принимал участие в разработке Gaudi 3 и фотонных межсоединений. До Intel он работал в Graphcore, Lucata и Microsoft Azure.
Для Intel это уже второй крупный переход за год: ранее подразделение DCAI покинул Джастин Хотар, ставший новым CEO Nokia.
Саураб Кулкарни, вице-президент Intel по управлению продуктами искусственного интеллекта для дата-центров, уходит из компании и, по сообщениям, присоединится к AMD. Руководить направлением временно будет Анил Нандури.
Кулкарни курировал развитие ИИ-направления Intel, в частности, принимал участие в разработке Gaudi 3 и фотонных межсоединений. До Intel он работал в Graphcore, Lucata и Microsoft Azure.
Уход совпал с активным набором AMD специалистов по ИИ — компания усиливает разработку учкорителей Instinct и ждет роста доходов от ИИ-направления до десятков миллиардов к 2027 году.
Для Intel это уже второй крупный переход за год: ранее подразделение DCAI покинул Джастин Хотар, ставший новым CEO Nokia.
👍3
❌ Дефицит GDDR7 грозит срывом релиза RTX 50 SUPER
По данным инсайдеров, NVIDIA может отложить или вовсе отменить серию видеокарт GeForce RTX 50 SUPER из-за нехватки видеопамяти GDDR7.
В стандартной линейке RTX 50 используется более доступная GDDR7 на 2 ГБ, тогда как версии SUPER задумывались с приростом памяти до 18-24 ГБ. Релиз планировали на CES 2026, но теперь приоритет, по слухам, смещен в сторону серверных ускорителей Blackwell и Rubin CPX.
Если дефицит сохранится, NVIDIA, скорее всего, ограничится базовыми картами RTX 50, а чипы SUPER останутся на бумаге, либо их релиз перенесут на третий квартал 2026.
По данным инсайдеров, NVIDIA может отложить или вовсе отменить серию видеокарт GeForce RTX 50 SUPER из-за нехватки видеопамяти GDDR7.
Эти модели, включая RTX 5070 SUPER и RTX 5080 SUPER, должны были получить более плотные модули по 3 ГБ каждый — но их массовое производство буксует на месте.
В стандартной линейке RTX 50 используется более доступная GDDR7 на 2 ГБ, тогда как версии SUPER задумывались с приростом памяти до 18-24 ГБ. Релиз планировали на CES 2026, но теперь приоритет, по слухам, смещен в сторону серверных ускорителей Blackwell и Rubin CPX.
Ранее подобная ситуация наблюдалась при выпуске видеокарт RTX 4000, когда из-за дефицита чипов GDDR6X Nvidia рассматривала переход на GDDR6.
Если дефицит сохранится, NVIDIA, скорее всего, ограничится базовыми картами RTX 50, а чипы SUPER останутся на бумаге, либо их релиз перенесут на третий квартал 2026.
👍3