🔮 GeForce RTX 6090 может быть на 40-55 % быстрее RTX 5090
Инсайдер Moore’s Law is Dead — настоящая Ванга в IT-среде. Правда, если предсказания Ванги, на самом деле, не сбывались, то прогнозы Moore’s Law is Dead не раз оказывались правдой.
В этот раз он поделился очень многообещающей инфой — якобы, производительность будущего флагмана Nvidia RTX 6090 будет на 40-55% выше, чем у RTX 5090.
Прогноз основан на утечках, связанных с конкурентной серией AMD Radeon RX 10000 (RDNA 7), релиз которой ожидается в 2027 году. В документах фигурирует модель Radeon RX 10090 XT с 36 ГБ памяти и 154 вычислительными блоками — примерно вдвое быстрее RTX 4090. Датамайнер считает, что аналогичная производительность будет и у RTX 6090.
Верим? 🤔
Инсайдер Moore’s Law is Dead — настоящая Ванга в IT-среде. Правда, если предсказания Ванги, на самом деле, не сбывались, то прогнозы Moore’s Law is Dead не раз оказывались правдой.
В этот раз он поделился очень многообещающей инфой — якобы, производительность будущего флагмана Nvidia RTX 6090 будет на 40-55% выше, чем у RTX 5090.
Пока о сроках выхода Nvidia RTX 6090 ничего не известно, но если темпы обновления архитектуры Blackwell сохранятся, новинка может появиться не раньше второй половины 2026 года.
Прогноз основан на утечках, связанных с конкурентной серией AMD Radeon RX 10000 (RDNA 7), релиз которой ожидается в 2027 году. В документах фигурирует модель Radeon RX 10090 XT с 36 ГБ памяти и 154 вычислительными блоками — примерно вдвое быстрее RTX 4090. Датамайнер считает, что аналогичная производительность будет и у RTX 6090.
Верим? 🤔
1👍2
💰 Intel нацелилась на SambaNova
Мы тут недавно рассказывали, что команда стартапа SambaNova не смогла привлечь инвестиции и планирует продать свой бизнес. Изначально все думали, что компания будет поглощена Oracle, но оказалось, что к сделке по покупке подключилась Intel.
Сделка оценивается минимум в $5 млрд — именно столько стоила SambaNova после последнего раунда инвестиций в 2021 году. В отличие от Oracle, которая хотела просто подобрать перспективных инженеров с тонущего корабля, Intel планирует забрать не только людей, но и технологию разработки RDU-чипов.
Если сделка состоится, Intel получит замкнутую экосистему SambaNova — от RDU-чипов и стоек SambaRack до софта SambaFlow и системы развертывания ИИ DataScale.
Однако сумма в $5 млрд выглядит тяжелой для Intel, которая все еще восстанавливается после нескольких кризисных лет и череды провальных релизов.
Мы тут недавно рассказывали, что команда стартапа SambaNova не смогла привлечь инвестиции и планирует продать свой бизнес. Изначально все думали, что компания будет поглощена Oracle, но оказалось, что к сделке по покупке подключилась Intel.
Сделка оценивается минимум в $5 млрд — именно столько стоила SambaNova после последнего раунда инвестиций в 2021 году. В отличие от Oracle, которая хотела просто подобрать перспективных инженеров с тонущего корабля, Intel планирует забрать не только людей, но и технологию разработки RDU-чипов.
Понятное дело, что таким нехитрым способом Intel хочет наверстать упущенное в ИИ-сегменте.
Если сделка состоится, Intel получит замкнутую экосистему SambaNova — от RDU-чипов и стоек SambaRack до софта SambaFlow и системы развертывания ИИ DataScale.
Однако сумма в $5 млрд выглядит тяжелой для Intel, которая все еще восстанавливается после нескольких кризисных лет и череды провальных релизов.
🌭2👍1
🤖 Emu3.5: новая мультимодальная world-модель с 20-кратным ускорением
BAAI представила Emu3.5 — крупную мультимодальную систему мира, объединяющую текст, видео и изображения в общее пространство восприятия.
Модель с 34 мдрд параметров обучена на более чем 10 трлн визуальных/языковых токенов и дополнительно оптимизирована с помощью обучения с подкреплением, что усилило ее способности к рассуждению и смешанной генерации контента.
Главный козырь — метод DiDA (Discrete Diffusion Adaptation). Он переводит последовательное декодирование в параллельное двустороннее предсказание токенов, благодаря чему инференс ускоряется примерно в 20 раз без потери качества.
По сути, BAAI пытается приблизить модель к человеческому восприятию, где язык, зрение и действия связаны в единую систему.
BAAI представила Emu3.5 — крупную мультимодальную систему мира, объединяющую текст, видео и изображения в общее пространство восприятия.
Модель с 34 мдрд параметров обучена на более чем 10 трлн визуальных/языковых токенов и дополнительно оптимизирована с помощью обучения с подкреплением, что усилило ее способности к рассуждению и смешанной генерации контента.
Главный козырь — метод DiDA (Discrete Diffusion Adaptation). Он переводит последовательное декодирование в параллельное двустороннее предсказание токенов, благодаря чему инференс ускоряется примерно в 20 раз без потери качества.
Emu3.5 уже показывает преимущество над предыдущими версиями и конкурентами вроде Nano Banana в задачах редактирования и генерации мультимодальных данных.
По сути, BAAI пытается приблизить модель к человеческому восприятию, где язык, зрение и действия связаны в единую систему.
👍2
🤖 ByteDance тестирует архитектуру LoopLM Ouro
Китайский ИИ-гигант ByteDance наращивает авторитет в ИИ, стремясь превзойти Alibaba и DeepSeek. Сейчас компания готовит новый козырь в рукаве в лице новой, уникальной архитектуры LoopLM Ouro.
LoopLM Ouro использует нелинейный подход, при котором модель будет прогонять стек слоев LLM (до 4 циклов), формируя более глубокие скрытые рассуждения без увеличения параметров.
На базе LoopLM уже разработаны 2 модели — Ouro-1.4B (24 слоя) и Ouro-2.6B (48 слоев). Обе обучены на датасете из 7,7 трлн токенов, поддерживают рассуждения и доступны для скачивания на HuggingFace.
Пока что LoopLM отстает от трансформеров по скорости и стабильности, но ByteDance активно ведет доработку своей новинки, которая можно будет задействовать в краевых и адаптивных вычислениях.
Китайский ИИ-гигант ByteDance наращивает авторитет в ИИ, стремясь превзойти Alibaba и DeepSeek. Сейчас компания готовит новый козырь в рукаве в лице новой, уникальной архитектуры LoopLM Ouro.
LoopLM Ouro использует нелинейный подход, при котором модель будет прогонять стек слоев LLM (до 4 циклов), формируя более глубокие скрытые рассуждения без увеличения параметров.
Архитектура также включает технологии MHA, RoPE, SwiGLU и сэндвич-нормализацию. По данным команды, LoopLM лучше распознает вредоносные запросы и последовательно уточняет ответы между шагами.
На базе LoopLM уже разработаны 2 модели — Ouro-1.4B (24 слоя) и Ouro-2.6B (48 слоев). Обе обучены на датасете из 7,7 трлн токенов, поддерживают рассуждения и доступны для скачивания на HuggingFace.
Пока что LoopLM отстает от трансформеров по скорости и стабильности, но ByteDance активно ведет доработку своей новинки, которая можно будет задействовать в краевых и адаптивных вычислениях.
👍1
❌ Intel свернула планы по Battlemage с 3D-кэшем и 40 ядрами Xe2
Инсайдеры раскрыли отмененные планы Intel по выпуску линейки GPU BMG-G10, у которых было до 40 ядер Xe2, 512 МБ 3D-V кэша и интерфейсом PCIe 5.0, которые должны были войти в линейку Battlemage.
Эти решения разрабатывались для мощных ИИ-ускорителей с 192-битными и 256-битными шинами памяти и также рассматривались как основа для интеграции в процессоры Halo SoC.
Процессоры Halo SoC с этим GPU также отменили — теперь ставка делается на Nova Lake с графикой Xe3P.
Причина сворачивания — финансовое давление и реструктуризация GPU-подразделения под новым руководством. Battlemage BMG-G21 с 20 ядрами Xe2 остался единственным представителем отмененной серии.
Инсайдеры раскрыли отмененные планы Intel по выпуску линейки GPU BMG-G10, у которых было до 40 ядер Xe2, 512 МБ 3D-V кэша и интерфейсом PCIe 5.0, которые должны были войти в линейку Battlemage.
Эти решения разрабатывались для мощных ИИ-ускорителей с 192-битными и 256-битными шинами памяти и также рассматривались как основа для интеграции в процессоры Halo SoC.
Видеокарты на базе BMG-G10 должны были называться Battlemage X3/X4 (до 28 ядер у X3 и до 40 ядер у X4). На плате могло размещаться до 6 чипов GDDR6, а питание подавалось по 2×8 pin).
Процессоры Halo SoC с этим GPU также отменили — теперь ставка делается на Nova Lake с графикой Xe3P.
Причина сворачивания — финансовое давление и реструктуризация GPU-подразделения под новым руководством. Battlemage BMG-G21 с 20 ядрами Xe2 остался единственным представителем отмененной серии.
🤯1
Сегодня вечером на Ютубе Выйдет одна из самых красивых сборок, что мы снимали.📈
В этом ролике мы покажем, как DeepSeek R1 70B работает на этом железе и какого размера контекста нам удалось достигнуть.
Gigabyte MZ73-LM0 + 2x EPYC + H100 96GB
В этом ролике мы покажем, как DeepSeek R1 70B работает на этом железе и какого размера контекста нам удалось достигнуть.
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍4 2💩1
🤖 LongCat-Flash-Omni: мультимодальная модель с 560 млрд параметров
Компания Meituan LongCat очень неожиданно перешла из сферы доставки еды в область разработки искусственного интеллекта, и что самое удивительное, их нейросети разрывают все шаблоны.
Недавно они представили свой новый проект LongCat-Flash-Omni — мультимодальную модель нового поколения на архитектуре MoE с 560 млрд параметров (27 млрд активных), и при этом она находится в открытом доступе на GitHub.
LongCat-Flash-Omni использует энкодеры и декодеры для каждой модальности и обучающий конвейер с поэтапным включением модальностей. Такой подход сохраняет производительность в кросс-модальных навыках.
LongCat-Flash-Omni близка к Gemini 2.5 Pro и превосходит Qwen 3 Omni в заданиях на память и мультимодальность.
Компания Meituan LongCat очень неожиданно перешла из сферы доставки еды в область разработки искусственного интеллекта, и что самое удивительное, их нейросети разрывают все шаблоны.
Недавно они представили свой новый проект LongCat-Flash-Omni — мультимодальную модель нового поколения на архитектуре MoE с 560 млрд параметров (27 млрд активных), и при этом она находится в открытом доступе на GitHub.
Нейронка объединяет текст, изображение, аудио и речь в едином контексте и работает в режиме реального времени с минимальной задержкой. Контекстное окно достигает 128 000 токенов.
LongCat-Flash-Omni использует энкодеры и декодеры для каждой модальности и обучающий конвейер с поэтапным включением модальностей. Такой подход сохраняет производительность в кросс-модальных навыках.
LongCat-Flash-Omni близка к Gemini 2.5 Pro и превосходит Qwen 3 Omni в заданиях на память и мультимодальность.
1👍3💩1🌭1
⚒️ Nano-vLLM: минималистичная версия vLLM в 1200 строк кода
А вы знали, что существует облегченная версия движка инференса vLLM? Она называется Nano-vLLM, ее разработал один из инженеров DeepSeek и движок умещается всего в 1200 строк кода на Python.
Платформа поддерживает кэширование префиксов, тензорный параллелизм, компиляцию Torch и использование CUDA-графов. Такой набор делает ее пригодной для быстрой отладки, экспериментов и обучения принципам высокопроизводительного вывода LLM без тяжелых зависимостей.
Идеальный вариант, чтобы вкатиться в ИИ, если хочется работать с vLLM, но ориг не тянет.
А вы знали, что существует облегченная версия движка инференса vLLM? Она называется Nano-vLLM, ее разработал один из инженеров DeepSeek и движок умещается всего в 1200 строк кода на Python.
Nano-vLLM обеспечивает сопоставимую скорость вывода ИИ и сохраняет ключевые принципы оригинальной архитектуры — открытость, совместимость и высочайшую производительность.
Платформа поддерживает кэширование префиксов, тензорный параллелизм, компиляцию Torch и использование CUDA-графов. Такой набор делает ее пригодной для быстрой отладки, экспериментов и обучения принципам высокопроизводительного вывода LLM без тяжелых зависимостей.
Идеальный вариант, чтобы вкатиться в ИИ, если хочется работать с vLLM, но ориг не тянет.
👍2
Смотрим на рабочую станцию с H100. Вообще вроде красиво получилось. Да и приятно когда токены так быстро вылетают, хотя H100 и побыстрее может)))
DeepSeek 70B Q4_K_M + 128k контекст. Посмотреть как он работает можно по таймкодам. Мы об этом позаботились!
https://youtu.be/RC44oa_m_vY?si=8prXC_X8WDfEuIw3
Please open Telegram to view this post
VIEW IN TELEGRAM
YouTube
Сборка сервера для ИИ: DeepSeek локально на H100 и EPYC
Собираем сервер для ИИ на двух процессорах AMD EPYC и видеокарте NVIDIA H100. Это мощная рабочая станция, созданная для задач обучения и инференса нейросетей. Демонстрируем процесс сборки, организацию охлаждения, кабель-менеджмент и установку компонентов…
52 5 2🌭1💅1
⚒️ Wine 10.18: подготовка к релизу 11.0 идет во всю
Популярная прога Wine для запуска приложений Windows на Linux получила новое обновление до версии 10.18.
Главные новшества — расширения режима WoW64, который позволяет запускать 32-битные Windows-программы в 64-битных системах Linux. Теперь WoW64 поддерживает отображение памяти OpenGL через Vulkan и обеспечивает сквозную работу SCSI-устройств.
Также были добавлены API барьеров синхронизации и улучшена обработка исключений WinRT. Всего исправлено около 30 ошибок, включая игровые и прикладные сбои.
Обновление можно скачать на официальном сайте проекта WineHQ.
Популярная прога Wine для запуска приложений Windows на Linux получила новое обновление до версии 10.18.
Главные новшества — расширения режима WoW64, который позволяет запускать 32-битные Windows-программы в 64-битных системах Linux. Теперь WoW64 поддерживает отображение памяти OpenGL через Vulkan и обеспечивает сквозную работу SCSI-устройств.
Также были добавлены API барьеров синхронизации и улучшена обработка исключений WinRT. Всего исправлено около 30 ошибок, включая игровые и прикладные сбои.
Все изменения сделаны в целях подготовки к запуску нового, крупного апдейта до версии Wine 11.0.
Обновление можно скачать на официальном сайте проекта WineHQ.
👍1
🤯 PewDiePie теперь техноблогер
PewDiePie, который в прошлом был самым популярным летсплейщиком и ютубером в целом, похоже, успешно справился с кризисом среднего возраста, став…техноблогером, которого смотрят миллионы человек.
Он уже выпустил ролики про вкатывание в Linux, сборку сервака, локальный инференс нейронок по 120 млрд параметров, написание СОБСТВЕННОГО чат-бота ChatOS, настройку RAG и прочие интересности, приправляя это прикольчиками и фирменным монтажом.
А ведь все начиналось с редстоуна в майнкрафте…
Поздравляем легенду, но мы то с вами знаем, на каком канале реально шарят за серверное железо 😉
PewDiePie, который в прошлом был самым популярным летсплейщиком и ютубером в целом, похоже, успешно справился с кризисом среднего возраста, став…техноблогером, которого смотрят миллионы человек.
Он уже выпустил ролики про вкатывание в Linux, сборку сервака, локальный инференс нейронок по 120 млрд параметров, написание СОБСТВЕННОГО чат-бота ChatOS, настройку RAG и прочие интересности, приправляя это прикольчиками и фирменным монтажом.
При этом, за Феликсом следят свыше 110 млн человек, и миллионы зрителей реально смотрят, как он компилирует CUDA или собирает платформу на RTX 4000 Ada и RTX 4090.
А ведь все начиналось с редстоуна в майнкрафте…
Поздравляем легенду, но мы то с вами знаем, на каком канале реально шарят за серверное железо 😉
👍3
🖥 ORICO выпустила мини-ПК OmniPro в стиле Mac Pro с Ryzen 7 8845HS
Китайская компания ORICO представила компактный ПК OmniPro, который подозрительно похож на уменьшенный Mac Pro.
Корпус с габаритами 139 × 61 × 185 мм выполнен из алюминия, а внутри стоит 8-ядерный Ryzen 7 8845HS (16 потоков, до 5,1 ГГц) с графикой Radeon 780M на архитектуре RDNA 3.
Базовая версия без памяти и накопителя оценивается в ~$550, а вариант с 32 ГБ ОЗУ и 1 ТБ SSD стоит ~$605.
Модель уже доступна для заказа в Китае и, судя по форм-фактору, будет конкурировать с мини-ПК от китайских Beelink и Minisforum в нише компактных рабочих станций.
Китайская компания ORICO представила компактный ПК OmniPro, который подозрительно похож на уменьшенный Mac Pro.
Корпус с габаритами 139 × 61 × 185 мм выполнен из алюминия, а внутри стоит 8-ядерный Ryzen 7 8845HS (16 потоков, до 5,1 ГГц) с графикой Radeon 780M на архитектуре RDNA 3.
Заявленная вычислительная мощность — до 38 TOPS, что позволяет использовать устройство для легких ИИ-задач и мультимедийных приложений.
Базовая версия без памяти и накопителя оценивается в ~$550, а вариант с 32 ГБ ОЗУ и 1 ТБ SSD стоит ~$605.
Модель уже доступна для заказа в Китае и, судя по форм-фактору, будет конкурировать с мини-ПК от китайских Beelink и Minisforum в нише компактных рабочих станций.
👍3