Прайс на Nvidia RTX PRO 6000 Blackwell Workstation Edition снова взлетел — топовый ИИ-ускоритель теперь продается по $16 000, тогда как раньше за GPU требовали $13 250. При этом в момент выхода карточки в 2025 году стоимость RTX PRO 6000 Blackwell Workstation Edition достигала всего $8 565 — цена взлетела почти в 2 раза со старта продаж.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩19🤯6
Alibaba представила Qwen3.8-2.4T-A95B, первую открытую модель в классе Qwen-Max. с 2,4 трлн общих и 95 млрд благодаря архитектуре Mixture-of-ExpertsНативное контекстное окно составляет 262 144 токена, а расширенное достигает примерно 1,01 млн токенов.
Архитура основана на Qwen3.5 и использует DeltaNet, Gated Attention и Multi-Token Prediction. Для агентных задач Alibaba отдельно добавила управление глубиной рассуждения через reasoning_effort и сохранение предыдущего процесса рассуждений через preserve_thinking. Модель рассчитана на работу с большими кодовыми базами, документами и длинными цепочками действий, а для запуска компания указывает совместимость с vLLM, SGLang и TokenSpeed.
Веса LLM уже лежат на Hugging Face.
😅 Канал Serverflow в MAX: Подписаться
Архитура основана на Qwen3.5 и использует DeltaNet, Gated Attention и Multi-Token Prediction. Для агентных задач Alibaba отдельно добавила управление глубиной рассуждения через reasoning_effort и сохранение предыдущего процесса рассуждений через preserve_thinking. Модель рассчитана на работу с большими кодовыми базами, документами и длинными цепочками действий, а для запуска компания указывает совместимость с vLLM, SGLang и TokenSpeed.
В Terminal Bench 2.1 Qwen3.8 набрала 86,6 балла против 84,6 у Opus 4.8, 84,6 у Fable 5 и 88,8 у GPT-5.6 Sol. В SWE-bench Pro результат Qwen составил 67,7 против 69,2, 80,0 и 64,6 соответственно.
В DeepSWE 1.1 Qwen3.8 получила 56,6 балла против 59,0 у Opus 4.8, 70,0 у Fable 5 и 73,0 у GPT-5.6 Sol. На FrontierSWE она набрала 73,5, уступив Opus 4.8 с 70,0 и Fable 5 с 88,8, но опередив в этой таблице только модели с худшими результатами.
В AndroidBench Qwen3.8 получила 75,1 против 69,8 у Opus 4.8, 84,5 у Fable 5 и 74,0 у GPT-5.6 Sol. В общем тестировании Qwen3.8 показала 92,6 на GPQA Diamond против 92,0 у Opus 4.8, 92,6 у Fable 5 и 94,1 у GPT-5.6 Sol.
Веса LLM уже лежат на Hugging Face.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12🌭4🍾2
Команда Intel нашла уязвимость в процессорах…AMD. Бэкдоры CVE-2026-6726 и CVE-2026-6727 обнаружили в чипах Ryzen серий 3000-9000, Ryzen AI, Threadripper и Z1/Z2, а уязвимым оказался один модуль fTPM — благодаря дырам злоумышленники могли получить доступ к зашифрованным данным. Intel не стала портить жизнь конкурентам, поэтому о проблеме уже доложено вендорам материнских плат, чтобы те выпустили патч с исправлениями в BIOS.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍25💅5
Kioxia и SanDisk представили 2-Тбитную QLC 3D NAND 9-го поколения для серверных и облачных систем хранения. Новые ячейки памяти используют архитектуру CBA, где CMOS размещается непосредственно под массивом ячеек, а новая 6-плоскостная схема размещения позволяет увеличить производительность чтения и записи.
Главное изменение по сравнению с QLC NAND 8-го поколения связано со скоростью интерфейса — она выросла до 4,8 Гбит/с на контакт, то есть прирост составил 33%, а сами компании также заявляют о более высокой энергоэффективности операций чтения и записи. За счет CBA Kioxia и SanDisk могут отдельно развивать и CMOS, и массив памяти, не переделывая всю технологическую платформу целиком.
😅 Канал Serverflow в MAX: Подписаться
Главное изменение по сравнению с QLC NAND 8-го поколения связано со скоростью интерфейса — она выросла до 4,8 Гбит/с на контакт, то есть прирост составил 33%, а сами компании также заявляют о более высокой энергоэффективности операций чтения и записи. За счет CBA Kioxia и SanDisk могут отдельно развивать и CMOS, и массив памяти, не переделывая всю технологическую платформу целиком.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8
Вчера в сети распространился фейк, что Сэма Альтмана не стало. На деле это оказался вброс — кто-то (проделки Дарио?) отредактировал статью о CEO OpenAI в Wiki, и автоматизированная поисковая выдача Google начала указывать 12 августа как дату его кончины. На деле с Сэмом все хорошо, он будет продолжать дарить нам новые модели GPT за оверпрайс.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭17💅6💩2😡1
SpaceXAI представила Grok 4.6 — новая нейронка получила значительный скачок производительности, местами не только сравнявшись, но и обойдя GPT-5.6 Sol и Claude Fable 5. При этом цена осталась на уровне Grok 4.5: $2 за 1 миллион входных и $6 за 1 миллион выходных токенов. Похоже, SpaceXAI наконец-то прорвалась в высшую лигу ИИ-индустрии.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14💩3
Дженсен Хуанг заявил, что ИИ-ускорители Nvidia A100 “будут способны выполнять поставленные задачи с 2020 по 2029 год”. Видимо, после 2029 легендарные решения на Ampere уйдут на покой.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10💩4
Gemini 3.7 Flash теперь отображается в Google Cloud Console. Релиз может состояться уже сегодня 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10
DeepSeek обновила свою флагманскую ИИ-модель DeepSeek V4 Pro 0813 в API. В Terminal Bench 2.1 новая версия получила 87,9 балла против 72,1 у V4 Pro Preview, почти сравнявшись с Kimi K3 на 88,3 и Fable 5 на 88, а также обойдя Opus 4.8 с 85 баллами. Самый заметный прирост пришелся на агентные сценарии. В DeepSWE результат вырос с 12,8 до 62,7 балла, а в NL2Repo с 38,5 до 61,5. При этом контекстное окно осталось на уровне 1 млн токенов, поддерживаются обычный и thinking-режимы, вызов инструментов и Responses API. Пока обновление доступно только через API, новые веса не опубликованы. При этом компания подняла цены на использование нейронки: теперь за V4 Pro придется отдавать $0,66 за 1 млн входных токенов и $1,98 за 1 млн выходных токенов вне пиковой нагрузки. Новые тарифы вступят в силу в 16 августа — до этого момента модель будет оцениваться в $0,435 за 1 млн входных токенов и $0,87 за 1 млн выходных токенов соответственно.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🌭3💅1
ServerFlow | Новости и Железо 💾
До релиза Qwen3.8-27b осталось чуть больше суток 🎉 😅 Канал Serverflow в MAX: Подписаться
Фанаты Qwen тут? Вы бы хотели, чтобы мы начали поставлять легендарных капибар в честь релиза нового поколения Qwen?)
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🌭40👍22🤯3
ServerFlow | Новости и Железо 💾
Gemini 3.7 Flash теперь отображается в Google Cloud Console. Релиз может состояться уже сегодня 👀 😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14🤯2💩2💅1
This media is not supported in your browser
VIEW IN TELEGRAM
Сверхбыстрый режим для GPT-5.6 Sol теперь доступен в ограниченной предварительной версии в облаке Cerebras 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🤯2
ServerFlow | Новости и Железо 💾
Gemini 3.7 Flash уже появилась на Vertex 👀 😅 Канал Serverflow в MAX: Подписаться
Google официально выпустила Gemini 3.7 Flash, новую флагманскую модель Flash для программирования, агентных задач и многоэтапных рабочих процессов. Контекстное окно составляет 1 млн токенов, за один ответ модель может выдать до 64 тыс. токенов.
Глубину рассуждения можно выбрать вручную: low, medium или high. В low модель работает с минимальной задержкой, medium установлен по умолчанию для большинства задач, а high использует больше вычислений для сложного кода и агентных цепочек.
Google также улучшила диагностику ошибок, повторные попытки и завершение многошаговых задач, а генерация интерфейсов по дизайн-макетам стала точнее.
Gemini 3.7 Flash уже используется как версия Flash по умолчанию в Antigravity. До 31 декабря 2026 года в Google AI Studio и Gemini Enterprise Agent Platform действует цена $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных. С 1 января 2027 года тариф составит $1,50 и $7,50 соответственно.
😅 Канал Serverflow в MAX: Подписаться
Глубину рассуждения можно выбрать вручную: low, medium или high. В low модель работает с минимальной задержкой, medium установлен по умолчанию для большинства задач, а high использует больше вычислений для сложного кода и агентных цепочек.
Google также улучшила диагностику ошибок, повторные попытки и завершение многошаговых задач, а генерация интерфейсов по дизайн-макетам стала точнее.
Gemini 3.7 Flash уже используется как версия Flash по умолчанию в Antigravity. До 31 декабря 2026 года в Google AI Studio и Gemini Enterprise Agent Platform действует цена $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных. С 1 января 2027 года тариф составит $1,50 и $7,50 соответственно.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12
По данным отраслевых СМИ, AMD может заключить с Intel Foundry соглашение на выпуск процессоров по технологии корпусирования EMIB-T. Intel собирается запустить ее массовое производство в 2027 году, а готовность самой технологии уже достаточно высока для работы с крупными заказчиками, включая конкурентов
EMIB-T использует кремниевые перемычки со сквозными TSV для соединения нескольких кристаллов и памяти внутри одного корпуса. Аналитики оценивают стоимость такой упаковки примерно на 50% ниже TSMC CoWoS. Выход годных корпусов Intel уже приближается к 90%, хотя выход годных кремниевых подложек пока составляет около 50%.
Для AMD это может стать дополнительным источником упаковочных мощностей на фоне ограничений TSMC, которая получила заказы от Nvidia, Apple и других компаний на годы вперед.
😅 Канал Serverflow в MAX: Подписаться
EMIB-T использует кремниевые перемычки со сквозными TSV для соединения нескольких кристаллов и памяти внутри одного корпуса. Аналитики оценивают стоимость такой упаковки примерно на 50% ниже TSMC CoWoS. Выход годных корпусов Intel уже приближается к 90%, хотя выход годных кремниевых подложек пока составляет около 50%.
Для AMD это может стать дополнительным источником упаковочных мощностей на фоне ограничений TSMC, которая получила заказы от Nvidia, Apple и других компаний на годы вперед.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9
This media is not supported in your browser
VIEW IN TELEGRAM
Nvidia объявила, что передовые коммутаторы Spectrum-X Ethernet Photonics уже запущены в массовое производство.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍8🍾4🤯1
Производитель памяти CXMT обогнал Tencent и стал самой дорогой компанией Китая — теперь ее стоимость составляет $524 миллиарда против $510 миллиарда у Tencent.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🌭16👍8🍾2
ИИ-генератор музыки для пятерочки — MiniMax представила открытую модель MiniMaxMusic 3 для создания музыкальных композиций продолжительностью до 5 минут. На вход подаются текст песни и описание музыки, включая жанр, BPM, тональность, вокал, инструменты и структуру композиции. На выходе модель создает стерео WAV 32 кГц, 16 бит.
Внутри используется связка из двух моделей: глобальная LLM на 8 млрд параметров отвечает за доработку текста и работает с первым уровнем RVQ-кодов, а локальная модель на 0,6 млрд гененрирует вокальную артикуляцию, инструменты и акустические детали. Для разметки песни можно использовать секции [Intro], [Verse], [Pre-Chorus], [Chorus], [Bridge], [Instrumental] и [Outro], поэтому структура трека задается не только описанием стиля, но и непосредственно в исходном тексте.
После этого непрерывные скрытые состояния обеих моделей поступают в Flow-VAE вместо обычного декодирования только дискретных токенов. Музыкальный токенизатор использует восемь уровней RVQ: первый содержит 16 384 кодов и хранит основную музыкальную структуру, остальные семь по 1 024 кода описывают акустические детали. Такой подход позволяет сохранять мотивы, ритм, вокальную подачу и аранжировку на протяжении всей композиции, а Music 3 уже доступна для тестирования через демо.
Нейронка доступна на Hugging Face.
😅 Канал Serverflow в MAX: Подписаться
Внутри используется связка из двух моделей: глобальная LLM на 8 млрд параметров отвечает за доработку текста и работает с первым уровнем RVQ-кодов, а локальная модель на 0,6 млрд гененрирует вокальную артикуляцию, инструменты и акустические детали. Для разметки песни можно использовать секции [Intro], [Verse], [Pre-Chorus], [Chorus], [Bridge], [Instrumental] и [Outro], поэтому структура трека задается не только описанием стиля, но и непосредственно в исходном тексте.
После этого непрерывные скрытые состояния обеих моделей поступают в Flow-VAE вместо обычного декодирования только дискретных токенов. Музыкальный токенизатор использует восемь уровней RVQ: первый содержит 16 384 кодов и хранит основную музыкальную структуру, остальные семь по 1 024 кода описывают акустические детали. Такой подход позволяет сохранять мотивы, ритм, вокальную подачу и аранжировку на протяжении всей композиции, а Music 3 уже доступна для тестирования через демо.
Нейронка доступна на Hugging Face.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13💩3🤯1🍾1