ServerFlow | Новости и Железо 💾
4.24K subscribers
4.88K photos
387 videos
12 files
2.37K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
Прайс на Nvidia RTX PRO 6000 Blackwell Workstation Edition снова взлетел — топовый ИИ-ускоритель теперь продается по $16 000, тогда как раньше за GPU требовали $13 250. При этом в момент выхода карточки в 2025 году стоимость RTX PRO 6000 Blackwell Workstation Edition достигала всего $8 565 — цена взлетела почти в 2 раза со старта продаж.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩19🤯6
Alibaba представила Qwen3.8-2.4T-A95B, первую открытую модель в классе Qwen-Max. с 2,4 трлн общих и 95 млрд благодаря архитектуре Mixture-of-ExpertsНативное контекстное окно составляет 262 144 токена, а расширенное достигает примерно 1,01 млн токенов.

Архитура основана на Qwen3.5 и использует DeltaNet, Gated Attention и Multi-Token Prediction. Для агентных задач Alibaba отдельно добавила управление глубиной рассуждения через reasoning_effort и сохранение предыдущего процесса рассуждений через preserve_thinking. Модель рассчитана на работу с большими кодовыми базами, документами и длинными цепочками действий, а для запуска компания указывает совместимость с vLLM, SGLang и TokenSpeed.

В Terminal Bench 2.1 Qwen3.8 набрала 86,6 балла против 84,6 у Opus 4.8, 84,6 у Fable 5 и 88,8 у GPT-5.6 Sol. В SWE-bench Pro результат Qwen составил 67,7 против 69,2, 80,0 и 64,6 соответственно.


В DeepSWE 1.1 Qwen3.8 получила 56,6 балла против 59,0 у Opus 4.8, 70,0 у Fable 5 и 73,0 у GPT-5.6 Sol. На FrontierSWE она набрала 73,5, уступив Opus 4.8 с 70,0 и Fable 5 с 88,8, но опередив в этой таблице только модели с худшими результатами.


В AndroidBench Qwen3.8 получила 75,1 против 69,8 у Opus 4.8, 84,5 у Fable 5 и 74,0 у GPT-5.6 Sol. В общем тестировании Qwen3.8 показала 92,6 на GPQA Diamond против 92,0 у Opus 4.8, 92,6 у Fable 5 и 94,1 у GPT-5.6 Sol.


Веса LLM уже лежат на Hugging Face.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12🌭4🍾2
Команда Intel нашла уязвимость в процессорах…AMD. Бэкдоры CVE-2026-6726 и CVE-2026-6727 обнаружили в чипах Ryzen серий 3000-9000, Ryzen AI, Threadripper и Z1/Z2, а уязвимым оказался один модуль fTPM — благодаря дырам злоумышленники могли получить доступ к зашифрованным данным. Intel не стала портить жизнь конкурентам, поэтому о проблеме уже доложено вендорам материнских плат, чтобы те выпустили патч с исправлениями в BIOS.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍25💅5
Kioxia и SanDisk представили 2-Тбитную QLC 3D NAND 9-го поколения для серверных и облачных систем хранения. Новые ячейки памяти используют архитектуру CBA, где CMOS размещается непосредственно под массивом ячеек, а новая 6-плоскостная схема размещения позволяет увеличить производительность чтения и записи.

Главное изменение по сравнению с QLC NAND 8-го поколения связано со скоростью интерфейса — она выросла до 4,8 Гбит/с на контакт, то есть прирост составил 33%, а сами компании также заявляют о более высокой энергоэффективности операций чтения и записи. За счет CBA Kioxia и SanDisk могут отдельно развивать и CMOS, и массив памяти, не переделывая всю технологическую платформу целиком.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8
Вчера в сети распространился фейк, что Сэма Альтмана не стало. На деле это оказался вброс — кто-то (проделки Дарио?) отредактировал статью о CEO OpenAI в Wiki, и автоматизированная поисковая выдача Google начала указывать 12 августа как дату его кончины. На деле с Сэмом все хорошо, он будет продолжать дарить нам новые модели GPT за оверпрайс.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭17💅6💩2😡1
SpaceXAI представила Grok 4.6 — новая нейронка получила значительный скачок производительности, местами не только сравнявшись, но и обойдя GPT-5.6 Sol и Claude Fable 5. При этом цена осталась на уровне Grok 4.5: $2 за 1 миллион входных и $6 за 1 миллион выходных токенов. Похоже, SpaceXAI наконец-то прорвалась в высшую лигу ИИ-индустрии.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14💩3
Дженсен Хуанг заявил, что ИИ-ускорители Nvidia A100 “будут способны выполнять поставленные задачи с 2020 по 2029 год”. Видимо, после 2029 легендарные решения на Ampere уйдут на покой.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10💩4
До релиза Qwen3.8-27b осталось чуть больше суток 🎉

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍32🍾9💩1
Gemini 3.7 Flash теперь отображается в Google Cloud Console. Релиз может состояться уже сегодня 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10
DeepSeek обновила свою флагманскую ИИ-модель DeepSeek V4 Pro 0813 в API. В Terminal Bench 2.1 новая версия получила 87,9 балла против 72,1 у V4 Pro Preview, почти сравнявшись с Kimi K3 на 88,3 и Fable 5 на 88, а также обойдя Opus 4.8 с 85 баллами. Самый заметный прирост пришелся на агентные сценарии. В DeepSWE результат вырос с 12,8 до 62,7 балла, а в NL2Repo с 38,5 до 61,5. При этом контекстное окно осталось на уровне 1 млн токенов, поддерживаются обычный и thinking-режимы, вызов инструментов и Responses API. Пока обновление доступно только через API, новые веса не опубликованы. При этом компания подняла цены на использование нейронки: теперь за V4 Pro придется отдавать $0,66 за 1 млн входных токенов и $1,98 за 1 млн выходных токенов вне пиковой нагрузки. Новые тарифы вступят в силу в 16 августа — до этого момента модель будет оцениваться в $0,435 за 1 млн входных токенов и $0,87 за 1 млн выходных токенов соответственно.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🌭3💅1
ServerFlow | Новости и Железо 💾
До релиза Qwen3.8-27b осталось чуть больше суток 🎉 😅 Канал Serverflow в MAX: Подписаться
Фанаты Qwen тут? Вы бы хотели, чтобы мы начали поставлять легендарных капибар в честь релиза нового поколения Qwen?)

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🌭40👍22🤯3
This media is not supported in your browser
VIEW IN TELEGRAM
Сверхбыстрый режим для GPT-5.6 Sol теперь доступен в ограниченной предварительной версии в облаке Cerebras 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🤯2
ServerFlow | Новости и Железо 💾
Gemini 3.7 Flash уже появилась на Vertex 👀 😅 Канал Serverflow в MAX: Подписаться
Google официально выпустила Gemini 3.7 Flash, новую флагманскую модель Flash для программирования, агентных задач и многоэтапных рабочих процессов. Контекстное окно составляет 1 млн токенов, за один ответ модель может выдать до 64 тыс. токенов.

Глубину рассуждения можно выбрать вручную: low, medium или high. В low модель работает с минимальной задержкой, medium установлен по умолчанию для большинства задач, а high использует больше вычислений для сложного кода и агентных цепочек.

Google также улучшила диагностику ошибок, повторные попытки и завершение многошаговых задач, а генерация интерфейсов по дизайн-макетам стала точнее.

Gemini 3.7 Flash уже используется как версия Flash по умолчанию в Antigravity. До 31 декабря 2026 года в Google AI Studio и Gemini Enterprise Agent Platform действует цена $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных. С 1 января 2027 года тариф составит $1,50 и $7,50 соответственно.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12
По данным отраслевых СМИ, AMD может заключить с Intel Foundry соглашение на выпуск процессоров по технологии корпусирования EMIB-T. Intel собирается запустить ее массовое производство в 2027 году, а готовность самой технологии уже достаточно высока для работы с крупными заказчиками, включая конкурентов

EMIB-T использует кремниевые перемычки со сквозными TSV для соединения нескольких кристаллов и памяти внутри одного корпуса. Аналитики оценивают стоимость такой упаковки примерно на 50% ниже TSMC CoWoS. Выход годных корпусов Intel уже приближается к 90%, хотя выход годных кремниевых подложек пока составляет около 50%.

Для AMD это может стать дополнительным источником упаковочных мощностей на фоне ограничений TSMC, которая получила заказы от Nvidia, Apple и других компаний на годы вперед.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9
This media is not supported in your browser
VIEW IN TELEGRAM
Nvidia объявила, что передовые коммутаторы Spectrum-X Ethernet Photonics уже запущены в массовое производство.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍8🍾4🤯1
Производитель памяти CXMT обогнал Tencent и стал самой дорогой компанией Китая — теперь ее стоимость составляет $524 миллиарда против $510 миллиарда у Tencent.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🌭16👍8🍾2
ИИ-генератор музыки для пятерочки — MiniMax представила открытую модель MiniMaxMusic 3 для создания музыкальных композиций продолжительностью до 5 минут. На вход подаются текст песни и описание музыки, включая жанр, BPM, тональность, вокал, инструменты и структуру композиции. На выходе модель создает стерео WAV 32 кГц, 16 бит.

Внутри используется связка из двух моделей: глобальная LLM на 8 млрд параметров отвечает за доработку текста и работает с первым уровнем RVQ-кодов, а локальная модель на 0,6 млрд гененрирует вокальную артикуляцию, инструменты и акустические детали. Для разметки песни можно использовать секции [Intro], [Verse], [Pre-Chorus], [Chorus], [Bridge], [Instrumental] и [Outro], поэтому структура трека задается не только описанием стиля, но и непосредственно в исходном тексте.

После этого непрерывные скрытые состояния обеих моделей поступают в Flow-VAE вместо обычного декодирования только дискретных токенов. Музыкальный токенизатор использует восемь уровней RVQ: первый содержит 16 384 кодов и хранит основную музыкальную структуру, остальные семь по 1 024 кода описывают акустические детали. Такой подход позволяет сохранять мотивы, ритм, вокальную подачу и аранжировку на протяжении всей композиции, а Music 3 уже доступна для тестирования через демо.

Нейронка доступна на Hugging Face.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13💩3🤯1🍾1