ServerFlow | Новости и Железо 💾
4.24K subscribers
4.88K photos
387 videos
12 files
2.37K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
SpaceXAI представила Grok 4.6 — новая нейронка получила значительный скачок производительности, местами не только сравнявшись, но и обойдя GPT-5.6 Sol и Claude Fable 5. При этом цена осталась на уровне Grok 4.5: $2 за 1 миллион входных и $6 за 1 миллион выходных токенов. Похоже, SpaceXAI наконец-то прорвалась в высшую лигу ИИ-индустрии.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14💩3
Дженсен Хуанг заявил, что ИИ-ускорители Nvidia A100 “будут способны выполнять поставленные задачи с 2020 по 2029 год”. Видимо, после 2029 легендарные решения на Ampere уйдут на покой.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10💩4
До релиза Qwen3.8-27b осталось чуть больше суток 🎉

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍32🍾9💩1
Gemini 3.7 Flash теперь отображается в Google Cloud Console. Релиз может состояться уже сегодня 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10
DeepSeek обновила свою флагманскую ИИ-модель DeepSeek V4 Pro 0813 в API. В Terminal Bench 2.1 новая версия получила 87,9 балла против 72,1 у V4 Pro Preview, почти сравнявшись с Kimi K3 на 88,3 и Fable 5 на 88, а также обойдя Opus 4.8 с 85 баллами. Самый заметный прирост пришелся на агентные сценарии. В DeepSWE результат вырос с 12,8 до 62,7 балла, а в NL2Repo с 38,5 до 61,5. При этом контекстное окно осталось на уровне 1 млн токенов, поддерживаются обычный и thinking-режимы, вызов инструментов и Responses API. Пока обновление доступно только через API, новые веса не опубликованы. При этом компания подняла цены на использование нейронки: теперь за V4 Pro придется отдавать $0,66 за 1 млн входных токенов и $1,98 за 1 млн выходных токенов вне пиковой нагрузки. Новые тарифы вступят в силу в 16 августа — до этого момента модель будет оцениваться в $0,435 за 1 млн входных токенов и $0,87 за 1 млн выходных токенов соответственно.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🌭3💅1
ServerFlow | Новости и Железо 💾
До релиза Qwen3.8-27b осталось чуть больше суток 🎉 😅 Канал Serverflow в MAX: Подписаться
Фанаты Qwen тут? Вы бы хотели, чтобы мы начали поставлять легендарных капибар в честь релиза нового поколения Qwen?)

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🌭40👍22🤯3
This media is not supported in your browser
VIEW IN TELEGRAM
Сверхбыстрый режим для GPT-5.6 Sol теперь доступен в ограниченной предварительной версии в облаке Cerebras 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🤯2
ServerFlow | Новости и Железо 💾
Gemini 3.7 Flash уже появилась на Vertex 👀 😅 Канал Serverflow в MAX: Подписаться
Google официально выпустила Gemini 3.7 Flash, новую флагманскую модель Flash для программирования, агентных задач и многоэтапных рабочих процессов. Контекстное окно составляет 1 млн токенов, за один ответ модель может выдать до 64 тыс. токенов.

Глубину рассуждения можно выбрать вручную: low, medium или high. В low модель работает с минимальной задержкой, medium установлен по умолчанию для большинства задач, а high использует больше вычислений для сложного кода и агентных цепочек.

Google также улучшила диагностику ошибок, повторные попытки и завершение многошаговых задач, а генерация интерфейсов по дизайн-макетам стала точнее.

Gemini 3.7 Flash уже используется как версия Flash по умолчанию в Antigravity. До 31 декабря 2026 года в Google AI Studio и Gemini Enterprise Agent Platform действует цена $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных. С 1 января 2027 года тариф составит $1,50 и $7,50 соответственно.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12
По данным отраслевых СМИ, AMD может заключить с Intel Foundry соглашение на выпуск процессоров по технологии корпусирования EMIB-T. Intel собирается запустить ее массовое производство в 2027 году, а готовность самой технологии уже достаточно высока для работы с крупными заказчиками, включая конкурентов

EMIB-T использует кремниевые перемычки со сквозными TSV для соединения нескольких кристаллов и памяти внутри одного корпуса. Аналитики оценивают стоимость такой упаковки примерно на 50% ниже TSMC CoWoS. Выход годных корпусов Intel уже приближается к 90%, хотя выход годных кремниевых подложек пока составляет около 50%.

Для AMD это может стать дополнительным источником упаковочных мощностей на фоне ограничений TSMC, которая получила заказы от Nvidia, Apple и других компаний на годы вперед.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9
This media is not supported in your browser
VIEW IN TELEGRAM
Nvidia объявила, что передовые коммутаторы Spectrum-X Ethernet Photonics уже запущены в массовое производство.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍8🍾4🤯1
Производитель памяти CXMT обогнал Tencent и стал самой дорогой компанией Китая — теперь ее стоимость составляет $524 миллиарда против $510 миллиарда у Tencent.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🌭16👍8🍾2
ИИ-генератор музыки для пятерочки — MiniMax представила открытую модель MiniMaxMusic 3 для создания музыкальных композиций продолжительностью до 5 минут. На вход подаются текст песни и описание музыки, включая жанр, BPM, тональность, вокал, инструменты и структуру композиции. На выходе модель создает стерео WAV 32 кГц, 16 бит.

Внутри используется связка из двух моделей: глобальная LLM на 8 млрд параметров отвечает за доработку текста и работает с первым уровнем RVQ-кодов, а локальная модель на 0,6 млрд гененрирует вокальную артикуляцию, инструменты и акустические детали. Для разметки песни можно использовать секции [Intro], [Verse], [Pre-Chorus], [Chorus], [Bridge], [Instrumental] и [Outro], поэтому структура трека задается не только описанием стиля, но и непосредственно в исходном тексте.

После этого непрерывные скрытые состояния обеих моделей поступают в Flow-VAE вместо обычного декодирования только дискретных токенов. Музыкальный токенизатор использует восемь уровней RVQ: первый содержит 16 384 кодов и хранит основную музыкальную структуру, остальные семь по 1 024 кода описывают акустические детали. Такой подход позволяет сохранять мотивы, ритм, вокальную подачу и аранжировку на протяжении всей композиции, а Music 3 уже доступна для тестирования через демо.

Нейронка доступна на Hugging Face.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13💩3🤯1🍾1
По данным DigiTimes, NVIDIA уже активно разрабатывает следующее поколение GPU Feynman, которое должно прийти на смену Rubin и Rubin Ultra. Для этих чипов компания, как сообщается, выбрала 1,6-нм техпроцесс TSMC A16 вместо N2, а массовое производство ожидается во второй половине 2028 года.

Feynman получит поддержку технологии подачи питания с обратной стороны кристалла, 3D-стекирование SoIC и упаковку CoWoS-L или CoPoS. Несколько чиплетов сначала будут объединяться через SoIC, а затем устанавливаться в общий 2.5D-корпус. Для GPU также ожидается специальная HBM, вероятно HBM4E, с собственным базовым кристаллом, который сможет выполнять часть логики непосредственно рядом с памятью.

Отдельно NVIDIA собирается перейти на CPO с технологией COUPE от TSMC, заменив медные соединения между GPU на оптические. Для сравнения, Blackwell NVL72 обеспечивает 130 ТБ/с межпроцессорной пропускной способности, Rubin должен довести ее до 260 ТБ/с, Rubin Ultra до 520 ТБ/с, а Feynman нацелен уже на более чем 1 000 ТБ/с.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🤯2🍾2
По данным инсайдера Jaykihn, новые чипы Intel Razor Lake-AX будут базироваться на высокопроизводительных ядрах Coyote Cove в сочетании с энергоэффективными ядрами Arctic Wolf, и все это будет упаковываться в корпус BGA4326. Также новое поколение процессоров получит память, интегрированную в подложку, графику Xe3p вплоть до 32 вычислительных блоков и разблокированный разгон. CPU Intel Razor Lake-AX будут относиться к классу APU и встанут в прямую конфронтацию с APU-решениями AMD.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Дождались: Alibaba выпустила Qwen3.8-27B, плотную модель на 27 млрд параметров без MoE. Она умеет работать с текстом, изображениями и видео, а контекстное окно нейронки может достигать 1 миллиона токенов. Модель базируется на нейросети Qwen3.5 и включает те же оптимизационные механизмы: DeltaNet, Gated Attention и Multi-Token Prediction. Глубина рассуждения переключается через reasoning_effort в режимах xhigh, medium и low.

На Terminal Bench 2.1 Qwen3.8-27B получила 73,0 балла против 63,4 у Qwen3.6-27B и 64,0 у Qwen3.7-Plus, на SWE-bench Pro результат составил 61,7 против 53,5 и 51,2. В DeepSWE 1.1 новая модель набрала 42,2 против 13,3 и 14,2, в CoWorkBench 70,7 против 61,0 и 65,1, а в JobBench 33,4 против 21,8 и 27,6. На OSWorld-Verified, где модель должна выполнять действия в интерфейсе компьютера, Qwen3.8-27B получила 84,3 балла против 63,9 у Qwen3.6-27B и 73,3 у Qwen3.7-Plus. В мультимодальном SWE-MM результат составил 38,6 против 25,7 и 30,0.

Уже на релиза появилась поддержка всех популярных форматов вычислений и квантизаций: GGUF, NVFP4, MLX, FP16, FP8, FP4 — для запуска нужно от 16 до 54 ГБ VRAM. Вы буквально получите мощь закрытой Claude Opus 4.6 всего на одной потребительской видеокарте.

Модель уже доступна для скачивания Hugging Face.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍15🍾6🤯2💩2
AMD не стала медлить и уже объявила о Day 0 поддержке топовой компактной нейронки Qwen3.8-27B. LLM можно запускать локально на рабочих станциях на базе чиров Ryzen AI Max+ или на видеокартах Radeon AI PRO R9700 с 32 ГБ VRAM. При запуске через Llama.cpp на Windows через Vulkan-бэкенд Ryzen AI Max+ 395 показывает до 24,5 токена/с, а одна Radeon AI PRO R9700 достигает 51,8 токена/с.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍17