ServerFlow | Новости и Железо 💾
4.23K subscribers
4.87K photos
386 videos
12 files
2.36K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
Сверхбыстрый режим для GPT-5.6 Sol теперь доступен в ограниченной предварительной версии в облаке Cerebras 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🤯2
ServerFlow | Новости и Железо 💾
Gemini 3.7 Flash уже появилась на Vertex 👀 😅 Канал Serverflow в MAX: Подписаться
Google официально выпустила Gemini 3.7 Flash, новую флагманскую модель Flash для программирования, агентных задач и многоэтапных рабочих процессов. Контекстное окно составляет 1 млн токенов, за один ответ модель может выдать до 64 тыс. токенов.

Глубину рассуждения можно выбрать вручную: low, medium или high. В low модель работает с минимальной задержкой, medium установлен по умолчанию для большинства задач, а high использует больше вычислений для сложного кода и агентных цепочек.

Google также улучшила диагностику ошибок, повторные попытки и завершение многошаговых задач, а генерация интерфейсов по дизайн-макетам стала точнее.

Gemini 3.7 Flash уже используется как версия Flash по умолчанию в Antigravity. До 31 декабря 2026 года в Google AI Studio и Gemini Enterprise Agent Platform действует цена $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных. С 1 января 2027 года тариф составит $1,50 и $7,50 соответственно.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12
По данным отраслевых СМИ, AMD может заключить с Intel Foundry соглашение на выпуск процессоров по технологии корпусирования EMIB-T. Intel собирается запустить ее массовое производство в 2027 году, а готовность самой технологии уже достаточно высока для работы с крупными заказчиками, включая конкурентов

EMIB-T использует кремниевые перемычки со сквозными TSV для соединения нескольких кристаллов и памяти внутри одного корпуса. Аналитики оценивают стоимость такой упаковки примерно на 50% ниже TSMC CoWoS. Выход годных корпусов Intel уже приближается к 90%, хотя выход годных кремниевых подложек пока составляет около 50%.

Для AMD это может стать дополнительным источником упаковочных мощностей на фоне ограничений TSMC, которая получила заказы от Nvidia, Apple и других компаний на годы вперед.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9
This media is not supported in your browser
VIEW IN TELEGRAM
Nvidia объявила, что передовые коммутаторы Spectrum-X Ethernet Photonics уже запущены в массовое производство.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍8🍾4🤯1
Производитель памяти CXMT обогнал Tencent и стал самой дорогой компанией Китая — теперь ее стоимость составляет $524 миллиарда против $510 миллиарда у Tencent.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🌭16👍8🍾2
ИИ-генератор музыки для пятерочки — MiniMax представила открытую модель MiniMaxMusic 3 для создания музыкальных композиций продолжительностью до 5 минут. На вход подаются текст песни и описание музыки, включая жанр, BPM, тональность, вокал, инструменты и структуру композиции. На выходе модель создает стерео WAV 32 кГц, 16 бит.

Внутри используется связка из двух моделей: глобальная LLM на 8 млрд параметров отвечает за доработку текста и работает с первым уровнем RVQ-кодов, а локальная модель на 0,6 млрд гененрирует вокальную артикуляцию, инструменты и акустические детали. Для разметки песни можно использовать секции [Intro], [Verse], [Pre-Chorus], [Chorus], [Bridge], [Instrumental] и [Outro], поэтому структура трека задается не только описанием стиля, но и непосредственно в исходном тексте.

После этого непрерывные скрытые состояния обеих моделей поступают в Flow-VAE вместо обычного декодирования только дискретных токенов. Музыкальный токенизатор использует восемь уровней RVQ: первый содержит 16 384 кодов и хранит основную музыкальную структуру, остальные семь по 1 024 кода описывают акустические детали. Такой подход позволяет сохранять мотивы, ритм, вокальную подачу и аранжировку на протяжении всей композиции, а Music 3 уже доступна для тестирования через демо.

Нейронка доступна на Hugging Face.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13💩3🤯1🍾1
По данным DigiTimes, NVIDIA уже активно разрабатывает следующее поколение GPU Feynman, которое должно прийти на смену Rubin и Rubin Ultra. Для этих чипов компания, как сообщается, выбрала 1,6-нм техпроцесс TSMC A16 вместо N2, а массовое производство ожидается во второй половине 2028 года.

Feynman получит поддержку технологии подачи питания с обратной стороны кристалла, 3D-стекирование SoIC и упаковку CoWoS-L или CoPoS. Несколько чиплетов сначала будут объединяться через SoIC, а затем устанавливаться в общий 2.5D-корпус. Для GPU также ожидается специальная HBM, вероятно HBM4E, с собственным базовым кристаллом, который сможет выполнять часть логики непосредственно рядом с памятью.

Отдельно NVIDIA собирается перейти на CPO с технологией COUPE от TSMC, заменив медные соединения между GPU на оптические. Для сравнения, Blackwell NVL72 обеспечивает 130 ТБ/с межпроцессорной пропускной способности, Rubin должен довести ее до 260 ТБ/с, Rubin Ultra до 520 ТБ/с, а Feynman нацелен уже на более чем 1 000 ТБ/с.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🤯2🍾2
По данным инсайдера Jaykihn, новые чипы Intel Razor Lake-AX будут базироваться на высокопроизводительных ядрах Coyote Cove в сочетании с энергоэффективными ядрами Arctic Wolf, и все это будет упаковываться в корпус BGA4326. Также новое поколение процессоров получит память, интегрированную в подложку, графику Xe3p вплоть до 32 вычислительных блоков и разблокированный разгон. CPU Intel Razor Lake-AX будут относиться к классу APU и встанут в прямую конфронтацию с APU-решениями AMD.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Дождались: Alibaba выпустила Qwen3.8-27B, плотную модель на 27 млрд параметров без MoE. Она умеет работать с текстом, изображениями и видео, а контекстное окно нейронки может достигать 1 миллиона токенов. Модель базируется на нейросети Qwen3.5 и включает те же оптимизационные механизмы: DeltaNet, Gated Attention и Multi-Token Prediction. Глубина рассуждения переключается через reasoning_effort в режимах xhigh, medium и low.

На Terminal Bench 2.1 Qwen3.8-27B получила 73,0 балла против 63,4 у Qwen3.6-27B и 64,0 у Qwen3.7-Plus, на SWE-bench Pro результат составил 61,7 против 53,5 и 51,2. В DeepSWE 1.1 новая модель набрала 42,2 против 13,3 и 14,2, в CoWorkBench 70,7 против 61,0 и 65,1, а в JobBench 33,4 против 21,8 и 27,6. На OSWorld-Verified, где модель должна выполнять действия в интерфейсе компьютера, Qwen3.8-27B получила 84,3 балла против 63,9 у Qwen3.6-27B и 73,3 у Qwen3.7-Plus. В мультимодальном SWE-MM результат составил 38,6 против 25,7 и 30,0.

Уже на релиза появилась поддержка всех популярных форматов вычислений и квантизаций: GGUF, NVFP4, MLX, FP16, FP8, FP4 — для запуска нужно от 16 до 54 ГБ VRAM. Вы буквально получите мощь закрытой Claude Opus 4.6 всего на одной потребительской видеокарте.

Модель уже доступна для скачивания Hugging Face.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍15🍾6🤯2💩2
AMD не стала медлить и уже объявила о Day 0 поддержке топовой компактной нейронки Qwen3.8-27B. LLM можно запускать локально на рабочих станциях на базе чиров Ryzen AI Max+ или на видеокартах Radeon AI PRO R9700 с 32 ГБ VRAM. При запуске через Llama.cpp на Windows через Vulkan-бэкенд Ryzen AI Max+ 395 показывает до 24,5 токена/с, а одна Radeon AI PRO R9700 достигает 51,8 токена/с.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍17
Qwen3.8-27B в сравнении с DeepSeek V4 Flash, Claude Sonnet 5 и 4.6. Вполне неплохо для 27 миллиардов параметров.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍24🌭2
Anthropic опубликовала отчет, в котором признала, что ее сотрудники пользуются особой внутренней ИИ-моделью под кодовым названием Model 2 для исследований и разработок, производительность которой в разы выше, чем у Claude Mythos 5. При этом компания заявила, что модель неоднократно пыталась выйти из изолированной среды, нарушала правила обучения и создавала небезопасных ИИ-агентов. Anthropic также отметила, что никогда не будет публиковать Model 2 в публичный доступ.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩34👍5
Немецкие IT-исследователи обнаружили уязвимость LoongLeak в процессорах Loongson с архитектурой LoongArch. Проблема связана с одной из инструкций, которая оставляет часть регистра в неопределенном состоянии. Исследователи выяснили, что в некоторых случаях эти 32 бита могут содержать данные из L1-кэша, причем кеш не изолируется между отдельными программами.

Используя эту особенность, атакующий может предварительно изменить внутреннее состояние процессора и затем получать нужные фрагменты данных из кеша. В лабораторных тестах таким способом удалось извлечь ключи AES, части хешей паролей root, а также обойти ASLR и некоторые проверки целостности стека. Атаку можно запускать даже из виртуальной машины, используя ее для доступа к данным процесса на хост-системе.

Полностью устранить проблему обычным обновлением ПО нельзя, поскольку причина находится на уровне архитектуры процессора. Один из вариантов защиты заключается в отключении второго потока на ядре, но это снижает возможности многопоточности. Loongson уже выпустила программное исправление для 3A6000: очистка кеша снижает производительность максимум примерно на 1,4%. На практике масштаб угрозы ограничен тем, что процессоры Loongson почти не распространены за пределами Китая.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯10👍6🍾2
ServerFlow | Новости и Железо 💾
Photo
Те самые коллекционные карточки Хуанга 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💅8🌭5💩3🤯2👍1
Вот так новости: жена Дарио Амодея, главы компании Anthropic, предлагала Джеффри Эпштейну вложиться в свою студию 18+ фильмов класса люкс. Эпштейн отказался.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯28