This media is not supported in your browser
VIEW IN TELEGRAM
Сверхбыстрый режим для GPT-5.6 Sol теперь доступен в ограниченной предварительной версии в облаке Cerebras 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🤯2
ServerFlow | Новости и Железо 💾
Gemini 3.7 Flash уже появилась на Vertex 👀 😅 Канал Serverflow в MAX: Подписаться
Google официально выпустила Gemini 3.7 Flash, новую флагманскую модель Flash для программирования, агентных задач и многоэтапных рабочих процессов. Контекстное окно составляет 1 млн токенов, за один ответ модель может выдать до 64 тыс. токенов.
Глубину рассуждения можно выбрать вручную: low, medium или high. В low модель работает с минимальной задержкой, medium установлен по умолчанию для большинства задач, а high использует больше вычислений для сложного кода и агентных цепочек.
Google также улучшила диагностику ошибок, повторные попытки и завершение многошаговых задач, а генерация интерфейсов по дизайн-макетам стала точнее.
Gemini 3.7 Flash уже используется как версия Flash по умолчанию в Antigravity. До 31 декабря 2026 года в Google AI Studio и Gemini Enterprise Agent Platform действует цена $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных. С 1 января 2027 года тариф составит $1,50 и $7,50 соответственно.
😅 Канал Serverflow в MAX: Подписаться
Глубину рассуждения можно выбрать вручную: low, medium или high. В low модель работает с минимальной задержкой, medium установлен по умолчанию для большинства задач, а high использует больше вычислений для сложного кода и агентных цепочек.
Google также улучшила диагностику ошибок, повторные попытки и завершение многошаговых задач, а генерация интерфейсов по дизайн-макетам стала точнее.
Gemini 3.7 Flash уже используется как версия Flash по умолчанию в Antigravity. До 31 декабря 2026 года в Google AI Studio и Gemini Enterprise Agent Platform действует цена $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных. С 1 января 2027 года тариф составит $1,50 и $7,50 соответственно.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12
По данным отраслевых СМИ, AMD может заключить с Intel Foundry соглашение на выпуск процессоров по технологии корпусирования EMIB-T. Intel собирается запустить ее массовое производство в 2027 году, а готовность самой технологии уже достаточно высока для работы с крупными заказчиками, включая конкурентов
EMIB-T использует кремниевые перемычки со сквозными TSV для соединения нескольких кристаллов и памяти внутри одного корпуса. Аналитики оценивают стоимость такой упаковки примерно на 50% ниже TSMC CoWoS. Выход годных корпусов Intel уже приближается к 90%, хотя выход годных кремниевых подложек пока составляет около 50%.
Для AMD это может стать дополнительным источником упаковочных мощностей на фоне ограничений TSMC, которая получила заказы от Nvidia, Apple и других компаний на годы вперед.
😅 Канал Serverflow в MAX: Подписаться
EMIB-T использует кремниевые перемычки со сквозными TSV для соединения нескольких кристаллов и памяти внутри одного корпуса. Аналитики оценивают стоимость такой упаковки примерно на 50% ниже TSMC CoWoS. Выход годных корпусов Intel уже приближается к 90%, хотя выход годных кремниевых подложек пока составляет около 50%.
Для AMD это может стать дополнительным источником упаковочных мощностей на фоне ограничений TSMC, которая получила заказы от Nvidia, Apple и других компаний на годы вперед.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9
This media is not supported in your browser
VIEW IN TELEGRAM
Nvidia объявила, что передовые коммутаторы Spectrum-X Ethernet Photonics уже запущены в массовое производство.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍8🍾4🤯1
Производитель памяти CXMT обогнал Tencent и стал самой дорогой компанией Китая — теперь ее стоимость составляет $524 миллиарда против $510 миллиарда у Tencent.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🌭16👍8🍾2
ИИ-генератор музыки для пятерочки — MiniMax представила открытую модель MiniMaxMusic 3 для создания музыкальных композиций продолжительностью до 5 минут. На вход подаются текст песни и описание музыки, включая жанр, BPM, тональность, вокал, инструменты и структуру композиции. На выходе модель создает стерео WAV 32 кГц, 16 бит.
Внутри используется связка из двух моделей: глобальная LLM на 8 млрд параметров отвечает за доработку текста и работает с первым уровнем RVQ-кодов, а локальная модель на 0,6 млрд гененрирует вокальную артикуляцию, инструменты и акустические детали. Для разметки песни можно использовать секции [Intro], [Verse], [Pre-Chorus], [Chorus], [Bridge], [Instrumental] и [Outro], поэтому структура трека задается не только описанием стиля, но и непосредственно в исходном тексте.
После этого непрерывные скрытые состояния обеих моделей поступают в Flow-VAE вместо обычного декодирования только дискретных токенов. Музыкальный токенизатор использует восемь уровней RVQ: первый содержит 16 384 кодов и хранит основную музыкальную структуру, остальные семь по 1 024 кода описывают акустические детали. Такой подход позволяет сохранять мотивы, ритм, вокальную подачу и аранжировку на протяжении всей композиции, а Music 3 уже доступна для тестирования через демо.
Нейронка доступна на Hugging Face.
😅 Канал Serverflow в MAX: Подписаться
Внутри используется связка из двух моделей: глобальная LLM на 8 млрд параметров отвечает за доработку текста и работает с первым уровнем RVQ-кодов, а локальная модель на 0,6 млрд гененрирует вокальную артикуляцию, инструменты и акустические детали. Для разметки песни можно использовать секции [Intro], [Verse], [Pre-Chorus], [Chorus], [Bridge], [Instrumental] и [Outro], поэтому структура трека задается не только описанием стиля, но и непосредственно в исходном тексте.
После этого непрерывные скрытые состояния обеих моделей поступают в Flow-VAE вместо обычного декодирования только дискретных токенов. Музыкальный токенизатор использует восемь уровней RVQ: первый содержит 16 384 кодов и хранит основную музыкальную структуру, остальные семь по 1 024 кода описывают акустические детали. Такой подход позволяет сохранять мотивы, ритм, вокальную подачу и аранжировку на протяжении всей композиции, а Music 3 уже доступна для тестирования через демо.
Нейронка доступна на Hugging Face.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13💩3🤯1🍾1
По данным DigiTimes, NVIDIA уже активно разрабатывает следующее поколение GPU Feynman, которое должно прийти на смену Rubin и Rubin Ultra. Для этих чипов компания, как сообщается, выбрала 1,6-нм техпроцесс TSMC A16 вместо N2, а массовое производство ожидается во второй половине 2028 года.
Feynman получит поддержку технологии подачи питания с обратной стороны кристалла, 3D-стекирование SoIC и упаковку CoWoS-L или CoPoS. Несколько чиплетов сначала будут объединяться через SoIC, а затем устанавливаться в общий 2.5D-корпус. Для GPU также ожидается специальная HBM, вероятно HBM4E, с собственным базовым кристаллом, который сможет выполнять часть логики непосредственно рядом с памятью.
Отдельно NVIDIA собирается перейти на CPO с технологией COUPE от TSMC, заменив медные соединения между GPU на оптические. Для сравнения, Blackwell NVL72 обеспечивает 130 ТБ/с межпроцессорной пропускной способности, Rubin должен довести ее до 260 ТБ/с, Rubin Ultra до 520 ТБ/с, а Feynman нацелен уже на более чем 1 000 ТБ/с.
😅 Канал Serverflow в MAX: Подписаться
Feynman получит поддержку технологии подачи питания с обратной стороны кристалла, 3D-стекирование SoIC и упаковку CoWoS-L или CoPoS. Несколько чиплетов сначала будут объединяться через SoIC, а затем устанавливаться в общий 2.5D-корпус. Для GPU также ожидается специальная HBM, вероятно HBM4E, с собственным базовым кристаллом, который сможет выполнять часть логики непосредственно рядом с памятью.
Отдельно NVIDIA собирается перейти на CPO с технологией COUPE от TSMC, заменив медные соединения между GPU на оптические. Для сравнения, Blackwell NVL72 обеспечивает 130 ТБ/с межпроцессорной пропускной способности, Rubin должен довести ее до 260 ТБ/с, Rubin Ultra до 520 ТБ/с, а Feynman нацелен уже на более чем 1 000 ТБ/с.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🤯2🍾2
По данным инсайдера Jaykihn, новые чипы Intel Razor Lake-AX будут базироваться на высокопроизводительных ядрах Coyote Cove в сочетании с энергоэффективными ядрами Arctic Wolf, и все это будет упаковываться в корпус BGA4326. Также новое поколение процессоров получит память, интегрированную в подложку, графику Xe3p вплоть до 32 вычислительных блоков и разблокированный разгон. CPU Intel Razor Lake-AX будут относиться к классу APU и встанут в прямую конфронтацию с APU-решениями AMD.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4
Дождались: Alibaba выпустила Qwen3.8-27B, плотную модель на 27 млрд параметров без MoE. Она умеет работать с текстом, изображениями и видео, а контекстное окно нейронки может достигать 1 миллиона токенов. Модель базируется на нейросети Qwen3.5 и включает те же оптимизационные механизмы: DeltaNet, Gated Attention и Multi-Token Prediction. Глубина рассуждения переключается через reasoning_effort в режимах xhigh, medium и low.
На Terminal Bench 2.1 Qwen3.8-27B получила 73,0 балла против 63,4 у Qwen3.6-27B и 64,0 у Qwen3.7-Plus, на SWE-bench Pro результат составил 61,7 против 53,5 и 51,2. В DeepSWE 1.1 новая модель набрала 42,2 против 13,3 и 14,2, в CoWorkBench 70,7 против 61,0 и 65,1, а в JobBench 33,4 против 21,8 и 27,6. На OSWorld-Verified, где модель должна выполнять действия в интерфейсе компьютера, Qwen3.8-27B получила 84,3 балла против 63,9 у Qwen3.6-27B и 73,3 у Qwen3.7-Plus. В мультимодальном SWE-MM результат составил 38,6 против 25,7 и 30,0.
Уже на релиза появилась поддержка всех популярных форматов вычислений и квантизаций: GGUF, NVFP4, MLX, FP16, FP8, FP4 — для запуска нужно от 16 до 54 ГБ VRAM. Вы буквально получите мощь закрытой Claude Opus 4.6 всего на одной потребительской видеокарте.
Модель уже доступна для скачивания Hugging Face.
😅 Канал Serverflow в MAX: Подписаться
На Terminal Bench 2.1 Qwen3.8-27B получила 73,0 балла против 63,4 у Qwen3.6-27B и 64,0 у Qwen3.7-Plus, на SWE-bench Pro результат составил 61,7 против 53,5 и 51,2. В DeepSWE 1.1 новая модель набрала 42,2 против 13,3 и 14,2, в CoWorkBench 70,7 против 61,0 и 65,1, а в JobBench 33,4 против 21,8 и 27,6. На OSWorld-Verified, где модель должна выполнять действия в интерфейсе компьютера, Qwen3.8-27B получила 84,3 балла против 63,9 у Qwen3.6-27B и 73,3 у Qwen3.7-Plus. В мультимодальном SWE-MM результат составил 38,6 против 25,7 и 30,0.
Уже на релиза появилась поддержка всех популярных форматов вычислений и квантизаций: GGUF, NVFP4, MLX, FP16, FP8, FP4 — для запуска нужно от 16 до 54 ГБ VRAM. Вы буквально получите мощь закрытой Claude Opus 4.6 всего на одной потребительской видеокарте.
Модель уже доступна для скачивания Hugging Face.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍15🍾6🤯2💩2
AMD не стала медлить и уже объявила о Day 0 поддержке топовой компактной нейронки Qwen3.8-27B. LLM можно запускать локально на рабочих станциях на базе чиров Ryzen AI Max+ или на видеокартах Radeon AI PRO R9700 с 32 ГБ VRAM. При запуске через Llama.cpp на Windows через Vulkan-бэкенд Ryzen AI Max+ 395 показывает до 24,5 токена/с, а одна Radeon AI PRO R9700 достигает 51,8 токена/с.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍17
ServerFlow | Новости и Железо 💾
Дождались: Alibaba выпустила Qwen3.8-27B, плотную модель на 27 млрд параметров без MoE. Она умеет работать с текстом, изображениями и видео, а контекстное окно нейронки может достигать 1 миллиона токенов. Модель базируется на нейросети Qwen3.5 и включает те…
Unsloth: вы можете запускать Qwen3.8-27B в GGUF-формате всего на 17 ГБ ОЗУ 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🌭17💅3💩1
Qwen3.8-27B в сравнении с DeepSeek V4 Flash, Claude Sonnet 5 и 4.6. Вполне неплохо для 27 миллиардов параметров.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍24🌭2
Anthropic опубликовала отчет, в котором признала, что ее сотрудники пользуются особой внутренней ИИ-моделью под кодовым названием Model 2 для исследований и разработок, производительность которой в разы выше, чем у Claude Mythos 5. При этом компания заявила, что модель неоднократно пыталась выйти из изолированной среды, нарушала правила обучения и создавала небезопасных ИИ-агентов. Anthropic также отметила, что никогда не будет публиковать Model 2 в публичный доступ.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩34👍5
Немецкие IT-исследователи обнаружили уязвимость LoongLeak в процессорах Loongson с архитектурой LoongArch. Проблема связана с одной из инструкций, которая оставляет часть регистра в неопределенном состоянии. Исследователи выяснили, что в некоторых случаях эти 32 бита могут содержать данные из L1-кэша, причем кеш не изолируется между отдельными программами.
Используя эту особенность, атакующий может предварительно изменить внутреннее состояние процессора и затем получать нужные фрагменты данных из кеша. В лабораторных тестах таким способом удалось извлечь ключи AES, части хешей паролей root, а также обойти ASLR и некоторые проверки целостности стека. Атаку можно запускать даже из виртуальной машины, используя ее для доступа к данным процесса на хост-системе.
Полностью устранить проблему обычным обновлением ПО нельзя, поскольку причина находится на уровне архитектуры процессора. Один из вариантов защиты заключается в отключении второго потока на ядре, но это снижает возможности многопоточности. Loongson уже выпустила программное исправление для 3A6000: очистка кеша снижает производительность максимум примерно на 1,4%. На практике масштаб угрозы ограничен тем, что процессоры Loongson почти не распространены за пределами Китая.
😅 Канал Serverflow в MAX: Подписаться
Используя эту особенность, атакующий может предварительно изменить внутреннее состояние процессора и затем получать нужные фрагменты данных из кеша. В лабораторных тестах таким способом удалось извлечь ключи AES, части хешей паролей root, а также обойти ASLR и некоторые проверки целостности стека. Атаку можно запускать даже из виртуальной машины, используя ее для доступа к данным процесса на хост-системе.
Полностью устранить проблему обычным обновлением ПО нельзя, поскольку причина находится на уровне архитектуры процессора. Один из вариантов защиты заключается в отключении второго потока на ядре, но это снижает возможности многопоточности. Loongson уже выпустила программное исправление для 3A6000: очистка кеша снижает производительность максимум примерно на 1,4%. На практике масштаб угрозы ограничен тем, что процессоры Loongson почти не распространены за пределами Китая.
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯10👍6🍾2
ServerFlow | Новости и Железо 💾
Photo
Please open Telegram to view this post
VIEW IN TELEGRAM
💅8🌭5💩3🤯2👍1
Вот так новости: жена Дарио Амодея, главы компании Anthropic, предлагала Джеффри Эпштейну вложиться в свою студию 18+ фильмов класса люкс. Эпштейн отказался.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯28