ServerFlow | Новости и Железо 💾
4.24K subscribers
4.89K photos
387 videos
12 files
2.37K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
В HWiNFO появилась поддержка Intel Razor Lake-AX. Это первое косвенное подтверждение существования новой процессорной платформы, которая должна стать отдельным высокопроизводительным сегментом Intel для ноутбуков и других мобильных систем. По текущим утечкам, выход Razor Lake-AX ожидается ориентировочно в 2028-2029 годах, уже после релиза Nova Lake.

Razor Lake-AX отличается от обычных версий S, H и HX тем, что это будут полноценные SoC с большим количеством CPU-ядер и GPU-ядер, большим объемом встроенного кэша и различными контроллерами внутри одного кристалла. Базовая архитектура Razor Lake должна использовать P-ядра Griffin Cove и E-ядра Golden Eagle, а графическая часть может получить Xe3P Celestial или следующее поколение Xe4 Druid. Еще одна предполагаемая особенность AX-версии — встроенная в чип память, вероятно LPDDR6, что позволит использовать унифицированный пул для CPU и GPU.

По концепции Razor Lake-AX напрямую конкурирует с AMD Strix Halo и ее следующими поколениями. AMD уже развивает Halo-платформы с большим объемом общей памяти и мощной встроенной графикой, а Intel, судя по Razor Lake-AX, собирается предложить аналогичный класс SoC с упором на CPU, GPU и ИИ-нагрузки в одном чипе. При этом HWiNFO подтверждает только появление ранней программной поддержки, а характеристики и сроки выхода пока остаются предварительными.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4💩1
CEO Intel Лип-Бу Тан заявил, что память снова стала стратегически важной для IT-индустрии, поэтому компания компания изучает новую архитектуру памяти, чтобы выйти на один рынок с Miron, SK Hynix и Samsung.

Интерес Intel может быть связан не с возвращением к обычному производству DRAM, а с новой системой хранения данных для ИИ-систем — Тан говорит о размещении памяти непосредственно поверх процессора и о синергии CPU и хранилища. На этом фоне особенно интересен недавний патент Intel XBM: в нем описывается стек DRAM, который обходится без дорогого кремниевого интерпозера HBM и использует соединения UCIe.

У Intel уже был большой опыт работы с памятью. Компания начинала именно с DRAM, затем пыталась закрепиться в NAND и Optane, но в итоге отказалась от этих направлений. Теперь ситуация изменилась, резкий рост спроса на память для ИИ сделал DRAM и HBM стратегическим ресурсом, поэтому Intel снова рассматривает собственные разработки. Однако о строительстве новых фабрик или полноценном возвращении в производство памяти речи пока нет.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭3👍1🤯1
Передовая ИИ-стойка Nvidia Kyber на конференции GTC 2026 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍6
DeepSeek V4 Pro появился в API DeepSeek 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9
Media is too big
VIEW IN TELEGRAM
Всего 5 дней до итогов! Забирайте AMD Radeon Instinct MI50 16GB!

Нажимайте кнопку "Участвую!" под закреплённым постом, и выигрывайте!

🗓 Итоги: 17 августа 2026 в 18:00 (по МСК)
🚚 Отправляем приз по РФ и РБ (СДЭК до ПВЗ)
1👍30
Прайс на Nvidia RTX PRO 6000 Blackwell Workstation Edition снова взлетел — топовый ИИ-ускоритель теперь продается по $16 000, тогда как раньше за GPU требовали $13 250. При этом в момент выхода карточки в 2025 году стоимость RTX PRO 6000 Blackwell Workstation Edition достигала всего $8 565 — цена взлетела почти в 2 раза со старта продаж.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩19🤯6
Alibaba представила Qwen3.8-2.4T-A95B, первую открытую модель в классе Qwen-Max. с 2,4 трлн общих и 95 млрд благодаря архитектуре Mixture-of-ExpertsНативное контекстное окно составляет 262 144 токена, а расширенное достигает примерно 1,01 млн токенов.

Архитура основана на Qwen3.5 и использует DeltaNet, Gated Attention и Multi-Token Prediction. Для агентных задач Alibaba отдельно добавила управление глубиной рассуждения через reasoning_effort и сохранение предыдущего процесса рассуждений через preserve_thinking. Модель рассчитана на работу с большими кодовыми базами, документами и длинными цепочками действий, а для запуска компания указывает совместимость с vLLM, SGLang и TokenSpeed.

В Terminal Bench 2.1 Qwen3.8 набрала 86,6 балла против 84,6 у Opus 4.8, 84,6 у Fable 5 и 88,8 у GPT-5.6 Sol. В SWE-bench Pro результат Qwen составил 67,7 против 69,2, 80,0 и 64,6 соответственно.


В DeepSWE 1.1 Qwen3.8 получила 56,6 балла против 59,0 у Opus 4.8, 70,0 у Fable 5 и 73,0 у GPT-5.6 Sol. На FrontierSWE она набрала 73,5, уступив Opus 4.8 с 70,0 и Fable 5 с 88,8, но опередив в этой таблице только модели с худшими результатами.


В AndroidBench Qwen3.8 получила 75,1 против 69,8 у Opus 4.8, 84,5 у Fable 5 и 74,0 у GPT-5.6 Sol. В общем тестировании Qwen3.8 показала 92,6 на GPQA Diamond против 92,0 у Opus 4.8, 92,6 у Fable 5 и 94,1 у GPT-5.6 Sol.


Веса LLM уже лежат на Hugging Face.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12🌭4🍾2
Команда Intel нашла уязвимость в процессорах…AMD. Бэкдоры CVE-2026-6726 и CVE-2026-6727 обнаружили в чипах Ryzen серий 3000-9000, Ryzen AI, Threadripper и Z1/Z2, а уязвимым оказался один модуль fTPM — благодаря дырам злоумышленники могли получить доступ к зашифрованным данным. Intel не стала портить жизнь конкурентам, поэтому о проблеме уже доложено вендорам материнских плат, чтобы те выпустили патч с исправлениями в BIOS.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍25💅5
Kioxia и SanDisk представили 2-Тбитную QLC 3D NAND 9-го поколения для серверных и облачных систем хранения. Новые ячейки памяти используют архитектуру CBA, где CMOS размещается непосредственно под массивом ячеек, а новая 6-плоскостная схема размещения позволяет увеличить производительность чтения и записи.

Главное изменение по сравнению с QLC NAND 8-го поколения связано со скоростью интерфейса — она выросла до 4,8 Гбит/с на контакт, то есть прирост составил 33%, а сами компании также заявляют о более высокой энергоэффективности операций чтения и записи. За счет CBA Kioxia и SanDisk могут отдельно развивать и CMOS, и массив памяти, не переделывая всю технологическую платформу целиком.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8
Вчера в сети распространился фейк, что Сэма Альтмана не стало. На деле это оказался вброс — кто-то (проделки Дарио?) отредактировал статью о CEO OpenAI в Wiki, и автоматизированная поисковая выдача Google начала указывать 12 августа как дату его кончины. На деле с Сэмом все хорошо, он будет продолжать дарить нам новые модели GPT за оверпрайс.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭17💅6💩2😡1
SpaceXAI представила Grok 4.6 — новая нейронка получила значительный скачок производительности, местами не только сравнявшись, но и обойдя GPT-5.6 Sol и Claude Fable 5. При этом цена осталась на уровне Grok 4.5: $2 за 1 миллион входных и $6 за 1 миллион выходных токенов. Похоже, SpaceXAI наконец-то прорвалась в высшую лигу ИИ-индустрии.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14💩3
Дженсен Хуанг заявил, что ИИ-ускорители Nvidia A100 “будут способны выполнять поставленные задачи с 2020 по 2029 год”. Видимо, после 2029 легендарные решения на Ampere уйдут на покой.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10💩4
До релиза Qwen3.8-27b осталось чуть больше суток 🎉

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍32🍾9💩1
Gemini 3.7 Flash теперь отображается в Google Cloud Console. Релиз может состояться уже сегодня 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10
DeepSeek обновила свою флагманскую ИИ-модель DeepSeek V4 Pro 0813 в API. В Terminal Bench 2.1 новая версия получила 87,9 балла против 72,1 у V4 Pro Preview, почти сравнявшись с Kimi K3 на 88,3 и Fable 5 на 88, а также обойдя Opus 4.8 с 85 баллами. Самый заметный прирост пришелся на агентные сценарии. В DeepSWE результат вырос с 12,8 до 62,7 балла, а в NL2Repo с 38,5 до 61,5. При этом контекстное окно осталось на уровне 1 млн токенов, поддерживаются обычный и thinking-режимы, вызов инструментов и Responses API. Пока обновление доступно только через API, новые веса не опубликованы. При этом компания подняла цены на использование нейронки: теперь за V4 Pro придется отдавать $0,66 за 1 млн входных токенов и $1,98 за 1 млн выходных токенов вне пиковой нагрузки. Новые тарифы вступят в силу в 16 августа — до этого момента модель будет оцениваться в $0,435 за 1 млн входных токенов и $0,87 за 1 млн выходных токенов соответственно.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🌭3💅1
ServerFlow | Новости и Железо 💾
До релиза Qwen3.8-27b осталось чуть больше суток 🎉 😅 Канал Serverflow в MAX: Подписаться
Фанаты Qwen тут? Вы бы хотели, чтобы мы начали поставлять легендарных капибар в честь релиза нового поколения Qwen?)

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1🌭40👍22🤯3
This media is not supported in your browser
VIEW IN TELEGRAM
Сверхбыстрый режим для GPT-5.6 Sol теперь доступен в ограниченной предварительной версии в облаке Cerebras 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🤯2
ServerFlow | Новости и Железо 💾
Gemini 3.7 Flash уже появилась на Vertex 👀 😅 Канал Serverflow в MAX: Подписаться
Google официально выпустила Gemini 3.7 Flash, новую флагманскую модель Flash для программирования, агентных задач и многоэтапных рабочих процессов. Контекстное окно составляет 1 млн токенов, за один ответ модель может выдать до 64 тыс. токенов.

Глубину рассуждения можно выбрать вручную: low, medium или high. В low модель работает с минимальной задержкой, medium установлен по умолчанию для большинства задач, а high использует больше вычислений для сложного кода и агентных цепочек.

Google также улучшила диагностику ошибок, повторные попытки и завершение многошаговых задач, а генерация интерфейсов по дизайн-макетам стала точнее.

Gemini 3.7 Flash уже используется как версия Flash по умолчанию в Antigravity. До 31 декабря 2026 года в Google AI Studio и Gemini Enterprise Agent Platform действует цена $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных. С 1 января 2027 года тариф составит $1,50 и $7,50 соответственно.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12