Помните движок SGLang? Это та самая платформа, которая поддерживается практически любыми ИИ-ускорителями (даже китайскими Huawei Atlas/Ascend и CPU Intel/AMD), базируется на собственном одноименном языке программирования и использует революционный механизм автоматического повторного использования KV-кэша RadixAttention. Все это позволяет нарастить скорость инференса до огромных значений, в некоторых сценариях превосходя даже Хуанговский TensorRT-LLM.
Так вот, вчера движок обновился до версии SGLang v0.5.15, принеся много новых изменений. Во-первых, добавили поддержку новых нейронок: Hunyuan 3 (Hy3), Hierarchical Reasoning Model (HRM-Text), NVIDIA LocateAnything-3B, Baidu Unlimited-OCR, JoyEcho и Qwen3.6. Во-вторых, улучшили веб-поиск Breakable CUDA Graph и контекстный параллелизм для моделей MLA, вроде DeepSeek V3. Но самое интересное — глубокая настройка под производственное развертывание на мощных кластерах на базе ИИ-ускорителей Nvdia, в результате чего удалось запустить GLM-5.2 NVFP4 со скоростью 500+ токенов в секунду на 8x B300 и 450 токенов в секунду на 4x GB300.
😅 Канал Serverflow в MAX: Подписаться
Так вот, вчера движок обновился до версии SGLang v0.5.15, принеся много новых изменений. Во-первых, добавили поддержку новых нейронок: Hunyuan 3 (Hy3), Hierarchical Reasoning Model (HRM-Text), NVIDIA LocateAnything-3B, Baidu Unlimited-OCR, JoyEcho и Qwen3.6. Во-вторых, улучшили веб-поиск Breakable CUDA Graph и контекстный параллелизм для моделей MLA, вроде DeepSeek V3. Но самое интересное — глубокая настройка под производственное развертывание на мощных кластерах на базе ИИ-ускорителей Nvdia, в результате чего удалось запустить GLM-5.2 NVFP4 со скоростью 500+ токенов в секунду на 8x B300 и 450 токенов в секунду на 4x GB300.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9🤯3🍾3💅1
Британский Институт безопасности ИИ (AISI) нашел в новой флагманской у ИИ-модели OpenAI GPT 5.6 Sol абсолютно тот же набор уязвимостей, что и у Claude Fable 5 от Anthropic — нейронка поддается джеилбрейку и ее можно заставить выполнять длительные сессии по поиску уязвимостей и разработке эксплоитов, игнорируя механизмы защиты. Блокировка через 1…2…3…
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Инсайдеры заявляют об утечке информации о GPT-5.6. Нейронка может получить контекстное окно в 1,5 триллионов токенов, новый датасет для предварительного обучения, а объем модели может перевалить за 10 триллионов параметров.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Китайские ИИ-энтузиасты с OpenClaw — главная причина, почему Apple Mac Mini в дефиците 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
С сегодняшнего дня Claude Fable 5 будет доступна только в API 🥲 Будет ли Anthropic в очередной раз продлевать доступ по подписке к своей флагманской нейронке?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
😡5💅3 1
🗓 Коротко о главных новостях за эту неделю
❗️ Сбер представил GigaChat 3.5 Ultra
❗️ В сеть утекли первые подробности о Nvidia Rosa CPU
❗️ IBM представила мейнфреймы Compact z17 и LinuxOne
❗️ Intel готовит Nova Lake-S Xeon
❗️ Сбер представил GigaChat 3.5 Ultra
❗️ В сеть утекли первые подробности о Nvidia Rosa CPU
❗️ IBM представила мейнфреймы Compact z17 и LinuxOne
❗️ Intel готовит Nova Lake-S Xeon
ServerFlow
Сбер представил GigaChat 3.5 Ultra — отечественная 432b MoE-модель с открытым исходным кодом | Блог Serverflow
👍3🍾2💅2
Эффективность GPT-5.6 Sol была снижена OpenAI всего через 4 дня после релиза — нерф коснулся параметра “бюджета/глубины размышления” (или juice values).
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭4👍2 1
ServerFlow | Новости и Железо 💾
С сегодняшнего дня Claude Fable 5 будет доступна только в API 🥲 Будет ли Anthropic в очередной раз продлевать доступ по подписке к своей флагманской нейронке? 😅 Канал Serverflow в MAX: Подписаться
Как и ожидалось, Anthropic продлила доступ к Claude Fable 5 до 19 июля, при этом сохранив 50% увеличение лимитов на использование нейронки по тарифам 🎉
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🍾2 1
ServerFlow | Новости и Железо 💾
Как и ожидалось, Anthropic продлила доступ к Claude Fable 5 до 19 июля, при этом сохранив 50% увеличение лимитов на использование нейронки по тарифам 🎉 😅 Канал Serverflow в MAX: Подписаться
Твиттерский попал в больницу из-за того, что Anthropic постоянно меняет правила использования своей топовой ИИ-модели Claude Fable 5. Роб заявляет, что начал плохо чувствовать себя после длительной сессии в Claude — судя по всему, он пытался потратить оставшийся недельный лимит на Fable 5 до 12 июля, когда Anthropic планировала закрыть доступ к нейронке по тарифному плану, а потом компания внезапно продлила доступность LLM.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩13👍2💅1 1
Bloomberg заявляют, что новый флагманский процессор Apple M7 Ultra выйдет в первой половине 2028 года, а M7 Pro и M7 Max могут увидеть свет уже в конце этого года. Топовый M7 Ultra может получить аж 1,5 ТБ унифицированной памяти, что выведет новые Mac Studio на базе этих чипов вне всякой конкуренции даже с передовыми рабочими станциями Nvidia DGX Station с 748 ГБ. При этом, все семейство чипом M6 может быть полностью пропущено, так как компания нацелена на доминацию в сегменте ИИ-станций и Apple требуется больше времени на разработку более совершенных SoC.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5🤯1🍾1
GPT-5.6 Sol оказался действительно опасен, только для обычных пользователей — нейронка отключила SaaS-стартапу буквально всех подписчиков за несколько секунд во время обработки заявок в платежной системе Stripe. Нейронка не стала оправдываться, объяснив, что “действовало безрассудно” и “совершила катастрофическую ошибку”, но деньги уже не вернуть.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
💩6 3🤯2
Тибо заявляет, что GPT 5.6 Sol будет доступна в ChatGPT по тарифам Go, Plus, Pro и т.д. без ограничений, пока не выйдет более совершенная модель. Намек на то, что нейронку не заблокируют и не переведут в API, как это произошло с Claude Fable 5 от Anthropic. Это уже не стеб, а настоящая травля — сотрудники OpenAI уже несколько дней отпускают подобные подколы в отношении конкурента. Anthropic все еще сохраняет молчание, видимо, концентрируя усилия на разработке Claude Opus 5.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5💅2🤯1
This media is not supported in your browser
VIEW IN TELEGRAM
Вот как выглядит иммерсионное (погружное) охлаждение ИИ-серверов 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🌭1💅1
Intel представила семейство однокристальных систем Starfire, разработанных для спутников, орбитальных станций и другой космической техники. Линейка включает две модели: Low Power и Performance. Обе производятся по техпроцессу 18A, рассчитаны на срок службы более 10 лет, защищены от радиации по стандартам TID, SEL и SEE и сохраняют работоспособность при температурах от −55 до +125 °C.
Оба чипа получили 8-ядерный процессор (4 P-ядра + 4 LPE), 4 ядра Xe3, встроенный NPU, поддержку LPDDR5/DDR5, 12 линий PCIe 4.0 и упаковку Intel Foveros. Starfire Low Power работает с TDP 10 Вт, P-ядрами до 1,0 ГГц, LPE-ядрами до 850 МГц, графикой до 1,0 ГГц и обеспечивает до 45 TOPS. Starfire Performance предлагает TDP 35 Вт, частоты 3,1 ГГц для P-ядер, 2,1 ГГц для LPE-ядер, графику до 2,0 ГГц и производительность NPU до 75 TOPS. Вот уж не думали, что Intel будет осваивать космос.
😅 Канал Serverflow в MAX: Подписаться
Оба чипа получили 8-ядерный процессор (4 P-ядра + 4 LPE), 4 ядра Xe3, встроенный NPU, поддержку LPDDR5/DDR5, 12 линий PCIe 4.0 и упаковку Intel Foveros. Starfire Low Power работает с TDP 10 Вт, P-ядрами до 1,0 ГГц, LPE-ядрами до 850 МГц, графикой до 1,0 ГГц и обеспечивает до 45 TOPS. Starfire Performance предлагает TDP 35 Вт, частоты 3,1 ГГц для P-ядер, 2,1 ГГц для LPE-ядер, графику до 2,0 ГГц и производительность NPU до 75 TOPS. Вот уж не думали, что Intel будет осваивать космос.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍3🤯3🍾3
This media is not supported in your browser
VIEW IN TELEGRAM
Nvidia тизерит свое выступление на конференции GTC Berlin, которая пройдет с 20 по 22 октября 2026 года. Предзаказ пропусков до 15 июля идет со скидкой в 400€.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1 4🍾3🤯1
SK Hynix: 2027 год станет пиком кризиса памяти.
Тем временем Linus Tech Tips:
😅 Канал Serverflow в MAX: Подписаться
Тем временем Linus Tech Tips:
Please open Telegram to view this post
VIEW IN TELEGRAM
1🌭8💅2🍾1
Всего за 5 месяцев количество пользователей OpenAI Codex увеличилось с 1 до 7 миллионов, а с учетом темпов роста платформы, к октябрю 2026 года Codex может пробить отметку в 10 миллинов юзеров🎉
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🤯1🌭1
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯4🍾2