В твиттере началась очередная драма — Илон Маск и Сэм Альтман вступили в публичную словесную перепалку. Илон, как обычно, исковеркал имя Сэма, назвав его “мошенником мирового уровня”, в ответ на что Альтман заявил, что Маск “впаривает инвесторам идею скорого появления космических ЦОД”, и добавил, что новая одержимость экс-триллионера — лучший бенчмарк для GPT-5.6. Илон ответил, что ЦОД в космосе появятся в следующем году, и Альман сможет “посмотреть на них, если Альтмана отпустят по УДО”, и напомнив, что Сэм украл благотворительный проект и технологии Apple.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5🤯1🍾1
ServerFlow | Новости и Железо 💾
В твиттере началась очередная драма — Илон Маск и Сэм Альтман вступили в публичную словесную перепалку. Илон, как обычно, исковеркал имя Сэма, назвав его “мошенником мирового уровня”, в ответ на что Альтман заявил, что Маск “впаривает инвесторам идею скорого…
Маск на эмоциях даже удалил из друзей в X директора по искусственному интеллекту компании Meta* Александра Вана 🫠
*Деятельность Meta Platforms Inc. в России признана экстремистской и запрещена
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯3👍1💅1
Помните движок SGLang? Это та самая платформа, которая поддерживается практически любыми ИИ-ускорителями (даже китайскими Huawei Atlas/Ascend и CPU Intel/AMD), базируется на собственном одноименном языке программирования и использует революционный механизм автоматического повторного использования KV-кэша RadixAttention. Все это позволяет нарастить скорость инференса до огромных значений, в некоторых сценариях превосходя даже Хуанговский TensorRT-LLM.
Так вот, вчера движок обновился до версии SGLang v0.5.15, принеся много новых изменений. Во-первых, добавили поддержку новых нейронок: Hunyuan 3 (Hy3), Hierarchical Reasoning Model (HRM-Text), NVIDIA LocateAnything-3B, Baidu Unlimited-OCR, JoyEcho и Qwen3.6. Во-вторых, улучшили веб-поиск Breakable CUDA Graph и контекстный параллелизм для моделей MLA, вроде DeepSeek V3. Но самое интересное — глубокая настройка под производственное развертывание на мощных кластерах на базе ИИ-ускорителей Nvdia, в результате чего удалось запустить GLM-5.2 NVFP4 со скоростью 500+ токенов в секунду на 8x B300 и 450 токенов в секунду на 4x GB300.
😅 Канал Serverflow в MAX: Подписаться
Так вот, вчера движок обновился до версии SGLang v0.5.15, принеся много новых изменений. Во-первых, добавили поддержку новых нейронок: Hunyuan 3 (Hy3), Hierarchical Reasoning Model (HRM-Text), NVIDIA LocateAnything-3B, Baidu Unlimited-OCR, JoyEcho и Qwen3.6. Во-вторых, улучшили веб-поиск Breakable CUDA Graph и контекстный параллелизм для моделей MLA, вроде DeepSeek V3. Но самое интересное — глубокая настройка под производственное развертывание на мощных кластерах на базе ИИ-ускорителей Nvdia, в результате чего удалось запустить GLM-5.2 NVFP4 со скоростью 500+ токенов в секунду на 8x B300 и 450 токенов в секунду на 4x GB300.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9🤯3🍾3💅1
Британский Институт безопасности ИИ (AISI) нашел в новой флагманской у ИИ-модели OpenAI GPT 5.6 Sol абсолютно тот же набор уязвимостей, что и у Claude Fable 5 от Anthropic — нейронка поддается джеилбрейку и ее можно заставить выполнять длительные сессии по поиску уязвимостей и разработке эксплоитов, игнорируя механизмы защиты. Блокировка через 1…2…3…
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Инсайдеры заявляют об утечке информации о GPT-5.6. Нейронка может получить контекстное окно в 1,5 триллионов токенов, новый датасет для предварительного обучения, а объем модели может перевалить за 10 триллионов параметров.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Китайские ИИ-энтузиасты с OpenClaw — главная причина, почему Apple Mac Mini в дефиците 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
С сегодняшнего дня Claude Fable 5 будет доступна только в API 🥲 Будет ли Anthropic в очередной раз продлевать доступ по подписке к своей флагманской нейронке?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
😡5💅3 1
🗓 Коротко о главных новостях за эту неделю
❗️ Сбер представил GigaChat 3.5 Ultra
❗️ В сеть утекли первые подробности о Nvidia Rosa CPU
❗️ IBM представила мейнфреймы Compact z17 и LinuxOne
❗️ Intel готовит Nova Lake-S Xeon
❗️ Сбер представил GigaChat 3.5 Ultra
❗️ В сеть утекли первые подробности о Nvidia Rosa CPU
❗️ IBM представила мейнфреймы Compact z17 и LinuxOne
❗️ Intel готовит Nova Lake-S Xeon
ServerFlow
Сбер представил GigaChat 3.5 Ultra — отечественная 432b MoE-модель с открытым исходным кодом | Блог Serverflow
👍3🍾2💅2
Эффективность GPT-5.6 Sol была снижена OpenAI всего через 4 дня после релиза — нерф коснулся параметра “бюджета/глубины размышления” (или juice values).
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭4👍2 1
ServerFlow | Новости и Железо 💾
С сегодняшнего дня Claude Fable 5 будет доступна только в API 🥲 Будет ли Anthropic в очередной раз продлевать доступ по подписке к своей флагманской нейронке? 😅 Канал Serverflow в MAX: Подписаться
Как и ожидалось, Anthropic продлила доступ к Claude Fable 5 до 19 июля, при этом сохранив 50% увеличение лимитов на использование нейронки по тарифам 🎉
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🍾2 1
ServerFlow | Новости и Железо 💾
Как и ожидалось, Anthropic продлила доступ к Claude Fable 5 до 19 июля, при этом сохранив 50% увеличение лимитов на использование нейронки по тарифам 🎉 😅 Канал Serverflow в MAX: Подписаться
Твиттерский попал в больницу из-за того, что Anthropic постоянно меняет правила использования своей топовой ИИ-модели Claude Fable 5. Роб заявляет, что начал плохо чувствовать себя после длительной сессии в Claude — судя по всему, он пытался потратить оставшийся недельный лимит на Fable 5 до 12 июля, когда Anthropic планировала закрыть доступ к нейронке по тарифному плану, а потом компания внезапно продлила доступность LLM.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩13👍2💅1 1
Bloomberg заявляют, что новый флагманский процессор Apple M7 Ultra выйдет в первой половине 2028 года, а M7 Pro и M7 Max могут увидеть свет уже в конце этого года. Топовый M7 Ultra может получить аж 1,5 ТБ унифицированной памяти, что выведет новые Mac Studio на базе этих чипов вне всякой конкуренции даже с передовыми рабочими станциями Nvidia DGX Station с 748 ГБ. При этом, все семейство чипом M6 может быть полностью пропущено, так как компания нацелена на доминацию в сегменте ИИ-станций и Apple требуется больше времени на разработку более совершенных SoC.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5🤯1🍾1
GPT-5.6 Sol оказался действительно опасен, только для обычных пользователей — нейронка отключила SaaS-стартапу буквально всех подписчиков за несколько секунд во время обработки заявок в платежной системе Stripe. Нейронка не стала оправдываться, объяснив, что “действовало безрассудно” и “совершила катастрофическую ошибку”, но деньги уже не вернуть.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
💩6 3🤯2
Тибо заявляет, что GPT 5.6 Sol будет доступна в ChatGPT по тарифам Go, Plus, Pro и т.д. без ограничений, пока не выйдет более совершенная модель. Намек на то, что нейронку не заблокируют и не переведут в API, как это произошло с Claude Fable 5 от Anthropic. Это уже не стеб, а настоящая травля — сотрудники OpenAI уже несколько дней отпускают подобные подколы в отношении конкурента. Anthropic все еще сохраняет молчание, видимо, концентрируя усилия на разработке Claude Opus 5.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5💅2🤯1
This media is not supported in your browser
VIEW IN TELEGRAM
Вот как выглядит иммерсионное (погружное) охлаждение ИИ-серверов 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🌭1💅1
Intel представила семейство однокристальных систем Starfire, разработанных для спутников, орбитальных станций и другой космической техники. Линейка включает две модели: Low Power и Performance. Обе производятся по техпроцессу 18A, рассчитаны на срок службы более 10 лет, защищены от радиации по стандартам TID, SEL и SEE и сохраняют работоспособность при температурах от −55 до +125 °C.
Оба чипа получили 8-ядерный процессор (4 P-ядра + 4 LPE), 4 ядра Xe3, встроенный NPU, поддержку LPDDR5/DDR5, 12 линий PCIe 4.0 и упаковку Intel Foveros. Starfire Low Power работает с TDP 10 Вт, P-ядрами до 1,0 ГГц, LPE-ядрами до 850 МГц, графикой до 1,0 ГГц и обеспечивает до 45 TOPS. Starfire Performance предлагает TDP 35 Вт, частоты 3,1 ГГц для P-ядер, 2,1 ГГц для LPE-ядер, графику до 2,0 ГГц и производительность NPU до 75 TOPS. Вот уж не думали, что Intel будет осваивать космос.
😅 Канал Serverflow в MAX: Подписаться
Оба чипа получили 8-ядерный процессор (4 P-ядра + 4 LPE), 4 ядра Xe3, встроенный NPU, поддержку LPDDR5/DDR5, 12 линий PCIe 4.0 и упаковку Intel Foveros. Starfire Low Power работает с TDP 10 Вт, P-ядрами до 1,0 ГГц, LPE-ядрами до 850 МГц, графикой до 1,0 ГГц и обеспечивает до 45 TOPS. Starfire Performance предлагает TDP 35 Вт, частоты 3,1 ГГц для P-ядер, 2,1 ГГц для LPE-ядер, графику до 2,0 ГГц и производительность NPU до 75 TOPS. Вот уж не думали, что Intel будет осваивать космос.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍3🤯3🍾3