ServerFlow | Новости и Железо 💾
Anthropic внезапно выпустила Claude Fable 5.1 и Mythos 5.1 — новые флагманские ИИ-модели компании, которые получили значительный прирост производительности в кодинге, агентских и пользовательских сценариях. Fable 5.1 в бенчмарке Terminal-Bench 4.0 набирает…
Claude Fable 5.1 набрала всего на 4 балла больше по индексу искусственного интеллекта, чем Fable 5. Однако Fable 5.1 использует на 73,5 % больше токенов, чем Fable 5, а также требует на 56,2 % больше времени для выполнения инференса в режиме размышления Max. Возникает логичный вопрос — зачем нужна новая модель? Просто утереть нос OpenAI?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1💩18🤯1
ServerFlow | Новости и Железо 💾
Anthropic внезапно выпустила Claude Fable 5.1 и Mythos 5.1 — новые флагманские ИИ-модели компании, которые получили значительный прирост производительности в кодинге, агентских и пользовательских сценариях. Fable 5.1 в бенчмарке Terminal-Bench 4.0 набирает…
OpenAI мгновенно реагирует на релиз Fable 5.1 — компания объявила, что уже готовится к выпуску GPT Astra, и провела значительную переработку систем безопасности, чтобы сделать модель безопаснее для массового использования (чтобы нейронку не блокнуло правительство США).
Компания утверждает, что в данный момент Astra имеет “критический” уровень опасности в кибербезе. В тестах модель получила 100% на ExploitBench, а во внутреннем тесте на 20 свежих уязвимостях показала существенно более высокую способность выполнять цепочки атак, чем GPT-5.6 Sol, используя при этом меньше выходных токенов.
Из-за этого запуск будет проходить с ограничениями. Продвинутые кибервозможности сначала получит небольшая группа тестировщиков, а затем доступ планируют расширять через Daybreak Blue; при этом Astra уже обучена лучше соблюдать ограничения и в тестах отказывала в 91,5% запрещённых киберзапросов против 59% у GPT-5.6 Sol.
😅 Канал Serverflow в MAX: Подписаться
Компания утверждает, что в данный момент Astra имеет “критический” уровень опасности в кибербезе. В тестах модель получила 100% на ExploitBench, а во внутреннем тесте на 20 свежих уязвимостях показала существенно более высокую способность выполнять цепочки атак, чем GPT-5.6 Sol, используя при этом меньше выходных токенов.
Из-за этого запуск будет проходить с ограничениями. Продвинутые кибервозможности сначала получит небольшая группа тестировщиков, а затем доступ планируют расширять через Daybreak Blue; при этом Astra уже обучена лучше соблюдать ограничения и в тестах отказывала в 91,5% запрещённых киберзапросов против 59% у GPT-5.6 Sol.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯9👍3💩3
В честь года после запуска ежемесячной подписки GLM Coding Plan от Z.ai, компания раздала всем пользователям своей платформы бесплатную карту сброса еженедельного и 5-часового лимита.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🍾4
По данным The Wall Street Journal, компания Google отказалась от внутренних кандидатов на роль Gemini 3.5 Pro после того, как они не смогли превзойти Gemini Flash. Теперь все встало на свои места…
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💅9💩1
Друзья, хотим вновь поблагодарить вас за огромную активность на нашем крайнем видеоролике с запуском DeepSeek V4-Flash на ИИ-сервере — всего за 12 дней количество просмотров перевалило за 100 тысяч 🎉
Ваше внимание — это наилучшая мотивация для нас, поэтому мы будем в том же духе продолжать радовать вас интересным и информативным контентом о мире железа и нейронок!
P.S: Новый ролик уже в производстве 😉
😅 Канал Serverflow в MAX: Подписаться
Ваше внимание — это наилучшая мотивация для нас, поэтому мы будем в том же духе продолжать радовать вас интересным и информативным контентом о мире железа и нейронок!
P.S: Новый ролик уже в производстве 😉
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍44🌭6🤯1🍾1💅1
А также хотим выразить отдельную благодарность за активность под роликом про Unsloth Studio на нашем втором канале с обзорами локальных нейронок и ИИ-инструментов — более 60 тысяч просмотров всего за 4 дня 🤯
Без вашего внимания мы бы не смогли достичь таких результатов, огромное вам спасибо, вы самые лучшие ❤️
Кстати, если вы интересуетесь локальными нейронками, но еще не смотрели ролик, то настоятельно рекомендуем вам это исправить, ведь веб-интерфейс Unsloth Studio — это буквально Llama.cpp на стероидах, который позволяет и инференсить, и дообучать почти любые локальные нейронки.
Это новая звезда локального инференса, поэтому не теряйте время и обязательно изучите возможности Unsloth Studio в нашем новом ролике!
😅 Канал Serverflow в MAX: Подписаться
Без вашего внимания мы бы не смогли достичь таких результатов, огромное вам спасибо, вы самые лучшие ❤️
Кстати, если вы интересуетесь локальными нейронками, но еще не смотрели ролик, то настоятельно рекомендуем вам это исправить, ведь веб-интерфейс Unsloth Studio — это буквально Llama.cpp на стероидах, который позволяет и инференсить, и дообучать почти любые локальные нейронки.
Это новая звезда локального инференса, поэтому не теряйте время и обязательно изучите возможности Unsloth Studio в нашем новом ролике!
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍23🌭3💅1
Оперативная информация от наших подписчиков: похоже, Google тестирует новую нейронку — в веб-интерфейсе компании при выборе Flash-модели нейронка опознает себя как Gemini 3.8 Flash. Ждем релиз сегодня?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩13👍8
AMD утверждает, что 3D DRAM с гибридным соединением может быть до 17 раз энергоэффективнее традиционного HBM. В такой архитектуре память размещается непосредственно над вычислительным чипом, а беспаечное соединение Cu-Cu сокращает электрические потери и позволяет сделать межсоединения плотнее.
Однако, гибридное соединение требует практически атомарной точности в соприкосновении поверхностей DRAM и процессора, а также последующей термообработки, а повышенная температура ухудшает способность ячеек DRAM удерживать заряд. Поэтому технология выглядит очень перспективно для ИИ-ускорителей, но до массового коммерческого применения AMD еще предстоит решить вопросы тепловой стойкости и чистоты производства.
😅 Канал Serverflow в MAX: Подписаться
Однако, гибридное соединение требует практически атомарной точности в соприкосновении поверхностей DRAM и процессора, а также последующей термообработки, а повышенная температура ухудшает способность ячеек DRAM удерживать заряд. Поэтому технология выглядит очень перспективно для ИИ-ускорителей, но до массового коммерческого применения AMD еще предстоит решить вопросы тепловой стойкости и чистоты производства.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8
Стартапы Far Labs из Абу-Даби и Evolving Edge из Остина хотят создать маркетплейсы, которые будут предлагать юзерам с простаивающими ПК продавать свои вычислительные мощности частным заказчиками. Far AI собирается запустить платформу в ближайшие недели с заявленной задержкой до 100 мс, а Evolving Edge уже тестирует открытую бету. Обе компании ориентируются прежде всего на небольшие открытые модели, которым не нужны мощности уровня дата-центров.
Far Labs распределяет части модели между несколькими компьютерами, а затем собирает результат через собственный оркестратор и балансировщик нагрузки. Evolving Edge использует систему Ray, выстраивая защита узлов вокруг изоляции, шифрованного соединения и ограничений доступа к CPU, GPU, памяти, диску и сети. Похожая сеть Salad уже насчитывает более 60 000 активных потребительских GPU, но экономика для владельцев железа остается главным вопросом: например, RTX 4090 при круглосуточной нагрузке может потреблять 350-450 Вт, и затраты на электричество способны съесть значительную часть заработка, если не весь доход.
😅 Канал Serverflow в MAX: Подписаться
Far Labs распределяет части модели между несколькими компьютерами, а затем собирает результат через собственный оркестратор и балансировщик нагрузки. Evolving Edge использует систему Ray, выстраивая защита узлов вокруг изоляции, шифрованного соединения и ограничений доступа к CPU, GPU, памяти, диску и сети. Похожая сеть Salad уже насчитывает более 60 000 активных потребительских GPU, но экономика для владельцев железа остается главным вопросом: например, RTX 4090 при круглосуточной нагрузке может потреблять 350-450 Вт, и затраты на электричество способны съесть значительную часть заработка, если не весь доход.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6💅1
Google без лишних анонсов добавила новую модель Gemini 3.8 Flash в Agent Studio в Google Cloud. По заявлениям компании, нейронка отлично показывает себя в кодинге, агентных задачах и мультимодальной обработке данных. Ждем официальный анонс 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭9👍3
Google официально представила новые ИИ-модели Gemini 3.8 Flash и Gemini 3.8 Flash Cyber.
Gemini 3.8 Flash стала самой интеллектуальной Flash-моделью компании для программирования, агентных сценариев и многошагового reasoning, при этом сохранив стартовую цену $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных. На HLE-Verified модель набрала 54,9%, а в DeepSWE v1.1 обошла Opus 5 и GPT-5.6 Sol в автономном решении сложных инженерных задач.
Главное изменение внутри модели — ставка на длинные агентные циклы: Gemini 3.8 Flash может делать больше шагов рассуждения и многократно вызывать инструменты, чтобы довести задачу до исполнения.
Для кибербезопасности Google выпустила 3.8 Flash Cyber: она обнаруживает уязвимости в кодовых базах на 20 языках программирования, показывает результат точности выше 70% во внутреннем тесте и получила 86,2% в CyberGym, обходя GPT-5.6 Sol и даже Mythos 5.
Gemini 3.8 Flash уже доступна разработчикам через Gemini API, Google AI Studio и Android Studio, а Gemini 3.8 Flash Cyber пока распространяется через программу Fairwind среди доверенных участников.
😅 Канал Serverflow в MAX: Подписаться
Gemini 3.8 Flash стала самой интеллектуальной Flash-моделью компании для программирования, агентных сценариев и многошагового reasoning, при этом сохранив стартовую цену $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных. На HLE-Verified модель набрала 54,9%, а в DeepSWE v1.1 обошла Opus 5 и GPT-5.6 Sol в автономном решении сложных инженерных задач.
Главное изменение внутри модели — ставка на длинные агентные циклы: Gemini 3.8 Flash может делать больше шагов рассуждения и многократно вызывать инструменты, чтобы довести задачу до исполнения.
Для кибербезопасности Google выпустила 3.8 Flash Cyber: она обнаруживает уязвимости в кодовых базах на 20 языках программирования, показывает результат точности выше 70% во внутреннем тесте и получила 86,2% в CyberGym, обходя GPT-5.6 Sol и даже Mythos 5.
Gemini 3.8 Flash уже доступна разработчикам через Gemini API, Google AI Studio и Android Studio, а Gemini 3.8 Flash Cyber пока распространяется через программу Fairwind среди доверенных участников.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🍾4💩1