ServerFlow | Новости и Железо 💾
4.21K subscribers
4.81K photos
381 videos
12 files
2.31K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
Anthropic внезапно выпустила Claude Fable 5.1 и Mythos 5.1 — новые флагманские ИИ-модели компании, которые получили значительный прирост производительности в кодинге, агентских и пользовательских сценариях.

Fable 5.1 в бенчмарке Terminal-Bench 4.0 набирает 55,8%, опережая Fable 5 (42,0%) и GPT-5.6 Sol (37,3%). В задачах агентного кодирования CursorBench 3.2.0 результат составляет 73,4% против 70,5% у Fable 5 и 67,2% у GPT-5.6 Sol. В многопрофильном рассуждении Humanity's Last Exam модель достигает 60,9% без инструментов и 65,0% с инструментами, превосходя Fable 5 (57,8% и 63,8%) и Opus 5 (56,6% и 63,6%). В GDPval-AA v2 показатель 1853 против 1723 у Fable 5 и 1711 у GPT-5.6 Sol.

Модель умеет работать с кодом, терминалом и внешними инструментами, а в научных задачах может самостоятельно проводить многошаговые исследования без участия человека — во внутренних тестах Fable 5.1 даже смогла дообучить собственную нейросеть для построения более детальной карты высот Венеры.

В области безопасности Anthropic внедрила Enterprise Frontier Safeguards — систему, позволяющую предприятиям хранить данные в собственной облачной инфраструктуре, а не на серверах Anthropic, сохраняя при этом продвинутую защиту от злоупотреблений.

При этом, стоимость использования Fable 5.1 не изменилась — все те же $10 за миллион входных и $50 за миллион выходных токенов, однако чтение уже закэшированного контекста подешевело на 75% до $0,25 за миллион токенов. Для обычных сценариев Anthropic ожидает снижение общей стоимости примерно на 25%, а для тяжёлых агентных задач экономия может достигать 45%.

Mythos 5.1 все также остается закрытым решением для ограниченного круга специалистов — в компании отмечают, что нейронка смогла написать 7 кастомных GPU-ядер, тем самым ускорив их до 2,5 раз на NVIDIA H100 для изучения биологии и геномики. Само собой, Mythos 5.1 на порядок опережает как своих предшественников, так и потребительскую Fable 5.1.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13🤯2💩2
ServerFlow | Новости и Железо 💾
Anthropic внезапно выпустила Claude Fable 5.1 и Mythos 5.1 — новые флагманские ИИ-модели компании, которые получили значительный прирост производительности в кодинге, агентских и пользовательских сценариях. Fable 5.1 в бенчмарке Terminal-Bench 4.0 набирает…
Claude Fable 5.1 набрала всего на 4 балла больше по индексу искусственного интеллекта, чем Fable 5. Однако Fable 5.1 использует на 73,5 % больше токенов, чем Fable 5, а также требует на 56,2 % больше времени для выполнения инференса в режиме размышления Max. Возникает логичный вопрос — зачем нужна новая модель? Просто утереть нос OpenAI?

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1💩18🤯1
ServerFlow | Новости и Железо 💾
Anthropic внезапно выпустила Claude Fable 5.1 и Mythos 5.1 — новые флагманские ИИ-модели компании, которые получили значительный прирост производительности в кодинге, агентских и пользовательских сценариях. Fable 5.1 в бенчмарке Terminal-Bench 4.0 набирает…
OpenAI мгновенно реагирует на релиз Fable 5.1 — компания объявила, что уже готовится к выпуску GPT Astra, и провела значительную переработку систем безопасности, чтобы сделать модель безопаснее для массового использования (чтобы нейронку не блокнуло правительство США).

Компания утверждает, что в данный момент Astra имеет “критический” уровень опасности в кибербезе. В тестах модель получила 100% на ExploitBench, а во внутреннем тесте на 20 свежих уязвимостях показала существенно более высокую способность выполнять цепочки атак, чем GPT-5.6 Sol, используя при этом меньше выходных токенов.

Из-за этого запуск будет проходить с ограничениями. Продвинутые кибервозможности сначала получит небольшая группа тестировщиков, а затем доступ планируют расширять через Daybreak Blue; при этом Astra уже обучена лучше соблюдать ограничения и в тестах отказывала в 91,5% запрещённых киберзапросов против 59% у GPT-5.6 Sol.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯9👍3💩3
В честь года после запуска ежемесячной подписки GLM Coding Plan от Z.ai, компания раздала всем пользователям своей платформы бесплатную карту сброса еженедельного и 5-часового лимита.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7🍾4
По данным The Wall Street Journal, компания Google отказалась от внутренних кандидатов на роль Gemini 3.5 Pro после того, как они не смогли превзойти Gemini Flash. Теперь все встало на свои места…

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💅9💩1
Друзья, хотим вновь поблагодарить вас за огромную активность на нашем крайнем видеоролике с запуском DeepSeek V4-Flash на ИИ-сервере — всего за 12 дней количество просмотров перевалило за 100 тысяч 🎉

Ваше внимание — это наилучшая мотивация для нас, поэтому мы будем в том же духе продолжать радовать вас интересным и информативным контентом о мире железа и нейронок!

P.S: Новый ролик уже в производстве 😉

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
2👍44🌭6🤯1🍾1💅1
А также хотим выразить отдельную благодарность за активность под роликом про Unsloth Studio на нашем втором канале с обзорами локальных нейронок и ИИ-инструментов — более 60 тысяч просмотров всего за 4 дня 🤯

Без вашего внимания мы бы не смогли достичь таких результатов, огромное вам спасибо, вы самые лучшие ❤️

Кстати, если вы интересуетесь локальными нейронками, но еще не смотрели ролик, то настоятельно рекомендуем вам это исправить, ведь веб-интерфейс Unsloth Studio — это буквально Llama.cpp на стероидах, который позволяет и инференсить, и дообучать почти любые локальные нейронки.

Это новая звезда локального инференса, поэтому не теряйте время и обязательно изучите возможности Unsloth Studio в нашем новом ролике!

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍23🌭3💅1
Оперативная информация от наших подписчиков: похоже, Google тестирует новую нейронку — в веб-интерфейсе компании при выборе Flash-модели нейронка опознает себя как Gemini 3.8 Flash. Ждем релиз сегодня?

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩13👍8
AMD утверждает, что 3D DRAM с гибридным соединением может быть до 17 раз энергоэффективнее традиционного HBM. В такой архитектуре память размещается непосредственно над вычислительным чипом, а беспаечное соединение Cu-Cu сокращает электрические потери и позволяет сделать межсоединения плотнее.

Однако, гибридное соединение требует практически атомарной точности в соприкосновении поверхностей DRAM и процессора, а также последующей термообработки, а повышенная температура ухудшает способность ячеек DRAM удерживать заряд. Поэтому технология выглядит очень перспективно для ИИ-ускорителей, но до массового коммерческого применения AMD еще предстоит решить вопросы тепловой стойкости и чистоты производства.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8
Стартапы Far Labs из Абу-Даби и Evolving Edge из Остина хотят создать маркетплейсы, которые будут предлагать юзерам с простаивающими ПК продавать свои вычислительные мощности частным заказчиками. Far AI собирается запустить платформу в ближайшие недели с заявленной задержкой до 100 мс, а Evolving Edge уже тестирует открытую бету. Обе компании ориентируются прежде всего на небольшие открытые модели, которым не нужны мощности уровня дата-центров.

Far Labs распределяет части модели между несколькими компьютерами, а затем собирает результат через собственный оркестратор и балансировщик нагрузки. Evolving Edge использует систему Ray, выстраивая защита узлов вокруг изоляции, шифрованного соединения и ограничений доступа к CPU, GPU, памяти, диску и сети. Похожая сеть Salad уже насчитывает более 60 000 активных потребительских GPU, но экономика для владельцев железа остается главным вопросом: например, RTX 4090 при круглосуточной нагрузке может потреблять 350-450 Вт, и затраты на электричество способны съесть значительную часть заработка, если не весь доход.

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6💅1
Google без лишних анонсов добавила новую модель Gemini 3.8 Flash в Agent Studio в Google Cloud. По заявлениям компании, нейронка отлично показывает себя в кодинге, агентных задачах и мультимодальной обработке данных. Ждем официальный анонс 👀

😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭9👍3