Оперативная информация от наших подписчиков: похоже, Google тестирует новую нейронку — в веб-интерфейсе компании при выборе Flash-модели нейронка опознает себя как Gemini 3.8 Flash. Ждем релиз сегодня?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩13👍8
AMD утверждает, что 3D DRAM с гибридным соединением может быть до 17 раз энергоэффективнее традиционного HBM. В такой архитектуре память размещается непосредственно над вычислительным чипом, а беспаечное соединение Cu-Cu сокращает электрические потери и позволяет сделать межсоединения плотнее.
Однако, гибридное соединение требует практически атомарной точности в соприкосновении поверхностей DRAM и процессора, а также последующей термообработки, а повышенная температура ухудшает способность ячеек DRAM удерживать заряд. Поэтому технология выглядит очень перспективно для ИИ-ускорителей, но до массового коммерческого применения AMD еще предстоит решить вопросы тепловой стойкости и чистоты производства.
😅 Канал Serverflow в MAX: Подписаться
Однако, гибридное соединение требует практически атомарной точности в соприкосновении поверхностей DRAM и процессора, а также последующей термообработки, а повышенная температура ухудшает способность ячеек DRAM удерживать заряд. Поэтому технология выглядит очень перспективно для ИИ-ускорителей, но до массового коммерческого применения AMD еще предстоит решить вопросы тепловой стойкости и чистоты производства.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8
Стартапы Far Labs из Абу-Даби и Evolving Edge из Остина хотят создать маркетплейсы, которые будут предлагать юзерам с простаивающими ПК продавать свои вычислительные мощности частным заказчиками. Far AI собирается запустить платформу в ближайшие недели с заявленной задержкой до 100 мс, а Evolving Edge уже тестирует открытую бету. Обе компании ориентируются прежде всего на небольшие открытые модели, которым не нужны мощности уровня дата-центров.
Far Labs распределяет части модели между несколькими компьютерами, а затем собирает результат через собственный оркестратор и балансировщик нагрузки. Evolving Edge использует систему Ray, выстраивая защита узлов вокруг изоляции, шифрованного соединения и ограничений доступа к CPU, GPU, памяти, диску и сети. Похожая сеть Salad уже насчитывает более 60 000 активных потребительских GPU, но экономика для владельцев железа остается главным вопросом: например, RTX 4090 при круглосуточной нагрузке может потреблять 350-450 Вт, и затраты на электричество способны съесть значительную часть заработка, если не весь доход.
😅 Канал Serverflow в MAX: Подписаться
Far Labs распределяет части модели между несколькими компьютерами, а затем собирает результат через собственный оркестратор и балансировщик нагрузки. Evolving Edge использует систему Ray, выстраивая защита узлов вокруг изоляции, шифрованного соединения и ограничений доступа к CPU, GPU, памяти, диску и сети. Похожая сеть Salad уже насчитывает более 60 000 активных потребительских GPU, но экономика для владельцев железа остается главным вопросом: например, RTX 4090 при круглосуточной нагрузке может потреблять 350-450 Вт, и затраты на электричество способны съесть значительную часть заработка, если не весь доход.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6💅1
Google без лишних анонсов добавила новую модель Gemini 3.8 Flash в Agent Studio в Google Cloud. По заявлениям компании, нейронка отлично показывает себя в кодинге, агентных задачах и мультимодальной обработке данных. Ждем официальный анонс 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭9👍3
Google официально представила новые ИИ-модели Gemini 3.8 Flash и Gemini 3.8 Flash Cyber.
Gemini 3.8 Flash стала самой интеллектуальной Flash-моделью компании для программирования, агентных сценариев и многошагового reasoning, при этом сохранив стартовую цену $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных. На HLE-Verified модель набрала 54,9%, а в DeepSWE v1.1 обошла Opus 5 и GPT-5.6 Sol в автономном решении сложных инженерных задач.
Главное изменение внутри модели — ставка на длинные агентные циклы: Gemini 3.8 Flash может делать больше шагов рассуждения и многократно вызывать инструменты, чтобы довести задачу до исполнения.
Для кибербезопасности Google выпустила 3.8 Flash Cyber: она обнаруживает уязвимости в кодовых базах на 20 языках программирования, показывает результат точности выше 70% во внутреннем тесте и получила 86,2% в CyberGym, обходя GPT-5.6 Sol и даже Mythos 5.
Gemini 3.8 Flash уже доступна разработчикам через Gemini API, Google AI Studio и Android Studio, а Gemini 3.8 Flash Cyber пока распространяется через программу Fairwind среди доверенных участников.
😅 Канал Serverflow в MAX: Подписаться
Gemini 3.8 Flash стала самой интеллектуальной Flash-моделью компании для программирования, агентных сценариев и многошагового reasoning, при этом сохранив стартовую цену $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных. На HLE-Verified модель набрала 54,9%, а в DeepSWE v1.1 обошла Opus 5 и GPT-5.6 Sol в автономном решении сложных инженерных задач.
Главное изменение внутри модели — ставка на длинные агентные циклы: Gemini 3.8 Flash может делать больше шагов рассуждения и многократно вызывать инструменты, чтобы довести задачу до исполнения.
Для кибербезопасности Google выпустила 3.8 Flash Cyber: она обнаруживает уязвимости в кодовых базах на 20 языках программирования, показывает результат точности выше 70% во внутреннем тесте и получила 86,2% в CyberGym, обходя GPT-5.6 Sol и даже Mythos 5.
Gemini 3.8 Flash уже доступна разработчикам через Gemini API, Google AI Studio и Android Studio, а Gemini 3.8 Flash Cyber пока распространяется через программу Fairwind среди доверенных участников.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🍾4💩1
Инсайдеры заявляют, что в логах API OpenAI появилось упоминание GPT-6 Astra 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍12
Дефицит DRAM дошел до того, что Google создала внутреннюю цепочку повторного использования памяти. По словам старшего директора по инфраструктуре Нихила Чериана, компания разбирает выведенные из эксплуатации серверы, извлекает исправные модули DDR4 и возвращает их в новые ИИ-серверы. Для этого Google даже разработала специальные адаптеры, позволяющие подключать память предыдущего поколения к актуальным платформам.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍30🤯9💩1
К ИИ-гонке подтянулась Meta* — компания выпустила Muse Spark 1.3, свою флагманскую ИИ-модель для агентных сценариев и кодинга. Модель стала лучше справляться с длинными задачами, умеет вести несколько рабочих процессов в одном потоке, задает уточняющие вопросы при неоднозначных запросах и сообщает пользователю в случае возникновения проблем — в общем, трушный агентных помощник для любых задач.
В кодинге упор сделали на долгие инженерные задачи: Muse Spark 1.3 лучше сохраняет требования из больших инструкций, реже делает лишние шаги и выдает более аккуратный код. Отдельно улучшили самоконтроль модели: она лучше различает то, что действительно может сделать, и ситуации, где данных или возможностей недостаточно, вместо того чтобы придумывать результат.
При внутренних тестах Muse Spark 1.3 использовала на 20% меньше вызовов инструментов и на 25% меньше токенов, чем предыдущий флагман компании Muse Spark 1.2. В ключевых ИИ-бенчмарках модель обходит передовую GPT-5.6 Sol и лишь немного уступает Opus 5, а по индексу Artificial Analysis нейронка Muse Spark 1.3 в режиме Max заняла третье место, уступив Opus 5 и Fable 5.1, подвинув на одну позицию назад GPT-5.6 Sol. (Кстати, Gemini 3.8 Flash тем временем плетется на 10 позиции).
Muse Spark 1.3 уже доступна в Muse Code и Meta* Model API. Режим максимального reasoning пока проходит дополнительное тестирование безопасности и появится позже. Цена в API — $1.25 за 1 млн входных токенов и $4.25 за 1 млн выходных токенов.
*Деятельность Meta Platforms Inc. в России признана экстремистской и запрещена
😅 Канал Serverflow в MAX: Подписаться
В кодинге упор сделали на долгие инженерные задачи: Muse Spark 1.3 лучше сохраняет требования из больших инструкций, реже делает лишние шаги и выдает более аккуратный код. Отдельно улучшили самоконтроль модели: она лучше различает то, что действительно может сделать, и ситуации, где данных или возможностей недостаточно, вместо того чтобы придумывать результат.
При внутренних тестах Muse Spark 1.3 использовала на 20% меньше вызовов инструментов и на 25% меньше токенов, чем предыдущий флагман компании Muse Spark 1.2. В ключевых ИИ-бенчмарках модель обходит передовую GPT-5.6 Sol и лишь немного уступает Opus 5, а по индексу Artificial Analysis нейронка Muse Spark 1.3 в режиме Max заняла третье место, уступив Opus 5 и Fable 5.1, подвинув на одну позицию назад GPT-5.6 Sol. (Кстати, Gemini 3.8 Flash тем временем плетется на 10 позиции).
Muse Spark 1.3 уже доступна в Muse Code и Meta* Model API. Режим максимального reasoning пока проходит дополнительное тестирование безопасности и появится позже. Цена в API — $1.25 за 1 млн входных токенов и $4.25 за 1 млн выходных токенов.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5🌭2
Alibaba внезапно обновила свою флагманскую облачную модель доверсии Qwen3.8-Max-0902. Модель все также имеет 2,4 трлн параметров, поддерживает до 991 тыс. токенов входного контекста и ответы 131 тыс токенов, а дополнительное дообучение на Coding и Cowork позволило улучшить результаты в сложных корпоративных задачах, научных исследованиях и длинных агентных процессах.
При цене за токены $2 за 1 млн входных и $6 за 1 млн выходных токенов, в Terminal-Bench 2.1 Qwen3.8-Max набрала 86,6% против 88,8% у GPT-5.6 Sol и 84,6% у Opus 4.8 и Fable 5. В PaperBench Qwen вообще вышла на первое место с 93,0% против 90,5% у GPT-5.6 Sol, 88,8% у Fable 5 и 80,3% у Opus 4.8. При этом на SWE-bench Pro результат 67,7% уступает Fable 5 с 80,0%, но превосходит GPT-5.6 Sol с 64,6%.
Модель уже доступна в API QwenCloud, скорее всего позднее Alibaba также дропнет открытые веса флагмана.
😅 Канал Serverflow в MAX: Подписаться
При цене за токены $2 за 1 млн входных и $6 за 1 млн выходных токенов, в Terminal-Bench 2.1 Qwen3.8-Max набрала 86,6% против 88,8% у GPT-5.6 Sol и 84,6% у Opus 4.8 и Fable 5. В PaperBench Qwen вообще вышла на первое место с 93,0% против 90,5% у GPT-5.6 Sol, 88,8% у Fable 5 и 80,3% у Opus 4.8. При этом на SWE-bench Pro результат 67,7% уступает Fable 5 с 80,0%, но превосходит GPT-5.6 Sol с 64,6%.
Модель уже доступна в API QwenCloud, скорее всего позднее Alibaba также дропнет открытые веса флагмана.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12
Инсайдеры заявляют, что OpenAI, помимо GPT-6 Astra, готовит релиз ChatGPT Images 2.1 уже сегодня, а сейчас компания якобы проводит скрытое тестирование прямо в веб-версии GPT. Ждем новую волну нейрослопа (хотя прошлая до сих пор не прошла).
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍7
OpenAI опубликовала на GitHub общедоступную ветку новых компьютерных сред на JavaScript и Python, которые помечены как "gpt6" 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭7💩2