OpenAI выпустила GPT-6.1 Sol. Новая модель подтянула кодинг, работу с интерфейсами, агентные задачи и работу с десятками инструментов, при этом сохранила стоимость GPT-6 Sol — в API модель стоит $2 за 1 млн входных токенов и $10 за 1 млн выходных токенов, + $0,10 за кэшированные запросы.
На DeepSWE v1.1 модель почти вышла на один уровень с GPT-6 Astra при примерно в 5 раз меньшей стоимости задачи. На OSWorld 2.0 GPT-6.1 Sol всего на 2,1 пункта ниже Astra, но задача обходится примерно в 7 раз дешевле.
GPT-6.1 Sol уже доступна в ChatGPT Work, Codex и API.
😅 Канал Serverflow в MAX: Подписаться
На DeepSWE v1.1 модель почти вышла на один уровень с GPT-6 Astra при примерно в 5 раз меньшей стоимости задачи. На OSWorld 2.0 GPT-6.1 Sol всего на 2,1 пункта ниже Astra, но задача обходится примерно в 7 раз дешевле.
GPT-6.1 Sol уже доступна в ChatGPT Work, Codex и API.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8🤯1
OpenAI представила новую подписку Pro 500 — при цене в $500, она дает в 25 раз больше лимитов, чем Plus, а также открывает режим Ultrafast для модели Astra, ускоряя инференс в 8 раз.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
💩21👍2🤯2
Инсайдеры обнаружили упоминание новой версии DeepSeek V4.1 Flash Fast.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8🤯4
AMD раскрыла цены на все центральные процессоры EPYC Venice 9006 — в линейку вошла 31 модель CPU для сокетов SP7 и SP8. Самый младший чип на SP8 с 8 ядрами будет стоить менее 1000 баксов, тогда как за топовые решения на SP7 до 256 ядер придется отвалить почти 15к баксов.
К слову, 8-ядерный Intel Xeon 6507P стоит немногим меньше 800 долларов, а флагманский Intel Xeon 6990E+ с 288 ядрами стоит на 100 баксов дороже флагмана AMD.
😅 Канал Serverflow в MAX: Подписаться
К слову, 8-ядерный Intel Xeon 6507P стоит немногим меньше 800 долларов, а флагманский Intel Xeon 6990E+ с 288 ядрами стоит на 100 баксов дороже флагмана AMD.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯13
ServerFlow | Новости и Железо 💾
OpenAI выпустила GPT-6.1 Sol. Новая модель подтянула кодинг, работу с интерфейсами, агентные задачи и работу с десятками инструментов, при этом сохранила стоимость GPT-6 Sol — в API модель стоит $2 за 1 млн входных токенов и $10 за 1 млн выходных токенов,…
GPT-6.1 Sol слегка подвинула OpenAI в рейтинге Artificial Analysis, обойдя Muse Spark 1.3. Модели Anthropic все еще в лидерах.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6💅2
Свежее фото новеньких Nvidia Vera CPU — компания активно рассылает тестовые образцы ИИ-стартапам в преддверии старта продаж.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍19🌭3🤯2
По данным отраслевых источников, весь объем поставок AMD EPYC 9006 Venice на 2027 год уже распродан, поэтому AMD якобы начала принимать заказы на 2028 год. Портал Morgan Stanley уже прогнозирует отгрузку около 6,75 млн Venice в 2027 году против ~1,25 млн чипов в 2026 году. При этом информация о распроданных объемах пока не подтверждена AMD.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯10
ServerFlow | Новости и Железо 💾
Photo
“Облачный компьютер”, на котором запускают OpenAI dots, протестили в Geekbench 7. Судя по всему, ИИ-агенты работают в облачном инстансе Microsoft на базе 80-ядерных процессоров AMD EPYC 9V74 с производительностью 1667 баллов в однопоточке и 9434 баллов в многопоточке.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6🤯2
DeepSeek совместно с Huawei открыла исходный код инструментов для программирования ИИ-ускорителей Ascend — DeepGEMM Ascend. Главная часть библиотеки — TileLang, язык программирования и набор инструментов для создания и оптимизации вычислительных ядер под китайские ИИ-чипы.
Компании развивают собственный программный слой, который должен упростить запуск и оптимизацию ИИ-моделей на ускорителях Huawei без привязки к экосистеме Nvidia CUDA. DeepSeek уже вместе с Huawei работала над оптимизацией ПО для Ascend 950, а дальнейшая разработка продолжится.
😅 Канал Serverflow в MAX: Подписаться
Компании развивают собственный программный слой, который должен упростить запуск и оптимизацию ИИ-моделей на ускорителях Huawei без привязки к экосистеме Nvidia CUDA. DeepSeek уже вместе с Huawei работала над оптимизацией ПО для Ascend 950, а дальнейшая разработка продолжится.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯17👍8🍾4🌭1💅1
This media is not supported in your browser
VIEW IN TELEGRAM
Никогда не обнулю твои лимиты
Никогда не выпущу открытую модель
Никогда не закончу дефицит оперативки
😅 Канал Serverflow в MAX: Подписаться
Никогда не выпущу открытую модель
Никогда не закончу дефицит оперативки
Please open Telegram to view this post
VIEW IN TELEGRAM
👍37🍾8😡5🌭4🤯2
Оказалось, что режим Ultrafast для GPT6.1 Sol со скоростью инференса 300 ток/с работает не на мощностях Cerebras, как было ранее, а на мощностях оборудования Nvidia. Компания косвенно подтвердила это недвусмысленным комментарием под постом SemiAnalysis.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍20💩3🤯2💅1
Canonical выпустила экспериментальный ISO-образ Ubuntu 26.10 Concept с поддержкой устройств на базе Snapdragon X2. Он уже поддерживается на ASUS Zenbook A14/A16, Lenovo Yoga Slim 7 и HP EliteBook X G2q.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14🌭14🍾1