Anthropic представила Claude Haiku 5.5 — самую младшую, быструю и дешевую модель семейства Claude 5.5.
Claude Haiku 5.5 специализируется на легких задачах, которые требуют максимальной скорости и максимально доступной стоимости — суммаризация, сжатие контекста, запросы к базам данных, классификация, поддержка клиентов в реальном времени, а также Anthropic отдельно отмечает, что нейронка хорошо подходит как субагент для старших моделей Opus 5.5 и Sonnet 5.5 в задачах программирования
Для запросов до 100 тысяч токенов Haiku 5.5 стоит на 90% дешевле, чем Haiku 4.5: $0,10 за миллион входных токенов и $0,50 за миллион выходных вместо $1 и $5 — это эквивалентно стоимости GPT-6 Luna. Чтение из кэша обходится всего в $0,01 за миллион токенов.
На OSWorld 2.1 Haiku 5.5 набрала 72,4% против 15,7% у Haiku 4.5. В Humanity's Last Exam без инструментов результат вырос с 10,2% до 45,9%, а с инструментами с 18,7% до 57,4%. На Terminal-Bench 4.0 предшественник не решил ни одной задачи, а новая модель набрала 39,2%. В задачах офисной работы GDPval-AA рейтинг вырос с 735 до 1620, что выше, чем у конкурента из OpenAI в этом же классе, GPT-6 Luna, с его 1437 баллами.
Еще одно нововведение: впервые в линейке Haiku появилась настройка уровня усилий размышления. Как и у старших моделей, можно выбрать, на чем делать акцент: на экономии или на качестве ответов. Режимов пять, от Low до Max.
Помимо релиза Haiku, компания также снизила стоимость чтения из кэша для Sonnet 5.5 вдвое, с $0,20 до $0,10 за миллион токенов. Так как в агентных задачах именно кэш составляет большую часть потребления, итоговая работа Sonnet 5.5 подешевеет примерно на 20%. Подписчики Max и Team начнут получать ежемесячные кредиты на API: $100 для Max 5x, $200 для Max 20x и до $500 на команду в Team.
Модель уже доступна в API, а также в AWS, Google Cloud и Microsoft Azure.
😅 Канал Serverflow в MAX: Подписаться
Claude Haiku 5.5 специализируется на легких задачах, которые требуют максимальной скорости и максимально доступной стоимости — суммаризация, сжатие контекста, запросы к базам данных, классификация, поддержка клиентов в реальном времени, а также Anthropic отдельно отмечает, что нейронка хорошо подходит как субагент для старших моделей Opus 5.5 и Sonnet 5.5 в задачах программирования
Для запросов до 100 тысяч токенов Haiku 5.5 стоит на 90% дешевле, чем Haiku 4.5: $0,10 за миллион входных токенов и $0,50 за миллион выходных вместо $1 и $5 — это эквивалентно стоимости GPT-6 Luna. Чтение из кэша обходится всего в $0,01 за миллион токенов.
На OSWorld 2.1 Haiku 5.5 набрала 72,4% против 15,7% у Haiku 4.5. В Humanity's Last Exam без инструментов результат вырос с 10,2% до 45,9%, а с инструментами с 18,7% до 57,4%. На Terminal-Bench 4.0 предшественник не решил ни одной задачи, а новая модель набрала 39,2%. В задачах офисной работы GDPval-AA рейтинг вырос с 735 до 1620, что выше, чем у конкурента из OpenAI в этом же классе, GPT-6 Luna, с его 1437 баллами.
Еще одно нововведение: впервые в линейке Haiku появилась настройка уровня усилий размышления. Как и у старших моделей, можно выбрать, на чем делать акцент: на экономии или на качестве ответов. Режимов пять, от Low до Max.
Помимо релиза Haiku, компания также снизила стоимость чтения из кэша для Sonnet 5.5 вдвое, с $0,20 до $0,10 за миллион токенов. Так как в агентных задачах именно кэш составляет большую часть потребления, итоговая работа Sonnet 5.5 подешевеет примерно на 20%. Подписчики Max и Team начнут получать ежемесячные кредиты на API: $100 для Max 5x, $200 для Max 20x и до $500 на команду в Team.
Модель уже доступна в API, а также в AWS, Google Cloud и Microsoft Azure.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🍾3💩2🌭1
Nvidia в рамках конференции Microsoft анонсировала релиз открытой ИИ-модели Nemotron 70b 15 октября. Нейронку можно будет запускать на ИИ-ПК RTX Spark.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍16🌭2💩1
Microsoft раскрыла цену Surface Laptop Ultra. За $2599 предлагается конфигурация с 18-ядерным процессором, 5120-ядерным GPU Blackwell и 24 ГБ унифицированной памяти. Версия с 20-ядерным CPU и 6144-ядерным GPU стартует с $3699 и комплектуется 32 ГБ памяти. За $4699 можно получить 64 ГБ памяти и SSD на 2 ТБ, а максимальная конфигурация с 128 ГБ памяти и SSD на 1 ТБ обойдется в $5899. Интересной особенностью корпуса стал новый съемный USB-C-порт. Отдельно Microsoft представила ИИ-ПК Surface RTX Spark Dev Box за $5999.
* Указана рекомендуемая розничная цена без учета НДС и логистических затрат. Реальная стоимость оборудования будет отличаться.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯16
Касательно Surface RTX Spark Dev Box за 6к баксов — это настольный ИИ-ПК на базе 20-ядерной версии N1X с 6144 ядрами CUDA от графики Blackwell. Система получила 128 ГБ унифицированной памяти и SSD на 2 ТБ. TDP составляет 100 Вт. Корпус выполнен из анодированного алюминия методом 3D-печати и одновременно используется как радиатор системы охлаждения. Корпус, кстати, по высоте получился в разы компактнее решений других партнеров Nvidia и эталонной версии RTX Spark.
Surface RTX Spark Dev Box входит в инициативу Microsoft Project Zenith и поставляется с Windows 11 Pro для разработчиков. Предустановлены Visual Studio Code, Git, GitHub CLI, GitHub Copilot, WSL, Python и Node.
😅 Канал Serverflow в MAX: Подписаться
Surface RTX Spark Dev Box входит в инициативу Microsoft Project Zenith и поставляется с Windows 11 Pro для разработчиков. Предустановлены Visual Studio Code, Git, GitHub CLI, GitHub Copilot, WSL, Python и Node.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5💩4
Материнская плата RTX Spark с чипом N1X, на которой базируются свежие ноуты Microsoft Surface Laptop Ultra.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10🤯2🌭2
This media is not supported in your browser
VIEW IN TELEGRAM
Nvidia показала своих роботов-манипуляторов для сборки тестовых плат GB300 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🤯4
Media is too big
VIEW IN TELEGRAM
Хуанг лично присутствовал на конфе Microsoft, и заявил, что “Если бы не Windows, Nvidia не была бы основана”.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯15👍5💩2💅1
И еще один момент — оказывается, в RTX Spark для графического процессора Blackwell можно выделить только 80 ГБ памяти. Тем временем, в AMD Ryzen AI Max+ 395 для GPU можно выделить до 96 ГБ памяти.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯24🍾1💅1
На демонстрации возможностей инференса нейронок на Surface Laptop Ultra засетилось наличие NPU в устройстве. Который, к тому же, совершенно не загружается системой.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8🌭7💅3💩1
Компания Tiny Corp показала прототип нового вычислительного узла (возможно, Tinybox v3) на базе аж 12 GPU Nvidia RTX. Только представьте, как сильно шумит эта штука…
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯9👍4💩2🌭1
Please open Telegram to view this post
VIEW IN TELEGRAM
👍8🤯7🍾3🌭1
ServerFlow | Новости и Железо 💾
Китайская компания JGINYUE представила PCIe-плату расширения на базе чипсета AMD B650 для интеграции сразу 4x NVMe SSD M.2 в один слот. Чипсет AMD B650, который используется здесь как контроллер для распределения линий PCIe, поэтому материнской плате не требуется…
Вышла очередная китайская PCIe-карта расширения на чипсете AMD — в этот раз отличилась Minisforum, представив расширитель SSD ESP4B с 4x слотами M.2 на чипсете AMD B850 (Promontory 21) с интерфейсом PCIe 4.0 x4.
При установке 1 или 2 SSD в ESP4B они работают PCIe 4.0 x4, а при заполнении всех четырех слотов переключаются на x2. В тесте SSD Kingston Gen 4 показал около 6,1 ГБ/с при подключении двух накопителей и около 3,3 ГБ/с при заполнении всех четырех слотов.
Помимо 4x M.2, на карте есть OCuLink для подключения внешней видеокарты. С комплектным адаптером этот интерфейс можно использовать для подключения четырех SATA-устройств. Также есть USB Type-C с пропускной способностью 20 Гбит/с.
😅 Канал Serverflow в MAX: Подписаться
При установке 1 или 2 SSD в ESP4B они работают PCIe 4.0 x4, а при заполнении всех четырех слотов переключаются на x2. В тесте SSD Kingston Gen 4 показал около 6,1 ГБ/с при подключении двух накопителей и около 3,3 ГБ/с при заполнении всех четырех слотов.
Помимо 4x M.2, на карте есть OCuLink для подключения внешней видеокарты. С комплектным адаптером этот интерфейс можно использовать для подключения четырех SATA-устройств. Также есть USB Type-C с пропускной способностью 20 Гбит/с.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍10🤯2🍾1