⚡️ Релиз Claude Opus 4.5 — новый флагман Anthropic уже здесь!
Anthropic представила новую модель Claude Opus 4.5, и это новый топ в кодинге и агентских задачах!
При этом стоимость использования Claude Opus 4.5 снизилась в три раза — до $5 за миллион входных токенов и $25 за миллион выходных токенов.
Еще улучшили работу с контекстом, субагентами и оптимизировали расход памяти, что добавило ~15 % эффективности сверху в сложных задачах.
Opus 4.5 стал не только более производительным, но и более доступным, и это не может не радовать!
Anthropic представила новую модель Claude Opus 4.5, и это новый топ в кодинге и агентских задачах!
Модель стала заметно сильнее в программировании: в SWE-bench Verified она набрала 80,9 %, обойдя Gemini 3 Pro и GPT-5.1. В языковых операциях Opus 4.5 набрала высший балл в семи из восьми языков, в агентских операциях флагман Anthropic также вырвался на первое место.
При этом стоимость использования Claude Opus 4.5 снизилась в три раза — до $5 за миллион входных токенов и $25 за миллион выходных токенов.
В модели также улучшили систему многоэтапных рассуждений и появился параметр effort, регулирующий глубину мышления. На максимальном уровне Opus 4.5 работает точнее Sonnet 4.5 и почти вдвое экономичнее по токенам.
Еще улучшили работу с контекстом, субагентами и оптимизировали расход памяти, что добавило ~15 % эффективности сверху в сложных задачах.
Opus 4.5 стал не только более производительным, но и более доступным, и это не может не радовать!
2👍3
💡 NPU 6 в Intel Nova Lake обеспечивает 74 TOPS
По данным инсайдера, десктопные процессоры Intel Nova Lake получат NPU шестого поколения с производительностью около 74 TOPS INT8.
NPU 6 останется на той же микроархитектуре, что и NPU 5, но с увеличенной производительностью в ИИ-операциях. Патчи для компиляторов уже подтвердили его появление в Nova Lake-S.
Походе, ожидается плавный апгрейд экосистемы ИИ-решений Intel — компания поднимает потолок локального инференса, но ПО пока в стадии разработки, поэтому практическая польза проявится после выхода устройств в релиз в 2026 году.
По данным инсайдера, десктопные процессоры Intel Nova Lake получат NPU шестого поколения с производительностью около 74 TOPS INT8.
Для сравнения: текущий NPU 3 в Arrow Lake выдает всего лишь до 11,5 TOPS, а NPU 5 в грядущем Panther Lake обещает около 50 TOPS. Если цифры подтвердятся, настольный сегмент Intel впервые получит NPU-чип на уровне Copilot+ и даже выше.
NPU 6 останется на той же микроархитектуре, что и NPU 5, но с увеличенной производительностью в ИИ-операциях. Патчи для компиляторов уже подтвердили его появление в Nova Lake-S.
Совместимость с предыдущими ИИ-платформами сохранится, так что разработчики смогут масштабировать существующие модели без пересборки пайплайна.
Походе, ожидается плавный апгрейд экосистемы ИИ-решений Intel — компания поднимает потолок локального инференса, но ПО пока в стадии разработки, поэтому практическая польза проявится после выхода устройств в релиз в 2026 году.
1🌭3
⚡️ Первая крупная MoE-модель на AMD MI300X: Zyphra успешно обучена
Компания Zyphra представила ZAYA1 — свою первую крупномасштабную MoE-модель, обученную полностью на GPU AMD Instinct MI300X в кластере с сетевыми картами Pensando.
192 ГБ HBM3 в MI300X позволили обойтись без сложностей в обучении моделей-экспертов, а оптимизированный распределенный ввод-вывод дал Zyphra более чем 10-кратное ускорение сохранения чекпойнтов.
Это один из первых кейсов крупного MoE-обучения вне экосистемы CUDA.
Компания Zyphra представила ZAYA1 — свою первую крупномасштабную MoE-модель, обученную полностью на GPU AMD Instinct MI300X в кластере с сетевыми картами Pensando.
В отчете Zyphra сказано, что модель показывает производительность на уровне ведущих открытых LLM в задачах логики, математики и программирования, что подтверждает пригодность MI300X для использования в других промышленных нагрузках.
192 ГБ HBM3 в MI300X позволили обойтись без сложностей в обучении моделей-экспертов, а оптимизированный распределенный ввод-вывод дал Zyphra более чем 10-кратное ускорение сохранения чекпойнтов.
Базовая версия ZAYA1 содержит 8,3 млрд параметров, из которых активны ~760 млн, а по данным разработчиков нейронка не уступает Qwen3-4B, Gemma3-12B, Llama-3-8B и OLMoE. Кластер построен на решениях AMD и IBM — MI300X и Pensando работают вместе с хранилищем IBM Cloud.
Это один из первых кейсов крупного MoE-обучения вне экосистемы CUDA.
2👍2🌭1💅1
Please open Telegram to view this post
VIEW IN TELEGRAM
2🌭4
⚡️ Подключаем любую LLM к любому MCP через фреймворк MCP-Use
На GitHib вышел MCP-Use — открытый фреймворк, который позволяет связать любую LLM с любым сервером MCP и собрать своих агентов с доступом к инструментам без использования проприетарных клиентов.
В набор входит поддержка MCP-агентов с многоэтапным рассуждением, клиентский слой для подключения внешних LLM, конструктор серверов MCP, веб-инспектор для отладки и UI-ресурсы для сборки приложений с интерактивными элементами.
Разрабы сделали шаг к более прозрачной экосистеме MCP, где инструменты можно подключать к тем моделям, которые хочется, а не к тем, которые продвигает вендор.
На GitHib вышел MCP-Use — открытый фреймворк, который позволяет связать любую LLM с любым сервером MCP и собрать своих агентов с доступом к инструментам без использования проприетарных клиентов.
Проект дает возможность развернуть полностью локальный MCP-клиент и работать с серверами без зависимости от ChatGPT-приложений.
В набор входит поддержка MCP-агентов с многоэтапным рассуждением, клиентский слой для подключения внешних LLM, конструктор серверов MCP, веб-инспектор для отладки и UI-ресурсы для сборки приложений с интерактивными элементами.
Все доступно в open-source и подходит как для прользовательских задач, так и для корпоративных сред.
Разрабы сделали шаг к более прозрачной экосистеме MCP, где инструменты можно подключать к тем моделям, которые хочется, а не к тем, которые продвигает вендор.
👀 А теперь переходим к важным новостям
Реддиторский воссоздал копию материнок Supermicro X13SAE-F и X13SAE в Minecraft.
Красиво, вот бы она еще работала...
Реддиторский воссоздал копию материнок Supermicro X13SAE-F и X13SAE в Minecraft.
Красиво, вот бы она еще работала...
1👍4 2
⚡️ Стартап Kneron показал чип KL1140 для периферийного ИИ
Kneron представила KL1140 — новый американский ИИ-чип для запуска языковых моделей локально на периферийных устройствах.
Подробные спецификации решения не раскрыты, но известно, что KL1140 относится к классу нейропроцессоров для инференса.
Ранее компания уже выпускала гибридные решения KL730 с Arm-CPU и NPU-ускорителем, так что новая линейка, скорее всего, унаследует эту архитектурную связку.
Kneron представила KL1140 — новый американский ИИ-чип для запуска языковых моделей локально на периферийных устройствах.
Компания заявляет, что на процессорах можно запускать модели-трансформеры без размером ~120 млрд параметров, но только в конфигурации из четырех чипов. Энергопотребление, по данным Kneron, в два раза ниже, чем у конкурентов, а TCO ниже примерно в десять раз.
Подробные спецификации решения не раскрыты, но известно, что KL1140 относится к классу нейропроцессоров для инференса.
Стартап обещает ускорение языковых задач, CV и возможность развертывания локальных LLM с минимальной задержкой.
Ранее компания уже выпускала гибридные решения KL730 с Arm-CPU и NPU-ускорителем, так что новая линейка, скорее всего, унаследует эту архитектурную связку.
👍1
😮 ASIC-схемы переходят на упаковку EMIB и отказываются от CoWoS
TrendForce отмечает: спрос на CoWoS в ИИ-секторе зашкаливает, а мощностей производства упаковок почти не осталось.
CoWoS-L сейчас активно применяется в GPU NVIDIA Blackwell и будет использоваться для выпуска Rubin, но технология упирается в ограничение площади ~3,5× и растущую себестоимость.
Пока что на EMIB подходят прежде всего под ASIC: пропускная способность технологии Intel ниже, чем у CoWoS, а задержки несколько выше. Поэтому NVIDIA и AMD останутся на CoWoS, но Google уже планирует задействовать EMIB в TPU v9 к 2027 году.
TrendForce отмечает: спрос на CoWoS в ИИ-секторе зашкаливает, а мощностей производства упаковок почти не осталось.
Из-за роста популярности ASIC-схем для ИИ крупные облачные провайдеры смотрят в сторону технологии упаковки Intel EMIB, которая позволяет собирать более крупные корпуса без массивных переходников и снижает стоимость сборки.
CoWoS-L сейчас активно применяется в GPU NVIDIA Blackwell и будет использоваться для выпуска Rubin, но технология упирается в ограничение площади ~3,5× и растущую себестоимость.
EMIB-M уже дает около 6× площади, а к 2026-2027 году она может увеличиться до ~8-12×. К тому же, у EMIB меньше рисков деформации, так как в подложку внедряются только маленькие кремниевые мосты.
Пока что на EMIB подходят прежде всего под ASIC: пропускная способность технологии Intel ниже, чем у CoWoS, а задержки несколько выше. Поэтому NVIDIA и AMD останутся на CoWoS, но Google уже планирует задействовать EMIB в TPU v9 к 2027 году.
👍1
⚒️ AMD представила официальный девкит Spartan UltraScale+ за 229 $
AMD выпустила оценочный набор SCU35 — стартовую плату с ПО-стеком под FPGA Spartan UltraScale+ SU35P для разработчиков.
Разработчики получают готовую плату с управлением и интерфейсами, так что начать работу можно без собственной PCB — все доступно из коробки.
SCU35 — первый официальный devkit на Spartan UltraScale+ с глобальной доступностью и долгим жизненным циклом. Хороший вариант для тех, кто хочет попробовать UltraScale+ с минимальным бюджетом.
AMD выпустила оценочный набор SCU35 — стартовую плату с ПО-стеком под FPGA Spartan UltraScale+ SU35P для разработчиков.
Платформа рассчитана на недорогие периферийные системы, где важно обилие линий ввода-вывода, низкое энергопотребление и механизмы безопасности.
Разработчики получают готовую плату с управлением и интерфейсами, так что начать работу можно без собственной PCB — все доступно из коробки.
SU35P дает широкий набор I/O и поддержку различных датчиков. Набор интегрируется с платформами Vivado и Vitis, доступен MicroBlaze и готовые шаблоны для HyperRAM. Подключение сторонних модулей тоже поддерживается — набор работает по методу plug-and-play.
SCU35 — первый официальный devkit на Spartan UltraScale+ с глобальной доступностью и долгим жизненным циклом. Хороший вариант для тех, кто хочет попробовать UltraScale+ с минимальным бюджетом.
👍2