ServerFlow | Новости и Железо 💾
4.25K subscribers
4.98K photos
394 videos
12 files
2.44K links
Серверы, нейронки, инсайды и немного технической магии. Мы препарируем железо, тестим AI-движки и рассказываем всё как есть.

Хотите поболтать?
https://t.me/serverflow_chat

Оформить заказ?
@ServerFlow

Сотрудничество?
@marketing_sf

https://serverflow.ru
Download Telegram
⚡️ Релиз Claude Opus 4.5 — новый флагман Anthropic уже здесь!

Anthropic представила новую модель Claude Opus 4.5, и это новый топ в кодинге и агентских задачах!

Модель стала заметно сильнее в программировании: в SWE-bench Verified она набрала 80,9 %, обойдя Gemini 3 Pro и GPT-5.1. В языковых операциях Opus 4.5 набрала высший балл в семи из восьми языков, в агентских операциях флагман Anthropic также вырвался на первое место.


При этом стоимость использования Claude Opus 4.5 снизилась в три раза — до $5 за миллион входных токенов и $25 за миллион выходных токенов.

В модели также улучшили систему многоэтапных рассуждений и появился параметр effort, регулирующий глубину мышления. На максимальном уровне Opus 4.5 работает точнее Sonnet 4.5 и почти вдвое экономичнее по токенам.


Еще улучшили работу с контекстом, субагентами и оптимизировали расход памяти, что добавило ~15 % эффективности сверху в сложных задачах.

Opus 4.5 стал не только более производительным, но и более доступным, и это не может не радовать!
2👍3
💡 NPU 6 в Intel Nova Lake обеспечивает 74 TOPS

По данным инсайдера, десктопные процессоры Intel Nova Lake получат NPU шестого поколения с производительностью около 74 TOPS INT8.

Для сравнения: текущий NPU 3 в Arrow Lake выдает всего лишь до 11,5 TOPS, а NPU 5 в грядущем Panther Lake обещает около 50 TOPS. Если цифры подтвердятся, настольный сегмент Intel впервые получит NPU-чип на уровне Copilot+ и даже выше.


NPU 6 останется на той же микроархитектуре, что и NPU 5, но с увеличенной производительностью в ИИ-операциях. Патчи для компиляторов уже подтвердили его появление в Nova Lake-S.

Совместимость с предыдущими ИИ-платформами сохранится, так что разработчики смогут масштабировать существующие модели без пересборки пайплайна.


Походе, ожидается плавный апгрейд экосистемы ИИ-решений Intel — компания поднимает потолок локального инференса, но ПО пока в стадии разработки, поэтому практическая польза проявится после выхода устройств в релиз в 2026 году.
1🌭3
⚡️ Первая крупная MoE-модель на AMD MI300X: Zyphra успешно обучена

Компания Zyphra представила ZAYA1 — свою первую крупномасштабную MoE-модель, обученную полностью на GPU AMD Instinct MI300X в кластере с сетевыми картами Pensando.

В отчете Zyphra сказано, что модель показывает производительность на уровне ведущих открытых LLM в задачах логики, математики и программирования, что подтверждает пригодность MI300X для использования в других промышленных нагрузках.


192 ГБ HBM3 в MI300X позволили обойтись без сложностей в обучении моделей-экспертов, а оптимизированный распределенный ввод-вывод дал Zyphra более чем 10-кратное ускорение сохранения чекпойнтов.

Базовая версия ZAYA1 содержит 8,3 млрд параметров, из которых активны ~760 млн, а по данным разработчиков нейронка не уступает Qwen3-4B, Gemma3-12B, Llama-3-8B и OLMoE. Кластер построен на решениях AMD и IBMMI300X и Pensando работают вместе с хранилищем IBM Cloud.


Это один из первых кейсов крупного MoE-обучения вне экосистемы CUDA.
2👍2🌭1💅1
Знатоки, пишите в комменты, что это за уникальный процессор и чем он примечателен😎
Please open Telegram to view this post
VIEW IN TELEGRAM
2🌭4
⚡️ Подключаем любую LLM к любому MCP через фреймворк MCP-Use

На GitHib вышел MCP-Use — открытый фреймворк, который позволяет связать любую LLM с любым сервером MCP и собрать своих агентов с доступом к инструментам без использования проприетарных клиентов.

Проект дает возможность развернуть полностью локальный MCP-клиент и работать с серверами без зависимости от ChatGPT-приложений.


В набор входит поддержка MCP-агентов с многоэтапным рассуждением, клиентский слой для подключения внешних LLM, конструктор серверов MCP, веб-инспектор для отладки и UI-ресурсы для сборки приложений с интерактивными элементами.

Все доступно в open-source и подходит как для прользовательских задач, так и для корпоративных сред.


Разрабы сделали шаг к более прозрачной экосистеме MCP, где инструменты можно подключать к тем моделям, которые хочется, а не к тем, которые продвигает вендор.
👀 А теперь переходим к важным новостям

Реддиторский воссоздал копию материнок Supermicro X13SAE-F и X13SAE в Minecraft.

Красиво, вот бы она еще работала...
1👍42
⚡️ Стартап Kneron показал чип KL1140 для периферийного ИИ

Kneron представила KL1140 — новый американский ИИ-чип для запуска языковых моделей локально на периферийных устройствах.

Компания заявляет, что на процессорах можно запускать модели-трансформеры без размером ~120 млрд параметров, но только в конфигурации из четырех чипов. Энергопотребление, по данным Kneron, в два раза ниже, чем у конкурентов, а TCO ниже примерно в десять раз.


Подробные спецификации решения не раскрыты, но известно, что KL1140 относится к классу нейропроцессоров для инференса.

Стартап обещает ускорение языковых задач, CV и возможность развертывания локальных LLM с минимальной задержкой.


Ранее компания уже выпускала гибридные решения KL730 с Arm-CPU и NPU-ускорителем, так что новая линейка, скорее всего, унаследует эту архитектурную связку.
👍1
😮 ASIC-схемы переходят на упаковку EMIB и отказываются от CoWoS

TrendForce отмечает: спрос на CoWoS в ИИ-секторе зашкаливает, а мощностей производства упаковок почти не осталось.

Из-за роста популярности ASIC-схем для ИИ крупные облачные провайдеры смотрят в сторону технологии упаковки Intel EMIB, которая позволяет собирать более крупные корпуса без массивных переходников и снижает стоимость сборки.


CoWoS-L сейчас активно применяется в GPU NVIDIA Blackwell и будет использоваться для выпуска Rubin, но технология упирается в ограничение площади ~3,5× и растущую себестоимость.

EMIB-M уже дает около 6× площади, а к 2026-2027 году она может увеличиться до ~8-12×. К тому же, у EMIB меньше рисков деформации, так как в подложку внедряются только маленькие кремниевые мосты.


Пока что на EMIB подходят прежде всего под ASIC: пропускная способность технологии Intel ниже, чем у CoWoS, а задержки несколько выше. Поэтому NVIDIA и AMD останутся на CoWoS, но Google уже планирует задействовать EMIB в TPU v9 к 2027 году.
👍1
⚒️ AMD представила официальный девкит Spartan UltraScale+ за 229 $

AMD выпустила оценочный набор SCU35стартовую плату с ПО-стеком под FPGA Spartan UltraScale+ SU35P для разработчиков.

Платформа рассчитана на недорогие периферийные системы, где важно обилие линий ввода-вывода, низкое энергопотребление и механизмы безопасности.


Разработчики получают готовую плату с управлением и интерфейсами, так что начать работу можно без собственной PCB — все доступно из коробки.

SU35P дает широкий набор I/O и поддержку различных датчиков. Набор интегрируется с платформами Vivado и Vitis, доступен MicroBlaze и готовые шаблоны для HyperRAM. Подключение сторонних модулей тоже поддерживается — набор работает по методу plug-and-play.


SCU35 — первый официальный devkit на Spartan UltraScale+ с глобальной доступностью и долгим жизненным циклом. Хороший вариант для тех, кто хочет попробовать UltraScale+ с минимальным бюджетом.
👍2