Пустой M.2 теперь можно превратить в мини-LLM-ускоритель — компания Unigen показала компактные NPU-модуль Amaretti для инференса в формате формата M.2 / E1.S. Заявлены до 60 TOPS, 32 ГБ памяти LPDDR4X, 20 МБ SRAM и возможность крутить модели до 20 млрд параметров при энергопотреблении около 10 Вт. Для задач вроде RAG, агентных рабочих процессов, инференса на периферии и мобильных устройствах решение выглядит более чем достойно, а для более тяжелых ИИ-задач в системе остается полноценный слот PCIe x16 под GPU. Цены на решение пока не разглашают.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9 2
По данным утечки с Board Channels, которую подхватили Gazlog и профильные инсайдеры, NVIDIA может выпустить версии GeForce RTX 5060 и 5060 Ti с 9 ГБ памяти уже в мае-июне, вероятно ближе к Computex 2026. Видеокарты будут иметь три чипа GDDR7 по 3 ГБ на 96-битной шине, обеспечивая 9 ГБ VRAM и пропускную способность порядка 336 ГБ/с. Так Nvidia пытается решить 2 задачи: дать пользователям чуть больше видеопамяти для бюджетного сегмента и сократить себестоимость производства за счет перехода со 128-битной шины на 96-битную.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭2
⚡️Вышел ⚡️Вышел ⚡️Вышел ⚡️
Сегодня проверим маленькие локальные LLM в агентских задачах ⚙️
Это и многое другое вы узнаете в новом видео!
🤖 Напоминаем, это наш второй канал, на котором мы делаем фокус на тесте разных ИИ-моделей, без масштаба, но со смыслом :)
Смотреть: https://youtu.be/YI7Ps8z5d8k?si=G-zyzv45E-11hxj_
😅 Канал Serverflow в MAX: Подписаться
Сегодня проверим маленькие локальные LLM в агентских задачах ⚙️
- Реальный проект в OpenCode
- Web search и работа с JSON
- Benchmark на tool calling для локальных моделей
Это и многое другое вы узнаете в новом видео!
Смотреть: https://youtu.be/YI7Ps8z5d8k?si=G-zyzv45E-11hxj_
Please open Telegram to view this post
VIEW IN TELEGRAM
YouTube
Маленькие LLM как агенты - тест локальных моделей до 8B
В этом видео тестирую маленькие локальные модели в реальных агентских задачах. Все модели запускаются через llama.cpp в GGUF и работают в OpenCode с одинаковым контекстом 64k, чтобы сравнение было максимально честным.
В тестах участвуют модели от 3B до 9B…
В тестах участвуют модели от 3B до 9B…
2🤯4
Anthropic официально представила Claude Opus 4.7 — апдейт не столько в производительности, сколько в агентной эффективности благодаря точному следованию инструкциям и стабильности на длинных контекстах.
Модель получила улучшенную мультимодальность с обработкой изображений до 2 576 px по длинной стороне, новый уровень размышления xhigh между high и max, а также обновленный токенизатор с приростом экономии токенов до 1,35× в зависимости от типа контента.
При этом цена API на Claude Opus 4.7 не изменилась в сравнении с Opus 4.6: $5 за 1 млн входных токенов и $25 за 1 млн выходных.
😅 Канал Serverflow в MAX: Подписаться
Модель получила улучшенную мультимодальность с обработкой изображений до 2 576 px по длинной стороне, новый уровень размышления xhigh между high и max, а также обновленный токенизатор с приростом экономии токенов до 1,35× в зависимости от типа контента.
Самое интересное — безопасность. Opus 4.7 стала первой публичной моделью Anthropic, где открыто применяются механизмы ограничения кибервозможностей, протестированные после анонса Mythos / Project Glasswing. Компания обкатывает защитные механизмы на более массовой модели, прежде чем двигать в публичный доступ системы Mythos-класса.
При этом цена API на Claude Opus 4.7 не изменилась в сравнении с Opus 4.6: $5 за 1 млн входных токенов и $25 за 1 млн выходных.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Проблема интернета будущего решена. Инженерный совет Интернета (IETF) представил новую концепцию протокола IP — IPv8. Ключевая особенность состоит в полной совместимости с адресами IPv4, он работает как склейка: первые 4 числа от 0 до 255 выступают идентификатором сети или оператора, а вторые 4 числа являются личным адресом устройства. В случае, если заменить первые идентификаторы на нули, то IP-адрес станет стандартным IPv4 и будет работать без изменений. В перспективе IPv8 может увеличить адресное пространство на 18 квинтиллионов уникальных айпишников, что навсегда решит вопрос дефицита адресов. И еще одна изюминка — IPv8 не требует поддержки со стороны оборудования, он работает на всем, что поддерживает IPv4, чего не скажешь про IPv6.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9
Media is too big
VIEW IN TELEGRAM
OpenAI выпустила обновление приложения Codex. Теперь платформа умеет управлять памятью устройства, использовать любые компьютерные приложения и браузер пользователя при выполнении задач. Также накатили много новых плагинов для агентной разработки, тестирования и других опций.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
AMD официально подтвердила, что в центральных процессорах следующего поколения EPYC Verano получат поддержку памяти SOCAMM2 на базе LPDDR5X/LPDDR6. Апдейт нацелен на использование CPU Verano в ИИ-стойках для оптимизации хост-функций и управления агентными рабочими процессами.
EPYC Verano и будут работать в связке с будущими AMD Instinct MI500 и сетевыми адаптерами Vulcano в рамках ИИ-стоек Helios (аналог NVL72 от AMD). Модульная компактная память SOCAMM2 позволит снизить энергопотребление системы, увеличить плотность размещения памяти и упростит охлаждение центральных процессоро AMD EPYC Verano в вычислительных нодах. При этом, память SOCAMM2 также будет использоваться в грядущих ИИ-ускорителях Nvidia Rubin. Похоже, что ключевые поставщики ИИ-оборудования массово переходят с RDIMM на новый эффективный стандарт оперативки.
😅 Канал Serverflow в MAX: Подписаться
EPYC Verano и будут работать в связке с будущими AMD Instinct MI500 и сетевыми адаптерами Vulcano в рамках ИИ-стоек Helios (аналог NVL72 от AMD). Модульная компактная память SOCAMM2 позволит снизить энергопотребление системы, увеличить плотность размещения памяти и упростит охлаждение центральных процессоро AMD EPYC Verano в вычислительных нодах. При этом, память SOCAMM2 также будет использоваться в грядущих ИИ-ускорителях Nvidia Rubin. Похоже, что ключевые поставщики ИИ-оборудования массово переходят с RDIMM на новый эффективный стандарт оперативки.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6🤯1
В новом Linux 7.1 убрали поддержку отечественный периферийных процессоров Байкал-Т1. Удаление объяснили отсутствием сопровождения архитектуры и незаконченной интеграцией компонентов Baikal в экосистему Linux.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
1 9👍2😡1 1
Инсайдер HXL заявил, что AMD оживит продажи процессоров Ryzen 5800X3D во 2 квартале 2026 года в рамках 10-летия сокета AM4. Чипы выйдут в виде ревизии 10th Anniversary Edition, но изменений характеристик не ждите: 8/16 ядер и потоков, 100 МБ 3D-V кэша, частота 4,5 ГГц. Информации о ценах пока нет.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Orange Pi представила Zero 3W — новый одноплатник размером 65×32 мм на базе SoC Allwinner A733 с конфигурацией 2× Cortex-A76 до 2 ГГц + 6× Cortex-A55, плюс отдельное RISC-V ядро для задач реального времени. Больше всего интересен объем памяти: до 16 ГБ LPDDR5-4800, а также eMMC и UFS.
Также используется графика Imagination с поддержкой Vulkan 1.3 и OpenCL 3.0, видеоблок умеет декодировать 8K и кодировать 4K, а встроенный NPU выдает до 3 TOPS. Это позволяет запускать базовый инференс, CV-модели и легковесных агентов. Доступны сетевые интерфейсы Wi-Fi и Bluetooth, а также вывод PCIe 3.0 x1 через FPC для подключения периферии. Есть стандартные GPIO, USB и видеовыходы, что делает плату универсальной для edge-сценариев, встраиваемых систем и компактных AI-узлов. Цена вопроса — от $25.
😅 Канал Serverflow в MAX: Подписаться
Также используется графика Imagination с поддержкой Vulkan 1.3 и OpenCL 3.0, видеоблок умеет декодировать 8K и кодировать 4K, а встроенный NPU выдает до 3 TOPS. Это позволяет запускать базовый инференс, CV-модели и легковесных агентов. Доступны сетевые интерфейсы Wi-Fi и Bluetooth, а также вывод PCIe 3.0 x1 через FPC для подключения периферии. Есть стандартные GPIO, USB и видеовыходы, что делает плату универсальной для edge-сценариев, встраиваемых систем и компактных AI-узлов. Цена вопроса — от $25.
Please open Telegram to view this post
VIEW IN TELEGRAM
🌭2👍1
This media is not supported in your browser
VIEW IN TELEGRAM
Хуанг в новом интервью вступил в жаркую полемику на счет необходимости поставок ИИ-чипов в Китай 👀
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯3👍1
Intel представила 6 новых SoC-чипов Core Series 3 Wildcat Lake. Почти все процессоры имеют идентичную конфигурацию ядер с 2 P-ядрами и 4 LPE-ядрами, отличия заключаются только в частотах (от 4.3 до 4.8 ГГц), наличии встроенного NPU и количества ядер графики. Только самый младший Core 3 304 имеет на 1 P-ядро меньше.
Процессоры поддерживают до 64 ГБ памяти DDR5-6400, либо 48 ГБ LPDDR5X-7467, у всех процессоров есть 6 МБ кэша L3, есть 2 порта Thunderbolt 4, Wi-Fi 7, Bluetooth 6.0. Чипы произведены на техпроцессе Intel 18A, TDP достигает 35 Вт. Суть линейки — не максимальная производительность, а энергоэффективность, поэтому они подойдут для бюджетных ноутбуков и встраиваемых систем.
😅 Канал Serverflow в MAX: Подписаться
Процессоры поддерживают до 64 ГБ памяти DDR5-6400, либо 48 ГБ LPDDR5X-7467, у всех процессоров есть 6 МБ кэша L3, есть 2 порта Thunderbolt 4, Wi-Fi 7, Bluetooth 6.0. Чипы произведены на техпроцессе Intel 18A, TDP достигает 35 Вт. Суть линейки — не максимальная производительность, а энергоэффективность, поэтому они подойдут для бюджетных ноутбуков и встраиваемых систем.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1
Компания IonQ показала свой фотонный интерконнект, который позволяет объединять отдельные квантовые компьютеры в единую систему. В демонстрации удалось связать две QPU-системы на базе ионных кубитов, передавая квантовое состояние через фотоны с сохранением когерентности — ключевого условия для выполнения сложных квантовых операций. Такой подход дает высокую точность и стабильность, но раньше упирался в масштабирование QPU-систем — новый интерконнект решает это через генерацию, передачу и детектирование фотонов, которые используются для создания запутанности между разными квантовыми системами.
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2 1
В сеть утекли предполагаемые бенчмарки DeepSeek V4, где модель якобы берет 1-е место во всех 12 ключевых тестах и уверенно обходит Gemini 3.1 Pro, GPT-5.3 и Claude Opus 4.6. Верим?
😅 Канал Serverflow в MAX: Подписаться
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4 4