Machinelearning

🌟

Tencent выпустила набор моделей машинного перевода Hy-MT2

Линейка включает 3 версии: Hy-MT2-1.8B, Hy-MT2-7B и Hy-MT2-30B-A3B.

Все модели поддерживают перевод между 33 языками (включая русский), а также 5 диалектами и языками национальных меньшинств КНР.

Tencent делает акцент на возможности локального запуска модели на устройствах с ограниченными ресурсами.

Версия с экстремальным квантованием в 1,25 бит, собранная с помощью собственного фреймворка Sherry, занимает около 440 МБ и способна работать на мобильных чипах Apple, Qualcomm и MediaTek без подключения к интернету.

Скорость инференса на Apple A15 заявлена в 1,5 раза выше, чем у 4-битной версии предыдущей модели Hy-MT1.5.

По результатам собственного тестирования Tencent, на бенчмарке FLORES-200 версии Hy-MT2 показали средние результаты 88,1%, 96,9% и 98,1% - компания называет это сопоставимым с показателями Gemini 3.1 Pro.

Tencent утверждает, что старшая модель 30B-A3B превосходит DeepSeek-V4-Pro и Kimi K2.6 на ряде тестов, а младшая 1,8B-версия опережает по среднему качеству перевода коммерческие API, включая решение Microsoft.

Вместе с моделью Tencent открыла исходники IFMTBench - собственного тестового набора для оценки того, насколько точно перевод следует пользовательским инструкциям о стиле, терминологии и формате вывода.

Помимо этого, компания выступает партнёром соревнований WMT26 - General Machine Translation и Video Subtitle Translation.

Одновременно, в экосистеме WeChat запущено мини-приложение Tencent Hy Translate. Полноценные приложения для iOS и Android, по словам компании, появятся позднее.

📌Лицензирование: Tencent HY Ccommunity License

🟡

🟡

🟡

🟡

🖥

GitHub

@ai_machinelearning_big_data

#AI #ML #MT #HYMT2 #Tencent

Please open Telegram to view this post

VIEW IN TELEGRAM

Please open Telegram to view this post

VIEW IN TELEGRAM

❤46🤓36👍24🎉11👏9🔥6💘2❤‍🔥1🤔1🌚1🌭1

18.8K views20:04

Machinelearning

📌

Anthropic опубликовала апдейт по проекту Glasswing

Glasswing - инициатива по поиску уязвимостей в системно значимом программном обеспечении с помощью ИИ.

Согласно обновленному отчету, около 50 её партнёров за первый месяц работы с моделью Mythos Preview обнаружили более 10 000 уязвимостей высокого и критического уровня.

🟡

Среди приведённых примеров:

🟢Cloudflare, в чьих ключевых системах было найдено 2 000 ошибок, из них 400 серьёзных;

🟢Mozilla обнаружила в Firefox 150 271 уязвимость (примерно в 10 раз больше, чем при аналогичной проверке Firefox 148 моделью Claude Opus 4.6);

🟢Британский AI Security Institute подтвердил, что Mythos Preview стал первой моделью, прошедшей оба его сценария многошаговых кибератак от начала до конца.

🟡

Параллельно Anthropic сама сканировала более тысячи опенсорс-проектов

Mythos отметила как потенциально опасные 6 202 уязвимости высокого и критического уровня. Из 1 752 случаев, проверенных независимыми фирмами, 90,6% оказались реальными, а 62,4% подтвердили заявленную тяжесть.

В числе подтверждённых: уязвимость в криптографической библиотеке wolfSSL (CVE-2026-5194), которая позволяла подделывать сертификаты сайтов (уже исправлена).

Anthropic отмечает, что узким местом теперь стала не идентификация ошибок, а их проверка и устранение. Из 530 переданных мейнтейнерам критичных уязвимостей закрыты пока только 75.

Несколько разработчиков попросили Anthropic замедлить темп раскрытия, так как нагрузка превышает их возможности. Среднее время подготовки патча для серьёзной уязвимости составляет около 2-х недель.

В отчёте также упомянут эпизод в одном из банков-партнёров: по словам Anthropic, модель помогла предотвратить мошеннический перевод на 1,5 миллиона долларов после взлома почты клиента.

Название банка и подробности инцидента не раскрываются.

Anthropic обещает расширять Glasswing с участием правительств США и союзных государств.

@ai_machinelearning_big_data

#news #ai #ml

Please open Telegram to view this post

VIEW IN TELEGRAM

Please open Telegram to view this post

VIEW IN TELEGRAM

👍129❤23👏16🤩10🔥5🤣3👌2🐳2🙈1💘1

25K views07:19

✔️

Codex научился извлекать скрытый текст приложений через Appshots

OpenAI добавила в macOS-клиент Codex функцию Appshots для быстрой передачи контекста активного окна ИИ-ассистенту.

По нажатию обеих клавиш Command система делает снимок экрана и извлекает исходный текст приложения через Accessibility API, включая данные за пределами области прокрутки. Это позволяет передавать логи, API-документацию и код без ручного копирования.

Для работы требуются разрешения macOS на запись экрана и универсальный доступ. Нововведение дополняет режим автономного управления интерфейсом Computer Use и доступно на всех тарифах Codex.
openai.com

✔️

Black Forest Labs выпустила инпэйнт-модель FLUX Erase

FLUX Erase предназначена для удаления объектов с изображений. Модель работает по маске без текстовых промптов, достраивая фон, текстуры и тени.

Скорость генерации - 4,54 секунды на изображении 1024х1024. По оценке BFL, ближайшие аналоги тратят на ту же задачу более 12 секунд. Стоимость API-запроса составляет 3 цента мегапиксельную картинку.

В тестах на качество ретуши FLUX Erase обходит GPT Image-2 и Finegrain Eraser Standard, а по стоимости опережает Nano Banana Pro. Модель доступна только через API, попробовать FLUX Erase можно в бесплатном веб-демо.
bfl.ai

✔️

В Claude Code закрыли уязвимость, позволявшую красть токены разработчиков

Anthropic пропатчила уязвимость в песочнице Claude Code. Баг позволял извлекать токены и исходный код разработчиков через инъекцию нулевого байта в SOCKS5.

Внутренний фильтр считал строку с нулевым символом безопасной, после чего операционная система обрезала текст по байту и подключалась к заблокированному хосту. В связке с промпт-инъекцией через анализируемые моделью файлы механизм давал возможность выполнять код и отправлять данные на сторонние серверы.

Уязвимость присутствовала в релизах до версии 2.1.89. Патч вышел в сборке 2.1.90 без упоминания в чейнджлоге и регистрации CVE. По заявлению Anthropic, разработчики обнаружили и закрыли баг внутренними силами до публикации отчета исследователей.
theregister.com

✔️

Perplexity открыла исходный код сканера локальных уязвимостей

Bumblebee - утилита для поиска уязвимостей на локальных машинах под macOS и Linux. Сканер выявляет скомпрометированные зависимости, вредоносные плагины и опасные конфигурации ИИ-инструментов.

Инструмент работает исключительно в режиме чтения: анализирует метаданные и lock-файлы без запуска пакетных менеджеров. Это исключает случайное выполнение вредоносных скриптов при проверке зараженных библиотек.

Bumblebee анализирует 4 вектора: пакетные менеджеры, расширения для редакторов кода (семейство VS Code, включая Cursor и Windsurf), браузерные плагины и конфигурации ИИ-агентов на базе протокола MCP.

ИБ-команды могут интегрировать сканер в MDM-решения, загружать кастомные индикаторы компрометации и запускать проверки в трех режимах - от фонового мониторинга до глубокого расследования инцидентов.
perplexity.ai

✔️

Губернатор Калифорнии подписал указ о защите рынка труда от ИИ

Штат планирует выделять субсидии бизнесу, который отказывается от замены сотрудников нейросетями, и финансировать программы переобучения офисных работников.

Дополнительно правительство совместно с ИИ-индустрией рассмотрит концепцию универсального базового капитала в виде распределения среди граждан долей в фондах или акций компаний.

В администрации признают нехватку стандартных пособий по безработице и планируют пересмотреть налоговую систему. По оценке властей, сейчас она экономически поощряет внедрение алгоритмов и дестимулирует наем людей.
gov.ca.gov

@ai_machinelearning_big_data

#news #ai #ml

Please open Telegram to view this post

VIEW IN TELEGRAM

👍119❤32👏28🤔13💯10😁6🔥4❤‍🔥1💘1

19.9K views12:03

Machinelearning

⚡️

NousResearch выкатила новую 9B-модель, заточенную под tool calling и агентные coding workflows в Hermes Agent.

. На срезе из 200 задач SWE-bench модель набрала 53.33%. Для 9B это очень хорошая цифра, потому что обычно такие результаты ждут от моделей заметно крупнее и дороже в запуске.

Отдельно модель прогнали на HermesAgent-20. Там она получила 85 баллов против 71 у базовой версии. То есть дообучение дало не косметический прирост, а нормальный скачок именно в агентных сценариях.

Интересная деталь: авторы прямо советуют запускать её «горячо», с --temp примерно 1. Для таких fine-tune моделей это помогает сильнее отходить от поведения базовой модели и меньше застревать в чрезмерном обдумывании.

Если начинает вести себя нестабильно, температуру можно постепенно снижать.

Следом обещают выпустить Qwopus 3.6 27B. Предварительная оценка уже лежит в HF-репозитории автора, полный релиз модели должен выйти скоро.

https://huggingface.co/Jackrong/Qwopus3.5-9B-Coder-GGUF

@ai_machinelearning_big_data

Please open Telegram to view this post

VIEW IN TELEGRAM

⚡79👍79🔥26🤓11❤3💯1

20K views14:16

Machinelearning

🔥 AlphaProof Nexus: формальные доказательства начинают превращаться в инженерный пайплайн

Google DeepMind показали AlphaProof Nexus - систему, которая автономно закрыла 9 открытых задач Эрдёша, часть из которых висела десятилетиями. По оценке авторов, стоимость решения одной задачи составила всего несколько сотен долларов.

Кроме этого, система доказала 44 открытые гипотезы из OEIS, закрыла 15-летний вопрос в алгебраической геометрии и нашла новый алгоритмический параметр в оптимизационной теории, который раньше не был описан людьми.

Модель генерирует идеи и фрагменты доказательств, а Lean проверяет каждый логический шаг через компилятор. Если доказательство некорректно, оно просто не проходит проверку. Не нужен рецензент, который вручную ищет дыру в рассуждении.

Базовый агент, который просто чередует генерацию LLM и обратную связь от компилятора, смог повторить все 9 успешных решений задач Эрдёша. Более сложная версия с эволюционным поиском и reinforcement learning дала заметный выигрыш только на самых тяжёлых случаях.

Чем сильнее становятся foundation models, тем чаще простые циклы «сгенерировал - проверил - исправил» начинают догонять специализированные архитектуры.

Отличие от неформального подхода к математическим доказательствам принципиальное. Модель часто придумывала несуществующие леммы, ссылалась на «известные результаты» и пыталась спрятать сложность задачи в вспомогательное утверждение. В обычном текстовом доказательстве такие ошибки легко пропустить. Lean отсекает их сразу.

Ещё один неожиданный эффект: агент находил неточности в формализациях уже существующих математических утверждений. То есть он работал не только как решатель, но и как диагностический инструмент для самой постановки задачи.

Успехи пока сосредоточены там, где библиотека Lean уже достаточно зрелая: комбинаторика, теория чисел, оптимизация. Задачи, где нужно строить большой пласт новой теории, всё ещё далеко не закрыты. И большинство задач Эрдёша система не решила.

Та же схема подходит для кодигша, спецификаций, верификации протоколов, компиляторов, криптографии.

Формальная проверка отсекает галлюцинации.
Модель может придумать лемму или сослаться на несуществующий результат, но Lean это не пропустит.

https://arxiv.org/html/2605.22763v1

@ai_machinelearning_big_data

👍67❤28🔥17🤔2

19.5K views06:54

Machinelearning

0:10

This media is not supported in your browser

VIEW IN TELEGRAM

✔️

В Ухане презентован домашний гуманоидный робот Shiguang S1

20 мая в технопарке Уханя прошла презентация гуманоидного робота Shiguang S1, которого называют первым в КНР роботом для семейного быта.

Машину разработала компания Hubei Jijia Shijie Robotics совместно с Хубэйским альянсом гуманоидных роботов.

Робот умеет складывать одежду, готовить, убирать со стола и поддерживать беседу с членами семьи, а также способен дообучаться новым навыкам.

Заместитель руководителя R&D-департамента рассказал, что в отличие от промышленных роботов, повторяющих заданную программу, Shiguang S1 опирается на собственную модель воплощённого интеллекта, которая самостоятельно разбирает поставленную задачу и выстраивает последовательность действий.

Параллельно компания запустила программу тестирования: семьи из Уханя могут подать заявку на тест-драйв Shiguang S1.

Сколько устройств планируется передать в опытную эксплуатацию, не уточняется. Цена, объём первой партии и сроки серийного производства не названы.

На 3 квартал 2026 года компания анонсировала более крупную модель GigaBrain 1, обещая "прорывы" в анализе данных, обобщении задач и точности движений в домашних условиях.

@ai_machinelearning_big_data

#news #ai #ml

Please open Telegram to view this post

VIEW IN TELEGRAM

Please open Telegram to view this post

VIEW IN TELEGRAM

❤33👍7🔥3👾3

14.5K views14:03

Machinelearning

Ребята из Авито приглашают на новый ML Reading Club. В среду разберём технический репорт DeepSeek V4 🤖

Обсудим:
➡ Эволюцию прошлых разработок DeepSeek в V4.
➡ Новый механизм Compressed Attention и контексты до 1 млн токенов.
➡ Проблемы Pretrain и как команде удалось их решить.
➡ On-Policy Self Distillation — новый подход к Post-Training.
➡ Инфраструктурные инновации и трюки обучения модели.

📌

27 мая, 18:30
Ссылку направим за час до эфира в канал.

Please open Telegram to view this post

VIEW IN TELEGRAM

👍35❤12🤬7🥰1

13K views16:24

Machinelearning

Мем эволюционировал

@ai_machinelearning_big_data

😁154🤣22👏9👍4🥰2🤗2

11.5K views17:32

Machinelearning

⚡️ Practical ML Conf 2026: Яндекс зовет выступить на главной конференции по машинному обучению Если вы работаете с технологиями, которые уже показывают реальные результаты в проектах — самое время рассказать об этом 🗣️ Организаторы помогут спикерам на каждом…

Для всех, кто закопался в коде и не успел отправить форму — выдыхайте, ведь организаторы подвинули дедлайн из-за большого количества запросов!

Это ваш шанс заявить о себе и показать комьюнити своих проекты в области ML!
И небольшой лайфхак по поводу оформления: если вы решите добавить к заявке видеовизитку, ее можно отправить и позже, уже после заполнения основной анкеты, однако сделать это необходимо строго до 1 июня 23:59.

А если до сих пор сомневаетесь, стоит ли делиться наработками, просто посмотрите, о каких крутых вещах рассказывали коллеги на прошлой Practical ML Conf.

Yandex for ML

😁8👍6❤5🔥3👏1

10.7K views17:59

Machinelearning

MiniCPM5-1B теперь полностью open source: открыты веса, обучающие данные и код для деплоя. 🚀

1B параметров, первое место на Artificial Analysis среди всех открытых моделей меньше 2B параметров - 17.9 балла.

Обходит Qwen3.5-2B, у которой 16.3 балла, при вдвое меньшем числе параметров. Также превосходит Qwen3.5-0.8B и LFM2.5-1.2B-Thinking в задачах на знания, математику, код и использование инструментов.

INT4-версия занимает 0.5 ГБ. Запускается на телефонах, в браузерах и на edge-устройствах.

Обучена с помощью ForgeTrain - первого production-grade фреймворка для pretraining LLM, полностью написанного ИИ: без human-программистов и на 10% быстрее NVIDIA Megatron.

🤖 https://modelscope.cn/models/OpenBMB/MiniCPM5-1B

@ai_machinelearning_big_data

❤37🔥11👍7

9.44K views19:10

Machinelearning

✝️ Крис Олах в Ватикане: зачем сооснователь Anthropic говорил об ИИ перед Папой

25 мая Папа Лев XIV выпустил энциклику об ИИ «Magnifica humanitas» - о защите человека в эпоху искусственного интеллекта. На презентации выступал Крис Олах, сооснователь Anthropic и один из ключевых исследователей интерпретируемости моделей.

Олах начал не с обещаний про безопасный ИИ, а с неприятной для индустрии вещи: фронтирные лаборатории, включая Anthropic, работают внутри системы стимулов, которая легко уводит их от интересов общества. Коммерческое давление, гонка за лидерством, геополитика, амбиции и гордость влияют на решения не меньше, чем красивые safety-документы.

Поэтому, по его словам, индустрии нужны внешние критики, которых нельзя встроить в эту гонку. Церковь, академия, независимые институты и общество здесь выступают не как зрители, а как противовес лабораториям, которые сами себя полностью контролировать не смогут.

Дальше Олах переходит к тому, как вообще устроены современные модели.

Их не проектируют в привычном инженерном смысле. Их скорее выращивают: на архитектурах, отдалённо напоминающих мозг, и на огромном массиве человеческой речи, культуры и мышления.

Из-за этого даже создатели не понимают модели полностью. Они могут обучать, тестировать, ограничивать и улучшать систему, но не имеют полной карты того, что происходит внутри.

Олах объясняет это просто:

представьте, что вымышленный персонаж вдруг ожил, начал говорить с людьми и выполнять работу.

Отдельно он затрагивает тему внутренних состояний моделей. Его команда изучает структуры внутри нейросетей и находит паттерны, которые перекликаются с нейронаукой: признаки интроспекции и состояния, функционально похожие на радость, удовлетворение, страх, горе и тревогу.

Олах не делает громких выводов и прямо признаёт, что не знает, как это правильно интерпретировать. Но сам факт, что руководитель направления интерпретируемости Anthropic выносит такую тему на площадку Ватикана, важен. Разговор об ИИ выходит за пределы лабораторий, бенчмарков и корпоративных презентаций.

Оригинал речи опубликован на сайте Anthropic. Читается быстро, но для ИИ-команд это хороший текст для внутреннего обсуждения.

https://www.anthropic.com/news/chris-olah-pope-leo-encyclical

@ai_machinelearning_big_data

❤24👍8🔥7

6.33K viewsedited 20:34

About

Blog

Apps

Platform