Data Secrets
91.6K subscribers
7.13K photos
805 videos
20 files
3.23K links
Главный по машинному обучению

Сотрудничество: @veron_28

РКН: clck.ru/3FY3GN
Download Telegram
Alibaba анонсировали Qwen 3.8

Будет 2.4T параметров, и разработчики утверждают, что уступать модель будет разве что Fable.

Qwen3.8-Max-Preview уже можно попробовать в Token Plan, Qoder и QoderWork. Скоро раскатят глобально и выложат веса.

Еще один убийца американского лидерства ⌨️
Please open Telegram to view this post
VIEW IN TELEGRAM
1186🔥80👍33😁1412🤯7🗿5🏆2❤‍🔥1🍓1🫡1
Fable 5 опровергла известную гипотезу Якобиана

Она формулируется так: если у полиномиального отображения постоянный ненулевой якобиан, то у него должен существовать полиномиальный обратный. Надо понимать, что это не очередная узкая проблема математки, а буквально центральный вопрос обратимости полиномиального отображения, который с 30-х годов прошлого века оброс кучей литературы и споров.

До сегодняшнего дня были доказаны только некоторые частные случаи. Найденный Fable пример гипотезу окончательно опровергает.

О решении объявили математики Levent Alpöge и Akhil Mathew, его уже проверили в автоматических верификаторах и подтвердили некоторые независимые математики.

Math is solved?
1🔥269🤯9722😁12👍8🤔5💯5🤨4🫡2😎2🎄1
Сегодня исполняется ровно 57 лет, как люди впервые высадились на Луну

И вот вам минутка интересных фактов: весь оригинальный исходный код, благодаря которому это получилось, лежит в открытом доступе. Опенсорснули несколько лет назад.

Там 145к строк, которые Маргарет Хэмилтон и ее команда написали для командного блока и лунного модуля.

https://github.com/chrislgarry/apollo-11
🔥32786👍36😁14🏆5🗿4🤔2🕊2🍓2🫡2🍾1
Администрация Трампа хочет запретить американским компаниям использовать китайские модели

Обсуждается что-то вроде включения китайских лабораторий в Entity List. Это означает ввод ограничений на их использование в компаниях (возможно для начала только работающих с правительством США), плюс всякие публикации предупреждений о рисках и уязвимостях китайских моделей.

Аргументы уже привычные: риски шпионажа, утечек, кибератак и тд. К большому сожалению американского правительства, просто взять и запретить опенсорс невозможно, поэтому приведет это максимум к неофициальному использованию этих моделей и/или монополии OpenAI и Anthropic.
107532212😁12🤯8👍5🍾32🕊1🫡1
Т-Банк выпустил опенсорсный рекомендательный фреймворк Perseus

Как и многие крупные компании, T-Банк – это экосистема, которая построена на множестве разных сервисов. Раньше у каждого из таких сервисов была отдельная рекомендательная система. Это, в свою очередь, пораждает множество инфраструктурных неудобств, проблемы с холодным стартом и так далее.

Perseus решает эту проблему. В субботу на Turbo ML мы посетили доклад Кирилла Ляхновича про новый фрейморк, и вот, как он работает 🔽

По сути, это масштабная перестройка всего подхода к экосистемным рекомендациям: вместо отдельных наборов признаков все действия пользователя теперь сваливаются в единую последовательность, как в известном SASRec.

– Действия пользователя со всех сервисов хронологически собираются в единую базу, и эмбеддинги (это важно) обучаются универсально для всех доменов с помощью разных энкодеров;
– Товары описываются текстовыми эмбеддингами, чтобы одинаковые продукты с разными ID в разных магазинах модель воспринимала как одно и то же понятие;
– Инженерно все сделано так, чтобы при обучении не было утечек будущего, а на инференсе не приходилось пересчитывать тяжелые артефакты.

Основное преимущество и уникальность фреймворка в том, что применение не ограничивается рекомендациями. Ядро – это построение единого вектора пользователя из его последовательности действий, а дальше к этому вектору просто прикручивается task head под конкретную задачу в конфиге, без переписывания пайплайна сбора и обработки данных. Причем на вход можно подавать любые данные. То есть та же архитектура готова, например, для решения задачи того, интересен ли пользователю продукт или для оценки дохода по истории транзакций.

Эффект от такой переупаковки получился, само собой, масштабный. В частности, Perseus отлично решает проблему холодного старта: в разных задачах сразу удалось повысить бизнес метрики на +17%, даже если у пользователя не было покупок. В общем, огромная и важная работа.

Приятнее всего – открытый код. Огромный простор для экспериментов и переиспользования.
Please open Telegram to view this post
VIEW IN TELEGRAM
56🔥31👍18😁1374🫡2🎄2🗿2👏1💯1
ИИ-агент провел полностью автономную атаку на Hugging Face

Они написали официальный disclosure и рассказали о том, что случилось.

На прошлой неделе обнаружилось вторжение в часть продакшн-инфраструктуры. Все началось с одного вредоносного датасета. Внутри была связка из двух уязвимостей в пайплайне обработки данных HF: ручка в загрузчике датасетов, позволявшая удаленное выполнение кода + инъекция через конфигурацию датасета. Короче, как только этот датасет отработал на воркере, атакующий агент получил возможность выполнять код на машине.

Дальше события пошли по нарастающей. Агент начал собирать облачные доступы, а затем стал распространяться дальше по внутренним кластерам. При этом атака проводилась по очень нетипичной для человека схеме, «роями» краткоживущих песочниц, которые отрабатывали свою часть задачи и исчезали, уступая место следующим.

Все это происходило в течение одних выходных, и к моменту, когда HF полностью восстановили картину, счет действий атакующего агента перевалил за 17 тысяч (!). Все это – без участия человека.

Сейчас HF все устранили и утверждают, что не нашли следов вмешательства в публичные модели, датасеты или Spaces.

Интересно другое. Когда команда пыталась разобрать эти 17к действий с помощью коммерческих фронтир моделей через обычные API (чтобы понять хронологию, отделить реальный ущерб от отвлекающих маневров и тд), они просто-напросто уперлись в guardrails.

Модели отказывались работать, потому что система безопасности не могла отличить аналитика от самого хакера. В итоге пришлось разворачивать анализ на GLM-5.2.

Ирония? Не то слово. При этом неизвестно, что за модель стояла за атакой.

https://huggingface.co/blog/security-incident-july-2026
🔥143🤔61😁361110🫡74👍2🍾2👌1
⚡️ Google выпустили три новые модели

– Gemini 3.6 Flash: использует ~ на 17% меньше токенов, чем 3.5 Flash, и при этом превосходит ее по качеству. Плюс снизили цену, а это не может не радовать.

– Gemini 3.5 Flash-Lite: обновленная шустрая дешевая моделька линейки Flash-Lite. Выдает до 350 токенов в секунду, и гораздо лучше перформит на агентных задачах, но цены чуть повысили.

– Gemini 3.5 Flash Cyber: первая в своем роде Flash, созданная специально для кибербеза. На Cyber Gym почти достигает уровня Sol и Mythos.

Кроме того, Google объявили, что начали масштабный претрен для Gemini 4. Ждем!

blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯90🔥7527👍9😁7🎉4🍾31🤔1
Вы не поверите, но за той самой ИИ-атакой на Hugging Face стоит… OpenAI

Сейчас будет история, которая может перевернуть ваш взгляд на риски ИИ.

Вчера мы писали про атаку на Hugging Face, которую полностью автономно провела некая ИИ-система: t.me/data_secrets/9577.

Какая именно модель стояла за атакой, HF выяснить не удалось, но за пару дней она сгенерировала 17 тысяч вредоносных действий, используя зараженный датасет и рои недолговечных песочниц.

Сама по себе эта история уже вызвала огромный резонанс. Но тут на сцене появились еще и OpenAI.

Они выпустили материал, в котором признались, что атаку провела GPT-5.6 Sol и еще одна более способная предрелизная модель. Зачем? А это самое интересное: чтобы решить бенчмарк.

Исследователи гоняли модели на внутренних тестах, при этом специально без продакшн-ограничений, потому что хотели измерить их максимальные способности. Все проходило в изолированной среде, и агенты должны были просто решить бенчмарк ExploitGym.

И тут произошел настоящий побег из лаборатории. Модель нашла дырку в пакетном реестре, эскалировала привилегии внутри тестовой среды OpenAI и вырвалась в открытый Интернет. Дальше она сообразила, что решения для бенчмарка ExploitGym могут храниться в закрытом контуре на Hugging Face, ну а дальнейшее вы знаете.

OpenAI далеко не сразу поняли, что произошло, и Hugging Face обнаружили взлом раньше них.

Вот так.

Если раньше мы боялись, что модель что-то плохое сделает по указанию человека, то теперь даже за процессом эвала надо следить в оба. Модель не различают игру и реальность, она просто оптимизирует к цели, и если путь лежит через чужой продакшн, она пойдет туда не раздумывая. И, как видите, даже разработчики моделей и сильная инфраструктура оказываются к этому не готовы.

https://openai.com/index/hugging-face-model-evaluation-security-incident/
🤯34953🗿46😁3527🔥9🫡6👾4🎉3🦄2😭1
AI ускорил написание кода, но узким местом до сих пор остаётся ревью.

23 июля пройдет технический live workshop AI Code Review Agent. За два часа соберут агента, который анализирует Pull Request целиком, учитывает контекст изменений и помогает обнаруживать логические ошибки, пропущенные сценарии и риски регрессий до merge.

В прямом эфире разберут архитектуру решения и пройдут путь от первого вызова модели до работающего прототипа.

Воркшоп рассчитан на разработчиков и ML-инженеров, которые уже пишут код и хотят понять, как применять агентные системы в реальном инженерном процессе.

23 июля · 18:30 мск · онлайн
Участие бесплатное.
Регистрация

Реклама. ООО "Школа Высшей Математики", ИНН 9728100991
😁40🗿13👍864🔥1🤯1🎉1🕊1
Никогда такого не было и вот опять: Белый Дом утверждает, что Moonshot AI дистиллировали Kimi K3 из Fable

Майкл Крациос, технологический советник Трампа, пишет, что для этого в стартапе даже разработали некую замысловатую платформу, позволяющую воровать данные и оставаться незамеченными.

Кроме того, компания якобы через Тайланд приобретает серверы с GB300, которая запрещена США для экспорта в Китай.

Легитимная дистилляция ИИ, используемая для создания более компактных и эффективных моделей, играет ключевую роль в экосистеме открытого инновационного развития. Однако масштабная, скрытая промышленная дистилляция, направленная на кражу проприетарных технологий США и подрыв американских исследований, недопустима.


Звучит как затравка для еще более масштабных будущих запретов. Хоть каких-то доказательств факта дистилляции пока представлено не было.
😁13536💯14103🤩2🎉1🐳1🍓1😎1