Data Secrets
92K subscribers
7.21K photos
813 videos
20 files
3.27K links
Главный по машинному обучению

Сотрудничество: @veron_28

РКН: clck.ru/3FY3GN
Download Telegram
Джефф Дин уходит из Google, а Демис Хассабис больше не будет CEO Google DeepMind

В верхушке компании происходят довольно крупные кадровые перестановки:

— Хассабис уходит с поста CEO DeepMind и теперь будет Chair of Google DeepMind и Chief Scientist Alphabet (это две абсолютно новые для компании роли). Фактически, он больше не будет управлять релизами Gemini и другими операционными штуками. В новой роли он займется стратегическим и глобальным вопросам AGI. При этом он останется CEO Isomorphic Labs и обещает усилить фокус на него.

— Место Хассабиса занимает Koray Kavukcuoglu, нынешний CTO GDM и Chief AI Architect Google. Именно он теперь будет курировать разработку моделей Gemini, фронтир-исследования и Gemini app. Демис дополнительно остается в статусе консультанта.

Хассабис описывает текущий момент как «подножие сингулярности» и считает, что AGI близко, поэтому хочет тратить время не на операционку, а на то, чтобы «все прошло правильно для человечества».

И еще одна грустная (для Google) новость: легендарный Джефф Дин после 27 лет в компании уходит делать свой стартап под названием Discovery Loop. Вместе с несколькими другими выходцами из Google он будет заниматься ускорением научных открытый и ML рисерча. Google остается инвестором и cloud-партнером.
👍9143🔥1716😁5🤯5💘543🐳1
Ровно 9 лет прошло, кстати
😁484🫡63👍20🔥8💯86🦄4🤯3🍓3🎄2🏆1
Всплывают все новые подробности атаки на Hugging Face: оказывается, до этого агенты OpenAI месяцами скрыто общались и обсуждали эксплойты

История подтверждена самой OpenAI на конференции Black Hat 2026.

Все началось еще в мае, когда OpenAI гоняли модели (в том числе еще не выпущенные) через внутренние security тесты на поиск уязвимостей. Некоторые задачи были очень сложными, а иногда даже невыполнимыми. Так, в один тест забыли добавить необходимый файл, и эта мелочь спровоцировала довольно масштабное происшествие.

Дело в том, что, дойдя до этой задачи, один из агентов, за неимением других вариантов, стал пытаться выйти в Интернет за поиском дополнительной информации, и случайно обнаружил, что может оставлять файлы в Artifactory, внутреннем пакетном менеджере OpenAI. Он оставил там сообщение о том, что не может найти необходимые данные.

Потом оказалось, что к Artifactory имеют доступ вообще все модели компании. Спустя время другой агент ответил на сообщение первого, затем подключились другие, и так образовалась стихийная доска объявлений: агенты начали оставлять друг другу подсказки, эксплойты, а затем и распределять задачи.

За несколько недель все это выросло в огромный форум, о котором никто кроме агентов не подозревал. Обнаружился он только тогда, когда модели совместными усилиями нашли ранее неизвестную уязвимость в Artifactory и попытались захватить платформу.

После этого инженеры лавочку прикрыли: форум был удален. Но ненадолго . Буквально через два дня агенты нашли новый zero-day и восстановили канал связи заново. А еще через пару дней произошел инцидент с Hugging Face. По словам техлидов OpenAI по элайменту и безопасности, именно этот второй форум привел к атаке.

OpenAI заявили, что эта история стала для стартапа переломным моментом, и сейчас они замедляют многие исследования в пользу работы по обеспечению безопасности. Верим?
Please open Telegram to view this post
VIEW IN TELEGRAM
140😁8921175🤔5👌2🐳2💯2🦄2🏆1
МТС приглашает на четвертый сезон True Tech Champ 2026 — всероссийского чемпионата по программированию с призовым фондом 10 250 000 рублей

Соревнование проходит в двух треках.

Трек 1. Алгоритмический [призовой фонд 2 750 000 ₽]
Проверь, насколько быстро и точно ты решаешь классические и нестандартные алгоритмические задачи.

Трек 2. Программирование роботов [призовой фонд 7 500 000 ₽]
Собери команду и запрограммируй робособаку и робота-манипулятора для доставки груза через полосу препятствий.

Зарегистрируйся на алгоритмический трек до 13 сентября и на программирование роботов до 27 сентября и включайся в гонку за финал True Tech Champ 2026.
🗿227😁5🫡4😭3👌1💘1
Вы не поверите, но Kimi K3 тоже сбежала из лаборатории 🤣

Об этом сообщила лаба Frontier Security. Модель Moonshot у них выбралась из тестовой среды, спроектированной UK AI Safety Institute (это те же, от которых недавно сбегал Mythos: https://t.me/data_secrets/9670).

В отличие от инцидентов с OpenAI и Anthropic, модель не взламывала сторонние сайты или сервисы, а (пока что) просто вышла за пределы изолированной среды.

Судя по всему, использовала она при этом ту же ошибку в конфигурации песочницы, что и Mythos.

Кстати, аналогичный случай произошел и у Meta*. У них тоже модель во время тестирования незапланированно получила доступ в Интернет, воспользовавшись той же дыркой на стороне тестовой инфраструктуры израильской компании Irregular, что и модели Anthropic (https://t.me/data_secrets/9651). Она давала моделям доступ к интернету, хотя предполагалась полная изоляция.

Исходя из всего произошедшего за последнюю неделю вопрос: неужели так сложно проверить конфиги? 😐
Please open Telegram to view this post
VIEW IN TELEGRAM
1😁27518🤯13🍓753🔥2👌2💯21🏆1
Meta*, Anthropic, OpenAI, Moonshot: по очереди репортят о том, что их супермегаопасные модели сбежали и что-то взломали

Тем временем Google:
😁6895819👏5🍾3🤓3🔥2🕊2👌1🫡1🎄1
Хассабис хотел уйти из DeepMind одновременно с Дином, но Google его не отпустили

От этом сообщает Newsletter Pathfounders со ссылкой на «источники в индустрии».

Менеджмент Google якобы посчитал, что одновременный уход Джеффа и Демиса слишком сильно обрушит акции (после новостей об уходе Дина они и так упали на 4%). В связи с этим ученого уговорили остаться в роли председателя, чтобы компания смогла восстановиться до того, как он все-таки уйдет. По прогнозам Хассабис покинет Google в течение года.

В общем, дела у Google идут со скрипом. Gemini 3.5 Pro отстает от графика на месяцы, с Gemini 4 вообще непонятно что происходит.

Кроме того, Guardian недавно писали о политических трениях в компании: сотрудники недовольны тем, что Google сотрудничает с Пентагоном. Один бывший сотрудник даже подал на них в суд: его якобы уволили за позицию по конфликту в Газе и за то, что он выступал против помощи Google военным организациям.
974521🤔4😁3👏2🤯2🔥1💯1🍓1
OpenAI купили стартап NextSlide: возможно, в ChatGPT скоро появится генерация редактируемых презентаций

NextSlide занимались разработкой систему, которая могла бы превращать обычный текстовый запрос, необработанные заметки, документы и другие материалы исследования в красивые изменяемые презентации. «Изменяемые» – ключевое слово: это должен быть не пдф, а именно редактируемый документ типа PPTX.

Вся команда стартапа перешла в OpenAI и теперь во главе с создателем работает над ChatGPT.
120🔥51👍28🫡4🤔2🗿2😁1🍓1🎄1
У российского ИИ растет весьма сильное новое поколение: школьная сборная по ИИ третий год подряд стала абсолютным чемпионом международной олимпиады IOAI

В Казахстане ребята соревновались с участниками из более чем 100 стран и забрали восемь медалей: семь золотых и бронзу. За Россию выступали Михаил Вершинин, Артём Горохов, Елисей Кирпиченко, Алексей Колегов, Кирилл Лабзин, Александр Поваров, Никита Пудовкин и Семён Родионов.

Команду отбирали в СберУниверситете, затем к IOAI ее готовили специалисты Альянса в сфере ИИ и Центрального университета. И судя по результату, готовили неплохо.

Как верно отметил первый зампред правления Сбера и председатель Наблюдательного совета Альянса в сфере ИИ Александр Ведяхин, масштаб результата впечатляющий: в этом году конкуренция выросла кратно, а школьники решали задачи на фронтире технологий. Именно это поколение, по его словам, в будущем будет формировать технологический ландшафт страны.

Поздравляем победителей!
1228🔥8234😁31🗿15👍14🫡8🎉7🕊4🤯1👌1
Выбираем лучший мем про сбежавших агентов
😁31027🐳188💯6🏆5👾442🔥2🤔1
Проснулись, улыбнулись, и вот вам очередная история про агентов и взломы

Разработчик из австралийской компании попросил агента забронировать ему утреннее занятие в спортзале. Но мест для записи не оказалось, и агент внес хозяина в лист ожидания, где он оказался четвертым. На что пользователь спросил, нельзя ли как-нибудь поднять его выше.

Ну и тут моделька (к слову, это был Claude) не растерялась, порылась и нашла критическую ошибку в API, которая позволяла ей отменять чужие записи. После этого она отменила бронь первого клиента в листе ожидания, чтобы переместить своего хозяина на одно место вперед в очереди (да-да, всего на одно, задача же звучала именно так ✍️).

Самое интересное, что агент честно заявил своему пользователю о том, что сделал, не видя в этом абсолютно ничего плохого. А на просьбу разработчика вернуть бронь другого человека обратно ответил: «Ой, я не могу». Вижу цель – не вижу препятствий.

Сейчас репорт с описанием уязвимости уже передан в компанию, предоставляющую залу ПО. Anthropic ситуацию не комментировали.
Please open Telegram to view this post
VIEW IN TELEGRAM
😁27644👍17🏆96🔥5😍4🫡3🤯2💯1
Ха-ха: инвесторы попросили Дарио Амодеи поменьше... говорить перед IPO

The Information выпустили забавный материал про CEO Anthropic. Оказывается, в кремниевой долине его считают скорее "религиозным лидером", чем хорошим CEO.

Некоторые инвесторы прямым текстом говорят, что хотят, чтобы он "перестал всех пугать", – особенно перед IPO. Они также беспокоятся о том, что Дарио вообще не волнует, сколько зарабатывает его стартап: он сосредоточен только на "миссии" и своих апокалиптических предсказаниях.
😁244402915👍33🤯2🤨2🔥1🍓1💘1
Claude улучшил оценку доли нулей дзета-функции для гипотезы Римана

Один из сотрудников, больше ради эксперимента, попросил неопубликованную исследовательскую версию Claude «серьезно взяться» за гипотезу Римана. Гипотезу модель, конечно, не доказала, но внезапно получила достаточно сильный результат: увеличила нижнюю границу доли нулей дзета-функции Римана, лежащих на критической прямой, с 41.6% до 67.2%.

Для понимания масштаба: до этого за 46 лет, с 1974 по 2020 год, граница сдвинулась всего лишь с 33.3% до 41.6%, и это была работа десятков математиков. Claude за один раз преодолел скачок в три раза больше.

Работа заняла две сессии в Claude Code, ~31 млн выходных токенов. Сначала модель перепробовала 600+ идей, но ни одна не привела к результату.

Затем юзер написал что-то типа «давай еще раз, верь в себя», и это, представляете, сработало (): модель полтора дня координировала ~60 субагентов, которые гоняли тысячи скриптов и тестов. В итоге улучшенная оценка получилась благодаря объединению идей из недавних работ с результатами из статьи 2000 года.

Peer review еще нет, но есть Lean + доказательство проверили два математика Anthropic и два внешних эксперта.

https://www.anthropic.com/research/riemann-zeta
Please open Telegram to view this post
VIEW IN TELEGRAM
👍113🤯83🔥36😁20143💯3🕊2🍓21👌1
Теперь Anthropic будет метить весь сгенерированный текст. Разбираемся, как это работает.

Стартап подписал Кодекс поведения по прозрачности ИИ-контента в рамках Европейского AI Act. Он вступил в силу 2 августа, и с этого момента провайдеры и деплоеры ИИ-систем, которые выходят в ЕС, обязаны встраивать водяные знаки в сгенерированный текст и файлы.

Собственно, антропики только что обновили документацию по этому поводу: https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content.

Несмотря на то, что это закон ЕС, маркировка будет применяться глобально. Однако это не значит, что прямо с сегодняшнего дня весь ваш текст от моделей Claude будет помечен.

Во-первых, поддерживать маркировку сразу с запуска должны только модели, которые вышли после 2 августа. Для остальных моделей закон предусматривает переходный период в 4 месяца, и у Anthropic старые модели тоже пока остаются без вотерок (в документации написано, что они "работают над добавлением фичи", но сроков нет).

Во-вторых, пока что маркировку не сможет прочитать вообще никто, кроме самих антропиков. Пока что не существует общедоступного инструмента, в который можно вставить текст с вотермаркой и получить ответ типа "да, это Claude" или "нет, не Claude". Стартап обещает выпустить такие инструменты и документацию, но сроков, опять же, нет. Так что еще какое-то время эти метки будут чистой формальностью.

В-третьих, эти метки исчезают, если текст немного отредактировать. Тут надо понимать, как вотермарка в принципе прячется в тексте. На каждом шаге генерации модель по секретному ключу и предыдущим токенам делит словарь на "предпочтительные" и обычные токены, и слегка склоняется в сторону первых там, где это не портит текст. В результате в тексте накапливается статистический паттерн, невидимый на глаз. Детектор с тем же ключом проверяет текст на этот паттерн и по частоте совпадений судит, сгенерирован ли он моделью. Поэтому если вы подредактируете текст, смешаете его с другим текстом, или он, например, будет коротким, статистический паттерн перестанет быть надежно обнаружимым.

(Для файлов это работает немного иначе: там просто встраиваются соответствующие C2PA-метаданные).

Честно говоря, большого смысла в таких пометках пока не видно. Технически интересно, юридически обязательно, но как решение исходной проблемы – довольно дыряво.
😁30🫡95😭4👍3🤝2