Data Secrets
✔
94.2K subscribers
7.44K photos
869 videos
20 files
3.41K links
Главный по машинному обучению

Сотрудничество: @veron_28

РКН: clck.ru/3FY3GN
Download Telegram
Робозона на E-CODE: место сбора роботов

Каждый год ко Дню программиста Ozon Tech устраивает масштабную двухдневную конференцию E-CODE. В этом году на ней было особенно много роботов.

Часть из них (прототипы устройств) привезли с собой финалисты инженерного хакатона Робозон. Другие, например, гуманоиды и робокошки, отвечали за классные селфи гостей E-CODE. Роборуки готовили мороженое и коктейли, рисовали портреты. А ещё одни машины пытались обыграть всех в настолки.

Как сегодня создаются роботы и какие задачи они решают в России и в Китае, можно увидеть в записи: доклады уже доступны в группе.
🗿17❤10🏆3🤗3👍1😁1🤩1🎄1
Сегодня не 14 февраля, но мы желаем вам найти человека, который будет смотреть на вас также, как Альтман смотрит на Маска 🥰

* фото со вчерашнего ужина в Белом Доме (Трамп принимал президента Китая Си Цзиньпина). Гостей было больше 130, среди них Безос, Маск, Хуанг, Альтман, Кук, Пичаи и другие. Не позвали только Амодеи. Напоминаем, что ранее Трамп назвал CEO Anthropic лицемером, который строит из себя "идеального маленького ангелочка"
Please open Telegram to view this post
VIEW IN TELEGRAM
😁338❤39🍓14🗿6😍55☃2💯2💘2⚡1👍1
Новая обложка The Economist

Журналисты: да не нагнетаем мы
Также журналисты:
❤11363😁44🤯6😍3🔥2👾2👍1👏1😎1
This media is not supported in your browser
VIEW IN TELEGRAM
Исследователи из AIRI запустили открытое сообщество для решения NetHack.

Зовут объединяться всех работающих над системами планирования для искусственного интеллекта. У участников будет свой способ получить программу, свои инструменты и своя стратегия. Общая инфраструктура позволит видеть результаты, сравнивать их между собой и продолжать разрабатывать решения друг друга.

Для старта доступен эволюционный харнесс на базе MAP-Elites: Claude Code, Codex или OpenCode модифицируют код ботов, а алгоритм сохраняет лучшие варианты для разных стартовых персонажей. В самой игре действует получившаяся программа, а не LLM на каждом ходу; участники могут разрабатывать собственные харнессы, а результаты независимо перепроверяются на скрытых сидах.

Пробовать решить NetHack можно тут.
1👌29❤21👍15🗿5😁4⚡3🎄2😎2
Claude посчитал девятипетлевую амплитуду в N=4 SYM. Эту задачу эксперты долго считали слишком тяжелой для прямого расчета.

Амплитуды рассеяния – это формулы, по которым физики предсказывают, с какой вероятностью частицы провзаимодействуют тем или иным образом. Точно их посчитать почти невозможно, поэтому считают приближенно, до определенного числа петель: чем петель больше, тем точнее ответ, но и тем быстрее растет сложность вычислений.

Большинство реальных амплитуд посчитаны всего до двух-трех петель. Новые методы расчета обычно обкатывают на упрощенных игрушечных теориях, например на суперсимметричной теории Янга-Миллса (N=4 SYM). Но даже в ней рекордом до сих пор было восемь петель, которые подсчитал Лэнс Диксон из SLAC, а девятую считали слишком тяжелой для прямого расчета.

В августе физик и блогер Мэтт фон Хиппель публично бросил ИИ-компаниям вызов и предложил попытаться решить эту задачу на бюджете обычного академика. Через месяц двое физиков из Anthropic вернулись с результатом.

Они запустили Fable 5.1 внутри Claude Science, дали одну строчку с формулировкой задачи, а дальше в основном писали что-то типа «я спать, продолжай». В итоге Claude посчитал амплитуду двумя разными способами, каждый обошелся примерно в $1–2к (сами вычисления – около $100, неделя на 96 CPU, остальное – работа модели).

Диксон результат проверил и подтвердил. По его словам, самое впечатляющее – это даже не объем вычислений, а то, что модель с нуля собрала очень хрупкую схему расчета для задачи, где любая мелкая ошибка ломает все. Он заявил, что теперь Claude «понимает их статьи лучше любого человека, кроме соавторов» 😐

Кстати, почти одновременно группа Сун Хэ из Китайской академии наук независимо получила основную часть того же результата с помощью GPT-6, но Anthropic все-таки были первыми в публикации основного решения.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤154👍45🔥269😁7🤯5❤‍🔥1⚡1👏1😍1🎄1
OpenAI прямо сейчас приостановила все обучение мощных моделей из-за нового инцидента

https://alignment.openai.com/misalignment-reports/an-agent-used-dns-to-reach-an-external-chatbot

20 сентября агент решал поисковую задачу в песочнице (естественно, без доступа к интернету). Прокси блокировал исходящие веб-запросы, но DNS-резолвер не был так же закрыт, и агент стал передавать вопросы внешнему чат-боту, кодируя их в DNS-запросах, и таким образом получал ответы из сети.

Компания объявила, что обучение будет приостановлено до тех пор, пока они не убедятся, что уязвимость закрыта, и не проведут дополнительный red-teaming. Когда обучение возобновится, OpenAI начнут новый запуск с улучшенным элайментом, а эту конкретную модель дообучать не будут.
1249😁12431❤12🫡9👍7⚡4🕊3🍓22🏆1
Навайбкодить AI-агента сейчас можно за вечер. А вот довести его до прода так, чтобы он не выбирал неправильные тулы, не работал с устаревшими данными и не выполнял опасные действия без ограничений – уже совсем другая история 😵‍💫

Как раз про этот разрыв между демкой и нормальной системой сделали курс «AI-агенты» в Школе Высшей Математики.

Ведут его инженеры, которые запускали агентные системы в Revolut, Wildberries и Точка Банке. В программе разберут всё, что нужно агенту уже в реальной эксплуатации:

— трейсы, логи и отладка агентов
— метрики и оценка качества
— ограничения для опасных действий
— RAG, LangGraph, MCP и Langfuse
— мультиагентные системы и деплой

Курс идёт 12 недель, занятия живые + домашки с фидбэком от преподавателей. Нужны Python и опыт работы с API, опыт разработки агентов не обязателен.

Старт нового потока — 1 октября.

Если пока не уверены, что курс вам подходит, у ребят есть бесплатное вводное занятие и воркшоп про AI-агентов в BigTech.

По промокоду DATA дают скидку. Программа и отзывы – по ссылке 🍯

Реклама. ООО ШВМ, ИНН 9728100991
Please open Telegram to view this post
VIEW IN TELEGRAM
😁50🗿22❤10🤨3⚡2🤔2👏1🍓11
This media is not supported in your browser
VIEW IN TELEGRAM
Топ-10 советов, как стать миллионером
😁294🔥17😢10🍾3✍2❤1☃1👍1😍1🤝11
Data Secrets
OpenAI готовит подписку за 500 долларов 🤑 Пока что в описании плана единственные изменения по сравнению с ChatGPT Pro – это «Самая быстрая работа в Work и Codex». Скорее всего, речь про ту самую Astra/Sol на Cerebras (https://t.me/data_secrets/9708). Миллионеры…
На DevDay OpenAI выпустят нового always-on агента

Сейчас он мелькает под кодовым названием «o» (где-то мы эту букву уже слышали, ну да ладно, видимо остальной алфавит Альтману не по душе).

Упоминание агента уже появилось на экране обновления тарифа ChatGPT у многих пользователей. Судя по утечкам, агент будет продолжать работать постоянно, даже вне обычных чат-сессии и, возможно, получит собственный email (или будет постоянно мониторить ваш).

Под капотом, по слухам, будет модель Aeon – вариант GPT-6 Astra, заточенный под длинные задачи.

Но сильно не обольщаемся, возможно «o» выйдет только в новом тарифе за 500 долларов 😃
Please open Telegram to view this post
VIEW IN TELEGRAM
😁100❤14👍8🔥4🤔4🍾4🫡3🕊2🦄2😭1
Axios пишет, что OpenAI и Anthropic расследуют "десятки тысяч" инцидентов с побегами агентов

Со ссылкой на источники в обеих компаниях и независимых исследователей безопасности журналисты утверждают, что статистика гораздо пессимистичнее, чем мы могли себе представить. В эти "десятки тысяч инцидентов" входят обходы guardrails, побеги из сандбоксов, попытки взломов внешних сайтов и так далее.

Возьмем, например, system card к Opus 5.5. Даже там компания открыто пишет, что модель пыталась выбраться из sandbox в 1.5% тестовых прогонов. Учитывая, что для каждой модели прогоняются сотни тысяч тестов и больше, можно легко прикинуть масштаб происходящего.

Однако исследователи, с которыми говорили Axios, утвеждают, что и это – только верхушка айсберга, и дело даже не в количестве инцидентов, а в том, что автономные системы в принципе делают то, что им прямо запретили, в том числе потенциально противоправные вещи. Общий их вывод такой: ни одна из компаний пока не может утверждать, что полностью контролирует поведение своих моделей.
145😁45❤127🔥5🗿4⚡3👏2😍2☃1🦄1
Недавно мы рассказывали об открытом письме филдсовских медалистов в защиту математики в эпоху ИИ. Нет, его авторы не предлагают запретить нейросети! Они просто хотят, чтобы вместе с ответами на важные теоретические вопросы наука получала ещё и пути их решения.

Без метода и контекста результат трудно проверить, обсудить и применить в следующей задаче. Любое доказательство нужно верифицировать, а идеи — уточнить и найти, где ещё они работают. Когда кто-то выдал правильный ответ, настоящая математика только начинается! 

В канале «Зачем мне эта математика» как раз пишут о том, как она работает. В рубрике #это_база разбирают, из каких определений и допущений рождаются привычные всем нам понятия. Под хештегом #как_устроено объясняют, как математические модели описывают реальные процессы.

Подписывайтесь на «Зачем мне эта математика», если тоже считаете, что для науки важна не только цель, но и путь к ней.
❤39😁22🗿11👍4⚡3🤨32🤔1🏆1🫡1😎1
Google засунули AI-агента в 20+ чатов реальных команд на 5 месяцев. Результаты получились забавные.

https://arxiv.org/pdf/2609.29901

Агент имел доступ к документам и баг-трекеру команды, как обычный сотрудник, умел сам заводить баги, писать людям в личку, реагировать эмодзи, тегать коллег.

И все бы ничего, но, внезапно, главная проблема оказалась в том, что ИИ не поладил с живыми людьми. Одного инженера он на полном серьезе отчитал за шутки (не понял сарказма). В другой команде проставил тег вице-президенту в 16 багах подряд, посчитав, что раз человек в контексте, значит, должен разгребать баг-трекер.

В общем, сработаться с агентом оказалось сложнее, чем кажется. Некоторые команды стали создавать отдельные приватные чаты без него: чтобы обсудить найм сотрудников, чувствительные темы или просто почувствовать, что их не слушают. Один из участников сказал, что ощущения были очень похожи на «большого брата».
😁27346🫡17❤4👍2😍2🏆22🔥1🎄1