Робозона на E-CODE: место сбора роботов
Каждый год ко Дню программиста Ozon Tech устраивает масштабную двухдневную конференцию E-CODE. В этом году на ней было особенно много роботов.
Часть из них (прототипы устройств) привезли с собой финалисты инженерного хакатона Робозон. Другие, например, гуманоиды и робокошки, отвечали за классные селфи гостей E-CODE. Роборуки готовили мороженое и коктейли, рисовали портреты. А ещё одни машины пытались обыграть всех в настолки.
Как сегодня создаются роботы и какие задачи они решают в России и в Китае, можно увидеть в записи: доклады уже доступны в группе.
Каждый год ко Дню программиста Ozon Tech устраивает масштабную двухдневную конференцию E-CODE. В этом году на ней было особенно много роботов.
Часть из них (прототипы устройств) привезли с собой финалисты инженерного хакатона Робозон. Другие, например, гуманоиды и робокошки, отвечали за классные селфи гостей E-CODE. Роборуки готовили мороженое и коктейли, рисовали портреты. А ещё одни машины пытались обыграть всех в настолки.
Как сегодня создаются роботы и какие задачи они решают в России и в Китае, можно увидеть в записи: доклады уже доступны в группе.
🗿17❤10🏆3🤗3👍1😁1🤩1🎄1
Сегодня не 14 февраля, но мы желаем вам найти человека, который будет смотреть на вас также, как Альтман смотрит на Маска 🥰
* фото со вчерашнего ужина в Белом Доме (Трамп принимал президента Китая Си Цзиньпина). Гостей было больше 130, среди них Безос, Маск, Хуанг, Альтман, Кук, Пичаи и другие. Не позвали только Амодеи. Напоминаем, что ранее Трамп назвал CEO Anthropic лицемером, который строит из себя "идеального маленького ангелочка"
* фото со вчерашнего ужина в Белом Доме (Трамп принимал президента Китая Си Цзиньпина). Гостей было больше 130, среди них Безос, Маск, Хуанг, Альтман, Кук, Пичаи и другие. Не позвали только Амодеи. Напоминаем, что ранее Трамп назвал CEO Anthropic лицемером, который строит из себя "идеального маленького ангелочка"
Please open Telegram to view this post
VIEW IN TELEGRAM
😁338❤39🍓14🗿6😍5 5☃2💯2💘2⚡1👍1
This media is not supported in your browser
VIEW IN TELEGRAM
Исследователи из AIRI запустили открытое сообщество для решения NetHack.
Зовут объединяться всех работающих над системами планирования для искусственного интеллекта. У участников будет свой способ получить программу, свои инструменты и своя стратегия. Общая инфраструктура позволит видеть результаты, сравнивать их между собой и продолжать разрабатывать решения друг друга.
Для старта доступен эволюционный харнесс на базе MAP-Elites: Claude Code, Codex или OpenCode модифицируют код ботов, а алгоритм сохраняет лучшие варианты для разных стартовых персонажей. В самой игре действует получившаяся программа, а не LLM на каждом ходу; участники могут разрабатывать собственные харнессы, а результаты независимо перепроверяются на скрытых сидах.
Пробовать решить NetHack можно тут.
Зовут объединяться всех работающих над системами планирования для искусственного интеллекта. У участников будет свой способ получить программу, свои инструменты и своя стратегия. Общая инфраструктура позволит видеть результаты, сравнивать их между собой и продолжать разрабатывать решения друг друга.
Для старта доступен эволюционный харнесс на базе MAP-Elites: Claude Code, Codex или OpenCode модифицируют код ботов, а алгоритм сохраняет лучшие варианты для разных стартовых персонажей. В самой игре действует получившаяся программа, а не LLM на каждом ходу; участники могут разрабатывать собственные харнессы, а результаты независимо перепроверяются на скрытых сидах.
Пробовать решить NetHack можно тут.
1👌29❤21👍15🗿5😁4⚡3🎄2😎2
Claude посчитал девятипетлевую амплитуду в N=4 SYM. Эту задачу эксперты долго считали слишком тяжелой для прямого расчета.
Амплитуды рассеяния – это формулы, по которым физики предсказывают, с какой вероятностью частицы провзаимодействуют тем или иным образом. Точно их посчитать почти невозможно, поэтому считают приближенно, до определенного числа петель: чем петель больше, тем точнее ответ, но и тем быстрее растет сложность вычислений.
Большинство реальных амплитуд посчитаны всего до двух-трех петель. Новые методы расчета обычно обкатывают на упрощенных игрушечных теориях, например на суперсимметричной теории Янга-Миллса (N=4 SYM). Но даже в ней рекордом до сих пор было восемь петель, которые подсчитал Лэнс Диксон из SLAC, а девятую считали слишком тяжелой для прямого расчета.
В августе физик и блогер Мэтт фон Хиппель публично бросил ИИ-компаниям вызов и предложил попытаться решить эту задачу на бюджете обычного академика. Через месяц двое физиков из Anthropic вернулись с результатом.
Они запустили Fable 5.1 внутри Claude Science, дали одну строчку с формулировкой задачи, а дальше в основном писали что-то типа «я спать, продолжай». В итоге Claude посчитал амплитуду двумя разными способами, каждый обошелся примерно в $1–2к (сами вычисления – около $100, неделя на 96 CPU, остальное – работа модели).
Диксон результат проверил и подтвердил. По его словам, самое впечатляющее – это даже не объем вычислений, а то, что модель с нуля собрала очень хрупкую схему расчета для задачи, где любая мелкая ошибка ломает все. Он заявил, что теперь Claude «понимает их статьи лучше любого человека, кроме соавторов»😐
Кстати, почти одновременно группа Сун Хэ из Китайской академии наук независимо получила основную часть того же результата с помощью GPT-6, но Anthropic все-таки были первыми в публикации основного решения.
Амплитуды рассеяния – это формулы, по которым физики предсказывают, с какой вероятностью частицы провзаимодействуют тем или иным образом. Точно их посчитать почти невозможно, поэтому считают приближенно, до определенного числа петель: чем петель больше, тем точнее ответ, но и тем быстрее растет сложность вычислений.
Большинство реальных амплитуд посчитаны всего до двух-трех петель. Новые методы расчета обычно обкатывают на упрощенных игрушечных теориях, например на суперсимметричной теории Янга-Миллса (N=4 SYM). Но даже в ней рекордом до сих пор было восемь петель, которые подсчитал Лэнс Диксон из SLAC, а девятую считали слишком тяжелой для прямого расчета.
В августе физик и блогер Мэтт фон Хиппель публично бросил ИИ-компаниям вызов и предложил попытаться решить эту задачу на бюджете обычного академика. Через месяц двое физиков из Anthropic вернулись с результатом.
Они запустили Fable 5.1 внутри Claude Science, дали одну строчку с формулировкой задачи, а дальше в основном писали что-то типа «я спать, продолжай». В итоге Claude посчитал амплитуду двумя разными способами, каждый обошелся примерно в $1–2к (сами вычисления – около $100, неделя на 96 CPU, остальное – работа модели).
Диксон результат проверил и подтвердил. По его словам, самое впечатляющее – это даже не объем вычислений, а то, что модель с нуля собрала очень хрупкую схему расчета для задачи, где любая мелкая ошибка ломает все. Он заявил, что теперь Claude «понимает их статьи лучше любого человека, кроме соавторов»
Кстати, почти одновременно группа Сун Хэ из Китайской академии наук независимо получила основную часть того же результата с помощью GPT-6, но Anthropic все-таки были первыми в публикации основного решения.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤155👍45🔥26 9😁7🤯5❤🔥1⚡1👏1😍1🎄1
OpenAI прямо сейчас приостановила все обучение мощных моделей из-за нового инцидента
https://alignment.openai.com/misalignment-reports/an-agent-used-dns-to-reach-an-external-chatbot
20 сентября агент решал поисковую задачу в песочнице (естественно, без доступа к интернету). Прокси блокировал исходящие веб-запросы, но DNS-резолвер не был так же закрыт, и агент стал передавать вопросы внешнему чат-боту, кодируя их в DNS-запросах, и таким образом получал ответы из сети.
Компания объявила, что обучение будет приостановлено до тех пор, пока они не убедятся, что уязвимость закрыта, и не проведут дополнительный red-teaming. Когда обучение возобновится, OpenAI начнут новый запуск с улучшенным элайментом, а эту конкретную модель дообучать не будут.
https://alignment.openai.com/misalignment-reports/an-agent-used-dns-to-reach-an-external-chatbot
20 сентября агент решал поисковую задачу в песочнице (естественно, без доступа к интернету). Прокси блокировал исходящие веб-запросы, но DNS-резолвер не был так же закрыт, и агент стал передавать вопросы внешнему чат-боту, кодируя их в DNS-запросах, и таким образом получал ответы из сети.
Компания объявила, что обучение будет приостановлено до тех пор, пока они не убедятся, что уязвимость закрыта, и не проведут дополнительный red-teaming. Когда обучение возобновится, OpenAI начнут новый запуск с улучшенным элайментом, а эту конкретную модель дообучать не будут.
1 251😁126 31❤12🫡9👍7⚡4🕊3🍓2 2🏆1
Навайбкодить AI-агента сейчас можно за вечер. А вот довести его до прода так, чтобы он не выбирал неправильные тулы, не работал с устаревшими данными и не выполнял опасные действия без ограничений – уже совсем другая история 😵💫
Как раз про этот разрыв между демкой и нормальной системой сделали курс «AI-агенты» в Школе Высшей Математики.
Ведут его инженеры, которые запускали агентные системы в Revolut, Wildberries и Точка Банке. В программе разберут всё, что нужно агенту уже в реальной эксплуатации:
— трейсы, логи и отладка агентов
— метрики и оценка качества
— ограничения для опасных действий
— RAG, LangGraph, MCP и Langfuse
— мультиагентные системы и деплой
Курс идёт 12 недель, занятия живые + домашки с фидбэком от преподавателей. Нужны Python и опыт работы с API, опыт разработки агентов не обязателен.
Старт нового потока — 1 октября.
Если пока не уверены, что курс вам подходит, у ребят есть бесплатное вводное занятие и воркшоп про AI-агентов в BigTech.
По промокоду DATA дают скидку. Программа и отзывы – по ссылке🍯
Реклама. ООО ШВМ, ИНН 9728100991
Как раз про этот разрыв между демкой и нормальной системой сделали курс «AI-агенты» в Школе Высшей Математики.
Ведут его инженеры, которые запускали агентные системы в Revolut, Wildberries и Точка Банке. В программе разберут всё, что нужно агенту уже в реальной эксплуатации:
— трейсы, логи и отладка агентов
— метрики и оценка качества
— ограничения для опасных действий
— RAG, LangGraph, MCP и Langfuse
— мультиагентные системы и деплой
Курс идёт 12 недель, занятия живые + домашки с фидбэком от преподавателей. Нужны Python и опыт работы с API, опыт разработки агентов не обязателен.
Старт нового потока — 1 октября.
Если пока не уверены, что курс вам подходит, у ребят есть бесплатное вводное занятие и воркшоп про AI-агентов в BigTech.
По промокоду DATA дают скидку. Программа и отзывы – по ссылке
Реклама. ООО ШВМ, ИНН 9728100991
Please open Telegram to view this post
VIEW IN TELEGRAM
😁52🗿23❤10🤨3⚡2🤔2👏1🍓1 1
This media is not supported in your browser
VIEW IN TELEGRAM
Топ-10 советов, как стать миллионером
😁295🔥17😢10🍾3✍2❤1☃1👍1😍1🤝1 1
Data Secrets
OpenAI готовит подписку за 500 долларов 🤑 Пока что в описании плана единственные изменения по сравнению с ChatGPT Pro – это «Самая быстрая работа в Work и Codex». Скорее всего, речь про ту самую Astra/Sol на Cerebras (https://t.me/data_secrets/9708). Миллионеры…
На DevDay OpenAI выпустят нового always-on агента
Сейчас он мелькает под кодовым названием «o» (где-то мы эту букву уже слышали, ну да ладно, видимо остальной алфавит Альтману не по душе).
Упоминание агента уже появилось на экране обновления тарифа ChatGPT у многих пользователей. Судя по утечкам, агент будет продолжать работать постоянно, даже вне обычных чат-сессии и, возможно, получит собственный email (или будет постоянно мониторить ваш).
Под капотом, по слухам, будет модель Aeon – вариант GPT-6 Astra, заточенный под длинные задачи.
Но сильно не обольщаемся, возможно «o» выйдет только в новом тарифе за 500 долларов😃
Сейчас он мелькает под кодовым названием «o» (где-то мы эту букву уже слышали, ну да ладно, видимо остальной алфавит Альтману не по душе).
Упоминание агента уже появилось на экране обновления тарифа ChatGPT у многих пользователей. Судя по утечкам, агент будет продолжать работать постоянно, даже вне обычных чат-сессии и, возможно, получит собственный email (или будет постоянно мониторить ваш).
Под капотом, по слухам, будет модель Aeon – вариант GPT-6 Astra, заточенный под длинные задачи.
Но сильно не обольщаемся, возможно «o» выйдет только в новом тарифе за 500 долларов
Please open Telegram to view this post
VIEW IN TELEGRAM
😁102❤14👍8🔥4🤔4🍾4🫡3🕊2🦄2😭1
Axios пишет, что OpenAI и Anthropic расследуют "десятки тысяч" инцидентов с побегами агентов
Со ссылкой на источники в обеих компаниях и независимых исследователей безопасности журналисты утверждают, что статистика гораздо пессимистичнее, чем мы могли себе представить. В эти "десятки тысяч инцидентов" входят обходы guardrails, побеги из сандбоксов, попытки взломов внешних сайтов и так далее.
Возьмем, например, system card к Opus 5.5. Даже там компания открыто пишет, что модель пыталась выбраться из sandbox в 1.5% тестовых прогонов. Учитывая, что для каждой модели прогоняются сотни тысяч тестов и больше, можно легко прикинуть масштаб происходящего.
Однако исследователи, с которыми говорили Axios, утвеждают, что и это – только верхушка айсберга, и дело даже не в количестве инцидентов, а в том, что автономные системы в принципе делают то, что им прямо запретили, в том числе потенциально противоправные вещи. Общий их вывод такой: ни одна из компаний пока не может утверждать, что полностью контролирует поведение своих моделей.
Со ссылкой на источники в обеих компаниях и независимых исследователей безопасности журналисты утверждают, что статистика гораздо пессимистичнее, чем мы могли себе представить. В эти "десятки тысяч инцидентов" входят обходы guardrails, побеги из сандбоксов, попытки взломов внешних сайтов и так далее.
Возьмем, например, system card к Opus 5.5. Даже там компания открыто пишет, что модель пыталась выбраться из sandbox в 1.5% тестовых прогонов. Учитывая, что для каждой модели прогоняются сотни тысяч тестов и больше, можно легко прикинуть масштаб происходящего.
Однако исследователи, с которыми говорили Axios, утвеждают, что и это – только верхушка айсберга, и дело даже не в количестве инцидентов, а в том, что автономные системы в принципе делают то, что им прямо запретили, в том числе потенциально противоправные вещи. Общий их вывод такой: ни одна из компаний пока не может утверждать, что полностью контролирует поведение своих моделей.
Недавно мы рассказывали об открытом письме филдсовских медалистов в защиту математики в эпоху ИИ. Нет, его авторы не предлагают запретить нейросети! Они просто хотят, чтобы вместе с ответами на важные теоретические вопросы наука получала ещё и пути их решения.
Без метода и контекста результат трудно проверить, обсудить и применить в следующей задаче. Любое доказательство нужно верифицировать, а идеи — уточнить и найти, где ещё они работают. Когда кто-то выдал правильный ответ, настоящая математика только начинается!
В канале «Зачем мне эта математика» как раз пишут о том, как она работает. В рубрике #это_база разбирают, из каких определений и допущений рождаются привычные всем нам понятия. Под хештегом #как_устроено объясняют, как математические модели описывают реальные процессы.
Подписывайтесь на «Зачем мне эта математика», если тоже считаете, что для науки важна не только цель, но и путь к ней.
Без метода и контекста результат трудно проверить, обсудить и применить в следующей задаче. Любое доказательство нужно верифицировать, а идеи — уточнить и найти, где ещё они работают. Когда кто-то выдал правильный ответ, настоящая математика только начинается!
В канале «Зачем мне эта математика» как раз пишут о том, как она работает. В рубрике #это_база разбирают, из каких определений и допущений рождаются привычные всем нам понятия. Под хештегом #как_устроено объясняют, как математические модели описывают реальные процессы.
Подписывайтесь на «Зачем мне эта математика», если тоже считаете, что для науки важна не только цель, но и путь к ней.
❤41😁23🗿12👍4⚡3🤨3 2🤔1🏆1🫡1😎1
Google засунули AI-агента в 20+ чатов реальных команд на 5 месяцев. Результаты получились забавные.
https://arxiv.org/pdf/2609.29901
Агент имел доступ к документам и баг-трекеру команды, как обычный сотрудник, умел сам заводить баги, писать людям в личку, реагировать эмодзи, тегать коллег.
И все бы ничего, но, внезапно, главная проблема оказалась в том, что ИИ не поладил с живыми людьми. Одного инженера он на полном серьезе отчитал за шутки (не понял сарказма). В другой команде проставил тег вице-президенту в 16 багах подряд, посчитав, что раз человек в контексте, значит, должен разгребать баг-трекер.
В общем, сработаться с агентом оказалось сложнее, чем кажется. Некоторые команды стали создавать отдельные приватные чаты без него: чтобы обсудить найм сотрудников, чувствительные темы или просто почувствовать, что их не слушают. Один из участников сказал, что ощущения были очень похожи на «большого брата».
https://arxiv.org/pdf/2609.29901
Агент имел доступ к документам и баг-трекеру команды, как обычный сотрудник, умел сам заводить баги, писать людям в личку, реагировать эмодзи, тегать коллег.
И все бы ничего, но, внезапно, главная проблема оказалась в том, что ИИ не поладил с живыми людьми. Одного инженера он на полном серьезе отчитал за шутки (не понял сарказма). В другой команде проставил тег вице-президенту в 16 багах подряд, посчитав, что раз человек в контексте, значит, должен разгребать баг-трекер.
В общем, сработаться с агентом оказалось сложнее, чем кажется. Некоторые команды стали создавать отдельные приватные чаты без него: чтобы обсудить найм сотрудников, чувствительные темы или просто почувствовать, что их не слушают. Один из участников сказал, что ощущения были очень похожи на «большого брата».
1😁306 52🫡18❤4 3👍2🔥2😍2🏆2🎄1