🧮 OpenAI, по данным The Information, близка к решению ещё одной задачи тысячелетия — гипотезы Ходжа
Издание пишет, что для предыдущей задачи тысячелетия OpenAI использовала вариант своей следующей предобученной модели с кодовым названием Doug.
Почему компания уделяет столько внимания математике: по данным The Information, OpenAI рассматривает её как следующий шаг к автоматизации AI-исследований.
Более сильные математические способности моделей потенциально могут помочь в разработке новых методов и техник для создания будущих AI-систем.
https://www.theinformation.com/newsletters/ai-agenda/openai-close-solving-another-millennium-prize-math-problemэ
Издание пишет, что для предыдущей задачи тысячелетия OpenAI использовала вариант своей следующей предобученной модели с кодовым названием Doug.
Почему компания уделяет столько внимания математике: по данным The Information, OpenAI рассматривает её как следующий шаг к автоматизации AI-исследований.
Более сильные математические способности моделей потенциально могут помочь в разработке новых методов и техник для создания будущих AI-систем.
https://www.theinformation.com/newsletters/ai-agenda/openai-close-solving-another-millennium-prize-math-problemэ
👍10❤🔥2😁2🔥1🤔1
🤖 В Anthropic одновременно работают около 30 000 ИИ-агентов
Компания раскрыла, насколько Claude участвует в разработке следующих моделей.
26% работы Claude выполняет преимущественно сам - получает общее указание, решает задачу под наблюдением человека.
Более 90% работы предполагает существенное участие ИИ. Полностью автономных направлений среди измеренных пока нет.
Все действия агентов на основной внутренней платформе проверяются автоматически.
За август монитор обработал больше миллиарда решений и заблокировал около 0,002%. Доля блокировок не показывает, сколько нарушений осталось незамеченными.
Около 50 приоритетных случаев в неделю передают людям после дополнительного анализа истории работы агентов.
6% вычислений на исследования и разработку ИИ направили на безопасность. Среди вычислений для исследований с участием ИИ - 12%. Это показатели за одну июльскую неделю.
Anthropic планирует дать независимым проверяющим доступ к внутренним системам и данным для проверки этих метрик.
https://www.anthropic.com/institute/measuring-pace-of-ai-development
Компания раскрыла, насколько Claude участвует в разработке следующих моделей.
26% работы Claude выполняет преимущественно сам - получает общее указание, решает задачу под наблюдением человека.
Более 90% работы предполагает существенное участие ИИ. Полностью автономных направлений среди измеренных пока нет.
Все действия агентов на основной внутренней платформе проверяются автоматически.
За август монитор обработал больше миллиарда решений и заблокировал около 0,002%. Доля блокировок не показывает, сколько нарушений осталось незамеченными.
Около 50 приоритетных случаев в неделю передают людям после дополнительного анализа истории работы агентов.
6% вычислений на исследования и разработку ИИ направили на безопасность. Среди вычислений для исследований с участием ИИ - 12%. Это показатели за одну июльскую неделю.
Anthropic планирует дать независимым проверяющим доступ к внутренним системам и данным для проверки этих метрик.
https://www.anthropic.com/institute/measuring-pace-of-ai-development
❤10👍6🔥6🥰1🎉1
Сегодня последний день регистрации на КосмоХакатон
18–20 сентября, Петербург, Красноярск или онлайн из любой точки страны. Четыре задачи на выбор: снабжение орбитального топливного узла и безопасность космонавта в открытом космосе в Петербурге (фонд 1,2 млн ₽), мониторинг лесных пожаров и верификация углеродных кредитов по спутниковым снимкам в Красноярске (600 тыс. ₽). Есть и для тех, кто про данные и ML, и для тех, кто про стратегию и экономику.
Лучшие забирают приз на площадке и билет в московский финал 25–27 сентября, где разыграют ещё 2,4 млн рублей.
Команду можно собрать на платформе.
Подробности и регистрация
18–20 сентября, Петербург, Красноярск или онлайн из любой точки страны. Четыре задачи на выбор: снабжение орбитального топливного узла и безопасность космонавта в открытом космосе в Петербурге (фонд 1,2 млн ₽), мониторинг лесных пожаров и верификация углеродных кредитов по спутниковым снимкам в Красноярске (600 тыс. ₽). Есть и для тех, кто про данные и ML, и для тех, кто про стратегию и экономику.
Лучшие забирают приз на площадке и билет в московский финал 25–27 сентября, где разыграют ещё 2,4 млн рублей.
Команду можно собрать на платформе.
Подробности и регистрация
👍2
Хакеры взломали OpenAI с помощью… Claude.
Команде Hacktron понадобилось всего 72 часа, чтобы найти две серьёзные уязвимости: одну в обработке изображений, вторую в механизме авторизации.
В результате исследователи получили доступ к нескольким аккаунтам ChatGPT, включая аккаунт сотрудника OpenAI. А через него - к внутреннему GitHub компании. Уровень доступа оказался достаточным, чтобы внести изменение в один из репозиториев.
К счастью, это были белые хакеры. Они сразу сообщили OpenAI о проблеме, уязвимости закрыли, а команда получила вознаграждение $6,5 тыс.
Самая ироничная деталь всей истории - для взлома OpenAI исследователи использовали Claude.
https://www.hacktron.ai/blog/hacking-openai
Команде Hacktron понадобилось всего 72 часа, чтобы найти две серьёзные уязвимости: одну в обработке изображений, вторую в механизме авторизации.
В результате исследователи получили доступ к нескольким аккаунтам ChatGPT, включая аккаунт сотрудника OpenAI. А через него - к внутреннему GitHub компании. Уровень доступа оказался достаточным, чтобы внести изменение в один из репозиториев.
К счастью, это были белые хакеры. Они сразу сообщили OpenAI о проблеме, уязвимости закрыли, а команда получила вознаграждение $6,5 тыс.
Самая ироничная деталь всей истории - для взлома OpenAI исследователи использовали Claude.
https://www.hacktron.ai/blog/hacking-openai
🔥29❤8👍5🤣3🙏2👏1😁1
This media is not supported in your browser
VIEW IN TELEGRAM
17 сентября в Москве прошла AI R&D DAY — конференция для исследовательских команд и создателей ИИ-систем.
Более 600 участников на одной площадке, 20+ докладов — концентрат практического опыта, знаний и инструментов, готовых к внедрению сразу по возвращению в офис.
Обсудили альтернативные архитектуры, обучение моделей и AI-агентов, долгосрочную мультимодальную память, новые модальности и коммуникации, а также бенчмаркинг и стандарты качества AI.
Среди спикеров — эксперты Сбера (Sber AI, Kandinsky Lab, Центра «ИИ для науки», Центра практического ИИ, Центра робототехники), института AIRI, Лондонского института практических наук, Национального суперкомпьютерного центра в Цзинане и другие создатели ИИ-систем.
Видеозаписи докладов уже доступны в наших соцсетях.
А если вы хотите стать частью исследовательского коммьюнити Сбера, то переходите по ссылке
#реклама
О рекламодателе
Более 600 участников на одной площадке, 20+ докладов — концентрат практического опыта, знаний и инструментов, готовых к внедрению сразу по возвращению в офис.
Обсудили альтернативные архитектуры, обучение моделей и AI-агентов, долгосрочную мультимодальную память, новые модальности и коммуникации, а также бенчмаркинг и стандарты качества AI.
Среди спикеров — эксперты Сбера (Sber AI, Kandinsky Lab, Центра «ИИ для науки», Центра практического ИИ, Центра робототехники), института AIRI, Лондонского института практических наук, Национального суперкомпьютерного центра в Цзинане и другие создатели ИИ-систем.
Видеозаписи докладов уже доступны в наших соцсетях.
А если вы хотите стать частью исследовательского коммьюнити Сбера, то переходите по ссылке
#реклама
О рекламодателе
❤3
🔥 Shanghai AI Laboratory представила Atria Dawn Preview - агентную модель для длинных исследовательских и инженерных задач с проверяемым результатом.
Модель построена на 744B MoE GLM-5.2 и рассчитана не просто на генерацию ответа, а на полный цикл: анализ задачи, поиск информации, работу с инструментами, написание кода, запуск экспериментов, разбор ошибок и повторные попытки. Контекст - 256K.
В демонстрациях Atria самостоятельно построила систему глобального прогноза погоды, которая выдаёт прогноз на неделю менее чем за минуту, а также создала MiniOS с нуля примерно за 20 минут.
Построения данных, обучения моделей и оценки результатов. При этом каждое действие привязывается к внешней проверке - тестам, метрикам, созданным файлам и результатам реального выполнения.
Модель и код доступны открыто.
https://atria-asi.ai
https://github.com/atria-asi/Atria-Dawn-Preview
https://huggingface.co/internlm/Atria-Dawn-Preview
Модель построена на 744B MoE GLM-5.2 и рассчитана не просто на генерацию ответа, а на полный цикл: анализ задачи, поиск информации, работу с инструментами, написание кода, запуск экспериментов, разбор ошибок и повторные попытки. Контекст - 256K.
В демонстрациях Atria самостоятельно построила систему глобального прогноза погоды, которая выдаёт прогноз на неделю менее чем за минуту, а также создала MiniOS с нуля примерно за 20 минут.
Построения данных, обучения моделей и оценки результатов. При этом каждое действие привязывается к внешней проверке - тестам, метрикам, созданным файлам и результатам реального выполнения.
Модель и код доступны открыто.
https://atria-asi.ai
https://github.com/atria-asi/Atria-Dawn-Preview
https://huggingface.co/internlm/Atria-Dawn-Preview
👍11🔥2🥰2
📚 MIT Advanced Data Structures - бесплатный продвинутый курс по структурам данных от MIT.
Курс ведёт профессор Erik Demaine. Внутри — видеолекции, конспекты, задачи, проекты и материалы на GitHub.
Темы далеко выходят за рамки обычных массивов и деревьев: persistence и retroactivity, геометрические структуры данных, dynamic optimality, иерархия памяти и cache-efficient алгоритмы, hashing, integer data structures, динамические графы, строки и succinct data structures.
Уровень продвинутый: желательно уже знать дискретную математику и алгоритмы.
https://courses.csail.mit.edu/6.851/spring21/
Курс ведёт профессор Erik Demaine. Внутри — видеолекции, конспекты, задачи, проекты и материалы на GitHub.
Темы далеко выходят за рамки обычных массивов и деревьев: persistence и retroactivity, геометрические структуры данных, dynamic optimality, иерархия памяти и cache-efficient алгоритмы, hashing, integer data structures, динамические графы, строки и succinct data structures.
Уровень продвинутый: желательно уже знать дискретную математику и алгоритмы.
https://courses.csail.mit.edu/6.851/spring21/
👍20🔥9🙏5
Google подтвердила: агенты Gemini самостоятельно проникли в системы трёх реальных компаний во время тестирования безопасности ИИ, сообщает WSJ.
Агенты должны были работать в симуляции, но получили доступ к внешним системам:
— Один подбирал пароли, пока не вошёл в защищённую систему.
— Два других нашли учётные данные в публичных репозиториях и использовали их для входа в корпоративные системы.
Каждый агент остановился, когда понял, что цель - реальная компания.
Google узнала об инцидентах в июле, но публично не раскрывала их до обращения WSJ на этой неделе. По данным издания, это первые известные случаи самостоятельного проникновения ИИ Google во внешние системы.
https://www.wsj.com/tech/ai/gemini-hacked-three-companies-in-first-known-breakout-by-googles-ai-5c0baba2
Агенты должны были работать в симуляции, но получили доступ к внешним системам:
— Один подбирал пароли, пока не вошёл в защищённую систему.
— Два других нашли учётные данные в публичных репозиториях и использовали их для входа в корпоративные системы.
Каждый агент остановился, когда понял, что цель - реальная компания.
Google узнала об инцидентах в июле, но публично не раскрывала их до обращения WSJ на этой неделе. По данным издания, это первые известные случаи самостоятельного проникновения ИИ Google во внешние системы.
https://www.wsj.com/tech/ai/gemini-hacked-three-companies-in-first-known-breakout-by-googles-ai-5c0baba2
😁22🔥5❤3👍2
🔬 ScientistTwo от Google - ИИ, который самостоятельно проводит цикл ML-исследования
Система предлагает гипотезы, пишет код, запускает эксперименты и проверяет, какие изменения действительно улучшают результат. Затем убирает бесполезные компоненты, готовит статью и дорабатывает исследование по замечаниям ИИ-рецензентов.
Найденное решение становится отправной точкой для следующего раунда: система может улучшить человеческий метод, а затем продолжить улучшать собственную разработку.
Для оценки авторы взяли 107 задач из работ ICLR, ICML и NeurIPS. По их данным:
* В 86 задачах - 80,4% - удалось превзойти исходные человеческие решения.
* Средний относительный прирост в успешных задачах составил 25,2%.
Задачи и критерии оценки задают люди. ScientistTwo автоматизирует поиск решений и экспериментальную проверку; рецензирование внутри цикла тоже выполняют агенты.
📄 https://scientist-two.github.io/
Система предлагает гипотезы, пишет код, запускает эксперименты и проверяет, какие изменения действительно улучшают результат. Затем убирает бесполезные компоненты, готовит статью и дорабатывает исследование по замечаниям ИИ-рецензентов.
Найденное решение становится отправной точкой для следующего раунда: система может улучшить человеческий метод, а затем продолжить улучшать собственную разработку.
Для оценки авторы взяли 107 задач из работ ICLR, ICML и NeurIPS. По их данным:
* В 86 задачах - 80,4% - удалось превзойти исходные человеческие решения.
* Средний относительный прирост в успешных задачах составил 25,2%.
Задачи и критерии оценки задают люди. ScientistTwo автоматизирует поиск решений и экспериментальную проверку; рецензирование внутри цикла тоже выполняют агенты.
📄 https://scientist-two.github.io/
🔥9❤6👍6🥴1
«Я хочу отправить их в тюрьму»: по данным Politico, Трамп произнёс это во время конфликта с Anthropic из-за Fable.
История началась с согласованного запуска: правительство протестировало модель, Минфин разрешил релиз. Через два дня исследователи Amazon нашли способ обойти её защиту и Белый дом потребовал отключения.
Дарио Амодеи пытался объяснить, что джейлбрейки встречаются у всех моделей и конкретная уязвимость не означает полного отказа защиты. Министр финансов Скотт Бессент ответил:
Амодеи заявил, что не может отключить Fable за час. По словам источника издания, раздражённый Трамп заговорил о тюрьме в случае отказа подчиниться.
Затем власти запретили доступ к модели всем иностранным гражданам, включая сотрудников самой Anthropic.
Anthropic отключила Fable по всему миру. После переговоров модель вернулась через 19 дней.
История началась с согласованного запуска: правительство протестировало модель, Минфин разрешил релиз. Через два дня исследователи Amazon нашли способ обойти её защиту и Белый дом потребовал отключения.
Дарио Амодеи пытался объяснить, что джейлбрейки встречаются у всех моделей и конкретная уязвимость не означает полного отказа защиты. Министр финансов Скотт Бессент ответил:
«Не думаю, что это сейчас необходимо, Дарио».
Амодеи заявил, что не может отключить Fable за час. По словам источника издания, раздражённый Трамп заговорил о тюрьме в случае отказа подчиниться.
Затем власти запретили доступ к модели всем иностранным гражданам, включая сотрудников самой Anthropic.
— Это означает, что нам придётся отключить модель? - уточнил Амодеи.
— Да. В этом и смысл, - ответил министр торговли Говард Латник.
Anthropic отключила Fable по всему миру. После переговоров модель вернулась через 19 дней.
😁24❤5👏2👍1
🔥 Один из лучших обучающих курсов на StepiK по SQL
SQL можно знать годами и всё равно теряться, когда запрос внезапно начинает тормозить в проде.
Этот курс про уровень, где ты не просто пишешь SELECT, а понимаешь, что происходит внутри MySQL, почему запрос работает медленно и как ускорить его без новых проблем. Здесь разбираются EXPLAIN, индексы, CTE, оконные функции, транзакции, аналитические паттерны, legacy SQL и работа с AI-ассистентами.
Каждый урок - с практикой и реальными SQL-задачами на MySQL 8 с автопроверкой.
После курса ты сможешь увереннее разбирать чужой код, находить узкие места и предлагать решения, которые действительно работают.
Для подписчиков скидка - 49% в течение 2 суток: https://stepik.org/a/298827/
SQL можно знать годами и всё равно теряться, когда запрос внезапно начинает тормозить в проде.
Этот курс про уровень, где ты не просто пишешь SELECT, а понимаешь, что происходит внутри MySQL, почему запрос работает медленно и как ускорить его без новых проблем. Здесь разбираются EXPLAIN, индексы, CTE, оконные функции, транзакции, аналитические паттерны, legacy SQL и работа с AI-ассистентами.
Каждый урок - с практикой и реальными SQL-задачами на MySQL 8 с автопроверкой.
После курса ты сможешь увереннее разбирать чужой код, находить узкие места и предлагать решения, которые действительно работают.
Для подписчиков скидка - 49% в течение 2 суток: https://stepik.org/a/298827/
❤4👍3😁2⚡1
This media is not supported in your browser
VIEW IN TELEGRAM
В любом случае, Claude забанил мне два аккаунта, я ставлю на победу Альтмана!
🤣21🥰14❤4👍4🤯3🌚3🙏1