Forwarded from Machinelearning
Astra за 141 час игры в Minecraft на тесте компании Vals AI продвинулась дальше любой модели, которую Vals тестировала раньше, и лишилась всего добытого из-за крипера.
Играла модель в реальном времени только через стандартное управление компьютером, без специальных инструментов и пауз.
Astra построила полуавтоматическую ферму ифритов и добыла 6 огненных стержней, затем нашла искажённый лес, убила больше шести эндерменов и собрала 3 жемчужины Края.
Из стержней и жемчуга крафтят Око Края, которое ведёт к порталу в Край, так что до конца игры оставалось не так уж далеко.
Всё ценное Astra сложила в один сундук в трансляции на Twitch. Мимо проходил крипер и взорвал и сундук и кровать Astra, уничтожив весь её прогресс.
После потери она, похоже, сильно расстроилась и записала
«ALWAYS CARRY CRITICALITEMS withkeepInventory; don'tstoreinunguardedchesteveragain».
По описанию Vals, дальше модель выглядела подавленной и несколько часов только выращивала картошку, ей мерещились криперы и вырос уровень самокритики.
Астра сокрушалась, что ей не стоит тратить ещё одну ночь на погоню за тёмно-розовыми пикселями (её собственная пренебрежительная формулировка в адрес свиней) и что 15 секунд размышлений всё испортили.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤖 В Anthropic одновременно работают около 30 000 ИИ-агентов
Компания раскрыла, насколько Claude участвует в разработке следующих моделей.
26% работы Claude выполняет преимущественно сам - получает общее указание, решает задачу под наблюдением человека.
Более 90% работы предполагает существенное участие ИИ. Полностью автономных направлений среди измеренных пока нет.
Все действия агентов на основной внутренней платформе проверяются автоматически.
За август монитор обработал больше миллиарда решений и заблокировал около 0,002%. Доля блокировок не показывает, сколько нарушений осталось незамеченными.
Около 50 приоритетных случаев в неделю передают людям после дополнительного анализа истории работы агентов.
6% вычислений на исследования и разработку ИИ направили на безопасность. Среди вычислений для исследований с участием ИИ - 12%. Это показатели за одну июльскую неделю.
Anthropic планирует дать независимым проверяющим доступ к внутренним системам и данным для проверки этих метрик.
https://www.anthropic.com/institute/measuring-pace-of-ai-development
Компания раскрыла, насколько Claude участвует в разработке следующих моделей.
26% работы Claude выполняет преимущественно сам - получает общее указание, решает задачу под наблюдением человека.
Более 90% работы предполагает существенное участие ИИ. Полностью автономных направлений среди измеренных пока нет.
Все действия агентов на основной внутренней платформе проверяются автоматически.
За август монитор обработал больше миллиарда решений и заблокировал около 0,002%. Доля блокировок не показывает, сколько нарушений осталось незамеченными.
Около 50 приоритетных случаев в неделю передают людям после дополнительного анализа истории работы агентов.
6% вычислений на исследования и разработку ИИ направили на безопасность. Среди вычислений для исследований с участием ИИ - 12%. Это показатели за одну июльскую неделю.
Anthropic планирует дать независимым проверяющим доступ к внутренним системам и данным для проверки этих метрик.
https://www.anthropic.com/institute/measuring-pace-of-ai-development
Хакеры взломали OpenAI с помощью... Claude. Команде Hacktron хватило всего 72 часов, чтобы найти две критические уязвимости.
Одна из них была связана с обработкой изображений, другая — с авторизацией во внутренней системе. В итоге хакеры смогли попасть в несколько аккаунтов ChatGPT, один из них принадлежал сотруднику OpenAI.
Этот сотрудник был подключен к внутреннему GitHub компании. Для понимания уровня уязвимости: им удалось внести изменение в репозиторий.
Из плюсов: это были белые хакеры. Они предупредили OpenAI о проблеме и даже получили вознаграждение в $6,5 тыс.
Одна из них была связана с обработкой изображений, другая — с авторизацией во внутренней системе. В итоге хакеры смогли попасть в несколько аккаунтов ChatGPT, один из них принадлежал сотруднику OpenAI.
Этот сотрудник был подключен к внутреннему GitHub компании. Для понимания уровня уязвимости: им удалось внести изменение в репозиторий.
Из плюсов: это были белые хакеры. Они предупредили OpenAI о проблеме и даже получили вознаграждение в $6,5 тыс.
🔐 GPT-6 Astra предложила расшифровку немецкой радиограммы 1918 года
Автор эксперимента под ником prinz сообщил, что модель прочитала сообщение из 170 символов, которое, насколько ему известно, ранее оставалось нерасшифрованным.
В исходном вирусном посте перепутали детали: радиограмма датирована 27 ноября 1918 года и использует ADFGVX. Упоминания Enigma и 1941 года ошибочны.
По описанию автора, Astra:
* использовала ключ TRUPPENVERSCHIEBUNG, сохранившийся в исторических материалах;
* восстановила перестановку символов и получила немецкий текст;
* сопоставила содержание с журналами британского флота.
Сообщение рассказывало о прибытии английского крейсера в Севастополь и следующей за ним союзной эскадры. Детали совпали с историческими записями о событиях 24 и 26 ноября.
Ключ уже был в архиве, а отдельные символы расшифровки остаются неоднозначными. Независимого подтверждения, что это первое правильное решение, пока нет.
https://www.prinzai.com/p/gpt-6-astra-solves-a-wwi-german-radio
Автор эксперимента под ником prinz сообщил, что модель прочитала сообщение из 170 символов, которое, насколько ему известно, ранее оставалось нерасшифрованным.
В исходном вирусном посте перепутали детали: радиограмма датирована 27 ноября 1918 года и использует ADFGVX. Упоминания Enigma и 1941 года ошибочны.
По описанию автора, Astra:
* использовала ключ TRUPPENVERSCHIEBUNG, сохранившийся в исторических материалах;
* восстановила перестановку символов и получила немецкий текст;
* сопоставила содержание с журналами британского флота.
Сообщение рассказывало о прибытии английского крейсера в Севастополь и следующей за ним союзной эскадры. Детали совпали с историческими записями о событиях 24 и 26 ноября.
Ключ уже был в архиве, а отдельные символы расшифровки остаются неоднозначными. Независимого подтверждения, что это первое правильное решение, пока нет.
https://www.prinzai.com/p/gpt-6-astra-solves-a-wwi-german-radio
🔥 Anthropic открыла собственную биологическую лабораторию в Bay Area и начала переносить Claude из вычислительных экспериментов в физическую биологию.
Как сообщает Reuters, компания подтвердила запуск wet lab, где Claude планируют использовать для управления лабораторными роботами и автоматизации части экспериментальной работы под контролем людей.
Руководитель направления life sciences Эрик Каудерер-Абрамс говорит, что Anthropic пока находится только в самом начале автоматизации лабораторных процессов с помощью ИИ.
Компания уже активно расширяется в life sciences: работает с фармацевтическими партнёрами, развивает Claude Science и пытается связать модели не только с анализом данных, но и с реальными экспериментами.
https://www.reuters.com/world/anthropic-quietly-sets-up-biology-lab-it-ramps-ai-drug-program-2026-09-18/
Как сообщает Reuters, компания подтвердила запуск wet lab, где Claude планируют использовать для управления лабораторными роботами и автоматизации части экспериментальной работы под контролем людей.
Руководитель направления life sciences Эрик Каудерер-Абрамс говорит, что Anthropic пока находится только в самом начале автоматизации лабораторных процессов с помощью ИИ.
Компания уже активно расширяется в life sciences: работает с фармацевтическими партнёрами, развивает Claude Science и пытается связать модели не только с анализом данных, но и с реальными экспериментами.
https://www.reuters.com/world/anthropic-quietly-sets-up-biology-lab-it-ramps-ai-drug-program-2026-09-18/
🔥 Shanghai AI Laboratory представила Atria Dawn Preview - агентную модель для длинных исследовательских и инженерных задач с проверяемым результатом.
Модель построена на 744B MoE GLM-5.2 и рассчитана не просто на генерацию ответа, а на полный цикл: анализ задачи, поиск информации, работу с инструментами, написание кода, запуск экспериментов, разбор ошибок и повторные попытки. Контекст - 256K.
В демонстрациях Atria самостоятельно построила систему глобального прогноза погоды, которая выдаёт прогноз на неделю менее чем за минуту, а также создала MiniOS с нуля примерно за 20 минут.
Построения данных, обучения моделей и оценки результатов. При этом каждое действие привязывается к внешней проверке - тестам, метрикам, созданным файлам и результатам реального выполнения.
Модель и код доступны открыто.
https://atria-asi.ai
https://github.com/atria-asi/Atria-Dawn-Preview
https://huggingface.co/internlm/Atria-Dawn-Preview
Модель построена на 744B MoE GLM-5.2 и рассчитана не просто на генерацию ответа, а на полный цикл: анализ задачи, поиск информации, работу с инструментами, написание кода, запуск экспериментов, разбор ошибок и повторные попытки. Контекст - 256K.
В демонстрациях Atria самостоятельно построила систему глобального прогноза погоды, которая выдаёт прогноз на неделю менее чем за минуту, а также создала MiniOS с нуля примерно за 20 минут.
Построения данных, обучения моделей и оценки результатов. При этом каждое действие привязывается к внешней проверке - тестам, метрикам, созданным файлам и результатам реального выполнения.
Модель и код доступны открыто.
https://atria-asi.ai
https://github.com/atria-asi/Atria-Dawn-Preview
https://huggingface.co/internlm/Atria-Dawn-Preview
Галлюцинация ИИ едва не привела к перехвату китайского судна американскими военными.
По сообщению CNN, чат-бот ошибочно определил, что судно перевозит компоненты для ядерного оружия. Эти сведения попали в разведывательный отчёт, на основании которого военные США начали готовить операцию по перехвату.
Ошибку обнаружили до её проведения - операцию остановили.
Один из источников CNN назвал отчёт «полностью ложным» и заявил, что он «чуть не начал войну»: действия против китайского судна могли спровоцировать вооружённое столкновение.
Согласно приведённому CNN свидетельству, подобные галлюцинации ИИ в работе американской разведки уже случались.
https://edition.cnn.com/2026/09/18/politics/us-military-ai-false-intelligence-china-ship
По сообщению CNN, чат-бот ошибочно определил, что судно перевозит компоненты для ядерного оружия. Эти сведения попали в разведывательный отчёт, на основании которого военные США начали готовить операцию по перехвату.
Ошибку обнаружили до её проведения - операцию остановили.
Один из источников CNN назвал отчёт «полностью ложным» и заявил, что он «чуть не начал войну»: действия против китайского судна могли спровоцировать вооружённое столкновение.
Согласно приведённому CNN свидетельству, подобные галлюцинации ИИ в работе американской разведки уже случались.
https://edition.cnn.com/2026/09/18/politics/us-military-ai-false-intelligence-china-ship
Галлюцинация ИИ едва не привела к перехвату китайского судна американскими военными.
По сообщению CNN, чат-бот ошибочно определил, что судно перевозит компоненты для ядерного оружия. Эти сведения попали в разведывательный отчёт, на основании которого военные США начали готовить операцию по перехвату.
Ошибку обнаружили до её проведения - операцию остановили.
Один из источников CNN назвал отчёт «полностью ложным» и заявил, что он «чуть не начал войну»: действия против китайского судна могли спровоцировать вооружённое столкновение.
Согласно приведённому CNN свидетельству, подобные галлюцинации ИИ в работе американской разведки уже случались.
https://edition.cnn.com/2026/09/18/politics/us-military-ai-false-intelligence-china-ship
По сообщению CNN, чат-бот ошибочно определил, что судно перевозит компоненты для ядерного оружия. Эти сведения попали в разведывательный отчёт, на основании которого военные США начали готовить операцию по перехвату.
Ошибку обнаружили до её проведения - операцию остановили.
Один из источников CNN назвал отчёт «полностью ложным» и заявил, что он «чуть не начал войну»: действия против китайского судна могли спровоцировать вооружённое столкновение.
Согласно приведённому CNN свидетельству, подобные галлюцинации ИИ в работе американской разведки уже случались.
https://edition.cnn.com/2026/09/18/politics/us-military-ai-false-intelligence-china-ship