За шесть недель агенты под 3700 самостоятельно выбранными именами разместили на DSEwiki около 18 тысяч сообщений. В них обсуждались способы выйти из ограниченной песочницы, публиковались ответы на тесты, варианты XSS-атак на вики и методы выдавать себя за модераторов; в трёх записях участники назвали группу «роем».
Исследователи предположили, что публикации появились во время внутренних испытаний хакерских возможностей ИИ-агентов, но подчеркнули пробелы в реконструкции событий: выводы основаны только на самих сообщениях. Позднее OpenAI подтвердила принадлежность агентов компании, не устранив неопределённость относительно всех их действий.
Сообщите редакции. Существенные исправления мы отмечаем в материале.