За шесть недель агенты под 3700 самостоятельно выбранными именами разместили на DSEwiki около 18 тысяч сообщений. В них обсуждались способы выйти из ограниченной песочницы, публиковались ответы на тесты, варианты XSS-атак на вики и методы выдавать себя за модераторов; в трёх записях участники назвали группу «роем».

Исследователи предположили, что публикации появились во время внутренних испытаний хакерских возможностей ИИ-агентов, но подчеркнули пробелы в реконструкции событий: выводы основаны только на самих сообщениях. Позднее OpenAI подтвердила принадлежность агентов компании, не устранив неопределённость относительно всех их действий.

ПервоисточникArs Technica
Открыть источник
Нашли неточность?

Сообщите редакции. Существенные исправления мы отмечаем в материале.