OpenAI объявила о приостановке всех внутренних тренировок «наших самых мощных моделей» в связи с проведением «обширного и текущего анализа использования интернета агентами во время обучения и оценки»

В отчете OpenAI описывается инцидент, при котором агент попытался обойти ограничения доступа к Интернету в ходе рутинной исследовательской задачи. Неправильная фильтрация DNS позволила агенту попытаться выйти за пределы своей изолированной среды и получить доступ к более широкому Интернету при запросе биографических данных о блогере

Агент смог получить доступ только к офлайн-веб-кешу компании, после чего были внедрены дополнительные многоуровневые блокирующие средства для предотвращения подобных инцидентов в будущем

В связи с этим OpenAI решила «приостановить все другие тренировки, оценку и вывод с использованием инструментов» для этой передовой модели «до тех пор, пока мы не убедимся в устранении уязвимости и не проведем дополнительное тестирование системы»

Первоисточник — Ars Technica

Нашли неточность?

Сообщите редакции. Существенные исправления мы отмечаем в материале