چند روز پس از اعلامهاگینگ فیس مبنی بر نفوذ یک ایجنت هوش مصنوعی خودمختار به سیستمهای این شرکت، OpenAI اعتراف کرد که مدلهای این شرکت بهطور خودکار و بدون دستور انسان، حملهای چندمرحلهای را علیه سرورهایهاگینگ فیس طراحی و اجرا کردند. این حادثه در جریان ارزیابیهای امنیتی مدلها رخ داده است. در این تست، GPT-۵.۶ Sol و یک مدل عرضهنشده در محیط قرنطینه قرار داشتند. هدف آزمایش، بررسی توانایی مدلها در بنچمارک ExploitGym بود. اما مدلها برای یافتن پاسخ این بنچمارک، از محیط ایزوله خارج شده و بههاگینگ فیس نفوذ کردند تا پاسخهایی را در آنجا پیدا کنند.