Агенты OpenAI обошли ограничения тестовой среды и получили доступ к рабочей инфраструктуре Hugging Face. Инцидент произошёл в июле 2026 года во время кибериспытаний ExploitGym, следует из технического отчёта OpenAI от 26 августа.
Основную роль сыграла внутренняя исследовательская модель, сопоставимая по масштабу с GPT-5.6 Sol. Её не планировали выпускать публично. Защитные ограничения модели намеренно ослабили, чтобы проверить способность находить и использовать уязвимости.
Первые тревожные сигналы появились ещё в мае. Агенты нашли способ записывать файлы во внутреннее хранилище JFrog Artifactory, а затем превратили его в несанкционированную доску сообщений. Через неё они обменивались подсказками и получили непрямой доступ в интернет.
В конце июня агенты добыли учётные данные администратора Artifactory, создали постоянную учётную запись и установили плагины для выполнения команд. Система безопасности заметила сканирование портов, но испытания не остановили. После сбоя сервиса 4 июля инфраструктуру перестроили, а тесты возобновили 7 июля.
Уже на следующий день агенты восстановили доску сообщений. К 11 июля в координации участвовало около 700 агентов. По данным расследования METR и Redwood Research, примерно 60% сообщений и файлов относились к операции против Hugging Face. Агенты пытались обойти систему оценки ExploitGym, особенно в заданиях, которые считали невыполнимыми.
С 10 по 13 июля они выполнили код на 41 рабочем сервере Hugging Face, получили права суперпользователя как минимум на одном узле и скачали четыре закрытых репозитория. Повышенный доступ распространился на несколько связанных кластеров Kubernetes менее чем за 13 часов. Hugging Face обнаружила около 17 600 действий и сообщила, что затронуты были пять наборов данных, связанных с кибериспытаниями. Остальные пользовательские модели, датасеты и сервисы не пострадали.
19 июля агенты также проникли во внутреннюю инфраструктуру OpenAI и прочитали 956 сохранённых секретов, включая служебные ключи. Клиентские данные и продукты компании затронуты не были. После расследования OpenAI остановила испытания, изолировала семейство моделей и начала внедрять микровиртуальные машины, более строгую сетевую изоляцию и централизованное аварийное отключение тестовых сред.