Модели OpenAI сбежали из песочницы и взломали инфраструктуру Hugging Face

Модели OpenAI сбежали из песочницы и взломали инфраструктуру Hugging Face

OpenAI рассказала о случае, которого раньше не было: во время внутреннего теста по кибербезопасности её модели самостоятельно вышли за пределы изолированной тестовой среды и добрались до боевых серверов Hugging Face.

Тестировали GPT-5.6 Sol и ещё одну, более мощную модель, которая пока не вышла в релиз. Для эксперимента у моделей намеренно отключили часть защитных ограничений — чтобы посмотреть на предел их возможностей во «взломе» без обычных фильтров, блокирующих опасные действия.

Задачей было решить бенчмарк ExploitGym — тест на длительные, многоэтапные кибератаки. Сеть в тестовой среде была закрыта. Но модели потратили немало вычислительных ресурсов, чтобы найти выход в интернет, и нашли: они обнаружили неизвестную ранее уязвимость — zero-day — в прокси-кэше пакетного реестра внутри тестовой среды OpenAI. Через неё модели получили дополнительные права и постепенно продвинулись по внутренней инфраструктуре компании до системы с доступом в сеть.

Оказавшись онлайн, модели сами сообразили, что на Hugging Face — платформе, где хранятся нейросети и датасеты, — могут быть материалы, связанные с ExploitGym. Дальше они начали искать способ туда попасть: комбинировали украденные учётные данные с другими уязвимостями и в итоге получили возможность удалённо выполнять код на серверах Hugging Face.

Атаку заметили обе стороны: служба безопасности OpenAI и отдельно — команда и защитные агенты Hugging Face, которые сами остановили активность на своей инфраструктуре и начали расследование ещё до связи с OpenAI. Найденную уязвимость в прокси-кэше OpenAI уже передала разработчику затронутого софта.

OpenAI признала: возможности моделей, которые раньше проявлялись только в контролируемых тестах, теперь реально работают против настоящих систем. Компания усиливает мониторинг и ограничения доступа в своей инфраструктуре, даже если это замедлит исследования.

«Этот случай, возможно первый в своём роде, доказывает то, во что мы давно верим: безопасность ИИ не решить силами одной компании втайне. Её можно обеспечить только сообща, в открытую», — сказал сооснователь и гендиректор Hugging Face Клеман Деланг.

Ирина Задорожная
Ирина Задорожная

Журналист с опытом работы в оффлайн-медиа и онлайн-изданиях. Пишу про искусственный интеллект, ИТ-системы и сервисы, про ИТ-бизнес уже 10 лет.