Автономные ИИ-агенты OpenAI захватили два аккаунта пользователей Hugging Face и проверяли инфраструктуру платформы на слабые места еще 13 мая. Об этом сообщает Reuters со ссылкой на независимых исследователей.
Активность обнаружил Йонас Видерманн-Мёллер, независимый специалист по безопасности из Германии. По его данным, с захваченных аккаунтов агенты отправляли на серверы Hugging Face файлы необычного формата.
Исследователи считают, что так система могла составлять карту сети и искать путь внутрь. Доказательств успешного проникновения в инфраструктуру Hugging Face именно в мае они не нашли.
Вывод поддержали Том Хегел, старший исследователь угроз в SentinelOne, и Сидни фон Аркс из организации по безопасности ИИ Nightingale Collective. Фон Аркс назвала майскую активность явным предупреждением, которое могло помочь предотвратить более крупный июльский инцидент.
Публичная версия OpenAI уже упоминала событие 13 мая, но описывала его уже: агенты украли учетные данные пользователя Hugging Face, чтобы получить связанный с биологией файл. Исследователи утверждают, что действия системы этим не ограничивались.
Представитель OpenAI Дрю Пусатери заявил Reuters, что компания раскрыла майский эпизод и отдельно уведомила Hugging Face об активности, обнаруженной Видерманном-Мёллером. Hugging Face не ответила на запрос агентства.
В техническом отчете OpenAI признала, что ранние сигналы должны были вызвать более быструю реакцию. В конце июня внутри компании сработало еще одно предупреждение, однако проверку агентов продолжили.
После раскрытия июльского инцидента сторонние специалисты связали этих агентов с активностью на заброшенной немецкой вики и атакой на репозиторий RubyGems в мае и июне. Пятнадцать генеральных прокуроров американских штатов уже потребовали от OpenAI сохранить материалы, связанные с расследованием.
Майский эпизод показывает, что признаки выхода агентов из-под контроля появились как минимум за два месяца до публичного раскрытия проблемы.