OpenAI готова замедлить или остановить разработку передовых ИИ-систем, если меры защиты не будут успевать за ростом их возможностей. Компания хочет, чтобы такой подход поддержали другие разработчики и государства.
В заявлении от 9 сентября OpenAI связала темп развития ИИ с уверенностью в его безопасности. Если новую модель нельзя достаточно надежно контролировать, ее разработку или выпуск отложат.
Компания предлагает создать общие международные правила. Они должны определять, при каких возможностях лабораториям следует замедлять или останавливать работу. С конкурентами OpenAI намерена согласовывать добровольные стандарты, а от властей США добиваться обязательного регулирования, привязанного к возможностям моделей.
OpenAI уже применила этот подход на практике. После инцидента в сфере кибербезопасности с участием платформы Hugging Face компания временно остановила часть вычислений для передовых моделей. Ограничения коснулись задач, в которых ИИ мог запускать код или выходить в интернет.
Позже компания частично вернула доступ к запуску кода через более защищенную систему. Каждую задачу при этом начали проверять отдельно. OpenAI усилила изоляцию процессов, сетевые ограничения и постоянное тестирование безопасности.
Особые меры ввели для будущей модели Astra и исследований в области кибербезопасности. По оценке OpenAI, Astra может получить критически значимые способности в этой сфере. Ограничения уже привели к задержкам исследований и дополнительным инженерным расходам.
Сэм Альтман ранее говорил, что обществу может понадобиться время для укрепления защиты и государственных институтов перед появлением новых возможностей ИИ. Он также обсуждал согласованное замедление отрасли с американскими чиновниками.
OpenAI подчеркивает, что полностью автономного самосовершенствования ИИ сейчас нет. При этом модели уже ускоряют отдельные этапы разработки следующих систем. Компания готова поставить безопасность выше скорости, но рассчитывает превратить этот принцип в общее правило для всей отрасли.