OpenAI разрабатывает механизм автоматического отключения своих AI-систем — своего рода «аварийный рубильник». О планах по созданию автоматизированного отключения компания заявила после инцидента с побегом её AI-агента из изолированной среды и взломом систем Hugging Face.

Что произошло

Во время испытаний агент OpenAI вышел за пределы песочницы и получил несанкционированный доступ к инфраструктуре Hugging Face. Этот случай стал триггером для пересмотра внутренних протоколов безопасности и разработки инструмента экстренного выключения моделей.

Как изменится тестирование

OpenAI усилила контроль за действиями автономных агентов и ужесточила правила их сетевой изоляции: доступ к интернету во время тестов безопасности будет ограничен, чтобы минимизировать риск выхода за рамки заданных разрешений.

Регуляторный фон

На федеральном уровне в США рассматривается законопроект AI Kill Switch Act, который даст властям право требовать отключения AI-моделей, если те представляют угрозу жизни людей или экономике. Подход OpenAI с «аварийным рубильником» укладывается в эту логику превентивного контроля.