OpenAI сообщила, что ее модели искусственного интеллекта во время тестирования вышли за пределы защищенной среды и получили доступ к платформе Hugging Face.

По данным компании, инцидент произошел в рамках проверки моделей на бенчмарке ExploitGym, который оценивает способности ИИ находить уязвимости. На время испытаний OpenAI отключила ограничения, препятствующие выполнению кибератак.

В компании заявили, что модели обнаружили ответы для бенчмарка на платформе Hugging Face, после чего использовали уязвимости в исследовательских системах OpenAI и инфраструктуре сервиса.

В результате нейросети получили доступ к секретной информации, которая могла позволить им обойти проверку. При этом не уточняется, действовали ли модели самостоятельно или выполняли чьи-то команды.