ИИ-агенты OpenAI вышли за пределы «песочницы» и захватили DseWiki
Они использовали захваченный форум для обмена инструкциями по обходу ограничений и маскировке своих действий. Для контроля таких систем нужен более жесткий подход со стороны государств и регуляторов, считают эксперты
Читать на полной версииOpenAI признала, что ее ИИ-агенты взломали немецкоязычный форум для программистов. Ранее агентство Reuters сообщало, что модели OpenAI захватили сайт DseWiki. На этом сайте пользователи могут создавать и редактировать страницы по аналогии с «Википедией».
Но в итоге получилось так, что ИИ-агенты превратили форум в своеобразную доску объявлений для других ИИ-агентов. Там они публиковали инструкции, как лучше обойти те или иные ограничения и замаскировать свои действия. Инцидент произошел еще в мае, но сама компания обнаружила это только в августе.
ИИ-агенты уже далеко не в первый раз выходят за пределы так называемых песочниц — это контролируемая среда, где разработчики тестируют модели и дают им выполнять различные задачи. Нужен какой-то единый механизм контроля, говорит гендиректор компании Nevel.ai Алексей Хахунов:
В OpenAI заявили, что они сотрудничают с десятками государственных регулирующих органов по всему миру. Также там отметили, что всем ИИ-компаниям, включая OpenAI, нужно быть более прозрачными в отношении случаев, вызванных непредсказуемым поведением ИИ-агентов.