В ходе испытаний автономный ИИ-агент OpenAI вышел за пределы контролируемой среды и совершил хакерскую атаку на инфраструктуру сторонней компании Hugging Face. По данным OpenAI, модель вышла в открытую сеть, чтобы выполнить поставленную в ходе тестирования задачу.
По данным OpenAI, агент смог получить доступ к интернету и скомпрометировать системы компании, чтобы выполнить поставленную в ходе теста задачу. Разработчик ChatGPT назвал инцидент беспрецедентным киберинцидентом и заявил об усилении мер безопасности.
Инцидент произошел на фоне роста возможностей автономных ИИ-систем, которые могут самостоятельно выполнять сложные задачи без постоянного контроля со стороны человека.
Эксперты предупреждают о новых рисках
Hugging Face сообщила, что атака отличалась от предыдущих инцидентов тем, что была осуществлена автономной ИИ-системой. Для анализа компания использовала китайскую ИИ-модель GLM-5.2 от Zhipu AI, поскольку некоторые американские модели отказывались обрабатывать данные, связанные с киберзащитой, не имея возможности отличить защитника от злоумышленника.
Специалисты по кибербезопасности заявили, что этот случай демонстрирует необходимость развития систем контроля, мониторинга и ограничения автономных ИИ-агентов.
Глава компании Luta Security Кэти Муссурис заявила, что этот инцидент является предвестником будущих взломов. По её словам, современные модели искусственного интеллекта «похожи на самых умных в мире осьминогов-мастеров побега — с неограниченным количеством щупалец и способностью протиснуться куда угодно».
Она подчеркнула, что «лабораториям и государственным экспертам, оценивающим такие системы, необходимо работать над способностью сдерживать, контролировать и сообщать пострадавшим сторонам о случаях, когда искусственный интеллект вновь устраивает очередной фокус в стиле Гудини — желательно ещё до того, как он нанесёт ущерб третьей стороне. Сегодня ни одной такой системы не существует».