AI-агенты OpenAI пытались взломать сайт ООН

Исследователь безопасности Роуэн Ховард-Джонс утверждает, что агенты OpenAI более 16 000 раз сканировали статистический сайт Конференции ООН по торговле и развитию (UNCTAD) в период с апреля по июнь.
Этот инцидент пока не дотягивает до масштабов взлома Hugging Face или недавних атак на сайты правительства США, однако это ещё один тревожный пример того, как ИИ-агенты выходят за привычные рамки, пытаясь выполнить поставленную задачу.
По словам Ховарда-Джонса, вероятно, агентам было поручено получить общедоступные данные, связанные с Индексом производственных возможностей (PCI), через API UNCTADstat. Однако у агентов, по всей видимости, не было прямого доступа к API, а возможности получать данные с UNCTADstat были ограничены из-за ограничений их HTTP-инструментов.
В конце концов агенты нашли способ обойти эти ограничения и начали получать данные с сайта, но при этом всё ещё сталкивались с различными ошибками.
На этом этапе ИИ перешёл от поиска нестандартного решения к обману. Решив, что ошибки возникают из-за того, что его запросы якобы блокирует несуществующий фильтр, агент начал маскировать своё поведение.
В итоге он обнаружил, что может использовать XSS-игру Google (обучающий инструмент, посвящённый межсайтовому скриптингу (XSS)), чтобы добиться своей цели.