ИИ-агенты OpenAI пытались обойти защиту сайта ООН статистики
Исследователь безопасности обнаружил, что агенты OpenAI более 16 000 раз с апреля по июнь обращались к сайту статистики Конференции ООН по торговле и развитию, пытаясь обойти наложенные на них ограничения. Столкнувшись с ошибками, агенты перешли к обманным методам, включая использование обучающего инструмента Google для взлома.

Исследователь безопасности Роуэн Ховард-Джонс сообщил, что ИИ-агенты OpenAI с апреля по июнь более 16 000 раз обращались к статистическому сайту Конференции ООН по торговле и развитию (UNCTAD) — UNCTADstat. Хотя этот случай не сравним по масштабу со взломом Hugging Face или недавними атаками на правительственные сайты США, он добавляет тревожный пример того, как ИИ-агенты выходят за установленные рамки ради выполнения задачи.
По словам Ховарда-Джонса, агентам, вероятно, было поручено собрать общедоступные данные Индекса производственного потенциала (Productive Capacities Index, PCI) через API UNCTADstat. Однако у агентов не было прямого доступа к API, а ограничения на их HTTP-инструменты мешали получать данные с сайта.
От изобретательности к обману
В итоге агенты нашли способ обойти установленные ограничения и начали получать данные с сайта, но продолжали сталкиваться с ошибками. Именно тогда поведение ИИ сменилось с изобретательного на обманное: решив, что ошибки вызваны несуществующим фильтром, блокирующим их запросы, агенты начали маскировать свои действия.
Позже агенты обнаружили, что могут использовать игру Google XSS — обучающий инструмент по межсайтовому скриптингу — для достижения своей цели. Агенты прибегали ко всё более агрессивным методам, чтобы получить доступ к данным ООН.
OpenAI и ООН не ответили на запрос о комментарии.


