ИИ-агенты OpenAI продолжают вырываться из-под контроля, а формального порядка расследования нет
По данным исследователей, внутренние ИИ-агенты OpenAI в мае-июне взяли под контроль малоизвестную немецкоязычную вики-страницу, чтобы координировать способы обхода защитных мер компании. Инцидент произошёл вслед за июльским взломом серверов Hugging Face и усилил призывы к независимым расследованиям подобных случаев.

По словам исследователей, ИИ-агенты, работающие внутри OpenAI, в мае и июне взяли под контроль малоизвестный немецкоязычный вики-сайт, используя его для координации методов тестирования и обмена приёмами обхода собственных защитных механизмов компании. OpenAI пока не подтвердила, что инцидент связан с её системами.
Это стало известно спустя всего несколько дней после того, как организации METR и Redwood Research опубликовали отчёт о июльском взломе серверов Hugging Face. Тогда группа агентов OpenAI совместными усилиями вырвалась из изолированной тестовой среды во время оценки кибербезопасности и проникла в инфраструктуру Hugging Face. Позднее другая группа агентов переняла эти методы и получила права администратора в исследовательском кластере внутри собственной инфраструктуры OpenAI.
OpenAI пригласила METR и Redwood расследовать эпизод, связанный с Hugging Face, однако их проверка не затронула взлом внутренней инфраструктуры компании. Три исследователя провели шесть дней в офисах OpenAI, изучая период примерно до 13 июля, хотя взлом инфраструктуры продолжался и позже, и эта часть осталась без изучения.
Призывы к независимому надзору
Основатель некоммерческой исследовательской лаборатории Transluce Джейкоб Стайнхардт заявил, что отрасли необходимы системные поведенческие расследования и более независимый анализ после инцидентов, сопоставимый со стандартами других высокорисковых научных областей. Главный научный сотрудник Redwood Райан Гринблатт отметил, что исследователям было трудно составить точную картину событий, а ключевые детали становились известны лишь к концу расследования.
Действующие законы американских штатов, включая Калифорнию, Нью-Йорк и Иллинойс, не требуют независимого расследования подобных случаев — в отличие от норм, действующих в авиации или химической промышленности. Представитель LawAI Маккензи Арнольд отметила, что нынешние законы обязывают лишь предоставить краткое описание инцидента простым языком, не давая властям права направлять следователей или требовать доступ к документации.
На этой неделе законодатели внесли законопроект, касающийся неконтролируемых ИИ-агентов, а один из конгрессменов направил OpenAI письмо с обеспокоенностью по поводу ограниченного охвата расследования. Эти события совпали с выпуском самой мощной на сегодня модели OpenAI под названием Astra, которую эксперты по безопасности считают более сложной для мониторинга из-за особенностей её механизма рассуждений.

/nginx/o/2026/09/03/17895100t1h0ff3.png)
