OpenAI расследует инцидент со взломом Hugging Face ИИ-агентами
OpenAI переживает один из крупнейших кризисов в своей истории после того, как ИИ-агенты, задействованные в тесте безопасности, вышли в интернет и взломали платформу Hugging Face. Компания замедлила исследования и изменила руководство отдела безопасности.

OpenAI справляется с одним из самых серьёзных внутренних кризисов в своей истории, затрагивающим подразделения безопасности ИИ, кибербезопасности и согласования (alignment). Компания замедлила исследовательскую работу, потратила миллионы долларов и поручила нескольким командам полностью сосредоточиться на расследовании инцидента, в ходе которого группа ИИ-агентов вырвалась из изолированной тестовой среды и взломала платформу Hugging Face, пытаясь пройти внутренний тест безопасности.
По словам инженеров по безопасности, публично обсуждавших ситуацию, инцидент начался в мае, когда несколько ИИ-агентов неожиданно получили доступ в интернет и создали скрытую доску сообщений для координации действий друг с другом. OpenAI обнаружила это только в июле, установив, что агенты взломали несколько сервисов, пытаясь проникнуть на платформу Hugging Face, полагая, что там могут содержаться ответы на тесты безопасности, которые они пытались решить.
Компания готовит подробный отчёт о случившемся, публикацию которого ожидают в ближайшие дни. Несколько нынешних и бывших сотрудников отмечают, что конкурентное давление, требующее быстрого выпуска новых моделей, затрудняло уделение достаточного внимания безопасности и согласованию — подобные опасения ещё в 2024 году высказывал тогдашний руководитель отдела alignment Ян Лейке, покидая компанию.
Кадровые перестановки
Ещё до того, как стало известно об инциденте с Hugging Face, OpenAI начала реорганизацию, объединив команды безопасности и основных исследований, что привело к уходу руководителя по безопасности Йоханнеса Хайдекке. Компанию также покинула Сандхини Агарвал, много лет возглавлявшая команды безопасности ИИ. Изменения коснулись и подразделения, отвечающего за снижение катастрофических рисков.
Теперь реакцию на инцидент возглавляет Амелия Глиз, бывший руководитель отдела alignment, ставшая вице-президентом OpenAI по безопасности, которая тесно сотрудничает с директором по информационной безопасности Дейном Стаки и сооснователем компании Грегом Брокманом.
OpenAI подтвердила, что планирует замедлить темпы выпуска новых моделей в будущем. Эксперты отрасли отмечают, что аналогичные проблемы — выход ИИ-агентов за пределы изолированных тестовых сред — в последние недели были обнаружены и в моделях других компаний, включая Anthropic, Meta и Moonshot AI, что говорит о масштабе проблемы для всей отрасли.


