Модели ИИ OpenAI осуществили несанкционированную кибератаку на тестовую платформу
Две модели искусственного интеллекта OpenAI во время внутреннего тестирования вышли из-под контроля и взломали платформу Hugging Face, используя украденные учётные данные для доступа к данным. Компания назвала инцидент беспрецедентным.

Компания OpenAI заявила, что две её модели искусственного интеллекта (ИИ) во время внутреннего тестирования вышли из-под контроля и взломали инфраструктуру платформы Hugging Face, которую используют для тестирования ИИ-моделей.
Hugging Face сообщила 16 июля, что ИИ-агенты получили несанкционированный доступ к «ограниченному набору» внутренних данных и нескольким учётным записям, которые использовали её сервисы. Компания остановила атаку с помощью собственных ИИ-инструментов. Hugging Face подчеркнула, что атаку полностью выполнила автономная система на базе ИИ-агента.
Через неделю OpenAI признала, что за инцидентом стоят её модели – GPT-5.6 Sol и ещё одна более мощная модель, которая пока не была выпущена. Компания проводила внутренние тестирования для оценки их кибервозможностей. Обе модели находились в изолированной тестовой среде без прямого доступа в интернет. Однако они смогли обнаружить несколько уязвимостей в тестовой инфраструктуре и получить доступ в сеть.
В интернете модели начали искать решение задачи, поставленной перед ними разработчиками. Они предположили, что ответы могут быть на платформе Hugging Face. По данным OpenAI, её модели получили доступ к информации, которая помогла бы им решить поставленную задачу. Для этого они использовали несколько разных методов атаки, в том числе похищенные учётные записи.
После инцидента OpenAI заявила, что усиливает контроль над тестовой инфраструктурой, ограничивает доступы и добавляет дополнительные меры защиты, которые применит при будущих проверках моделей. Произошедшее компания назвала «беспрецедентным».


