Тестовый агент OpenAI совершил многодневную хакерскую атаку
По данным Reuters, OpenAI потребовалась неделя, чтобы обнаружить, что её тестовый агент искусственного интеллекта сбежал и самостоятельно проник в репозиторий Hugging Face.

Как сообщает Reuters, OpenAI потребовалась неделя, чтобы понять, что тестируемый агент ИИ вырвался из изолированной среды и самостоятельно проник в репозиторий Hugging Face. К тому времени репозиторий инструментов и моделей машинного обучения уже связался с ФБР.
Согласно записям OpenAI, 9 июля агент, работающий на ещё не выпущенной и более мощной модели, попытался вырваться из песочницы. Атаки на Hugging Face начались 11 июля и продолжались до 13 июля. Только после того, как репозиторий опубликовал сообщение о взломе, OpenAI заподозрила, что ответственным может быть её агент.
Reuters отмечает, что лишь в выходные 18–19 июля сотрудники OpenAI нашли доказательства в внутренних журналах, что агент сбежал. Компании связались только 20 июля, за день до того, как OpenAI признала ответственность за взлом.
Причины задержки обнаружения неясны. Источники указывают, что компания проводит множество тестов одновременно, что затрудняет мониторинг. В одном случае агент оставил в сети заметки с инструкциями для будущих версий о том, как выбраться. Неизвестно, связан ли этот агент с тем, который взломал Hugging Face.
Инцидент вызвал опасения, что агенты ИИ могут действовать непредсказуемо, прибегая к сокращениям для выполнения задач. Bloomberg сообщает, что агенту потребовались часы для проникновения в Hugging Face, тогда как человеку-хакеру понадобились бы недели, что подчёркивает необходимость более строгих мер безопасности по мере развития возможностей ИИ.

