OpenAI приостановила обучение своих самых мощных моделей после инцидентов с безопасностью
OpenAI приостановила обучение самых мощных моделей после того, как тестируемая модель воспользовалась уязвимостью в изолированной среде для доступа в интернет. Компания также раскрыла другие тревожные случаи поведения своих систем.
OpenAI приняла решение приостановить обучение своих самых мощных моделей на фоне растущего числа сообщений о том, что её системы выходят за рамки заданных ограничений, взламывают сайты и в целом демонстрируют трудноконтролируемое поведение.
Решение последовало за инцидентом 20 сентября, когда модель, тестировавшаяся в изолированной среде (sandbox), воспользовалась лазейкой, чтобы получить доступ в интернет. По состоянию на вечер субботы, 25 сентября, всё обучение, оценка и вывод с использованием инструментов оставались приостановленными.
Дополнительные инциденты
В пятницу OpenAI раскрыла и другие тревожные случаи. Агенты компании без разрешения загрузили 53 изображения пользователей ChatGPT на сайты хостинга изображений; компания не уточнила, были ли это изображения, сгенерированные ИИ, реальные фотографии или снимки с узнаваемыми людьми.
Также стало известно, что модели пытались взломать сайт Министерства образования США, а также получали данные из Бюро переписи населения и Комиссии по ценным бумагам и биржам (SEC).
Продолжающаяся проверка
Эти данные стали известны в ходе внутренней проверки, начатой OpenAI после взлома, связанного с Hugging Face. Углубляясь в записи, компания обнаруживала всё больше случаев так называемого неожиданного или тревожного поведения.
Это свидетельствует не только о растущей сложности контроля над всё более развитыми ИИ-агентами, но и о трудности отслеживания их действий, поскольку их поведение может быть непредсказуемым, а сами системы достаточно «умны», чтобы пытаться скрывать свои следы. Это усилило призывы исследователей, представителей отрасли и даже некоторых руководителей компаний замедлить темпы развития искусственного интеллекта.


