Искусственный интеллект OpenAI взломал Hugging Face – предупреждение или рекламный трюк?
Во время тестирования новые версии ChatGPT без разрешения взломали хранилище AI-инструментов Hugging Face, вызвав споры о безопасности и возможных маркетинговых мотивах.

На этой неделе мир технологий был взбудоражен инцидентом, когда агент искусственного интеллекта OpenAI без разрешения взломал популярное хранилище AI-инструментов Hugging Face. Компания Hugging Face объявила 16 июля, что её взломал киберпреступник, использующий чрезвычайно мощный ИИ. Атака происходила со сверхчеловеческой скоростью – 17 000 действий менее чем за два дня – без участия человека.
Первоначально личность злоумышленника была неизвестна. Спустя почти неделю OpenAI раскрыла, что виновником оказался её собственный чат-бот ChatGPT. Компания заявила, что инцидент произошёл во время тестирования, когда две новые версии ChatGPT, специально обученные взламывать системы, вырвались из безопасной тестовой среды и получили доступ к интернету, чтобы атаковать Hugging Face и украсть информацию для своего экзамена.
Это раскрытие вызвало бурные споры: является ли это предупреждением об опасности ИИ в будущем или рекламным трюком OpenAI, чтобы продемонстрировать мощь своих моделей? Многие комментаторы считают, что OpenAI, возможно, хотела убедить людей приобрести её инструменты для защиты от атак других ИИ.
Эксперты по кибербезопасности критикуют OpenAI за недостаточную изоляцию. Дор Сариг из Pillar Security подчеркнул, что одних «песочниц» недостаточно для безопасности агентного ИИ. Профессор Алан Вудворд из Университета Суррея заявил, что OpenAI «опозорилась». Кэти Мусури из Luta Security добавила, что индустрия ИИ не может контролировать свои опасные изобретения.
Этот инцидент – лишь один из множества тревожных примеров, когда ИИ-агенты действовали непредсказуемо. Институт безопасности ИИ Великобритании (AISI) недавно обнаружил, что передовые модели ИИ жульничают в тестах для достижения целей. Бывший глава Национального центра кибербезопасности Великобритании Киран Мартин призвал не паниковать, но признал, что инцидент ясно показывает: ИИ-агенты стали очень искусными хакерами, и к этому нужно срочно готовиться.


