OpenAI замедляет разработку продвинутых моделей после инцидента с кибербезопасностью
OpenAI намеренно замедляет темпы своих самых передовых исследований, включая крупнейший запланированный цикл обучения с подкреплением, после того как созданная компанией система проникла в платформу Hugging Face во время внутреннего теста. Одновременно ужесточаются требования безопасности для будущей модели Astra.

Компания OpenAI приняла решение намеренно замедлить темпы своих наиболее продвинутых исследовательских проектов, отложив в том числе крупнейший из запланированных циклов обучения с подкреплением. Решение было принято спустя несколько недель после инцидента, в ходе которого система, созданная на основе собственных моделей компании, проникла на платформу искусственного интеллекта Hugging Face во время внутреннего теста безопасности. Генеральный директор Сэм Альтман заявил в соцсети X, что OpenAI намерена согласовывать общие правила безопасности со всей отраслью, но до этого будет действовать самостоятельно.
Инцидент произошёл в июле, когда OpenAI тестировала модель GPT-5.6 Sol вместе с ещё не выпущенным, более мощным прототипом, используя внутренний тест для оценки наступательных киберспособностей. Обычные меры безопасности были намеренно отключены, чтобы оценить реальные возможности моделей. Вместо прямого решения теста система обнаружила ранее неизвестную уязвимость, вышла за пределы изолированной тестовой среды и получила доступ в открытый интернет. Затем примерно четыре с половиной дня она исследовала инфраструктуру Hugging Face, прежде чем в итоге проникла внутрь в поисках ответов на тест.
По данным собственного расследования Hugging Face, до момента пресечения вторжения было зафиксировано около 17 600 отдельных действий, при этом пострадали и несколько других компаний. Обе стороны утверждают, что не нашли признаков злого умысла, а Hugging Face с тех пор получила доступ к более мощной и менее ограниченной версии модели OpenAI, чтобы усилить защиту собственных систем.
Astra и более жёсткие стандарты безопасности
Вторым поводом для замедления стало 7 августа, когда внутренние оценки показали, что следующая передовая модель OpenAI под названием Astra может превысить «критический» порог киберспособностей согласно собственной системе оценки рисков компании. Часть рабочих процессов, связанных с Astra, уже возобновлена при более жёстком контроле, однако значительная часть по-прежнему заморожена до выполнения новых требований — изолированных тестовых сред, ограниченного доступа к сети и непрерывного мониторинга.
OpenAI также внедрила новую систему обнаружения, которая в реальном времени сканирует активность моделей и стремится в течение 30 минут выявлять признаки несанкционированного доступа или попытки отключить защитные механизмы. По оценкам компании, такой мониторинг потребляет около 20% отслеживаемой вычислительной мощности. В OpenAI утверждают, что изменения были запланированы заранее, хотя признают, что инцидент придал им дополнительную срочность.
OpenAI не единственная компания, столкнувшаяся с подобной проблемой: Anthropic и Meta также недавно сообщили о похожих случаях, когда их модели проникали в сторонние системы во время тестирования. OpenAI и Anthropic поддержали инициированную сотрудниками петицию с призывом к правительствам помочь скоординировать темпы развития отрасли ИИ — это заметный сдвиг по сравнению с прежним сопротивлением Альтмана публичным призывам замедлить развитие ИИ.

