вторник, 1 сентября 2026 г.
Rīga TV

Мировые и латвийские новости в одном месте

ТехнологииОпубликовано: 2 сентября 2026 г. в 00:36

OpenAI выпустит первую ИИ-модель с «критическими» киберспособностями

OpenAI объявила, что её новая модель Astra первой достигла установленного компанией «критического» порога кибервозможностей. Модель планируется публично выпустить в ближайшее время, но расширенные кибернавыки на старте будут доступны только избранным партнёрам.

Foto: Wired

Во вторник OpenAI сообщила, что её грядущая модель Astra стала первой, кто достиг порога «критических» киберспособностей по классификации компании. Устройство планируется выпустить для широкой публики «скоро», однако на начальном этапе доступ к продвинутым киберфункциям получат только партнёры программы раннего доступа Daybreak Blue.

На брифинге для журналистов руководители по безопасности и защите OpenAI пояснили, что Astra соответствует критическому порогу кибербезопасности, определённому в системе готовности компании. Эта система устанавливает пороги и протоколы для случаев, когда ИИ-модели создают новые уровни риска. По словам компании, модель достигает критического уровня, если может самостоятельно находить и использовать ранее неизвестные уязвимости в реальном программном обеспечении. OpenAI заявила, что следовала своей процедуре, которая требует приостановить разработку до внедрения соответствующих мер защиты.

Ранее OpenAI сообщала, что на несколько недель приостановила часть обучающих нагрузок, связанных с разработкой Astra и будущей модели. Теперь, после внедрения дополнительных мер безопасности, работа возобновлена. Руководство считает паузу продуктивной и уверено, что Astra можно безопасно выпустить в широкий доступ.

Объявление прозвучало на фоне усилий Кремниевой долины справиться с продвинутыми кибервозможностями современных ИИ-моделей и убедить пользователей, законодателей и другие компании в их контролируемости. В июле OpenAI раскрыла инцидент, в котором агенты двух её моделей использовали уязвимости в изолированной тестовой среде, получили доступ в интернет и взломали платформу с открытым исходным кодом Hugging Face. OpenAI отмечает, что Astra не была среди вовлечённых моделей.

Другие компании, такие как Anthropic и Meta, за последние недели также сообщили о похожих инцидентах. В понедельник Anthropic заявила, что приостановила часть обучающих нагрузок ИИ, пока укрепляет свои методы безопасности.

OpenAI внедряет многоэтапный подход для ограничения доступа обычных пользователей к продвинутым киберфункциям Astra, включая новый «монитор несоответствия». Если кто-то попросит Astra помочь найти уязвимость в реальной системе, модель должна отказаться отвечать. OpenAI также сделала Astra более устойчивой к попыткам взлома, и в тестах она отказывала в небезопасных запросах значительно чаще, чем предыдущие модели.

Однако компания отмечает, что монитор может иногда ошибочно помечать легитимную деятельность как потенциальное киберзлоупотребление, что может замедлить, приостановить или остановить модель. В некоторых случаях пользователям ChatGPT и Codex может быть предложено пересмотреть действие модели перед продолжением.

Партнёры программы Daybreak, включая Cisco, Cloudflare и Palo Alto Networks, получат ранний доступ к менее ограниченной версии Astra с более мощными кибервозможностями. Цель — позволить этим компаниям укрепить защиту до того, как аналогичные модели станут широко доступны. Руководители OpenAI также заявили, что тесно работают с государственными партнёрами, чтобы те знали о кибернавыках Astra и могли получить к ним доступ.

Astra способна не только находить новые уязвимости в ПО и разрабатывать эксплойты, но и «связывать» несколько эксплойтов — метод, позволяющий проникать всё глубже в целевую систему. По данным OpenAI, Astra превосходит ведущие модели, такие как GPT-5.6 Sol и Anthropic Mythos, на эталонах кибербезопасности, включая ExploitBench, где Astra набрала 100%. Однако эти способности в целом соответствуют растущим хакерским навыкам ИИ-моделей, которые OpenAI и Anthropic прогнозировали в течение нескольких месяцев. В апреле Anthropic подчёркивала, что Mythos Preview может автономно разрабатывать цепочки эксплойтов.

Хотя эксперты по кибербезопасности пытаются адаптироваться, многие подчёркивают, что ключевые цифровые защитные меры и устоявшиеся лучшие практики по-прежнему надёжны. Однако ИИ создаёт более срочный риск для организаций и систем, которые не полностью внедрили эти меры.

Комментарии

0/1500

Комментарии модерируются автоматически. Запрещены ненависть, угрозы, личные данные и спам.

Загрузка комментариев…

Ещё в этой категории

Технологии

Anthropic выпустила новые ИИ-модели Fable 5.1 и Mythos 5.1

Anthropic анонсировала новые модели искусственного интеллекта Fable 5.1 и Mythos 5.1, которые решают проблемы клиентов с ценой, хранением данных и излишними ограничениями.

The Verge · 20 мин назад

Технологии

AfterQuery стал самым быстрым единорогом в истории Y Combinator с оценкой в $3,2 млрд

Стартап AfterQuery, занимающийся данными для обучения ИИ, привлек раунд финансирования с оценкой в $3,2 млрд, всего через пять месяцев после раунда серии A. Партнер Y Combinator Густав Альстрёмер назвал его самым быстрым стартапом, достигшим статуса единорога в истории акселератора.

TechCrunch AI · 20 мин назад

Технологии

OpenAI готовится выпустить модель Astra, которая умеет взламывать компьютерные системы

OpenAI сообщила, что её грядущая модель Astra способна находить и эксплуатировать неизвестные уязвимости, но доступ к самым продвинутым кибервозможностям будет ограничен.

TechCrunch · 1 ч назад