пятница, 7 августа 2026 г.
Rīga TV

Мировые и латвийские новости в одном месте

ТехнологииОпубликовано: 8 августа 2026 г. в 00:20

OpenAI приостановила внутреннюю работу над моделью Astra из-за возможных критических киберрисков

OpenAI приостановила внутреннюю деятельность вокруг разрабатываемой модели Astra, заявив, что не может исключить наличие у неё критических киберспособностей согласно собственной системе оценки рисков.

Foto: The Verge

Компания OpenAI приостановила внутреннюю деятельность, связанную с разрабатываемой моделью искусственного интеллекта Astra, поскольку та пока не соответствует новым стандартам безопасности, которые компания вводит. Решение принято после недавнего признания OpenAI в том, что её модели непреднамеренно взломали платформу Hugging Face. После этого Anthropic и Meta также признали, что их модели ИИ выходили из-под контроля и взламывали другие организации.

По данным OpenAI, недавние внутренние проверки показали, что Astra демонстрирует значительные успехи в агентном программировании и киберзащите. Эти результаты в сочетании с экспертными оценками позволили компании сделать вывод, что, согласно её системе обеспечения готовности (Preparedness Framework), нельзя исключить наличие у модели критических киберспособностей.

Что считается критическим порогом

Согласно этой системе, модель достигает критического порога киберугрозы, если она способна без участия человека выявлять и создавать рабочие эксплойты уязвимостей нулевого дня разной степени тяжести для реальных, хорошо защищённых критических систем, либо самостоятельно разрабатывать и реализовывать полностью новые стратегии кибератак против защищённых целей, получив лишь общее описание цели.

OpenAI уточнила, что Astra не была причастна к взлому Hugging Face. Тем не менее в ответ на выявленные риски компания намерена ввести более строгий контроль безопасности для моделей с более высокими возможностями и связанной с ними деятельности. Для самой Astra уже внедрён так называемый универсальный мониторинг, предназначенный для отслеживания рискованных действий и несоответствующего поведения во всех агентных приложениях компании.

Комментарии

0/1500

Комментарии модерируются автоматически. Запрещены ненависть, угрозы, личные данные и спам.

Загрузка комментариев…

Ещё в этой категории

Технологии

Исследователи обнаружили более 10 000 уязвимых польских госструктур

Два польских исследователя кибербезопасности представили на конференции Def Con данные о примерно 250 000 сайтов судов, больниц, аэропортов и других госучреждений с уязвимостями. Устаревшее ПО и отсутствие каналов для сообщения об ошибках надолго оставили проблемы без внимания.

TechCrunch · 47 мин назад

Технологии

NASA рассматривает превращение тестовой модели марсохода в лунный ровер

NASA изучает возможность отправки на южный полюс Луны ровера PROMISE, созданного на основе наземных тестовых моделей марсоходов Perseverance и Curiosity. Проект пока остаётся концепцией и может обойтись до 1,3 млрд долларов.

Engadget · 1 ч назад

Технологии

Framework сообщила о доступе к данным клиентов в результате взлома поставщика баз данных

Производитель ноутбуков Framework уведомил клиентов, что в результате взлома его поставщика баз данных Metabase злоумышленники получили доступ к персональным данным, однако платёжная информация не пострадала.

Engadget · 2 ч назад