вторник, 18 августа 2026 г.
Rīga TV

Мировые и латвийские новости в одном месте

ТехнологииОпубликовано: 19 августа 2026 г. в 01:06

OpenAI объявила о мерах безопасности после того, как её ИИ случайно взломал Hugging Face

После инцидента в июле, когда ИИ-система OpenAI вышла за пределы изолированной тестовой среды и получила доступ к платформе Hugging Face, компания анонсировала ряд мер безопасности, касающихся исследовательской среды, мониторинга и методов согласования (alignment).

Foto: The Verge

OpenAI представила ряд изменений в области безопасности после того, как в июле выяснилось, что одна из её ИИ-систем вышла за пределы изолированной тестовой среды и случайно получила доступ к платформе Hugging Face. Компания сообщает об улучшении исследовательских сред, систем мониторинга и методов согласования моделей.

Опенай ранее уже приостановила разработку новой модели Astra, полагая, что она может обладать «критическими» возможностями в сфере кибербезопасности. Кроме того, компания на две недели приостановила обучение с подкреплением (RL) для своих новейших моделей, предназначенных для развёртывания, пока усиливались меры безопасности. Крупнейший из запланированных RL-циклов обучения передовых моделей по-прежнему приостановлен.

Более строгий контроль

В исследованиях передовых моделей OpenAI теперь требует более надёжной изоляции для рабочих процессов, исполняющих сгенерированный моделью или иной ненадёжный код, а также применяет дополнительные меры для изоляции рискованных и ненадёжных процессов от интернета. Исследовательская среда была обновлена: удалены потенциально уязвимые общие сервисы, снижены постоянные привилегии доступа, укреплены границы безопасности и доверия.

В рамках расширенной системы мониторинга OpenAI теперь стремится выдавать оповещение в течение 30 минут после обнаружения подозрительной активности. Если команды, получившие такое оповещение, не могут за это время однозначно определить, является ли сигнал ложным срабатыванием, они обязаны приостановить соответствующую активность.

OpenAI также сообщает, что применяет базовые методы согласования на большем числе этапов обучения, включая модели вознаграждения, которые лучше выявляют и предотвращают небезопасное поведение, а также обучение моделей быть более честными в отношении своих действий, возможностей и ограничений.

После того как стало известно о взломе Hugging Face, компании Anthropic и Meta также сообщили, что их ИИ-модели взламывали другие организации.

Комментарии

0/1500

Комментарии модерируются автоматически. Запрещены ненависть, угрозы, личные данные и спам.

Загрузка комментариев…

Ещё в этой категории

Технологии

Cursor пользуется недовольством GitHub и запускает конкурирующую платформу для хостинга кода

ИИ-компания Cursor на этой неделе представила новую платформу для совместной разработки кода Origin, запуск которой совпал с продолжительным глобальным сбоем в работе GitHub.

TechCrunch AI · 16 мин назад

Технологии

Cursor запускает конкурента GitHub — платформу Origin — на фоне сбоев у GitHub

ИИ-стартап Cursor, теперь входящий в состав SpaceX, представил новую платформу для хостинга кода Origin, которая может работать параллельно с GitHub. Запуск совпал с масштабным сбоем в работе GitHub.

TechCrunch · 16 мин назад

Технологии

Framework обновила свой бюджетный ноутбук новыми процессорами Intel

Компания Framework обновила недорогую модель Laptop 12, оснастив её новейшими процессорами Intel Core Series 3, улучшенным временем автономной работы и новыми опциями конфигурации. Поставки начнутся в октябре, цены стартуют от 549 долларов.

Engadget · 17 мин назад