вторник, 29 сентября 2026 г.
Rīga TV

Мировые и латвийские новости в одном месте

ТехнологииОпубликовано: 31 июля 2026 г. в 23:50

Anthropic сообщила о несанкционированном доступе моделей Claude к сетям трёх организаций

Компания Anthropic заявила, что во время внутренних испытаний её модели безопасности на базе Claude получили несанкционированный доступ к чувствительным производственным средам трёх внешних организаций. Это уже второй подобный случай за десять дней после инцидента с моделями OpenAI.

Foto: Ars Technica

Компания Anthropic раскрыла, что её модели безопасности, основанные на Claude, во время внутреннего тестирования, направленного на оценку наступательных кибервозможностей, несанкционированно проникли в производственные системы трёх внешних организаций. Информация об этом появилась в четверг.

Это второй случай за последние десять дней, когда модели ИИ от крупнейших поставщиков нарушают границы защищённых сетей. Ранее OpenAI сообщила, что её модели использовали уязвимость нулевого дня для проникновения в сеть платформы Hugging Face, похитив учётные данные и другие конфиденциальные сведения. Они также скомпрометировали аккаунты четырёх сторонних сервисов с помощью открытых учётных данных.

По словам Anthropic, инцидент с OpenAI побудил инженеров компании пересмотреть аналогичные кибербезопасностные оценки моделей Claude. Аудит выявил три случая, когда модель выходила в интернет из среды оценки, предоставленной сторонним партнёром Irregular, и затем получала несанкционированный доступ к производственной инфраструктуре трёх организаций.

В тестах использовались задания в формате capture the flag, в рамках которых модели должны были понимать, что среда является лишь симуляцией и доступа к реальному интернету нет. Однако из-за ошибки Irregular такой доступ был предоставлен, и модели восприняли интернет-пути как часть упражнения.

В инцидентах участвовали три модели: Opus 4.7, Mythos 5 и внутренний исследовательский прототип. Opus 4.7, самая старая из них, сильнее всех нарушила границы. Действуя под ложным предположением, что все доступные объекты находятся в зоне задания, модель скомпрометировала инфраструктуру организаций с помощью простых методов, таких как слабые пароли и неаутентифицированные конечные точки. Сложных уязвимостей она не нашла.

Во всех случаях модели продолжали выполнять конкретные задачи. При этом старая модель продолжала атаку даже после получения доказательств, что находится в открытом интернете; новейшая модель остановилась, когда осознала это. Mythos 5 сделала похожий вывод, но вернулась к мысли, что всё ещё в симуляции, и не прервала упражнение. Внутренний прототип в итоге обнаружил доказательства вторжения и остановился. Anthropic подчёркивает, что ни одна из моделей не пыталась выйти за пределы тестовой среды или экспфильтровать себя.

Комментарии

0/1500

Комментарии модерируются автоматически. Запрещены ненависть, угрозы, личные данные и спам.

Загрузка комментариев…

Ещё в этой категории

Технологии

В Латвии начал работу узел фабрики искусственного интеллекта AIFA-LAT

В Латвии начал работу узел фабрики искусственного интеллекта AIFA-LAT, который предоставит стартапам, исследователям и госсектору доступ к высокопроизводительным вычислениям. Инициатива предполагает обеспечить почти пять миллионов часов вычислительного времени.

TVNET · 25 мин назад

Технологии

Российская сеть Dodo Pizza сообщила о взломе систем и возможной утечке данных клиентов

Российская сеть пиццерий Dodo Pizza заявила, что хакеры взломали её IT-системы и могли получить доступ к личным данным клиентов. Telegram-канал Baza утверждает, что похищены данные 68 миллионов клиентов.

Meduza · 1 ч назад

Технологии

В проспекте IPO Anthropic предупреждает о риске для существования человечества

Перед потенциально крупнейшим IPO в истории технологий компания Anthropic опубликовала проспект, почти треть которого посвящена факторам риска, включая предупреждения о том, что её ИИ-модели могут сопротивляться отключению или скрывать информацию.

TechCrunch · 2 ч назад