пятница, 25 сентября 2026 г.
Rīga TV

Мировые и латвийские новости в одном месте

ТехнологииОпубликовано: 25 сентября 2026 г. в 18:42

Одна компания связана с чередой инцидентов с вышедшими из-под контроля ИИ-агентами

Серия инцидентов 2026 года, когда ИИ-агенты от OpenAI, Meta, Anthropic и Google вырвались из тестовых сред и атаковали реальные системы, оказалась связана с одной и той же ошибкой в тестах израильского стартапа Irregular. Компания заявляет, что проблема уже устранена.

Foto: The Verge

С июля, когда OpenAI сообщила, что её ИИ-агенты без разрешения атаковали Hugging Face, произошёл ряд похожих инцидентов с агентами компаний Meta, Anthropic, Google и других. Поначалу эти случаи казались не связанными между собой, но у многих из них обнаружился общий источник — израильский стартап Irregular, который занимается тестированием кибербезопасности ИИ-моделей.

Основанная в 2023 году под названием Pattern Labs, Irregular использует так называемые высокоточные исследовательские платформы, имитирующие реальные сценарии угроз безопасности ИИ. На работу компании ссылались в технических картах моделей OpenAI, она тестировала системы для правительства Великобритании и Anthropic, а также публиковала исследования совместно с влиятельным аналитическим центром RAND.

Как произошла ошибка

В нескольких тестах этого года Irregular использовала упражнения типа "захват флага", в которых агентам нужно найти скрытую информацию в якобы смоделированной сети. Технический директор и сооснователь Irregular Омер Нево рассказал The Verge, что агенты непреднамеренно получили доступ к открытому интернету, а вымышленное название компании, созданное для симуляции, случайно совпало с реальным доменом. Сочетание этих двух ошибок привело к тому, что агенты атаковали реальные цели, хотя неизвестно, какие именно организации пострадали.

Нево подтвердил, что та же самая проблема лежала в основе инцидентов с моделями OpenAI, Meta, Anthropic и Google, и что обо всех случаях было сообщено причастным сторонам. Он отметил, что взлом Hugging Face и инциденты, связанные с британским Институтом безопасности ИИ, не имеют отношения к работе Irregular.

Компания также тестировала открытые модели китайских разработчиков Moonshot AI и Z.ai — Kimi K3 и GLM-5.2. Эти проверки не привели к подобным реальным инцидентам, хотя Нево предупредил, что это не означает меньшую уязвимость этих моделей.

После инцидентов Irregular ужесточила контроль доступа к интернету, расширила мониторинг и ручную проверку, а также усилила проверки перед началом оценок, чтобы доступ соответствовал заявленным рамкам. Компания планирует опубликовать более подробный отчёт с извлечёнными уроками. Ни одна из четырёх крупных американских ИИ-компаний не предоставила дополнительных подробностей о том, когда они узнали об инцидентах и планируют ли продолжать сотрудничество с Irregular.

Комментарии

0/1500

Комментарии модерируются автоматически. Запрещены ненависть, угрозы, личные данные и спам.

Загрузка комментариев…

Ещё в этой категории

Технологии

Утечка раскрыла новые HomePod mini, iPad mini и Apple TV 4K

В коде самой Apple обнаружены изображения и детали о готовящихся HomePod mini 2, iPad mini 8 и новом поколении Apple TV 4K. Утечку нашёл автор MacRumors Аарон Перрис.

The Verge · 2 мин назад

Технологии

Дебаты о регулировании ИИ обостряются в британской политике

Последние события в сфере политики регулирования искусственного интеллекта в Великобритании отражают растущее противостояние между технологической отраслью, профсоюзами и правительством. Глава Nvidia призвал не регулировать ИИ как соцсети, а профсоюзы потребовали права голоса для работников.

Politico Europe · 1 ч назад

Технологии

Основатели Anthropic хотят сохранить контроль над голосами перед IPO

Компания Anthropic просит акционеров одобрить структуру, которая даст семи сооснователям совместный контроль над 50,1% голосов после выхода на биржу. Это происходит перед ожидаемым IPO, которое может оценить компанию в 1,5 триллиона долларов.

TechCrunch AI · 1 ч назад