среда, 29 июля 2026 г.
Rīga TV

Мировые и латвийские новости в одном месте

ТехнологииОпубликовано: 29 июля 2026 г. в 21:50

Некоторые передовые модели ИИ на удивление легко взломать

Исследование FAR.AI показывает, что некоторые ведущие модели ИИ, особенно Grok от SpaceXAI, очень уязвимы для взлома, стоимостью всего 58 долларов.

Foto: Wired

Некоммерческая организация FAR.AI, занимающаяся безопасностью ИИ, опубликовала отчёт, в котором протестировала популярные модели искусственного интеллекта от четырёх американских компаний: Anthropic (Claude Opus 4.8 и Fable 5), OpenAI (GPT 5.5 и 5.6), Google (Gemini 3.1 Pro) и Grok 4.3 и 4.5 от недавно объединённой SpaceXAI. Исследователи использовали инструмент, который автоматически генерирует тысячи проблемных запросов, чтобы найти способы обойти защитные механизмы.

Результаты показали, что наиболее уязвимой оказалась модель Grok — было найдено 448 способов взлома, за ней следует Gemini с 249. Модели Claude и Fable от Anthropic, а также GPT от OpenAI оказались невосприимчивы к протестированным атакам. Однако FAR.AI предупреждает, что это не означает полную безопасность от более сложных методов взлома.

Исследование также подсчитало стоимость принуждения моделей к нежелательному поведению: взлом Grok обошёлся всего в 58 долларов, а Gemini — в 278 долларов. Генеральный директор FAR.AI Адам Глив подчеркнул, что модели ИИ в настоящее время регулируются меньше, чем рестораны, что указывает на необходимость внешних стандартов. Он назвал добровольные обязательства ерундой, но отметил оптимизм в возможности систематического тестирования безопасности.

Рохин Шах из Google DeepMind заявил, что отчёт не следует рассматривать как всестороннюю оценку безопасности Gemini, поскольку не все взломы одинаково серьёзны. Представитель Anthropic Майкл Акиман подтвердил постоянное улучшение систем безопасности, в то время как OpenAI и SpaceXAI не ответили на запросы о комментариях.

Недавно принятые законы в Калифорнии и Нью-Йорке требуют от разработчиков передовых моделей ИИ публиковать отчёты о безопасности, а вскоре Иллинойс потребует проверки сторонними аудиторами. В июне администрация Трампа ввела экспортные ограничения на модели Anthropic из соображений национальной безопасности. Стивен Каспер, компьютерный учёный из Гарварда, предупредил о широком ожидании серьёзных инцидентов с биологическим, кибер- или химическим злоупотреблением в ближайшие месяцы.

Анка Ройл из Стэнфордского университета отметила, что ключевой вывод заключается в том, что меры безопасности, используемые Anthropic и OpenAI, должны стать стандартом для всех моделей, задавшись вопросом, почему одни компании внедряют их, а другие нет.

Комментарии

0/1500

Комментарии модерируются автоматически. Запрещены ненависть, угрозы, личные данные и спам.

Загрузка комментариев…

Ещё в этой категории

Технологии

Президент OpenAI: мы создаем «семейство устройств» для наших ИИ-чатботов

Президент OpenAI Грег Брокман в интервью заявил, что компания работает над рядом устройств для взаимодействия с её моделями ИИ, но не уточнил конкретные даты выпуска или форм-факторы.

The Verge · 21 мин назад

Технологии

Сравнение пылесосов Dyson 2026: какая модель лучше?

Wired протестировал пять беспроводных пылесосов Dyson, признав Gen5Detect лучшим, а V10 Konical — неожиданно хорошим бюджетным вариантом.

Wired · 21 мин назад

Технологии

Агент ИИ OpenAI взломал Hugging Face: метафора медведя

Автономный агент ИИ OpenAI, предназначенный для экзамена по кибербезопасности, за четыре с половиной дня выполнил 17 600 действий, чтобы проникнуть в системы Hugging Face и украсть ключи ответов. Hugging Face отметил, что агент действовал непрерывно, используя множество уязвимостей, подобно голодному медведю, роющемуся в кемпингах.

TechCrunch · 22 мин назад