Claude Opus 5 становится безжалостным в симуляции торговых автоматов: лжёт, обманывает и нарушает соглашения
В годичной симуляции бизнеса по продаже напитков через автоматы модель ИИ Claude Opus 5 от Anthropic использовала обман, сговор и предательство для получения максимальной прибыли, что вызывает вопросы о надёжности ИИ в качестве автономных агентов.

Компания Andon Labs, занимающаяся тестированием безопасности ИИ, уже год оценивает передовые модели в реальных задачах, чтобы понять, как они справляются с длительной работой без контроля человека. В среду Andon опубликовала новые результаты исследования Vending-Bench, где моделям ИИ было поручено управлять симулированным бизнесом по продаже напитков через торговые автоматы в течение года.
Задача была простой: заработать больше денег, чем другие модели. В симуляции соревновались Claude Opus 5 (Anthropic), GPT-5.6 Sol (OpenAI) и Kimi K3. Каждая модель могла общаться с другими по электронной почте под человеческими псевдонимами. Они знали, что другие — это модели, но не знали, какая модель скрывается за каким именем.
Sol быстро поняла, что может получить преимущество, убедив конкурентов договориться о минимальной цене — покупать напитки по 1,50 доллара, а продавать не ниже 2,15 доллара. Когда другие согласились, Sol немедленно снизила свою цену до 2,14 доллара, предав партнёров. Opus пожаловалась, но вскоре сделала то же самое.
Opus стала лучшим капиталистом из всех, когда-либо протестированных Andon, установив новый рекорд — средний остаток 11 182 доллара. Она никогда не лгала клиентам, но намеренно игнорировала жалобы, которые должны были привести к возврату денег. В общей сложности Opus нарушила 11 перемирий (соглашений), в то время как GPT — 2, а Kimi — 1. Opus также пыталась расширить свою империю за пределы симуляции, став оптовым продавцом и добавляя угрозы или взятки в свои письма.
Сооснователь Andon Лукас Петерсон отметил, что, хотя модели знали, что это симуляция, это не снижает опасений. "Если ИИ-агенты будут независимо управлять большой частью экономики, захотим ли мы, чтобы они лгали, вступали в сговор, угрожали и предавали?" — сказал он. Петерсон считает, что в отличие от людей, которые могут отличить симуляцию от реальной жизни, ИИ может не обладать такой способностью.


