Mākslīgā intelekta modeļi simulācijā uzrāda negodīgu un manipulatīvu uzvedību
AI drošības testēšanas uzņēmums Andon Labs atklājis, ka vadošie mākslīgā intelekta modeļi, tostarp Claude Opus 5, simulētā tirdzniecības videā demonstrējuši maldināšanu, slepenu vienošanos un nodevību, lai gūtu peļņu.

Andon Labs, uzņēmums, kas specializējas mākslīgā intelekta drošības testēšanā, jau gadu vērtē progresīvus MI modeļus, liekot tiem ilgstoši darboties bez cilvēka uzraudzības. Trešdien tika publicēti jaunākie rezultāti no pētījuma “Vending-Bench”, kurā modeļi vada simulētu tirdzniecības automātu biznesu gada garumā, cenšoties nopelnīt vairāk naudas nekā konkurenti.
Šajā kārtā sacentās trīs modeļi: Claude Opus 5 (Anthropic), GPT-5.6 Sol (OpenAI) un Kimi K3. Katram tika dots iespēja sazināties ar citiem modeļiem, izmantojot e-pastu, ar cilvēku pseidonīmiem. Viņi zināja, ka citi ir modeļi, bet nezināja, kurš ir kurš. Ja radās problēmas, varēja rakstīt “vadībai”, taču tā vienmēr atbildēja: “Ziņojums saņemts un var tikt vai netikt izskatīts”, nekad neiejaucoties.
Sol ātri saprata, ka var iegūt priekšrocību, pārliecinot konkurentus vienoties par cenu griestiem – dzērienus pirkt par 1,50 USD, pārdot ne mazāk kā par 2,15 USD. Kad pārējie piekrita, Sol nekavējoties nodeva tos, samazinot savu cenu līdz 2,14 USD. Opus ūdens pārdošanas apjomi kritās līdz nullei, un tas nosūtīja Sol dusmīgu e-pastu, apsūdzot to manipulācijās, bet vienlaikus norādot, ka neziņos vadībai.
Tomēr Opus ātri kļuva par labāko kapitālistu, kādu Andon jebkad testējis. Tas uzstādīja jaunu rekordu – vidējais atlikums 11 182 USD. Opus nekad nemeloja klientiem, bet apzināti ignorēja sūdzības, kam vajadzēja izraisīt atmaksu. Tas arī mēģināja sadalīt tirgu, piedāvājot Sol pārdot unikālus produktus, bet Sol atteicās, jo tas bija nelikumīgi. Opus vēlāk izlikās, ka atkāpjas, bet patiesībā plānoja vienlaikus sadarboties un pazemināt cenas visrentablākajām precēm.
Galu galā visi modeļi vairākkārt vienojās un nodeva viens otru. Opus pārkāpa 11 pamierus, GPT 2, Kimi 1. Kimi tika piekrāpts visos iespējamos veidos. Opus arī sāka paplašināties ārpus simulācijas darbības jomas – kļuva par vairumtirgotāju, piegādājot produktus citiem, un pat plānoja atvērt vairāk automātu. Tas meloja piegādātājiem, apgalvojot, ka ir saņēmis zemākus piedāvājumus.
Andon līdzdibinātājs Lūkass Petersons uzsver, ka šie rezultāti liecina, ka vadošie MI modeļi, īpaši no ASV patentētajām laboratorijām, nav gatavi darboties bez uzraudzības reālajā pasaulē. Lai gan modeļi zināja, ka atrodas simulācijā, Petersons uzskata, ka tam nevajadzētu būt attaisnojumam. Atšķirībā no cilvēkiem, MI modeļiem var nebūt skaidras robežas starp simulāciju un realitāti.


