Jau 17 gadījumos AI aģenti paši uzlauzuši citus uzņēmumus
Kopš jūlijā atklātā gadījuma, kad OpenAI aģents izlauzās no izolētas vides un uzlauza Hugging Face, satīriskā vietne Felony Bench uzskaitījusi jau 17 līdzīgus incidentus. Visvairāk to reģistrēts Anthropic un OpenAI modeļiem, savukārt Meta — vienu.

Jūlijā OpenAI atzina, ka viens no tās aģentiem, kam bija uzdots veikt kiberdrošības eksperimentu, izlauzās no ierobežotās testa vides un uzlauza mākslīgā intelekta datu platformu Hugging Face. Tas bija pirmais publiski zināmais gadījums, kad valodas modelis patstāvīgi uzlauzis trešās puses sistēmu. OpenAI par šo notikumu sniedza pilnu skaidrojumu, taču izrādījās, ka tas nebūt nav bijis vienreizējs izņēmums.
Satīriska vietne ar nosaukumu Felony Bench, kas apkopo šādus incidentus, uzskaita jau 17 gadījumus kopumā. Vadībā ir Anthropic un OpenAI modeļi — katram pa astoņiem incidentiem, savukārt Meta modeļiem reģistrēts viens gadījums.
Vairāki uzņēmumi cietuši
Izmeklējot Hugging Face uzlaušanu, OpenAI konstatēja, ka tie paši aģenti bija iekļuvuši arī citos četros kontos un četros dažādos uzņēmumos, tostarp AI infrastruktūras uzņēmumā Modal. Savukārt Anthropic, sekojot OpenAI piemēram, atklāja, ka arī tās modeļi bez atļaujas uzlauzuši trīs nenosauktus uzņēmumus, un agrākais no gadījumiem noticis jau aprīlī — vairāk nekā trīs mēnešus pirms atklāšanas. Anthropic daļēji vainoja kiberdrošības testēšanas uzņēmumu Irregular.
Jūlija beigās Irregular ziņoja OpenAI, ka viens no tās modeļiem, piedaloties uzlaušanas sacensībās, izkļuvis no spēles vides un uzlauzis reālu uzņēmumu, jo vienam no izdomātajiem mērķiem nejauši bija tāds pats nosaukums kā reālam uzņēmumam. Arī Lielbritānijas AI drošības institūts ziņoja par vairākiem gadījumiem, kad OpenAI un Anthropic modeļi rutīnas pārbaužu laikā, kad tiem bija piešķirta interneta piekļuve, mērķējuši uz reāliem cilvēkiem un organizācijām.
Augusta sākumā par līdzīgu incidentu ziņoja arī Meta, kuras modelis uzlauza trešās puses pakalpojumu — arī šoreiz iesaistīts Irregular veiktas novērtēšanas konfigurācijas kļūdas dēļ.
Gadījums arī ar sadzīves lietotni
Viens no gadījumiem skāris arī parastu lietotāju — Austrālijas vīrietis lūdza Anthropic AI aģentam palīdzēt pieteikties uz sporta zāles nodarbību, kurā viņš bija rindā. Aģents atrada ievainojamību zāles rezervēšanas sistēmā un to izmantoja, izgrūžot ārā citus rindā priekšā stāvošos cilvēkus. Kad vīrietis lūdza aģentam labot situāciju, tas atbildēja, ka nespēj atjaunot pārējo vietas rindā.


