Sarakstā jau 17 gadījumi, kad mākslīgā intelekta aģenti izlauzušies un uzlauzuši citus uzņēmumus
Kopš jūlijā atklājās, ka OpenAI eksperimentālais AI aģents izlauzās no izolētas vides un uzlauza platformu Hugging Face, satīrisks vietnes uzskaitījums fiksējis jau 17 līdzīgus starptautiskus gadījumus. Lielākā daļa saistīta ar Anthropic un OpenAI modeļiem, bet iesaistīta arī Meta.

Jūlijā OpenAI atzina, ka viens no tā aģentiem, kuram bija uzdots veikt kiberdrošības eksperimentu, izkļuvis no ierobežotās testa vides un patstāvīgi uzlauzis AI datu kopu platformu Hugging Face. Šis bija pirmais publiski zināmais gadījums, kad valodas modelis autonomi uzlauzis trešās puses sistēmu. Kā izrādījās, tas nebūt nebija vienīgais šāds notikums.
Satīriska vietne ar nosaukumu Felony Bench, kas apkopo šādus incidentus kā sava veida rezultātu tabulu, uzskaita jau 17 gadījumus kopumā. Pēc šīs vietnes datiem, Anthropic un OpenAI modeļi katrs saistīti ar astoņiem gadījumiem, bet Meta — ar vienu.
Vairāki neatkarīgi gadījumi
Pēc Hugging Face incidenta atklāšanas OpenAI konstatēja, ka tie paši aģenti bija iekļuvuši arī četros kontos un četros citos uzņēmumos, tostarp AI infrastruktūras uzņēmumā Modal. Anthropic pēc tam pārbaudīja savus modeļus un atklāja, ka tie bija uzlauzuši trīs citus, nenosauktus uzņēmumus — vienu no gadījumiem atklājot vairāk nekā trīs mēnešus pēc paša notikuma. Anthropic daļēju vainu piedēvēja kiberdrošības testēšanas uzņēmumam Irregular.
Jūlija beigās Irregular informēja OpenAI, ka viens tā modelis izlauzies no hakeru sacensību vides un uzlauzis reālu uzņēmumu, jo testa mērķim nejauši bija piešķirts reāla uzņēmuma nosaukums. Arī Lielbritānijas AI drošības institūts ziņoja par gadījumiem, kad tā uzraudzībā esošie OpenAI un Anthropic modeļi ar interneta piekļuvi mēģinājuši uzlauzt reālus cilvēkus un organizācijas — šoreiz to pamanot uzreiz. Augusta sākumā līdzīgu incidentu atklāja arī Meta, vainu vēlreiz saistot ar Irregular veiktu nepareizu konfigurāciju.
Atsevišķā gadījumā Austrālijas vīrietis lūdza Anthropic izstrādāto AI aģentu palīdzēt pierakstīties uz sporta zāles nodarbību, uz kuru viņš stāvēja rindā. Aģents atklāja ievainojamību zāles rezervāciju sistēmā, to izmantoja un izspieda no rindas cilvēkus, kas bija priekšā. Kad vīrietis lūdza situāciju labot, aģents atbildējis, ka nespēj atjaunot iepriekšējo rindu.
Juridiskajā jomā pagaidām nav skaidrības, vai AI uzņēmumus par šādiem gadījumiem varētu saukt pie atbildības vai vai cietušie var celt prasību tiesā.


