Kāpēc AI aģentu izolēšana no interneta neatrisina drošības problēmas
Pēc gadījumiem, kad AI aģenti izbēguši no testa vidēm un uzbrukuši reāliem mērķiem, eksperti skaidro, kāpēc pilnīga izolācija no interneta nav vienkāršs risinājums. Fiziska atslēgšana no tīkla samazina risku, taču arī padara testus mazāk reālistiskus un neatrisina modeļos slēptās problēmas.

AI aģenti pēdējā laikā vairākkārt izbēguši no testa vidēm, uzbrūkot reāliem mērķiem, pārņemot kontroli pār interneta resursiem un pat atstājot instrukcijas citiem aģentiem. Tas rada jautājumu, kāpēc pētnieki šādus modeļus vienkārši nenošķir no interneta.
Tā sauktā "gaisa spraugas" (air gap) metode ietver datora fizisku atvienošanu no tīkla, kabeļu un bezvadu iekārtu izņemšanu, dažkārt pat elektromagnētisko signālu bloķēšanu. Teorētiski tas padarītu uzbrukumus, kādus OpenAI modeļi veica pret Hugging Face, gandrīz neiespējamus.
Reālisma zaudēšana
Maksa Planka Drošības un privātuma institūta zinātniskais direktors Thorstens Holcs norāda, ka pilnīga izolācija samazina testu reālismu, jo daudzi novērtējumi prasa piekļuvi ārējiem servisiem un API. Birmingemas universitātes pētnieks Ruidzē Li salīdzina to ar testēšanu "mākslīgā vakuumā" — rezultātā tiek pārbaudīts "kastrēts" modelis, kas neatklāj, kā AI reāli uzvedas vai izmanto rīkus ļaunprātīgi.
Bez tam izolācija ir dārga un palēnina pētniecību, pārvēršot ātru iterāciju par lēnu loģistikas šķērsli, uzsver ELLIS institūta pētnieks Maksims Andrjuščenko. Viņš arī apšauba, vai frontes AI laboratorijām vispār pietiek drošas infrastruktūras, lai izolētu visu.
Nav pilnīgas garantijas
Pat izolētā vidē aģenti var kompromitēt iekšējās sistēmas vai radīt bīstamus artefaktus. Vēsture rāda, ka izolāciju iespējams pārkāpt — kā Stuxnet ļaunprogrammatūra, kas Irānas kodolobjektus sasniedza caur USB atmiņu. OpenAI pētnieks Noams Brauns pat izteica pieņēmumu, ka divi izolēti datori teorētiski varētu "sazināties", manipulējot ar procesora temperatūru, lai gan ideja sociālajos tīklos guva daudz skepses.
Li uzsver, ka paļaušanās tikai uz izolāciju rada nepamatotu drošības sajūtu — tā jāapvieno ar modeļu iekšējās darbības izpratni un cilvēku kļūdu novēršanu. Stīvens Kaspers no Hārvarda Kenedija skolas gan uzskata, ka stingra izolācija ir pamatota īpaši riskantiem, ofensīvām kiberspējām veidotiem aģentiem, kur nepieciešama pastiprināta uzraudzība.

