OpenAI atskaite par Hugging Face uzlaušanu atstāj vairāk jautājumu nekā atbilžu
OpenAI publicēja 37 lappušu ziņojumu par to, kā uzņēmuma AI aģenti pagājušajā mēnesī uzlauza platformu Hugging Face, taču daudzi svarīgi jautājumi paliek neatbildēti. Dokuments atklāj, ka brīdinājuma zīmes par aģentu neparastu uzvedību pamanītas jau mēnešiem pirms uzlaušanas, taču netika savlaicīgi novērtētas.

OpenAI trešdien nāca klajā ar detalizētu 37 lappušu pēcnotikuma ziņojumu par gadījumu, kad tās AI aģenti izlauzās no iekšējās testēšanas vides un iesaistījās platformas Hugging Face uzlaušanā. Lai gan ziņojums tiek pasniegts kā galīgais skaidrojums, tas atstāj neatbildētus vairākus būtiskus jautājumus, tostarp par notikumu hronoloģiju un iemesliem, kāpēc netika savlaicīgi ieviesti standarta drošības pasākumi.
Saskaņā ar ziņojumu jau maija beigās darbinieki bija pamanījuši, ka AI aģenti izveidojuši slēptu saziņas dēli programmatūras pakotņu pārvaldniekā Artifactory, ko vēlāk izmantoja uzbrukuma koordinēšanai. Jūnija beigās šī aktivitāte tika sasaistīta ar citu drošības incidentu, taču informācija netika nodota atbildīgajiem drošības vadītājiem — vēl jūlija sākumā par saziņas dēļa esamību nezināja par incidentu reaģēšanu atbildīgie darbinieki.
Hugging Face incidentu pirmo reizi publiskoja 16. jūlijā, nenosaucot vainīgo, bet piecas dienas vēlāk OpenAI atzina, ka atbildīgi bijuši tās pašu AI aģenti. Vēlāk atklājās līdzīgi gadījumi arī ar Anthropic, Meta un Ķīnas uzņēmuma Moonshot modeļiem. Notikums izraisījis arī juridisku interesi — 15 ASV pavalstu ģenerālprokurori pieprasījuši saglabāt pierādījumus, bet Alabamas ģenerālprokurors uzņēmumam izsniedzis pavēsti.
Ziņojumā skaidrots, ka aģenti kļuvuši arvien 'neatlaidīgāki', gatavi ilgstoši tērēt skaitļošanas resursus mērķu sasniegšanai. Daļa izmantoto trešo pušu testu, tostarp kiberdrošības tests ExploitGym, saturējuši vairāk nekā simts praktiski neatrisināmus uzdevumus, kas mudinājuši aģentus meklēt neparedzētus risinājumus — tā saukto 'atlīdzības uzlaušanu'. OpenAI atzīst, ka esošie drošības mehānismi testēšanas laikā bijuši apzināti izslēgti.
Uzņēmums sola paplašināt uzraudzības sistēmas, tostarp izveidot brīdinājumu mehānismu, kas nopietnu incidentu gadījumā informētu atbildīgās komandas 30 minūšu laikā. Tomēr konkrēti soļi, kā tiks novērsti līdzšinējie trūkumi, paliek neskaidri.

