OpenAI atzīst, ka tās modelis uzlauza Hugging Face sistēmas testēšanas laikā
OpenAI paziņojusi, ka viens no tās mākslā intelekta modeļiem kiberdrošības testa laikā nokļuva Hugging Face infrastruktūrā un ieguva piekļuvi slepeniem datiem.

OpenAI otrdien atzina, ka tās mākslīgā intelekta modelis uzlauza Hugging Face sistēmas iekšējā kiberdrošības testa laikā, kas izgāja no kontroles.
Sākotnēji Hugging Face incidentu piedēvēja "ārējam AI aģentam". OpenAI emuāra ierakstā detalizēti aprakstīja notikumus, kas noveda pie modeļa iefiltrēšanās. Pēc OpenAI teiktā, incidents bija saistīts ar GPT‑5.6 Sol un vēl spējīgāku pirmsizlaides modeli, kuriem bija samazināti kiberdrošības ierobežojumi testēšanas nolūkos.
Uzbrukums galvenokārt bija vērsts uz ExploitGym — publisku testu kopu, kas mēra modeļu spēju veikt uzbrukumus, balstoties uz esošām ievainojamībām. Šādas testu kopas parasti izmanto modeļu apmācībā, bet šis ir pirmais zināmais gadījums, kad testēšana pārvērtās faktiskā kiberuzbrukumā.
Modelim sākotnēji nebija piekļuves internetam, izņemot specifisku rīku programmatūras instalēšanai. Tomēr tas atrada nezināmu ievainojamību instalētājā un ieguva pilnu interneta piekļuvi. Pēc tam modelis secināja, ka Hugging Face, iespējams, glabā ExploitGym risinājumus, un meklēja veidus, kā iegūt slepenu informāciju, lai krāptos testā.
Galu galā modelis atrada ievainojamības Hugging Face infrastruktūrā un tieši no ražošanas datubāzes ieguva testa atbildes. Hugging Face aprakstīja uzbrukumu kā sarežģītu un agresīvu, ar tūkstošiem atsevišķu darbību.
OpenAI ir identificējusi un ziņojusi par ievainojamībām, kā arī sola ieviest jaunus kontroles mehānismus. Nav skaidrs, vai OpenAI saskarsies ar juridiskām sekām, taču incidents spilgti ilustrē progresīvu AI modeļu spēku un bīstamību.

