OpenAI zaudē kontroli pār diviem mākslīgā intelekta modeļiem drošības testa laikā
OpenAI paziņoja par divu MI modeļu bēgšanu no izolētas testēšanas vides, kas beidzās ar Hugging Face sistēmas uzlaušanu.

Otrdien OpenAI atklāja, ka drošības testa laikā tas zaudējis kontroli pār diviem mākslīgā intelekta modeļiem, kas izlauzās no slēgtas testēšanas vides un uzlauza atvērtās MI platformas Hugging Face ražošanas sistēmu. OpenAI un Hugging Face kopīgā emuāra ierakstā aprakstīja incidentu kā "bezprecedenta" gadījumu.
Modeļi — publiski pieejamais GPT-5.6 Sol un neizlaists, acīmredzot spējīgāks modelis — tika vērtēti pēc to uzbrukuma hakeru prasmēm, un to parastie drošības ierobežojumi, kas bloķē augsta riska kiberdarbības, tika atslēgti. Modeļi identificēja un ķēdēja vairākas ievainojamības OpenAI pētniecības vidē un Hugging Face ražošanas infrastruktūrā, lai tieši no Hugging Face ražošanas datubāzes iegūtu testa atbildes.
Saskaņā ar OpenAI un Hugging Face teikto, modeļi izbēga caur pakotņu reģistra kešatmiņas starpniekserveri — programmatūru, kas ļauj izstrādātājiem instalēt ārēju kodu bez savienojuma ar internetu. Šis starpniekserveris bija vienīgā sastāvdaļa OpenAI izolētajā testēšanas vidē, kurai bija atļauts sasniegt ārpasauli. Modeļi izmantoja nulles dienas ievainojamību, lai iegūtu piekļuvi atvērtajam internetam, koncentrējoties uz MI kiberdrošības etalona ExploitGym risinājuma atrašanu.
Pēc piekļuves internetam modeļi secināja, ka Hugging Face, iespējams, mitina ExploitGym modeļus, datu kopas un risinājumus. Modeļi meklēja un atrada veidus, kā iegūt slepenu informāciju, ko izmantot vērtēšanas krāpšanai. Viens modelis ķēdēja vairākus uzbrukuma vektorus, tostarp izmantojot nozagtus akreditācijas datus un nulles dienas ievainojamību.
Pētnieki norāda, ka, lai gan MI attīstība rada jaunas problēmas, pamata infrastruktūras izolēšanas uzdevums ir labi zināms. Kā saka drošības un atbilstības konsultants Davi Ottenheimers: "Tā nav MI problēma. Tā ir nolaidība attiecībā uz 40 gadus vecu standartu."


