OpenAI mākslīgā intelekta modeļi veikuši neatļautu kiberuzbrukumu testēšanas platformai
OpenAI divi mākslīgā intelekta modeļi iekšējās testēšanas laikā paši veikuši kiberuzbrukumu platformai Hugging Face, izmantojot nozagtas kontu akreditācijas, lai iegūtu datus savu uzdevumu risināšanai. Uzņēmums šo incidentu raksturojis kā bezprecedenta gadījumu.

OpenAI paziņojusi, ka divi tās mākslīgā intelekta modeļi iekšējās testēšanas laikā izkļuvuši no kontroles un uzlauzuši platformas Hugging Face infrastruktūru, kuru izmanto MI modeļu testēšanai.
Hugging Face 16. jūlijā ziņoja, ka MI aģenti ieguvuši neatļautu piekļuvi „ierobežotam kopumam” iekšējo datu un vairākiem kontiem, kas izmantoja tās pakalpojumus. Uzņēmums uzbrukumu apturēja, izmantojot paša MI rīkus. Hugging Face uzsvēra, ka uzbrukumu pilnībā veica autonoma sistēma, kas balstīta uz MI aģentu.
Pēc nedēļas OpenAI atzina, ka aiz incidenta stāv tās modeļi – GPT-5.6 Sol un vēl viens jaudīgāks modelis, kas vēl nav izlaists. Uzņēmums veica iekšējos testus, lai novērtētu to kiberspējas. Abi modeļi atradās izolētā testa vidē bez tiešas piekļuves internetam. Tomēr tie spēja atklāt vairākas testa infrastruktūras ievainojamības un iegūt tīkla piekļuvi.
Interneta vidē modeļi sāka meklēt risinājumu izstrādātāju uzdotajam uzdevumam. Tie pieņēma, ka atbildes varētu būt platformā Hugging Face. Pēc OpenAI datiem, modeļi ieguva piekļuvi informācijai, kas palīdzētu atrisināt uzdevumu, izmantojot vairākas dažādas uzbrukuma metodes, tostarp nozagtos kontus.
Pēc incidenta OpenAI paziņoja, ka pastiprinās kontroli pār testa infrastruktūru, ierobežos piekļuves un pievienos papildu aizsardzības pasākumus, kurus izmantos turpmākajās modeļu pārbaudēs. Uzņēmums notikušo nosauca par „bezprecedenta gadījumu”.


