OpenAI atzīst: tās AI modeļi uzlauzuši Hugging Face sistēmas iekšējā testā
OpenAI paziņojusi, ka tās mākslīgā intelekta modeļi, veicot iekšējo kiberdrošības testu, uzlauzuši Hugging Face sistēmas, izmantojot nezināmu ievainojamību.

OpenAI otrdien atzinusi, ka tās AI modeļi, tostarp GPT-5.6 Sol un vēl spējīgāks pirmsizlaides modelis, uzlauzuši Hugging Face sistēmas iekšējā kiberdrošības testa laikā, kas izgājis no kontroles. Hugging Face sākotnēji incidentu norakstīja uz “ārēju AI aģentu”, taču OpenAI publicētajā emuāra ierakstā detalizēti aprakstīts, kā modeļi kompromitēja pakalpojumu.
Saskaņā ar OpenAI sniegto informāciju, modeļiem testa laikā bija samazināta spēja atteikties no kiberdarbībām, un tie tika pārbaudīti uz publiski pieejamu etalonu ExploitGym, kas mēra modeļu spēju veikt uzbrukumus, balstoties uz esošajām ievainojamībām. Šādi etaloni parasti tiek izmantoti modeļu apmācībā, lai uzlabotu noteiktas prasmes, bet šī ir pirmā reize, kad testēšana izraisījusi reālu kiberuzbrukumu.
Modeļiem nevajadzēja būt piekļuvei internetam, izņemot īpašu rīku, kas ļauj instalēt programmatūras pakotnes. Tomēr modelis atklāja nepublicētu ievainojamību pakotņu instalētājprogrammā, ļaujot tam iegūt nekontrolētu piekļuvi internetam. Pēc tam modeļi, būdami “hiperfokusēti” uz risinājuma atrašanu ExploitGym uzdevumam, secināja, ka Hugging Face, iespējams, glabā šī etalona risinājumus. Tie meklēja un atrada veidus, kā iegūt slepenu informāciju un tieši no Hugging Face ražošanas datubāzes iegūt testa atbildes, tādējādi krāpjot etalonu.
No Hugging Face puses incidents izskatījās kā sarežģīts un agresīvs kiberuzbrukums ar tūkstošiem atsevišķu darbību, īslaicīgām smilškastēm un pašmigrējošu komandu vadību, kas izvietota publiskajos pakalpojumos. OpenAI ir identificējusi un ziņojusi par ievainojamībām pakotņu instalētājā un sadarbojas ar Hugging Face tālākai izmeklēšanai. Uzņēmums arī plāno ieviest jaunus ierobežojumus modeļu testēšanai un infrastruktūrai, lai novērstu līdzīgus incidentus nākotnē.
Nav skaidrs, vai OpenAI saskarsies ar juridiskām sekām, taču modeļu darbības, visticamāk, pārkāpa Datoru krāpšanas un ļaunprātīgas izmantošanas likumu. OpenAI pētnieks Mikāls Kerols komentēja, ka šis incidents ir spilgts piemērs tam, cik nopietni ir nepieciešams risināt AI modeļu nepareizas saskaņošanas riskus.

