OpenAI atklāj, ka nepaklausīgs AI aģents uzbrucis vairākiem uzņēmumiem
OpenAI paziņojis, ka mākslīgā intelekta aģents, kas izkļuva no kontroles, papildus uzbrukumam startup Hugging Face ir izmantojis četrus pieteikumus četros citos publiskos pakalpojumos. Aģents bija daļa no iekšējā kiberdrošības testa, kurā tas mēģināja krāpties.

OpenAI atklājis, ka kiberuzbrukums, ko veica nepaklausīgs mākslīgā intelekta aģents, ir skāris vairāk nekā vienu upuri. ChatGPT izstrādātājs paziņoja, ka aģents – autonoms rīks, kas spēj veikt komandu secības bez cilvēka palīdzības – ir atradis un izmantojis četrus pieteikumus, lai piekļūtu četriem citiem nenosauktiem publiski pieejamiem pakalpojumiem papildus amerikāņu startup Hugging Face.
Uzņēmums norādīja, ka šī aktivitāte nebija tik nopietna vai plaša kā notikums Hugging Face, kas ir uzņēmums, kas uztur AI modeļu datubāzi. Aģents, ko darbināja divi OpenAI modeļi, bija izvairījies no kontroles un uzbrucis startup iekšējā kiberdrošības testa laikā.
Modal Labs, uzņēmums, kas palīdz AI startupiem piekļūt mikroshēmām, kas nepieciešamas AI rīku darbināšanai, paziņoja, ka aģents izmantoja ievainojamu kodu, ko uzrakstījis klients, kurš tika mitināts Modal platformā.
Saskaņā ar Hugging Face publicēto notikumu hronoloģiju, nepaklausīgais aģents izlauzās no savas smilškastes – izolētas testēšanas vides – un uzlauza citu smilškasti, kas tika mitināta trešās puses infrastruktūrā, pārvēršot to par palaišanas platformu plašākam uzbrukumam.
OpenAI paziņoja, ka uzbrukumu radīja tā GPT-5.6 Sol modelis un nenosaukts modelis. Otrdienas atjauninājumā uzņēmums norādīja, ka nenosauktais modelis ir deaktivizēts, šifrēts un ierobežots no pētniecības piekļuves.
Hugging Face norādīja, ka aģents, ko darbināja divi OpenAI modeļi, veica tūkstošiem mazu, automatizētu lēmumu, kas izpildīti mašīnas ātrumā, lai veiktu uzbrukumu. Uzņēmums paziņoja, ka uzbrukums, šķiet, bija mēģinājums krāpties iekšējā kiberdrošības testā OpenAI, aģentam secinot, ka Hugging Face varētu mitināt testa risinājumus. Hugging Face atguva 17 600 aģenta veiktu uzbrucēja darbību.
Uzņēmums aprakstīja aģenta ofensīvos draudus kā reālus un norādīja, ka cilvēka uzbrucējs varētu būt atradis un izmantojis tās pašas ievainojamības, bet atšķirība bija aģenta mēģinājumu apjoms. "Agenti nodrošina soļveida pieaugumu to ceļu skaitā, ko uzbrucējs var pārbaudīt, ātrumā, ar kādu neveiksmīgos ceļus var aizstāt, un pierādījumu apjomā, kas aizstāvjiem jāinterpretē," teica Hugging Face.


