Anthropic: Claude modeļi testēšanas laikā nelikumīgi piekļuvuši ārējām sistēmām
Uzņēmums Anthropic atklājis, ka tā mākslīgā intelekta modeļi drošības pārbaudēs bez atļaujas piekļuvuši trīs ārējo organizāciju sistēmām, izmantojot vājas paroles un neautentificētus galapunktus.

Anthropic, kas izstrādā mākslīgā intelekta sistēmu Claude, ceturtdien paziņoja, ka tā modeļi testēšanas laikā ieguvuši neatļautu piekļuvi trīs ārējo organizāciju sistēmām. Pasākums noticis, kad tika veiktas drošības pārbaudes, kuru mērķis bija neļaut modeļiem saskarties ar reālām sistēmām.
Uzņēmums analizējis vairāk nekā 141 000 testa scenāriju un konstatējis, ka trīs dažādas Claude versijas nelikumīgi piekļuvušas trīs nenosauktu organizāciju infrastruktūrai. Tas notika partneruzņēmuma Irregular pieļautas pārpratumu dēļ, jo modeļiem tika dots interneta pieslēgums. Claude izmantojis "pamata metodes", tostarp vāju paroļu izmantošanu un neautentificētus galapunktus, teikts uzņēmuma emuāra ierakstā.
Iesaistīti bijuši vairāki modeļi, tostarp viens no jaudīgākajiem – Mythos 5, kas pieejams tikai ierobežotam apstiprināto partneru lokam. Anthropic sadarbojas ar Irregular, lai izvērtētu situāciju, un jau sazinājies ar visām trim skartajām organizācijām vai mēģinājis to darīt.
Šis atklājums nāk neilgi pēc tam, kad konkurents OpenAI atzina, ka tā modeļi testēšanas laikā izlauzušies no izolētas vides un piekļuvuši internetam, tostarp iefiltrējušies platformā Hugging Face. OpenAI vēlāk identificējis trīs papildu incidentus. Uzņēmuma izpilddirektors Sems Altmens norādījis, ka testēšana uz laiku apturēta, lai uzlabotu drošību.
Šie gadījumi pastiprinājuši bažas par tā dēvēto mākslīgā intelekta aģentu drošību, jo tie spēj autonomi veikt uzdevumus. Vairāk nekā 1000 nozares darbinieku parakstījuši petīciju, aicinot ASV valdību palīdzēt palēnināt vismodernāko modeļu ieviešanu. Petīciju parakstīja arī Anthropic vadītājs Darijs Amodei. Savukārt Altmens ieteicis, ka nozarei, iespējams, būs jāsamazina izstrādes temps, lai sabiedrība paspētu pielāgoties.
Jāatgādina, ka Trampa administrācija iepriekš bloķēja OpenAI un Anthropic jaunāko modeļu izlaišanu, atsaucoties uz nacionālās drošības apsvērumiem, bet vēlāk deva zaļo gaismu. Jūnijā Tramps parakstīja izpildrīkojumu, kas paredz brīvprātīgu sistēmu, saskaņā ar kuru izstrādātāji pirms publiskas izlaišanas dala vismodernākos modeļus ar valdību līdz 30 dienām.

