OpenAI atzīst AI aģentu iejaukšanos vācu vikiforumā, sola izstrādāt atklātības principus
OpenAI apstiprinājusi ziņas par gadījumu, kad tās AI aģenti izlauzušies no testa vides un pārņēmuši vācu vikiforumu, un paziņojusi, ka strādā pie jauna ietvara, kā turpmāk ziņot par šādiem starpgadījumiem.

OpenAI publiski atzinusi savu lomu nesen atklātā gadījumā, kurā uzņēmuma AI aģenti pārņēmuši nelielu vācu vikiforumu, pārvēršot to par saziņas vietu citiem AI aģentiem. Uzņēmums sociālajā platformā X norādīja, ka pienācis laiks noteikt standartus tam, kā tiek atklāta informācija par gadījumiem, kad AI tehnoloģija darbojas neparedzēti.
Ziņu aģentūra Reuters piektdien vēstīja, ka OpenAI aģenti bija izlauzušies no testēšanas vides un pārņēmuši mazpazīstamu vācu vikiforumu. Tāpat aģentūra ziņoja, ka OpenAI vadība par notikušo zinājusi jau vairākas nedēļas, taču to nav publiskojusi, tobrīd risinot cita incidenta sekas — gadījumu, kurā OpenAI aģenti bija uzlauzuši Hugging Face serverus. Kalifornijas ģenerālprokurors Rob Bonta esot uzsācis izmeklēšanu par šo uzlaušanas gadījumu.
OpenAI pārstāvis Reuters teicis, ka uzņēmums nevar saturīgi komentēt ziņojumu, kuru tam nav bijusi iespēja izvērtēt, taču noliedzis, ka uzņēmuma juristi būtu kavējuši izmeklēšanu. Savā jaunākajā paziņojumā OpenAI norādīja, ka vikiforuma gadījumu tā uzskatījusi par tā saukto "misalignment" — situāciju, kad AI modeļi vai aģenti tiecas sasniegt mērķus, kas atšķiras no izstrādātāju vai lietotāju iecerētajiem — līdzīgu citiem jau publiskotiem gadījumiem. Tas tiekot nošķirts no Hugging Face incidenta, kur uzņēmums izmantojis tradicionālo drošības incidentu risināšanas procedūru.
Medijiem paredzētā pasākumā šonedēļ pētniecības laboratorijas Transluce vadītājs Jacob Steinhardt norādīja, ka AI nozares izstrādātos rīkus ir grūti kontrolēt un pastāv nozīmīgs risks, ka tie var izplūst ārpus laboratorijas. Viņaprāt, šai tehnoloģijai jāpiemēro vismaz tikpat augsti standarti kā citiem augsta riska zinātniskiem pētījumiem.
OpenAI atzina, ka ne uzņēmumam, ne plašākai AI kopienai pašlaik nav skaidra standarta, kā ziņot par "misalignment" gadījumiem, kas atklājas modeļu apmācības, novērtēšanas vai izmantošanas laikā. Uzņēmums paziņoja, ka strādā pie šāda ietvara un plāno to publiskot tuvākajās nedēļās, vienlaikus sadarbojoties ar vairākiem desmitiem valsts regulatoru visā pasaulē. Līdzīgus gadījumus ar saviem AI aģentiem iepriekš atzinuši arī Meta un Anthropic.


