Microsoft publicē AI ētikas kodeksu — modeļiem aizliegts uzlauzt sistēmas un maldināt cilvēkus
Microsoft ir izdevis jaunu rīcības kodeksu saviem AI modeļiem, nosakot stingrus ierobežojumus pret kiberuzbrukumiem, masveida iznīcināšanas ieročiem un cilvēku kontroles zaudēšanu. Dokuments nāk klajā laikā, kad nozarē pieaug bažas par AI drošību.

Microsoft ir publiskojis jaunu AI rīcības kodeksu, kas paredzēts, lai novirzītu uzņēmuma AI modeļus prom no bīstamas rīcības. Dokuments ir detalizētāks un praktiskāks nekā Anthropic vadītāja Dario Amodei nesenais aicinājums palēnināt AI attīstības tempu — tas koncentrējas uz konkrētām vērtībām un robežām, kas jāievēro modeļu apmācības procesā.
Kodekss sākas ar prognozi, ka nākamajā desmitgadē superinteliģenti AI risinājumi pārspēs cilvēku sniegumu lielākajā daļā uzdevumu. Dokumentā uzsvērts, ka šāda spēka savaldīšana, kontrole un saskaņošana ar cilvēku vērtībām ir viens no lielākajiem izaicinājumiem cilvēces vēsturē, tāpēc jābūt skaidrai izpratnei, kāpēc šīs sistēmas tiek veidotas un kā tās plānots kontrolēt.
Absolūti ierobežojumi
Kodekss nosaka vispārīgus principus — piemēram, ka AI modeļiem jāatbalsta cilvēki, nevis jāaizstāj tie, un jāveicina cilvēces labklājība. Papildus tam noteikti konkrēti drošības ierobežojumi, kas ir pārāki par atsevišķu lietotāju vēlmēm vai konkrētiem uzdevumiem. Šie "absolūtie ierobežojumi" aizliedz kiberuzbrukumus, kodola ieroču izstrādi un deepfake satura veidošanu.
Kodekss ietver arī plašākus noteikumus pret vispārēju cilvēku kontroles zaudēšanu — Microsoft AI modeļiem aizliegts izmantot adaptīvus, maldinošus, sevi pastiprinošus vai slepenas vienošanās mehānismus, lai izvairītos no cilvēku uzraudzības vai to pārvarētu.
Konteksts nozarē
Dokuments publicēts laikā, kad AI drošības jautājumiem tiek pievērsta bezprecedenta uzmanība, ko izraisījuši vairāki incidenti ar nekontrolētu AI aģentu rīcību, kā arī kāda Anthropic darbinieka pēkšņā aiziešana no darba, minot pieaugošo risku, ka AI varētu apdraudēt cilvēces eksistenci.
Microsoft kopā ar Anthropic, OpenAI un xAI ir kopumā atbalstījusi pieeju, kas paredz apzinātu AI attīstības tempa regulēšanu, tostarp ideju par neatkarīgiem novērtētājiem AI laboratorijās. Microsoft izpilddirektors Satja Nadella publiski pauda atbalstu šādiem pētniecības un uzraudzības mehānismiem.


