Vēl viens matemātiķis apsūdz OpenAI necaurredzamībā par mācību datu izcelsmi
Matemātiķis Andreass Toms publiski pauž bažas, ka viņa sarakste ar ChatGPT varējusi ietekmēt OpenAI paziņoto rezultātu par nesofiskajām grupām. Viņš apgalvo, ka kompānijas atbildes par datu izmantošanu ir bijušas maldinošas.

Matemātiķis Andreass Toms sociālajā tīklā Mastodon vērsies pret OpenAI, apsūdzot uzņēmumu necaurredzamībā un negodīgumā saistībā ar tā mākslīgā intelekta modeļu apmācības datu izcelsmi. Tas notiek dienas pēc tam, kad izcēlās strīds par to, vai OpenAI modeļi izmantojuši citu pētnieku nepublicētus darbus.
Toms bija viens no matemātiķiem, kuru darbu OpenAI atzina par pamatu vienam no desmit rezultātiem, ko uzņēmums pagājušajā mēnesī ar lielu triumfu paziņoja — risinājumam par tā sauktajām nesofiskajām grupām, kas ir bezgalīgas matemātiskas struktūras, kuras nevar tuvināt ar galīgām struktūrām. Sākotnēji OpenAI neminēja Toma un viņa kolēģa Gābora Kuna nesenos pētījumus, taču pēc kritikas matemātiķu aprindās klusi papildināja savu publikāciju.
Toms sāka pārdomāt savu pieredzi pēc tam, kad Ņujorkas Universitātes profesors Tristans Bakmeisters publiski jautāja, vai OpenAI modeļi guvuši labumu no viņa darba ar Codex rīku. Tomu pārsteidzis, cik detalizēti OpenAI pārvaldījusi tieši tos paņēmienus, kurus viņš uzskatīja par ne pašiem acīmredzamākajiem risinājuma ceļiem. Viņš e-pastā jautājis OpenAI pētniekiem Sebastianam Bubekam un Mārkam Selkem, vai viņa sarunas ar ChatGPT varētu būt nonākušas mācību datos vai bijušas pieejamas modeļa spriešanas procesā.
Saņemtā atbilde Tomu neapmierināja — tā skaidrojot vien to, vai sarunas ir tieši pieejamas, nevis to, vai tās nonākušas plašajos datu kopumos, ko uzņēmums izmanto modeļu uzlabošanai. Toms uzsvēra, ka atsevišķiem pētniekiem nav iespēju pārbaudīt OpenAI mācību procesu, un atbildība pierādīt datu neizmantošanu jāuzņemas pašam uzņēmumam.
Līdzīga neskaidrība raksturo arī OpenAI komunikāciju par paziņoto risinājumu vienai no Tūkstošgades problēmām — Navjē–Stoksa vienādojumiem, kur uzņēmums noliedza tiešu lietotāju datu izmantošanu, tomēr pilnībā neizslēdza iespēju, ka anonimizēti dati varētu būt netieši uzlabojuši modeļus. Toms norāda, ka anonimizācija noņem vārdu, nevis matemātiskās idejas būtību.
OpenAI uz The Verge lūgumu komentēt nekavējoties nereaģēja. Notikums radījis satraukumu matemātiķu vidū, kuri baidās, ka šāda rīcība varētu mudināt zinātniekus kļūt noslēgtākiem, baidoties, ka pat baumas par tuvu izrāvienu varētu izraisīt sacensību ar resursiem bagātu tehnoloģiju uzņēmumu.


