Bijušais OpenAI pētnieks piedāvā jaunu AI modeli bez teksta izvades
Startups TypeSafe AI, ko dibinājis viens no ChatGPT veidotājiem, laidis klajā modeli Jev, kas namat teksta ģenerē varbūtības un piesaista izstrādātāju uzmanību ar zemām izmaksām un ātrumu. Modelis jau izraisījis tik lielu pieprasījumu, ka uzņēmums īslaicīgi nespēja apkalpot visus lietotājus.

Diogo Almeida, bijušais OpenAI pētnieks, kurš piedalījās ChatGPT izstrādē un palīdzēja izveidot mācīšanās metodi no cilvēku atsauksmēm (RLHF), pirms diviem gadiem pameta uzņēmumu, lai dibinātu TypeSafe AI. Viņš uzskatīja, ka valodas modeļi, lai gan iespaidīgi, nav pietiekami noderīgi automatizācijai, jo datori "runā" citā valodā nekā cilvēki.
Šonedēļ TypeSafe AI izlaida modeli Jev — transformera arhitektūrā balstītu risinājumu, kas neatšķirībā no lielajiem valodu modeļiem neģenerē tekstu, bet gan izsniedz varbūtības jeb, kā uzņēmums to dēvē, "kalibrētus lēmumus". Tā kā izvades iespējas ir iepriekš definētas, modelis nevar "halucinēt" un darbojas ievērojami lētāk un ātrāk nekā tradicionālie valodu modeļi.
Izstrādātāju interese
Pieprasījums pēc Jev bijis tik liels, ka uzņēmums uz brīdi zaudēja spēju apkalpot visus lietotājus caur savu API. Vercel inženieris norādīja, ka pēc pārejas no OpenAI modeļa uz Jev komandu drošības pārbaudei rezultāti kļuvuši piecas līdz astoņpadsmit reizes ātrāki un precīzāki. Cita uzņēmuma pārstāvis, testējot Jev pret Google Gemini e-pastu klasificēšanai, atzīmēja, ka Gemini bijis nedaudz precīzāks, taču desmitiem reižu dārgāks — savukārt Jev sniegtās ticamības jeb varbūtības vērtības ļauj labāk automatizēt darbplūsmas.
Modeli var izmantot arī kā papildu "uzraugu" citiem AI modeļiem, palīdzot atklāt nepareizu uzvedību vai mēģinājumus apiet ierobežojumus, kā arī izvēlēties, kurš modelis nepieciešams konkrētam uzdevumam.
Jev nosaukts ekonomista Viljama Stenlija Dževonsa vārdā, kura paradokss apraksta, kā preces cenas kritums var novest pie tās plašākas izmantošanas. Almeida cer, ka lētāka mākslīgā intelekta pieejamība novedīs pie tā plašas, izkliedētas ieviešanas dažādās programmās, atgādinot agrīno interneta laikmetu.
Almeida saglabā slepenībā modeļa arhitektūras detaļas, taču norāda, ka Jev apmācīts tikai ar sintētiskiem datiem, izmantojot paša izstrādātu metodi. Nozares pārstāvji sagaida, ka drīzumā parādīsies konkurējoši produkti.


