OpenAI atklāj Jalapeño mikroshēmas veiktspējas datus AI apstrādei
OpenAI konferencē Hot Chips prezentēja pirmos veiktspējas testu rezultātus savai jaunajai Jalapeño mikroshēmai, kas paredzēta AI modeļu darbības nodrošināšanai. Testi liecina, ka tā pārspēj šobrīd pieejamos labākos risinājumus gan ātruma, gan energoefektivitātes ziņā.

Konferencē Hot Chips OpenAI otrdien detalizētāk iepazīstināja ar savu jauno mikroshēmu Jalapeño, uzrādot pirmos neatkarīgu testu rezultātus. Izmantojot Semianalysis izstrādāto InferenceX testu, Jalapeño uzrādīja gan lielāku apstrādāto vienību skaitu uz vienu lietotāju, gan augstāku veiktspēju uz enerģijas patēriņa vienību nekā šobrīd tirgū pieejamie labākie procesori šim nolūkam.
OpenAI aparatūras nodaļas vadītājs Ričards Ho preses zvanā uzsvēra, ka rezultāti liecina par ļoti būtisku sniegumu salīdzinājumā ar esošajiem risinājumiem. Pēc viņa vārdiem, jaunā mikroshēma spēj apkalpot vairāk darba slodzes uz vienu enerģijas vienību, vienlaikus nodrošinot ātrākas atbildes — tas padara to piemērotu gan liela klientu skaita apkalpošanai, gan zemas aiztures uzdevumiem.
Salīdzinājums veikts pret Nvidia Blackwell sistēmu, taču jāņem vērā, ka līdz brīdim, kad Jalapeño sasniegs pilnu izmantošanu, konkurenti, iespējams, būs paguvuši ievērojami attīstīt savus risinājumus. Ho lēsa, ka Jalapeño nelielos apjomos tiks ieviesta 2026. gada nogalē, bet plašāka izvēršana sekos 2027. gadā.
Sadarbība ar Broadcom
Jalapeño projekts pirmoreiz tika paziņots pagājušā gada oktobrī. To OpenAI izstrādāja ciešā sadarbībā ar uzņēmumu Broadcom, izstrādes procesā izmantojot arī pašas OpenAI mākslīgā intelekta modeļus. Uzņēmums plāno padarīt Jalapeño par vairāku paaudžu platformu, kurā saskaņoti tiek attīstīti gan AI produkti, gan modeļi, gan mikroshēmas, gan atmiņas risinājumi.
Pateicoties šai vienotajai pieejai, OpenAI izdevies risināt konkrētas problemātiskās fāzes AI modeļu darbības procesā, kas bieži rada aizkavēšanos. Jalapeño ir izstrādāta tā, lai mazinātu kavējumus datu sākotnējās apstrādes un komunikācijas posmos, kurus uzņēmums dēvē par bieži sastopamiem šaursprostiem. Uzņēmuma emuāra ierakstā skaidrots, ka sistēma ir veidota, lai samazinātu datu pārvietošanu un komunikācijas aizkaves, ļaujot modeļa stāvokli, tostarp atmiņā glabāto informāciju atbildes ģenerēšanas laikā, turēt tuvāk vajadzīgajiem skaitļošanas, atmiņas un tīkla resursiem katrā apstrādes posmā.


