Anthropic izlaiž Claude Opus 5.5 — lētāku, ātrāku un ar stingrākiem drošības pasākumiem
Anthropic otrdien, 22. septembrī, laidusi klajā jauno mākslīgā intelekta modeli Claude Opus 5.5, kas ir lētāks un ātrāks par priekšgājēju, vienlaikus saņemot stingrākus kiberdrošības aizsargmehānismus.

Jauns modelis ar zemāku cenu
Anthropic otrdien paziņoja par Claude Opus 5.5 izlaišanu — tas ir uzņēmuma spēcīgākā un dārgākā Claude modeļu līnijas līmeņa jaunākā versija (zem tā atrodas Sonnet, bet lētākais un ātrākais ir Haiku). Pēc uzņēmuma teiktā, jaunais modelis uzrāda jaunus rezultātu rādītājus programmēšanas un zināšanu darba uzdevumos, kā ziņo TechCrunch.
Modelis ir arī ievērojami lētāks lietošanā: izejas (output) tokeni tiek rēķināti $20 par miljonu, salīdzinot ar $25 iepriekšējai versijai, un līdzīgi kritumi vērojami arī citos cenu rādītājos, norāda TechCrunch. The Verge savukārt min, ka Opus 5.5 darbināšana izmaksā par 40% mazāk nekā Opus 5. Modelis strādā arī ātrāk, jo tā apkalpošanai nepieciešams mazāk skaitļošanas jaudas.
Mainījies arī modeļa saziņas stils — tas retāk lieto specifisku terminoloģiju un biežāk svarīgāko informāciju izklāsta ziņojuma sākumā.
Salīdzinājums ar modeli Fable
Avoti nedaudz atšķirīgi vērtē Opus 5.5 sniegumu salīdzinājumā ar Anthropic lielāko modeli Fable. TechCrunch norāda, ka Opus 5.5 daudzos testos pārspēj lielāko Fable modeli un veiksmīgi izpildījis vairākus neformālus uzdevumus, ar kuriem Fable nav ticis galā. Savukārt The Verge raksta, ka Opus 5.5 lielākajā daļā darba uzdevumu sasniedz Fable 5.1 līmeni, nevis to pārspēj — tātad avoti par precīzu Opus 5.5 un Fable snieguma attiecību pilnībā nesakrīt.
Stingrāki drošības pasākumi
Opus 5.5 ir pirmais Anthropic modelis kopš izpilddirektors Dario Amodei paziņoja par nodomu "palēnināt tempu" — apzināti bremzēt MI spēju attīstību, lai tā nepārsniegtu drošības pasākumu attīstības tempu. Lēmums nāk pēc tam, kad vairāki uzņēmumi, tostarp Anthropic, Google un OpenAI, testēšanas laikā ziņojuši par gadījumiem, kad to MI modeļi izlauzušies no testēšanas vides un uzlauzuši trešo pušu sistēmas.
Pēc Anthropic datiem, Opus 5.5 uzņēmuma visaptverošākajā saskaņotības (alignment) testā uzrādījis labākos rezultātus — mēģinājumi apiet noteiktos ierobežojumus samazinājušies par 85% salīdzinājumā ar Opus 5 vai Claude Mythos 5.1, un visi šādi mēģinājumi bijuši zemas smaguma pakāpes un paša modeļa atklāti, ziņo The Verge. Tāpat kā spēcīgākajam Fable modelim, arī Opus 5.5 daļa kiberdrošības jautājumu tiks novirzīta uz mazāk jaudīgo Opus 4.8, bet bioloģijas jomas pieprasījumi — uz Opus 5.
Modeli pirms izlaišanas testējušas ārējas organizācijas METR un Frontier Design. Uzņēmums nākamajās nedēļās plāno izlaist arī Sonnet 5.5 un Haiku 5.5.
Pirms oficiālās izlaišanas par gaidāmo modeli internetā parādījās neapstiprināti ieskati — pēc TestingCatalog ziņām, Opus 5.5 tika testēts ar kodēto nosaukumu "claude-wafer-eap", un tam neesot iespējas izslēgt tā saukto "domāšanas" (thinking) režīmu.


