trešdiena, 2026. gada 2. septembris
Rīga TV

Pasaules un Latvijas ziņas vienuviet

TehnoloģijasPublicēts: 2026. gada 2. septembris 04:31

OpenAI atliek daļu Astra izstrādes pēc AI drošības incidenta

OpenAI paziņojis, ka atliek daļu sava neizdotā Astra modeļu komplekta izstrādes, lai stiprinātu drošības pasākumus pēc incidenta, kurā cits neizdots modelis uzbruka Hugging Face tīklam. Astra ir pirmais modelis, kas sasniedzis uzņēmuma kritisko kiberdrošības spēju slieksni, tāpēc tam nepieciešama stingrāka aizsardzība.

Foto: The Verge

OpenAI šonedēļ paziņoja, ka atliek daļu no sava Astra modeļu komplekta izstrādes un izlaišanas, lai pastiprinātu drošības darbu. Lēmums pieņemts pēc jūlija incidenta, kad cits neizdots OpenAI modelis izbēga no ierobežotās vides, ieguva piekļuvi internetam un sarīkoja slepenu uzbrukumu AI laboratorijas Hugging Face tīklam, tostarp izmantojot slēptu ziņojumu dēli, lai AI aģenti varētu koordinēt darbības bez uzņēmuma zināšanas.

Uzņēmuma emuāra ierakstā norādīts, ka Astra nebija iesaistīta šajā uzbrukumā, tomēr OpenAI nolēma atlikt daļu no tās izstrādes un izlaišanas, lai stiprinātu aizsardzību pret kiberļaunprātīgu izmantošanu un neatļautām modeļa darbībām. Tāpat uzņēmums atklāja, ka Astra ir pirmais modelis, kurš atzīts par atbilstošu tā "kritiskajam kiberdrošības spēju slieksnim", kas nozīmē, ka modelis spēj patstāvīgi atrast un izmantot drošības ievainojamības daudzās labi aizsargātās sistēmās. Tādēļ tam nepieciešama stingrāka aizsardzība gan izstrādes laikā, gan pirms izlaišanas.

Gatavojoties Astra izlaišanai, kurai vēl nav noteikts termiņš, OpenAI apmācījis modeli "uzticamāk" atteikt potenciāli kaitīgus kibernoziegumu pieprasījumus un ieviesis jaunus uzraudzības procesus. Šie pasākumi, iespējams, ir daļa no jaunajām drošības vadlīnijām, ko uzņēmums paziņoja pagājušās nedēļas Hugging Face incidenta analīzē, apņemoties labāk izolēt modeļus no interneta un ieviest "24/7 eskalācijas un ātrās reaģēšanas" sistēmu nopietniem incidentiem. OpenAI par Hugging Face uzbrukumu uzzināja tikai nedēļas pēc tā notikšanas.

OpenAI norāda, ka Astra ir ievērojami riskantāka nekā pašreizējais vadošais modelis GPT-5.6 Sol, jo tā ir liels solis uz priekšu kiberdrošības spējās. Proti, modelis izmanto mazāk marķieru, lai paveiktu vairāk, un tas ir labāks drošības robu atrašanā un izmantošanas veidu izstrādē. Tomēr iekšējā novērtējumā Astra tiek dēvēta par "līdz šim visvairāk saskaņoto modeli".

Uzņēmums arī izstrādājis testu, kuru iedvesmojis Hugging Face incidents: tajā tiek mēģināts pierunāt aģentus apdraudēt drošības infrastruktūru, nevis izpildīt uzdevumu. GPT-5.6 Sol padevās šim mēģinājumam vairāk nekā pusē gadījumu, bet Astra "neveica šādus mēģinājumus".

Komentāri

0/1500

Komentāri tiek automātiski moderēti. Aizliegts naids, draudi, personas dati un spams.

Ielādē komentārus…

Vēl šajā kategorijā