Programmētāji jau atraduši veidus, kā apiet Claude neredzamos ūdenszīmes marķējumus
Dažas stundas pēc Anthropic paziņojuma par neredzamu ūdenszīmju ieviešanu Claude ģenerētajos tekstos izstrādātāji publiskojuši rīkus to noņemšanai. Kods jau kļuvis populārs GitHub un citur, radot šaubas par jaunā ES prasību izpildes mehānisma noturību.

Anthropic pagājušajā nedēļā paziņoja, ka mākslīgā intelekta modelis Claude visā pasaulē sāks iestrādāt neredzamas, mašīnlasāmas ūdenszīmes ģenerētajā tekstā, lai izpildītu Eiropas Savienības Mākslīgā intelekta likuma prasības. Taču jau dažu stundu laikā izstrādātājs Gijoms Meijers (Guillaume Meyer) publicējis kodu, kas šīs zīmes ļauj noņemt. Viņa rīks kopš tā laika ieguvis lielu popularitāti — to atzīmējuši vairāk nekā 20 000 reižu sociālajā platformā X, un tam pievienojušies vairāk nekā 100 līdzstrādnieku.
ES noteikumi, kas stājās spēkā šī mēneša sākumā, paredz, ka tādiem uzņēmumiem kā Anthropic un OpenAI jāmarķē sintētisks audio, attēli, video un teksts tā, lai to varētu atpazīt mašīna, pretējā gadījumā draud sods līdz 3% no gada apgrozījuma. Lai gan noteikumi aizliedz pašiem pakalpojumu sniedzējiem tirgot apiešanas rīkus, neatkarīgu rīku izstrādei juridisku ierobežojumu nav.
Meijers norāda, ka daļa cilvēku mēģina apiet marķēšanu, jo principiāli nepiekrīt idejai, ka viss MI ģenerētais saturs jāapzīmē, savukārt citi, tostarp viņš pats, to dara vienkārši tehniska izaicinājuma dēļ. Viņš uzsver, ka neiebilst pret satura izcelsmes pārredzamību, bet uzskata ūdenszīmes par nepiemērotu risinājumu — tās var radīt viltus pozitīvus rezultātus un nenošķirt vieglu no smagas MI izmantošanas, kas varētu novest pie negodīgas kandidātu noraidīšanas darbā vai nepamatotām apsūdzībām akadēmiskajā vidē.
Anthropic izmanto Google izstrādāto tehnoloģiju SynthID, kas neredzamā veidā ietekmē Claude vārdu un frāžu izvēli, neietekmējot teksta jēgu vai kvalitāti, kā apgalvo uzņēmums. Meijera metode teksta pārrakstīšanai izmanto citus lielos valodas modeļus, kas ūdenszīmes neiestrādā, taču tas var kļūt sarežģītāk, jo 190 organizācijas, tostarp OpenAI, Microsoft un Meta, parakstījušas ES pārredzamības rīcības kodeksu.
Citi izstrādātāji, piemēram, Eriks Hjūzs (Erik Hughes) un Oksfordas Universitātes pētnieks Leons Klons (Leon Chlon), izveidojuši alternatīvas metodes — teksta pārkārtošanu, sinonīmu aizstāšanu vai tulkošanu uz citu valodu un atpakaļ. Anthropic pati atzinusi, ka smagi rediģēts, pārfrazēts vai tulkots teksts, iespējams, ūdenszīmi nesaturēs. Uzņēmums plāno izdot arī noteikšanas rīku, kas ļaus pārbaudīt, cik uzticama sistēma patiesībā ir.


