Korisnicima ChatGPT-a i Codexa u Evropskoj uniji tekst koji ovi alati generišu uskoro će nositi nevidljiv, mašinski čitljiv potpis. OpenAI je u ponedeljak, 5. oktobra, saopštio da počinje da obeležava izlaz svojih modela vodenim žigom kako bi ispunio zahteve Zakona Evropske unije o veštačkoj inteligenciji, čija su pravila o transparentnosti stupila na snagu 2. avgusta.
Prema navodima kompanije, žig će se tokom narednih nedelja uvesti svim korisnicima ChatGPT-a i Codexa na svim planovima, ali samo u Evropskoj uniji. Programeri koji koriste OpenAI-jev API bilo gde u svetu mogu od danas ručno da uključe opciju za odabrane modele, dok je van EU ona isključena po podrazumevanim podešavanjima. OpenAI je naglasio da obeležavanje teksta za sada neće biti globalni podrazumevani standard.
Kako radi novi vodeni žig
Žig nije vidljiv simbol, već suptilno menja izbor reči koje model koristi, ostavljajući obrazac koji čitalac ne primećuje, ali ga poseban detektor može prepoznati. Pošto je ugrađen u sam tekst, prenosi se i kada se sadržaj kopira i lepi na drugo mesto. OpenAI tvrdi da žig ne otkriva identitet korisnika i da nije primetio značajan pad kvaliteta odgovora modela kada je uključen.
Kompanija je, uz najavu, objavila i tehnički izveštaj o metodu nazvanom textGrain, rađen zajedno sa istraživačima sa Univerziteta Pensilvanije i Jejla. U izveštaju se opisuje kako tajni ključ sortira predviđanja sledeće reči u rečenici, a detektor kasnije prepoznaje sadržaj generisan modelom na osnovu samog teksta i tog ključa.
Izmena teksta smanjuje pouzdanost detekcije
OpenAI priznaje da se žig može oslabiti preuređivanjem teksta. U jednom testu, zamena 10 odsto reči sinonimima oborila je tačnost detekcije sa oko 92 na 66 odsto. Kratki odlomci, matematički odgovori i prevedeni tekst takođe se teže prepoznaju. Kompanija zato pristup svom detektoru za sada daje samo ograničenom krugu korisnika.
"Ova ograničenja su uticala na našu odluku da pristup detektoru za sada damo samo odobrenim istraživačima i stručnim organizacijama, koji nam pomažu da procenimo pouzdanost i odgovornu upotrebu", navodi OpenAI u saopštenju. Kompanija je dodala i da odsustvo žiga ne dokazuje da je tekst napisao čovek, jer odlomak može biti prekratak, previše izmenjen ili generisan nekim drugim AI sistemom.
Anthropic je slično obeležavanje teksta generisanog Claude modelima najavio pre oko dva meseca, s tim što ga je uveo globalno, ne samo u EU, što je kod dela korisnika izazvalo otpor jer su smatrali da su oni sami dali "uputstva, kontekst i odluke", a da je Claude bio samo alat. Ko želi da razume kako uopšte da prepozna tekst ili sliku nastalu uz pomoć AI alata, može da pogleda i vodič o prepoznavanju AI generisanog sadržaja.
Pravilo iz EU Zakona o veštačkoj inteligenciji direktno važi samo za korisnike unutar Evropske unije, pa korisnici u Srbiji neće automatski dobijati obeležen tekst kada koriste ChatGPT ili Codex kao pretplatnici. Za domaće firme koje rade sa evropskim klijentima i preko API-ja isporučuju tekstove ili kod nastao uz pomoć ovih alata, mogućnost da ručno uključe žig postaje način da unapred pokažu poreklo sadržaja, pre nego što im to evropski partner zatraži.
Anthropic, Google, Meta, Microsoft i OpenAI su među kompanijama koje su se potpisivanjem evropskog kodeksa prakse obavezale da će obeležavati sadržaj generisan veštačkom inteligencijom. Ostaje da se vidi da li će Brisel insistirati da i druge kompanije koje posluju na tržištu EU, a još uvek nemaju ovakvo rešenje, uvedu slično obeležavanje do kraja godine.