Najava kompanije OpenAI da u Evropskoj uniji uvede nevidljivi vodeni žig u tekstove koje stvara ChatGPT na prvi pogled deluje kao prekretnica u borbi protiv zloupotrebe veštačke inteligencije. Međutim, praksa pokazuje znatno drugačiju sliku. Postavlja se pitanje da li „tajni potpis“ algoritma zaista može da razotkrije prepisivanje, dokaže autorstvo ili spreči zloupotrebe, ili je reč samo o potezu kojim se formalno udovoljava zahtevima briselske administracije.
Korisnicima koji platformi pristupaju preko programskog interfejsa (API) širom sveta označavanje će biti ponuđeno kao opcija, dok će za tržište Evropske unije postati obavezno. Međutim, sam pokušaj da se tekst obeleži kao AI generisan stvara niz praktičnih teškoća. Za razliku od fotografija ili video-snimaka gde se tehnički podaci i vizuelne nepravilnosti lakše prate, tekst je podložan promenama. Dovoljno je preformulisati nekoliko rečenica, skratiti pasus ili ga prevesti na drugi jezik, pa da se digitalni trag potpuno izgubi.
textGrain: I statistika ima mane
U osnovi ove tehnologije nalazi se sistem nazvan textGrain. Prilikom pisanja teksta, algoritam bira reči po određenom, statistički predvidivom obrascu. Time u tekstu ostavlja svojevrstan „matematički otisak“, odnosno skriveni digitalni potpis, koji čitalac ne može da prepozna niti detektuje, ali ga namenski softver označava kao sadržaj koji je kreiran veštačkom inteligencijom.
Uspešnost ove tehnologije zavisi od dužine teksta, same teme, a ponajviše od naknadnih izmena i dorade. Prema internim procenama OpenAI-ja, bilo je dovoljno zameniti tek svaku desetu reč sličnim izrazom u odlomku od oko tri stotine reči, pa da pouzdanost detekcije AI sadržaja sa početnih 92 padne na jedva 66 odsto.
Pritom, ovi procenti važe samo u strogo kontrolisanim laboratorijskim uslovima, isključivo za akademske tekstove i tehničku dokumentaciju pisanu na engleskom jeziku. Još uvek se ne zna kako se ova tehnologija ponaša kada radi sa jezicima koji imaju složeniju gramatiku, niti sa kraćim agencijskim vestima, pravnim ugovorima ili đačkim esejima i pismenim sastavima.
Poseban rizik nose pogrešni nalazi softvera. Sistem može da digne lažnu uzbunu i optuži autora teksta da je koristio veštačku inteligenciju samo zato što se izražavao kruto, zvanično ili ustaljenim frazama. Upravo zato OpenAI u početku ne dozvoljava svima pristup ovom alatu, već ga ustupa isključivo probranim istraživačima i stručnim ustanovama.
Algoritam prepoznaje statistički obrazac, ali ne i laž
Čak i kada softver sa velikom sigurnošću uoči statistički obrazac u tekstu, ostaje suštinsko pitanje: šta nam taj podatak zapravo govori?
Iz same kompanije otvoreno priznaju da žig ne otkriva ko je zaista autor teksta, odnosno ne utvrđuje ko ima autorska prava i ne može da izmeri u kojoj meri je tekst pisao čovek, a u kom mašina. Još važnije, prisustvo žiga ne potvrđuje da li su podaci navedeni u tekstu tačni.
U novinarstvu, obrazovanju i poslovanju te razlike su presudne. Jedan novinar može nedeljama da istražuje temu na terenu, proverava dokumentaciju, razgovara sa sagovornicima i sastavi tekst, a da softver iskoristi samo da mu stilski „dotera“ rečenice ili ispravi pravopisne greške. Drugi novinar može jednim upitom generisati članak pun neistina i plasirati ga u javnost.
U oba slučaja detektor beleži isto: softver je korišćen. Ali razlika između novinara koji je proverio izvore i onoga koji je nekritički preuzeo generisani tekst je ogromna. Isto važi i za diplomske radove ili poslovne izveštaje: da bi se utvrdilo da li je neko prekršio pravila, prvo se mora jasno znati šta je dozvoljena pomoć pri radu, a šta podvala. Sam žig na to pitanje ne može da odgovori.
Za medije važe drugačija pravila
Pravni okvir u Evropskoj uniji postavljen je članom 50. evropskog Zakona o veštačkoj inteligenciji (AI Act). Ovaj propis obavezuje tvorce velikih jezičkih modela da obezbede tehnička rešenja kojima se prepoznaje mašinski stvoren sadržaj. Ipak, zakonodavac je predvideo i razumne izuzetke, pre svega za upotrebu ovih alata u svrhe lekture i obrade teksta koja suštinski ne menja smisao niti tačnost samih podataka.
Za same redakcije znatno je važnija zakonska obaveza da javnosti stave do znanja kako je tekst nastao. Kada medij objavi tekst koji je napisala veštačka inteligencija, a bavi se temama od javnog značaja, dužan je da o tome obavesti čitaoce. Međutim, tu postoji ključan izuzetak: ta obaveza prestaje ukoliko je rukopis prošao redakcijsku proveru, ako su činjenice proverene i ako iza svake napisane reči imenom i prezimenom stoji urednik ili novinar koji za nju odgovara pred zakonom.
Tačnije, odsustvo vodenog žiga ne oslobađa redakciju odgovornosti za sporni tekst, baš kao što joj ni njegovo prisustvo ne šteti ukoliko stoji iza tačnosti objavljenih navoda.
Naposletku, upotrebna vrednost nevidljivog žiga ne zavisi od kvaliteta softvera, već od značaja koji mu se pripisuje i od toga kako institucije budu tumačile njegove rezultate.
Nevidljivi žig može imati smisla jedino kao signal uredniku ili profesoru da postoji sumnja da je tekst napisan pomoću alata veštačke inteligencije. Ukoliko se njegov izveštaj bezrezervno prihvati kao osnov za odbacivanje rukopisa, disciplinsku meru ili profesionalnu diskvalifikaciju, odluka će počivati na pretpostavci koju ni sama tehnologija ne može sa sigurnošću da potvrdi.
Milena Šović, AI Implementation Specialist & AI Content Trainer



