Nedavne promene u evropskom zakonodavstvu, tačnije primena Zakona o veštačkoj inteligenciji Evropske unije (EU AI Act), naterale su velike tehnološke kompanije da počnu sa ozbiljnim obeležavanjem sadržaja koji prave mašine. Kao odgovor na ove zahteve za većom transparentnošću, kompanija Anthropic je potvrdila da njihov poznati jezički model Claude sada globalno ugrađuje mašinski čitljiv vodeni žig u sve što napiše.
Međutim, za razliku od fotografija na kojima smo navikli da vidimo veliki, polutransparentni logo preko cele slike, ovde je situacija potpuno drugačija. Kako Claude zapravo ubacuje taj zaštitni znak u čiste reči, a da mi to ne možemo da primetimo?
Zaboravite na skrivene karaktere i dodatne razmake
Kada se pomene skriveni potpis u tekstu, mnogi ljudi pogrešno pretpostavljaju da veštačka inteligencija ubacuje nevidljive karaktere, duple razmake ili poseban kompjuterski kod skriven između slova. Kompanija Anthropic je jasno stavila do znanja da se ništa opipljivo ne dodaje u sam tekst i da apsolutno nema skrivenih karaktera.
Njihovo inženjersko rešenje se zapravo oslanja na suptilniji pristup poznat kao SynthID-Text, tehnologiju koju je originalno razvila kompanija Google DeepMind. Tajna se ne krije u dodavanju nečega novog, već u samom načinu na koji mašina donosi odluke dok piše.
Matematička igra i predviđanje sledeće reči
Da bismo razumeli kako ovaj sistem radi, moramo znati kako AI modeli uopšte funkcionišu. Veliki jezički modeli (LLM) stvaraju tekst tako što konstantno računaju verovatnoću i biraju koja reč, odnosno token, najlogičnije sledi nakon prethodnih reči.
Uzmimo za primer jednostavnu rečenicu: „Vreme je danas bilo hladno i…“. Jasno je da sledeća reč sasvim sigurno neće biti „slatko“. Međutim, sistem najčešće ima više podjednako dobrih i smislenih opcija za nastavak, poput reči „oblačno“ ili „sivo“. U normalnim okolnostima, običan softverski generator nasumičnih brojeva bi presudio koju će od ove dve reči model iskoristiti, jer čitaocu to suštinski ne menja smisao rečenice.
I upravo tu na scenu stupa vodeni žig! Umesto standardnog i potpuno nasumičnog biranja, vodeni žig koristi specijalni tajni kriptografski ključ i analizira nekoliko reči koje su prethodile, kako bi odlučio koju će reč model konačno odabrati. Zato se reči i dalje biraju naizgled prirodno, ali sa blagom statističkom pristrasnošću koja favorizuje reči na osnovu tog tajnog šablona.
Kada se takve „sitne“, nebitne odluke ponove desetine ili stotine puta tokom čitanja jednog dugačkog teksta, stvara se jedinstveni matematički obrazac. Taj obrazac je potpuno neprimetan za vas dok čitate, ali ga detektor koji poseduje pomenuti tajni ključ može lako izmeriti i izračunati statističku verovatnoću da je tekst napisao upravo Claude.
Da li žig kvari kvalitet vašeg teksta
Apsolutno ne. Zvanični interni testovi su pokazali da ovaj specifični proces ne utiče na kreativnost, ukupan kvalitet, kao ni na brzinu generisanja teksta. Sistem je optimizovan tako da ne zahteva dodatne tokene za rad. Model neće odjednom početi da koristi bizarne ili arhaične reči samo da bi veštački ispoštovao matematički vodeni žig – on i dalje bira isključivo iz skupa reči koje su maksimalno logične za dati kontekst.
Pošto je statistički potpis utkan u same reči, on uspešno preživljava i ostaje prisutan čak i kada korisnik kopira tekst i prebaci ga u neki sasvim drugi dokument ili aplikaciju.
Gde ovaj sistem najlakše puca i koje su mu mane
Iako ova tehnologija zvuči kao savršeno rešenje za profesore koji pregledaju eseje, ona nikako nije neuništiva. Postoje vrlo jasna ograničenja i situacije u kojima detekcija gubi svoju moć:
-
Kratki pasusi i poruke jednostavno ne sadrže dovoljno reči da bi se matematički obrazac pravilno i sigurno formirao, što drastično otežava pouzdanu detekciju.
-
Duboko i temeljno parafraziranje teksta najčešće potpuno uništava ovaj statistički potpis.
-
Snažno ljudsko uređivanje teksta ili njegovo prevođenje na drugi strani jezik takođe brišu dokaze.
-
Ako tekst koji je napisao Claude ubacite u drugi AI model (na primer ChatGPT) i zatražite da ga samo malo izmeni, prvobitni vodeni žig će veoma verovatno nestati pod naletom novog šablona.
Na kraju, postoji jedan veliki problem o kom se danas najviše polemiše – šta se dešava ako ste vi napisali ceo članak od nule, ali ste na kraju zamolili AI asistenta da samo ispravi jednu zapetu, lektoriše tekst ili poboljša gramatiku? Rezultujući tekst će i nakon tako male intervencije i dalje nositi vodeni žig.
Zbog toga Anthropic jasno i glasno upozorava javnost da detektovan žig ne dokazuje da je AI samostalno napisao celokupan sadržaj. On je isključivo tehnički dokaz da je model u nekom trenutku „dodirnuo“, procesuirao ili uredio taj tekst.
Dakle, vodeni žig je tu da ostane, a digitalni otisak je postao inteligentniji i suptilniji nego ikada pre. Ulazimo u eru gde granica između mašinskog i ljudskog pera postaje stvar statistike i skrivenih ključeva.



