Kompanija OpenAI odlučila je da podigne ulog u borbi protiv zloupotrebe veštačke inteligencije. Prema najnovijim informacijama, ChatGPT će ubuduće u generisani tekst ugrađivati nevidljivi vodeni žig — svojevrsni digitalni potpis koji bi trebalo da omogući prepoznavanje sadržaja koji je napisala mašina.

Ideja zvuči jednostavno: svaki put kada ChatGPT generiše duži tekst, u njega se “utka” jedinstveni algoritamski obrazac koji je nevidljiv ljudskom oku, ali ga specijalizovani alati mogu detektovati. Na taj način bi, u teoriji, bilo moguće utvrditi da neki tekst nije napisao čovek, čak i kada ga neko pokuša predstaviti kao svoj.
Kako funkcioniše nevidljivi vodeni žig?
Za razliku od klasičnih vodenih žigova koji se vide na slikama ili dokumentima, ovaj mehanizam radi na nivou verovatnoće. Model prilikom generisanja teksta ne bira uvek reč sa najvećom statističkom verovatnoćom, već pravi suptilne, unapred definisane izbore. Ti izbori formiraju obrazac koji detektorski algoritam može da prepozna.
Drugim rečima, vodeni žig ne menja smisao teksta, niti ga čini vidljivo drugačijim. On je “skriven” u načinu na koji su reči raspoređene i birane — poput tajnog potpisa koji ostaje zapisan ispod površine.
Slabost koja baca senku na celu ideju
Međutim, stručnjaci za bezbednost i obradu prirodnog jezika već ukazuju na ozbiljan problem. Vodeni žig je osetljiv na parafraziranje. Dovoljno je da neko tekst provuče kroz drugi AI alat, prevede ga na drugi jezik i vrati nazad, ili ga jednostavno prekuca svojim rečima — i trag se gubi.
To znači da će vodeni žig najbolje funkcionisati kao sredstvo za masovnu detekciju i statistiku, ali ne i kao pouzdan dokaz u pojedinačnim slučajevima. Za sada nije jasno ni da li će OpenAI ovu tehnologiju primenjivati globalno, niti kako će se nositi sa jezicima koji nisu engleski, gde su jezički obrasci daleko složeniji.
Šta to znači za korisnike i institucije?
Ova vest je posebno važna za obrazovne institucije, izdavače i medije koji se već godinama bore sa pitanjem kako prepoznati AI-generisan sadržaj. Univerziteti širom sveta uveliko koriste detektore poput GPTZero ili Turnitinovog AI modula, ali su ti alati često nepouzdani i skloni lažnim pozitivnim rezultatima.
Ako OpenAI uspe da implementira vodeni žig na skalabilan način, to bi mogao biti značajan korak napred. Ipak, ostaje ključno pitanje poverenja — ko će imati pristup detektoru, pod kojim uslovima, i kako će se sprečiti zloupotreba samog mehanizma?
Za sada, jedno je sigurno: trka između onih koji generišu AI sadržaj i onih koji ga pokušavaju prepoznati tek je počela. Vodeni žig je zanimljiv potez, ali daleko od konačnog rešenja.
Izvor: Mondo Bosna