Evo šta to znači za korisnike u EU
TEKST:
OpenAI je zvanično predstavio svoj pristup takozvanom tekstualnom vodenom žigu (text watermarking), kao direktan odgovor na nove zahteve EU AI Act-a. Cilj je jasan: omogućiti mašinski čitljivu identifikaciju teksta koji su generisali AI modeli, ali bez narušavanja kvaliteta samog izlaza.

Ova vest dolazi u trenutku kada regulatorni pritisak na generativnu veštačku inteligenciju raste iz nedelje u nedelju. Evropska unija je postavila rokove, a kompanije poput OpenAI-ja moraju da pronađu način da balansiraju između transparentnosti i tehničkih ograničenja koja su još uvek itekako prisutna.
Šta je zapravo textGrain?
OpenAI je razvio tehnologiju pod nazivom textGrain. Za razliku od vidljivih oznaka koje smo navikli da viđamo na slikama, ovaj sistem ubacuje nevidljivi statistički signal u izbor reči koje model generiše. Drugim rečima, sam tekst izgleda potpuno normalno ljudskom oku, ali algoritam za detekciju može da prepozna skriveni obrazac.
Zvuči kao naučna fantastika? Donekle i jeste, ali sa jasnim ograničenjima. OpenAI je i sam priznao da ova tehnologija nije savršena — daleko od toga.

Koliko je detekcija pouzdana?
U idealnim uslovima, rezultati su impresivni. Pri stopi lažno pozitivnih rezultata od 1%, detektor je uspeo da identifikuje vodeni žig u oko 80% kraćih tekstova (do 200 tokena) i čak 95% dužih tekstova (do 400 tokena). Međutim, kada je reč o sadržaju poput matematike — gde je izbor reči znatno ograničeniji — detekcija drastično opada.
Ono što dodatno komplikuje situaciju jeste uređivanje teksta. Ako zamenite samo 10% reči sinonimima, stopa detekcije pada sa 92% na 66%. Ako zamenite 25% reči, detekcija se survava na svega 17%. Ovo jasno pokazuje da vodeni žig nije neprobojan — daleko od toga.
Šta to praktično znači za korisnike?
OpenAI je odlučio da primeni fazni pristup. Evo šta to konkretno znači:
1. API korisnici mogu da se prijave — Počevši od danas, korisnici API-ja širom sveta mogu da uključe tekstualni vodeni žig za odabrane modele. Podrazumevano je isključen.
2. EU dobija nevidljivi žig — U narednim nedeljama, OpenAI će dodati nevidljivi vodeni žig na izlaz iz ChatGPT-a i Codex-a za korisnike u Evropskoj uniji.
3. Detektor je ograničen — Pristup detektoru biće omogućen samo odobrenim istraživačima i ekspertskim organizacijama koje mogu da pomognu u evaluaciji i unapređenju tehnologije.

Šta vodeni žig ne može da vam kaže?
Ovo je možda i najvažniji deo. OpenAI eksplicitno navodi da vodeni žig ne dokazuje autorstvo. On samo ukazuje na to da je tekst možda prošao kroz njihov sistem. Ne govori vam ko je tekst napisao, da li je uređivan, niti da li je originalan.
Drugim rečima, odsustvo vodenog žiga ne znači da tekst nije AI-generisan. A prisustvo istog ne znači da je tekst u potpunosti veštački.
Šire implikacije
OpenAI istovremeno podseća da njihovi alati za verifikaciju slika i audio zapisa ostaju javno dostupni. To uključuje openai.com/verify i Content Provenance API. Za razliku od teksta, ove tehnologije su zrelije i pouzdanije.
Ono što je ključno jeste da OpenAI planira da textGrain učini open source-om, kako bi i drugi mogli da grade na toj tehnologiji. To je pametan potez — jer ako želimo da se izborimo sa dezinformacijama u eri AI-ja, potrebna nam je industrijska saradnja, a ne zatvoreni sistemi.
Za sada, ostaje da vidimo kako će se ova tehnologija ponašati u realnim uslovima. Jer, kao što i sami inženjeri OpenAI-ja priznaju — savršeni uslovi u laboratoriji ne garantuju pouzdanost u svakodnevnoj upotrebi.