
Zamislite da vodite video-poziv sa osobom koju poznajete. Razgovor teče prirodno, sagovornik klima glavom, pravi pauze, čak i ono čuveno “hm” koje ispuni tišinu. A onda saznate da je sve vreme to bio AI. Zvuči kao scena iz naučne fantastike, ali upravo je to postalo realnost — nova tehnologija za generisanje video-poziva sa veštačkom inteligencijom toliko je ubedljiva da skoro polovina ispitanika nije posumnjala da razgovara sa mašinom.
Ovo nije još jedan u nizu deepfake eksperimenata koji se završavaju mucanjem i čudnim pokretima očiju. Reč je o sistemu koji u realnom vremenu generiše video i audio odgovore, prati kontekst razgovora i simulira ljudsko ponašanje do te mere da je granica između stvarnog i sintetičkog sadržaja praktično nestala. Prema podacima iz istraživanja, blizu 50 odsto učesnika nije prepoznalo da komunicira sa AI agentom, čak i kada su bili unapred upozoreni da je to moguće.
Kako je ovo uopšte moguće?
Ključ je u kombinaciji nekoliko tehnoloških probojaka koji su se poklopili u poslednjih godinu i po dana. Prvo, generativni AI modeli za video i govor dostigli su nivo na kojem mogu da proizvedu kadrove u realnom vremenu bez primetnog kašnjenja. Drugo, veliki jezički modeli (LLM) sada mogu da vode razgovor koji zvuči prirodno — sa humorom, uzdržanošću, čak i blagim nerazumevanjem koje je karakteristično za ljude. Treće, sinhronizacija usana i izraza lica više nije jeziva dolina, već prilično ubedljiv spektakl.
Ono što ovu tehnologiju izdvaja od ranijih pokušaja jeste interaktivnost u realnom vremenu. Dok su stariji sistemi generisali video unapred ili uz veliko kašnjenje, novi pristup omogućava da AI “sluša” sagovornika i trenutno reaguje — klimanjem glave, promenom izraza lica, pa čak i verbalnim odgovorima koji se poklapaju sa tonom razgovora. To je ono što ljudski mozak najteže detektuje, jer nesvesno tražimo mikro-izraze i sitne nesavršenosti koje odaju mašinu.
Šta ovo znači za svakodnevni život?
Posledice su dalekosežne, i to u oba smera. Sa jedne strane, ova tehnologija otvara vrata potpuno novim oblicima komunikacije — od virtuelnih asistenata koji izgledaju i zvuče kao prave osobe, do korisničke podrške koja više ne deluje robotski. U poslovnom svetu, AI agenti na video-pozivima mogli bi da vode preliminarne intervjue, prodajne razgovore ili čak terapijske sesije.
Sa druge strane, otvara se Pandorina kutija kada je reč o bezbednosti i poverenju. Ako skoro polovina ljudi ne može da razlikuje AI od čoveka na video-pozivu, šta to znači za online prevaru, krađu identiteta i manipulaciju javnim mnjenjem? Stručnjaci već upozoravaju da će detekcija sintetičkih medija postati jedan od najvećih izazova digitalnog doba — trka u naoružanju između onih koji stvaraju i onih koji otkrivaju deepfake sadržaj tek počinje.
Telegraf.rs prenosi da je ova tehnologija izazvala pomešane reakcije u tech zajednici. Dok jedni slave dostignuće kao korak ka potpuno novoj eri interakcije čovek-mašina, drugi pozivaju na hitno regulisanje i obavezno označavanje AI-generisanog sadržaja. Ono što je sigurno jeste da će se rasprava o etici, privatnosti i granicama veštačke inteligencije samo zaoštriti.
Gde je granica?
Ovo nije prvi put da tehnologija pretekne našu sposobnost da je razumemo. Ali retko kada je ta razlika bila tako tanka kao sada — svedena na nekoliko piksela i milisekundi kašnjenja. Sledeći put kada budete na video-pozivu, možda bi trebalo da se zapitate: da li je osoba sa druge strane zaista osoba? Odgovor bi mogao da vas iznenadi.
Jedno je jasno — AI video-pozivi nisu više eksperiment iz laboratorije. Oni su tu, među nama, i pitanje nije da li će promeniti način na koji komuniciramo, već koliko smo spremni da se nosimo sa tim.