Google predstavio Gemini 3.8 Live: Glasovni AI koji konačno zvuči kao pravi sagovornik

jakovradojevic
4 Min Read

Google je upravo predstavio dva nova modela veštačke inteligencije koja bi mogla da promene način na koji razgovaramo sa tehnologijom. U pitanju su Gemini 3.8 Live i Gemini 3.8 Live Extended Thinking — modeli koji donose ozbiljan napredak u glasovnoj interakciji i razumevanju konteksta u realnom vremenu.

Google predstavio Gemini 3.8 Live: Glasovni AI koji konačno zvuči kao pravi sagovornik

Ako ste ikada pokušali da vodite smislen razgovor sa glasovnim asistentom, znate koliko to ume da bude frustrirajuće. Prekidi, nesporazumi, čekanje da AI “procesuira” ono što ste rekli — sve to deluje kao da razgovarate sa robotom, a ne sa sagovornikom. Novi Gemini modeli upravo tu barijeru pokušavaju da sruše.

Dva modela, dve namene

Gemini 3.8 Live je napravljen za brzinu i efikasnost. Ovaj model kombinuje konverzacijsku inteligenciju sa tečnim dijalogom i vizuelnim razumevanjem — što znači da može da “vidi” ono što mu pokažete preko kamere i istovremeno vodi prirodan razgovor sa vama. Zamišljen je kao osnova za skalabilne glasovne agente koji mogu da se koriste u širokom spektru primena, od korisničke podrške do interaktivnih aplikacija.

Gemini 3.8 Live Extended Thinking je, kako ime sugeriše, namenjen kompleksnijim zadacima. Ovaj model može da obavlja višekoračno rezonovanje i rešava složene probleme — ali bez prekidanja razgovora. Drugim rečima, možete da razgovarate sa AI-jem dok on u pozadini radi na nečemu zahtevnom.

Google predstavio Gemini 3.8 Live: Glasovni AI koji konačno zvuči kao pravi sagovornik

Šta to praktično znači?

Zamislite da vozite automobil i pitate AI da vam pronađe najbolju rutu do destinacije, dok istovremeno analizira saobraćajne podatke u realnom vremenu. Ili da kuvate i tražite od asistenta da prilagodi recept za šest osoba umesto četiri, dok vam istovremeno objašnjava korake. Ovi modeli su dizajnirani upravo za takve scenarije — gde je potrebna i brza reakcija i dublja analiza.

Prema Google-ovom blog postu, ključna poboljšanja uključuju mogućnost prekidanja razgovora bez gubitka konteksta, prebacivanje između jezika tokom razgovora i sposobnost da AI objasni svoj proces razmišljanja dok radi na zadatku.

Za developere i obične korisnike

Ono što je posebno zanimljivo jeste da ovi modeli nisu namenjeni samo developerima i kompanijama. Iako će preduzeća moći da ih koriste za izgradnju pouzdanih glasovnih agenata putem Gemini API-ja, obični korisnici će ih pronaći u Google Workspace-u, Gemini aplikaciji i pretrazi. To znači da ćete moći da obavljate složene zadatke koristeći samo svoj glas — bilo da organizujete sastanke, analizirate dokumente ili tražite informacije.

Google predstavio Gemini 3.8 Live: Glasovni AI koji konačno zvuči kao pravi sagovornik

Veliki korak ka prirodnijoj komunikaciji

Iako smo navikli na impresivne demonstracije AI tehnologija, činjenica je da su glasovni asistenti do sada često ostavljali mnogo da se poželi. Novi Gemini modeli deluju kao ozbiljan pokušaj da se taj jaz smanji. Umesto da čekate da asistent “shvati” šta ste rekli, možete da vodite razgovor koji podseća na razmenu sa stvarnom osobom — sa pauzama, prekidima i promenama teme, baš kao u pravom razgovoru.

Naravno, ostaje da vidimo kako će se ovi modeli ponašati u praksi i da li će opravdati obećanja. Ali ako je suditi po onome što Google najavljuje, čini se da smo korak bliže trenutku kada će razgovor sa AI-jem konačno izgledati — i zvučati — potpuno prirodno.

Share this Article
Leave a comment