Google predstavio Gemini 3.8: Kreirajte sopstvene glasove uz pomoć veštačke inteligencije

jakovradojevic
2 Min Read

Google je ponovo podigao lestvicu u svetu veštačke inteligencije. Najnovija verzija njihovog modela, Gemini 3.8, donosi napredne mogućnosti pretvaranja teksta u govor (text-to-speech), koje korisnicima omogućavaju da kreiraju sopstvene, potpuno unikatne glasove.

Google predstavio Gemini 3.8: Kreirajte sopstvene glasove uz pomoć veštačke inteligencije

Ova funkcionalnost, najavljena putem zvaničnog YouTube kanala, predstavlja značajan iskorak u personalizaciji AI asistenata. Umesto da birate između nekoliko unapred definisanih glasova, Gemini 3.8 vam omogućava da “obučite” model da govori vašim tonom, ili tonom koji ste oduvek želeli.

Kako funkcioniše kreiranje glasa?

Suština je u sintezi govora vođenoj veštačkom inteligencijom. Korisnici mogu da unesu uzorke svog glasa ili da kroz jednostavan interfejs opišu kakav glas žele (npr. “dubok, miran muški glas sa blagim britanskim naglaskom”). Gemini 3.8 zatim generiše govor koji zvuči neverovatno prirodno, sa svim emocijama i intonacijama.

Ovo otvara vrata brojnim primenama — od stvaranja audio-knjiga sa vašim omiljenim likovima, preko razvoja personalizovanih virtuelnih asistenata, do pomoći osobama koje su izgubile sposobnost govora. Google ističe da je tehnologija optimizovana za real-time upotrebu, što znači da nema više neprijatnih pauza tokom konverzacije.

Iako još uvek nisu dostupni svi detalji o tome kada će ova funkcija biti široko dostupna, jasno je da se trka u razvoju generativne veštačke inteligencije dodatno zahuktava. Google je ovim potezom direktno izazvao konkurenciju poput OpenAI-ja i njihovog naprednog TTS modela.

Za sada, možete pogledati zvanični YouTube video koji prikazuje mogućnosti Gemini 3.8 u kreiranju glasova. Ostaje da vidimo kako će ova tehnologija biti integrisana u svakodnevne aplikacije i koliko će zaista biti pristupačna krajnjim korisnicima.

Share this Article
Leave a comment