{"id":2414,"date":"2026-10-01T16:27:57","date_gmt":"2026-10-01T16:27:57","guid":{"rendered":"https:\/\/11000.dev\/index.php\/2026\/10\/01\/google-predstavio-gemini-3-8-tts-glas-koji-zvuci-kao-covek-a-pravi-se-iz-jednog-prompta\/"},"modified":"2026-10-01T16:27:57","modified_gmt":"2026-10-01T16:27:57","slug":"google-predstavio-gemini-3-8-tts-glas-koji-zvuci-kao-covek-a-pravi-se-iz-jednog-prompta","status":"publish","type":"post","link":"https:\/\/11000.dev\/index.php\/2026\/10\/01\/google-predstavio-gemini-3-8-tts-glas-koji-zvuci-kao-covek-a-pravi-se-iz-jednog-prompta\/","title":{"rendered":"Google predstavio Gemini 3.8 TTS: Glas koji zvu\u010di kao \u010dovek, a pravi se iz jednog prompta"},"content":{"rendered":"<p><strong>Google je upravo predstavio dva nova modela za sintezu govora koji bi mogli da promene na\u010din na koji stvaramo audio sadr\u017eaj.<\/strong> U pitanju su Gemini 3.8 Flash TTS i Gemini 3.8 Flash-Lite TTS, a obe\u0107avaju ono \u0161to su kreatori godinama \u010dekali \u2014 potpunu kontrolu nad glasom, od akcenta do emocije.<\/p>\n<figure class=\"wp-block-image size-large\"><img decoding=\"async\" src=\"https:\/\/11000.dev\/wp-content\/uploads\/2026\/10\/gemini-audio__keyword__metacard__light.width-1300.png\" alt=\"Google predstavio Gemini 3.8 TTS: Glas koji zvu\u010di kao \u010dovek, a pravi se iz jednog prompta\" \/><\/figure>\n<p>Za razliku od starih sistema koji su radili po principu &#8220;izaberi jedan od ponu\u0111enih glasova i \u0107uti&#8221;, novi Gemini modeli funkcioni\u0161u kao pravi mali audio studio. Sve \u0161to vam treba jeste <strong>prirodan jezi\u010dki prompt<\/strong> \u2014 opi\u0161ete lik, akcenat, raspolo\u017eenje, pa \u010dak i to kako neko di\u0161e ili se smeje u pozadini, i model to izvede.<\/p>\n<h2>Od trideset glasova do beskona\u010dne biblioteke<\/h2>\n<p>Google se hvali da su sa prethodnih 30 unapred definisanih glasova sko\u010dili na prakti\u010dno neograni\u010denu biblioteku. Gemini 3.8 Flash TTS namenjen je onima koji \u017eele dubinsku kreativnu kontrolu \u2014 dizajnerima igara, autorima audio-knjiga, podkasterima i svima koji grade interaktivne medije. Mo\u017eete da re\u017eirate svaku liniju dijaloga ponaosob, birate tempo, menjate dijalekt u hodu, pa \u010dak i da dodate takozvano <em>backchanneling<\/em> \u2014 ono &#8220;aha&#8221;, &#8220;da, da&#8221;, &#8220;mmm&#8221; koje ljude \u010dini ljudima.<\/p>\n<figure class=\"wp-block-image size-large\"><img decoding=\"async\" src=\"https:\/\/11000.dev\/wp-content\/uploads\/2026\/10\/gemini-audio__keyword__metacard__.width-200.format-webp.webp\" alt=\"Google predstavio Gemini 3.8 TTS: Glas koji zvu\u010di kao \u010dovek, a pravi se iz jednog prompta\" \/><\/figure>\n<p>Sa druge strane, <strong>Gemini 3.8 Flash-Lite TTS<\/strong> cilja na masovnu produkciju. Brz, jeftin i optimizovan za sinhronizaciju velikih razmera, pravljenje audio sadr\u017eaja u velikom obimu i glasovne agente koji moraju da zvu\u010de prirodno, a da pritom ne ko\u0161taju bogatstvo. Fina kontrola tona i tempa ostaje tu, samo bez holivudske re\u017eije.<\/p>\n<h2>Gde sve ovo mo\u017ee da se koristi<\/h2>\n<p>Novi modeli su dostupni kroz <strong>Google AI Studio, Gemini API, Gemini Enterprise, Gemini Notebook i Google Vids<\/strong>. To zna\u010di da ih mo\u017eete ubaciti i u sopstvenu aplikaciju preko API-ja, ali i koristiti unutar Google-ovih alata za pravljenje videa ili bele\u0161ki.<\/p>\n<p>Ovo nije izolovan potez. Gemini Audio familija ubrzano raste \u2014 pre ovih modela stigli su 3.5 Live Translate, 3.5 Transcribe, 3.8 Live i 3.8 Live Extended Thinking. Google o\u010digledno gradi kompletan audio ekosistem, a TTS je samo jedan, ali verovatno najzvu\u010dniji deo slagalice.<\/p>\n<figure class=\"wp-block-image size-large\"><img decoding=\"async\" src=\"https:\/\/11000.dev\/wp-content\/uploads\/2026\/10\/blog-gemini-3.8-flash-tts__evals_.width-100.format-webp_21WnKg9.webp\" alt=\"Google predstavio Gemini 3.8 TTS: Glas koji zvu\u010di kao \u010dovek, a pravi se iz jednog prompta\" \/><\/figure>\n<h2>Bezbednost nije zanemarena<\/h2>\n<p>Kako to obi\u010dno biva kada se prave glasovi koji zvu\u010de kao stvarni ljudi, postavlja se pitanje zloupotrebe. Google tvrdi da je ugradio <strong>watermarking<\/strong> i druge sigurnosne mehanizme kako bi generisani audio mogao da se prepozna i kako bi se spre\u010dilo la\u017eno predstavljanje. Koliko je to zaista delotvorno, ostaje da vidimo u praksi \u2014 ali svest o problemu je barem tu.<\/p>\n<p>Detaljnije o svemu mo\u017eete pro\u010ditati na <a href=\"https:\/\/deepmind.google\/blog\/say-hello-to-gemini-38-text-to-speech\/\" target=\"_blank\">zvani\u010dnom Google DeepMind blogu<\/a>.<\/p>\n<p>Ono \u0161to je nekada zahtevalo studio, glumce i dane monta\u017ee, sada mo\u017ee da se odradi iz fotelje, uz nekoliko dobro napisanih re\u010denica. Pitanje vi\u0161e nije da li tehnologija mo\u017ee da zvu\u010di ljudski \u2014 pitanje je \u0161ta \u0107emo s njom raditi.<\/p>\n","protected":false},"excerpt":{"rendered":"<p>Google je upravo predstavio dva nova modela za sintezu govora koji bi mogli da promene na\u010din na koji stvaramo audio sadr\u017eaj. U pitanju su Gemini 3.8 Flash TTS i Gemini 3.8 Flash-Lite TTS, a obe\u0107avaju ono \u0161to su kreatori godinama \u010dekali \u2014 potpunu kontrolu nad glasom, od akcenta do emocije. Za razliku od starih sistema [&hellip;]<\/p>\n","protected":false},"author":1,"featured_media":2409,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"content-type":"","footnotes":""},"categories":[103,104],"tags":[],"class_list":["post-2414","post","type-post","status-publish","format-standard","has-post-thumbnail","category-ai","category-tehnologija"],"_links":{"self":[{"href":"https:\/\/11000.dev\/index.php\/wp-json\/wp\/v2\/posts\/2414","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/11000.dev\/index.php\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/11000.dev\/index.php\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/11000.dev\/index.php\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/11000.dev\/index.php\/wp-json\/wp\/v2\/comments?post=2414"}],"version-history":[{"count":0,"href":"https:\/\/11000.dev\/index.php\/wp-json\/wp\/v2\/posts\/2414\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/11000.dev\/index.php\/wp-json\/wp\/v2\/media\/2409"}],"wp:attachment":[{"href":"https:\/\/11000.dev\/index.php\/wp-json\/wp\/v2\/media?parent=2414"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/11000.dev\/index.php\/wp-json\/wp\/v2\/categories?post=2414"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/11000.dev\/index.php\/wp-json\/wp\/v2\/tags?post=2414"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}