Google je ponovo u centru pažnje, a ovog puta ne zbog novog modela za chat, već zbog onoga što mnogi smatraju sledećim velikim korakom u svetu veštačke inteligencije — Gemini Robotics 2. U najnovijem video prilogu koji se pojavio na YouTube-u, tim inženjera i sam “Apollo”, kako je nazvan interaktivni demonstrator, pokazali su šta nova generacija robotike može da uradi.

Iako je YouTube opis štur i sadrži uglavnom tehničke informacije i standardne odredbe o autorskim pravima, sam snimak otkriva mnogo više. Naime, Gemini Robotics 2 nije samo nadogradnja softvera — reč je o potpuno novom pristupu u kojem AI modeli upravljaju fizičkim robotima u realnom vremenu, kombinujući vizuelnu percepciju, jezičke instrukcije i motoričke veštine.

Ono što ovaj demo čini posebno zanimljivim jeste način na koji robot komunicira sa okolinom. Umesto unaprijed programiranih pokreta, Gemini Robotics 2 koristi multimodalne modele koji mogu da razumeju govor, prepoznaju objekte i donose odluke u hodu. To znači da robot može da izvrši zadatak koji nikada ranije nije video — na primer, da pronađe predmet na osnovu usmenog opisa ili da se prilagodi promenama u prostoru.
Šta to znači za budućnost?
Ako se ove mogućnosti potvrde u široj primeni, Gemini Robotics 2 mogao bi da ubrza razvoj autonomnih robota u industriji, logistici, pa čak i u kućnim uslovima. Google već neko vreme ulaže u oblast poznatu kao embodied AI — veštačka inteligencija koja nije samo “mozak na serveru”, već je utelovljena u mašini koja deluje u fizičkom svetu.
Detaljnije o samom snimku možete pogledati na YouTube kanalu, gde je Google objavio kratak, ali sadržajan pregled onoga što nas očekuje. Iako još uvek nema zvaničnog saopštenja o komercijalnoj dostupnosti, jasno je da trka u robotici sa AI pogonom tek počinje.