Veštačka inteligencija na srpskom 16.09.2026.

Google predstavio Gemini 3.8 Live za glasovne razgovore

Google predstavio Gemini 3.8 Live za glasovne razgovore

Google je 15. septembra predstavio dva nova modela za glasovnu komunikaciju, Gemini 3.8 Live i Gemini 3.8 Live Extended Thinking, namenjena razgovoru u realnom vremenu uz vizuelno razumevanje i podršku za desetine jezika. Kompanija ih opisuje kao svoje najnaprednije glasovne modele do sada, a najavila je postepeno uvođenje u Gemini API, Google AI Studio, Search Live, aplikaciju Gemini Live i pojedine alate u Workspace paketu.

Reč je o nastavku serije nadogradnji koje je Google ovog leta i jeseni uvodio u porodicu Gemini 3.8, posle Gemini 3.8 Flash modela koji je predstavljen svega nekoliko nedelja ranije. Dok je Flash bio usmeren na brzinu i nižu cenu obrade teksta i slike, novi Live modeli su napravljeni posebno za razgovor uživo, sa naglaskom na to da odgovor zvuči prirodno i da stiže bez zastoja.

Šta modeli donose

Osnovna verzija, Gemini 3.8 Live, namenjena je jeftinijim i skalabilnim razgovorima. Model obrađuje vizuelni sadržaj gotovo u realnom vremenu, što znači da može da prati ono što korisnik pokaže preko kamere i da o tome govori u hodu. Prema navodima Google-a, model automatski prepoznaje i prebacuje između 97 jezika tokom istog razgovora, bez potrebe da korisnik unapred izabere jezik. Može i da pokreće alate i API pozive u pozadini, a da pritom ne prekida tok razgovora, što je nadogradnja u odnosu na ranije glasovne modele kompanije, uključujući Gemini 3.5 Transcribe, koji je bio usmeren pre svega na prepis govora, ne i na razgovor uživo.

Zahtevnija varijanta, Gemini 3.8 Live Extended Thinking, gradi se na istoj osnovi, ali dodaje višestepeno rezonovanje dok model istovremeno govori. Prema opisu Google-a, model naglas najavljuje korake razmišljanja, na primer rečenicom tipa poput "Let me check that..." na engleskom, i naglas prati napredak kod složenijih zadataka. Zamišljen je za poslovne agente koji, recimo, treba da provere stanje porudžbine ili odgovore na zahtev korisnika kroz više koraka umesto jednog direktnog odgovora.

Rezultati merenja

Google navodi da je Gemini 3.8 Live Extended Thinking osvojio prvo mesto na Speech to Speech Quality Index istraživačke kuće Artificial Analysis, sa ocenom 82,6. Na testu agentskih zadataka τ-Voice model je rešio 68,6 odsto zadataka, dok je na užem testu za bankarske scenarije, τ-Voice-banking, rezultat 35,1 odsto. Na Big Bench Audio testu rezonovanja model je postigao 97,7 odsto tačnosti, a na nezavisnoj Speech Agent Areni zauzeo drugo mesto.

Google u saopštenju direktno poredi rezultate sa konkurentskim glasovnim sistemima, pre svega OpenAI-jevim GPT Live 1 Astra i Grok Voice modelom, tvrdeći da Gemini 3.8 Live Extended Thinking prednjači po kvalitetu razgovora uz nižu cenu po minutu. Tačan cenovnik za sada nije objavljen. Svi zvučni zapisi koje modeli proizvode nose SynthID vodeni žig, tehnologiju koju Google koristi da bi se sadržaj generisan veštačkom inteligencijom mogao naknadno prepoznati.

Dostupnost

Programeri mogu da testiraju oba modela preko Gemini API-ja i Google AI Studija odmah po objavi. Za velike korisnike, Gemini 3.8 Live Extended Thinking je za sada u privatnoj pretprodukciji unutar Gemini Enterprise, uz najavu da stiže i u Gemini Enterprise for Customer Experience, proizvod namenjen korisničkoj podršci. Kompanije koje su testirale modele pre objave, među njima Salesforce, ServiceNow i Genspark, pohvalile su brzinu odziva i sposobnost pozivanja spoljnih alata tokom razgovora.

Za obične korisnike, osnovna verzija Gemini 3.8 Live stiže u Search Live, Google-ovu opciju za glasovnu pretragu, dok Extended Thinking varijanta ulazi u aplikaciju Gemini Live i u pojedine Workspace alate, uključujući Docs, Gmail i Keep, za pretplatnike Google AI Pro i AI Ultra planova. Korisnici besplatnog Google AI naloga dobijaju pristup Extended Thinking modelu samo u Gmail-u i Keep-u, dok je puna verzija u Docs-u rezervisana za plaćene planove. Ova nadogradnja se nadovezuje na širi trend uvođenja glasovnih i multimodalnih mogućnosti u svakodnevne Google alate, sličan onome koji je viđen i kod produžetka Gemini video generisanja na 40 sekundi u 4K rezoluciji. Više o mogućnostima i ograničenjima cele porodice modela dostupno je na stranici posvećenoj Gemini-ju.

Često postavljana pitanja

Šta je Gemini 3.8 Live?
To je novi Google-ov model za glasovni razgovor u realnom vremenu, sa vizuelnim razumevanjem i automatskim prepoznavanjem 97 jezika tokom razgovora.

Po čemu se razlikuje od Gemini 3.8 Flash?
Flash je opšti model za tekst i sliku fokusiran na brzinu i cenu, dok je Live napravljen posebno za glasovni razgovor uživo, uključujući varijantu sa produženim rezonovanjem za složenije zadatke.

Da li je dostupan korisnicima u Srbiji?
Programeri svuda mogu da ga isprobaju preko Gemini API-ja i Google AI Studija. Dostupnost u Search Live-u, Gemini Live aplikaciji i Workspace alatima zavisi od toga da li je Google već pustio te proizvode u datoj zemlji i od tipa pretplate.

Koliko jezika model prepoznaje?
Google navodi da model automatski prepoznaje i prebacuje između 97 jezika u toku istog razgovora, bez ručnog podešavanja.

Da li se novi model plaća posebno?
Tačan cenovnik za programere nije objavljen u saopštenju. Za krajnje korisnike, pristup zavisi od postojećih Google AI Pro, Ultra ili besplatnih planova.

Ključne reči
Gemini 3.8 Live Google AI glasovni asistent Gemini Live Extended Thinking veštačka inteligencija
Podeli članak
Prethodni članakOpenAI, Anthropic i Google pregovaraju o A...

Budi u toku sa AI revolucijom

Prijavi se na newsletter i primaj najvažnije o AI agentima i modelima u inbox.