Gemini 3.8 Live: Google lancia due AI vocali più intelligenti
Google DeepMind ha annunciato due nuovi modelli vocali: Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking. Servono per parlare con l'AI in modo più naturale. Capiscono immagini, cambiano lingua e ragionano mentre parlano.
In breve
- Google lancia Gemini 3.8 Live e 3.8 Live Extended Thinking il 15 settembre 2026.
- I modelli vedono immagini in tempo reale e passano da una lingua all'altra durante la chat.
- Extended Thinking ragiona su compiti complessi mentre continua a parlare.
Due nuovi modelli per parlare con l'AI
Google DeepMind ha presentato due modelli vocali nuovi. Si chiamano Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking.
Servono per rendere le conversazioni con l'AI più naturali. L'annuncio è del 15 settembre 2026, sul blog di Google DeepMind.
Gemini 3.8 Live è pensato per la scala e il basso costo. Unisce intelligenza conversazionale, dialogo fluido e comprensione delle immagini.
Gemini 3.8 Live Extended Thinking è invece per compiti difficili. Ha più intelligenza e ragionamento in più passaggi.
In parole povere: sono due assistenti vocali. Uno è veloce ed economico. L'altro pensa più a fondo su problemi complessi.

Cosa sanno fare
Questi modelli guardano immagini quasi in tempo reale. Così capiscono meglio il contesto della conversazione.
Passano da una lingua all'altra durante la conversazione e gestiscono le interruzioni.
Possono gestire strumenti ed eseguire compiti in sottofondo, continuando a parlare senza interrompere la conversazione.
In parole povere: l'AI vede quello che le mostri, cambia lingua durante la conversazione e fa più cose insieme mentre ti parla.
I risultati nei test
Secondo la fonte, Gemini 3.8 Live Extended Thinking ha ottenuto il primo posto nello Speech to Speech Quality Index di Artificial Analysis, con un punteggio di 82,6.
Guida anche nel completamento di compiti complessi: 68,6% sul benchmark τ-Voice e 35,1% sul τ-Voice-banking di Sierra.
Sul test Big Bench Audio ha ottenuto il 97,7%. La fonte indica anche un prezzo competitivo rispetto ad altri modelli avanzati.
Gemini 3.8 Live, invece, si è piazzato secondo nella Speech Agent Arena. Resta molto economico da usare.
Sul benchmark EVA-Bench di ServiceNow, la fonte dice che i modelli spostano la frontiera di Pareto per i flussi di lavoro complessi.
In parole povere: nei test, questi modelli hanno ottenuto buoni piazzamenti. Uno vince per intelligenza, l'altro per il rapporto qualità-prezzo.
Come parlano mentre pensano
Extended Thinking ragiona e parla nello stesso momento. Il modello segnala di essere al lavoro mentre elabora, senza restare in silenzio.
Così la conversazione non si interrompe, anche durante compiti difficili.
Puoi usare i due modelli da oggi tramite Gemini API, Google Workspace e l'app Gemini. Sono disponibili anche in Search.
In parole povere: l'AI ti fa sapere che sta pensando, invece di lasciarti in attesa senza risposta.
Cosa cambia per te
Ecco cosa cambia se usi Gemini per parlare con l'AI.
- Puoi usare la voce per compiti più complessi, non solo domande semplici.
- L'AI capisce immagini mentre parli con lei, senza dover scrivere.
- Puoi passare da una lingua all'altra durante la conversazione e l'AI ti segue.
Google fa parlare l'AI e pensare insieme, senza pause imbarazzanti.
Fonti
Articolo divulgativo: i fatti sono rielaborati con parole nostre a partire dalle fonti citate. Per i dettagli ufficiali rimandiamo alle pagine originali. Aggiornato al 16 settembre 2026.
Immagini: sono illustrazioni generate con l'intelligenza artificiale e portano incisa l'icona ufficiale UE «AI GENERATED» (art. 50 AI Act). Non sono fotografie di fatti realmente accaduti e le persone ritratte non esistono: nessuna immagine raffigura persone reali citate nell'articolo.
Domande frequenti
Cosa distingue Gemini 3.8 Live da Extended Thinking?
Live è veloce ed economico. Extended Thinking ragiona più a fondo su compiti complessi.
Dove posso provare questi modelli?
Sono disponibili da oggi tramite Gemini API, Google Workspace, l'app Gemini e Search.





