Google rivoluziona la traduzione vocale in tempo reale: arriva Gemini 3.5 Live Translate

Google rivoluziona la traduzione vocale in tempo reale: arriva Gemini 3.5 Live Translate


Nella serata italiana di ieri, Google ha annunciato Gemini 3.5 Live Translate, il nuovo modello audio di intelligenza artificiale specializzato nella traduzione vocale in tempo reale che supporta oltre 70 lingue, che punta ad abbattere ulteriormente le barriere linguistiche, rendendo le conversazioni tradotte fluide e naturali.

Vent’anni fa, la traduzione automatica di Google è nata come uno dei nostri esperimenti pionieristici di apprendimento automatico, con l’obiettivo di trasformare la scienza del linguaggio nella magia della connessione umana. Da allora, questo esperimento ha fatto molta strada, con oltre un trilione di parole tradotte ogni mese per miliardi di utenti sui nostri prodotti. Oggi compiamo un ulteriore passo avanti con il rilascio di Gemini 3.5 Live Translate, il nostro modello audio più recente per la traduzione simultanea da parlato a parlato.

Segui TuttoAndroid su Google Discover

Offerta

Google ha annunciato il modello audio Gemini 3.5 Live Translate

Come anticipato in apertura, Google ha annunciato il nuovo modello audio per la traduzione vocale in tempo reale Gemini 3.5 Live Translate, un modello che è in grado di rilevare automaticamente oltre 70 lingue e generare una traduzione vocale fluida e dal suono naturale, preservando l’intonazione, il ritmo e il tono di chi sta parlando.

A differenza dei sistemi “classici” di traduzione vocale, questo nuovo modello è davvero “in tempo reale”: Gemini 3.5 Live Translate genera la voce in modo continuo, trovando un equilibrio tra l’attesa del contesto e la traduzione immediata; insomma, funge da una sorta di interprete vero e sempre a portata di mano.

Niente pause, solo ritardo di pochi secondi (appunto per costruire una finestra di contesto e poter procedere pedissequamente con il discorso dell’interlocutore). L’utente riuscirà così a comprendere appieno ciò che sta dicendo l’interlocutore e persino il modo in cui lo sta dicendo, percependone anche il tono.

Potenzialità per gli sviluppatori (API Gemini Live e Google AI Studio)

Al netto del supporto a un numero maggiore di lingue, il modello Gemini 3.5 Live Translate ha la capacità di elaborare il parlato in tempo reale, districandosi al meglio tra diverse lingue: gli input multilingue vengono infatti gestiti in maniera automatica, senza che gli utenti debbano configurare manualmente qualcosa.

Al contempo, il modello è ottimizzato per elaborare anche audio prelevati in ambienti rumorosi e, di conseguenza, le sue potenzialità possono tornare utili per la traduzione in tempo reale in svariati contesti: chiamate, riunioni, lezioni, trasmissioni e altro ancora.

Google sta già mettendo il nuovo modello a disposizione degli sviluppatori tramite la API Gemini Live e all’interno della suite Google AI Studio: ad esempio, con l’API Gemini LIve gli sviluppatori possono mettere a punto esperienze di doppiaggio e traduzione simultanea in più lingue.

Sempre grazie a questa API, svariate piattaforme di sviluppo consentono agli sviluppatori di creare soluzioni che integrano la traduzione vocale in tempo reale con semplicità. Ad esempio, Grab sta testando il nuovo modello per consentire la comunicazione multilingue in tempo (quasi) reale tra autisti e viaggiatori.

Potenzialità per le aziende (Google Meet)

Il nuovo modello appena annunciato da Google potenzierà anche la traduzione vocale di Google Meet per migliorare l’esperienza dei clienti aziendali con il supporto a più lingue (dalle 5 precedenti si passa a oltre 70), la capacità di tradurre conversazioni in oltre 2.000 combinazioni linguistiche all’interno della singola riunione (prima era possibile tradurre solo da e verso l’inglese) e con una nuova interfaccia utente che fornirà l’accesso immediato alla funzione.

Potenzialità per gli utenti consumer (Google Traduttore)

Ci sono miglioramenti anche per quanto concerne gli utenti consumer che potranno beneficiare di questo nuovo modello direttamente dall’app Google Traduttore, sfruttando la funzione di traduzione in tempo reale con le cuffie, che abilita il supporto a oltre 70 lingue.

Per gli utenti in possesso di uno smartphone Android c’è di più perché si concretizza infatti una novità emersa già nel mese di maggioLa traduzione in tempo reale funziona anche senza cuffie: con la nuova modalità di ascolto, gli utenti dovranno semplicemente avvicinare lo smartphone all’orecchio, come se fosse una normale chiamata, per ascoltare la traduzione direttamente dalla capsula auricolare dello smartphone.

A detta di Google, questa potenzialità (abilitata da Gemini 3.5 Live Translate) può essere utile in quelle situazioni in cui l’utente desidera ascoltare le traduzioni senza che gli altri le sentano o in quelle situazioni in cui l’utente non ha cuffie a portata di mano.

Disponibilità del modello Gemini 3.5 Live Translate

Arrivati alla fine, non ci resta che segnalarvi che il nuovo modello Gemini 3.5 Live Translate è già in fase di implementazione sui seguenti prodotti Google:

  • Nella API Gemini Live e su Google AI Studio per gli sviluppatori (in anteprima pubblica).
  • Su Google Meet per i clienti aziendali (Google Workspace) che partecipano all’anteprima privata della funzione; nel corso dell’anno, l’implementazione verrà estesa a un pubblico più ampio.
  • Su Google Traduttore (app per Android e iOS) per gli utenti “consumer” a livello globale.

Google sottolinea che, alla pari degli altri contenuti generati dall’IA con i suoi modelli, anche tutti i file audio generati dai suoi modelli IA di questo tipo sono contrassegnati dalla filigrana SynthID per far sì che siano immediatamente riconducibili all’IA e prevenire la disinformazione.



Vedi Post Originale: https://www.tuttoandroid.net/news/2026/06/10/google-gemini-3-5-live-translate-ufficiale-1157548/

Condividi il tuo amore
Tutto Android
Tutto Android
Articoli: 31636

Lascia una risposta

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *