Google dà un volto alle conversazioni con Gemini 3.8 Live. L’aggiornamento introduce Live Avatar, una figura animata che risponde mentre l’utente parla con il modello. La voce è accompagnata dal movimento delle labbra e da espressioni facciali diverse, così la risposta assume anche una forma visiva. È un cambiamento concreto nell’interfaccia: l’utente può seguire la conversazione guardando un interlocutore digitale, oltre che ascoltandone le parole.
Per ora Live Avatar è disponibile soltanto ai clienti Gemini Enterprise. La scelta colloca il lancio nell’offerta destinata alle organizzazioni, dove un avatar può diventare il volto di un’interazione con l’AI. L’annuncio riguarda una funzione che combina conversazione e video generato durante lo scambio: il personaggio deve accompagnare la risposta mentre viene pronunciata, mantenendo coerenti voce, bocca ed espressioni.
La capacità multilingue è uno degli aspetti su cui Google insiste. Live Avatar supporta 97 lingue e, secondo l’azienda, può passare dall’una all’altra senza perdere fedeltà video né introdurre derive visive. Per un’organizzazione che dialoga con utenti in lingue diverse, il punto è mantenere riconoscibile lo stesso avatar durante la conversazione, anche quando cambia la lingua parlata. Google presenta questa continuità come una caratteristica del sistema.
In un video diffuso dall’azienda, l’avatar parla in inglese e in giapponese. In entrambi i passaggi, l’animazione della bocca segue ciò che viene detto. La dimostrazione rende visibile il lavoro richiesto alla sincronizzazione: non basta produrre una risposta nella lingua corretta, perché anche il movimento del volto deve restare allineato alla voce mentre la conversazione procede.
Live Avatar può inoltre mostrare informazioni sullo schermo mentre parla. La risposta può quindi affiancare alla spiegazione orale contenuti visibili nella stessa interazione. Per chi usa il sistema, il volto animato non è l’unico elemento dell’interfaccia: la conversazione può includere materiale da osservare nel momento in cui viene presentato. È una combinazione che apre a scambi in cui ascolto e consultazione avvengono insieme.
Il lancio arriva circa una settimana dopo la presentazione del nuovo modello Gemini 3.8 Live. Google afferma che il modello elabora gli input visivi quasi in tempo reale. Live Avatar aggiunge a questa base un modo per rappresentare visivamente le risposte del sistema. La vicinanza tra i due annunci mostra la direzione del prodotto: un’interazione in cui il modello riceve elementi visivi e restituisce risposte attraverso voce, immagini sullo schermo e un volto animato.
Le organizzazioni potranno scegliere un personaggio da una libreria di avatar preimpostati oppure crearne uno proprio. Questa possibilità lascia ai clienti la scelta di come presentare l’assistente nelle interazioni con gli utenti. Google ha descritto entrambe le opzioni come parte dell’offerta, dando spazio sia a una selezione pronta all’uso sia a un’identità visiva definita dall’organizzazione.
Google afferma infine che i contenuti prodotti da Live Avatar includono il watermark invisibile SynthID e misure di tutela pensate per rispettare l’identità. Sono elementi che accompagnano la possibilità di creare avatar personalizzati, dove l’aspetto di una persona digitale diventa parte del prodotto. Con questa funzione, Gemini Enterprise porta la conversazione con l’AI su un piano audiovisivo che le aziende potranno configurare per i propri utenti.