Ven. Set 25th, 2026
Gemini Ai ora ti consente di trasformare le tue idee in libri di fiabe illustrati con la narrazione

È stata una settimana impegnativa per Google: l'azienda ha annunciato diversi aggiornamenti in arrivo per una serie di servizi, che coprono tutto, dalle funzionalità di monitoraggio della salute, fino agli avatar AI online. A proposito di quest'ultimo, Google ha confermato di aver lanciato Gemini 3.8 Live con Live Avatar in Gemini Enterprise, che introduce una presenza visiva nei suoi modelli di intelligenza artificiale conversazionale.

Basandosi sulla versione Gemini 3.8 Live della settimana precedente, la nuova funzionalità abbina la generazione di video in streaming a bassa latenza con il parlato per creare un personaggio virtuale dinamico in grado di ascoltare, vedere e parlare contemporaneamente.

Immagine: Google

Google afferma che Live Avatar è progettato per applicazioni aziendali come il servizio clienti e procedure dettagliate interattive e presenta anche una precisa sincronizzazione labiale, espressioni facciali naturali e turni fluidi. Il sistema è in grado di elaborare input visivi e audio contemporaneamente per imitare la naturale interazione umana.

Immagine: Google

Per gestire operazioni complesse, la funzionalità supporta “l’esecuzione asincrona dello strumento”, consentendo essenzialmente all’intelligenza artificiale di recuperare dati e attivare attività in background mantenendo una conversazione ininterrotta. Include anche il supporto per la sincronizzazione vocale multilingue e cambia 97 lingue diverse durante la conversazione adattando i movimenti e le espressioni delle labbra.

LEGGI: ​​Il nuovo aggiornamento di Google Foto aggiunge 5 nuove funzionalità AI per le tue immagini

Google aggiunge che le organizzazioni che utilizzano la funzione possono accedere ad avatar predefiniti o crearne uno proprio da un'immagine di riferimento di alta qualità per abbinare identità di marca specifiche, sebbene la creazione personalizzata sia attualmente limitata all'utilizzo aziendale. Per motivi di sicurezza e trasparenza, tutti gli output audio e video sono incorporati con filigrane SynthID per garantire che i contenuti generati dall'intelligenza artificiale rimangano rilevabili.