Benvenuti su Sì! Magazine - il blog di pagine sì!

Google presenta Gemini 3.8 Live, la nuova AI per conversazioni vocali avanzate

I nuovi modelli Gemini 3.8 Live e Live Extended Thinking migliorano il ragionamento in tempo reale, gli assistenti vocali e le applicazioni AI di Google
google gemini

Google amplia la propria famiglia di modelli di intelligenza artificiale con il lancio di Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking, due nuove soluzioni progettate per migliorare le interazioni vocali con l’AI. I modelli sono stati sviluppati per offrire un’esperienza conversazionale più naturale, con una maggiore capacità di comprendere richieste complesse e rispondere in modo rapido durante gli scambi in tempo reale.

L’obiettivo di Mountain View è rendere gli assistenti basati sull’intelligenza artificiale sempre più vicini a una comunicazione umana, grazie a sistemi in grado di elaborare informazioni durante una conversazione senza interrompere il flusso del dialogo.

Gemini 3.8 Live migliora gli assistenti vocali basati sull’intelligenza artificiale

Il modello Gemini 3.8 Live è stato pensato principalmente per garantire un equilibrio tra prestazioni elevate, possibilità di utilizzo su larga scala e contenimento dei costi operativi. La nuova tecnologia permette agli sviluppatori di creare agenti vocali più efficienti, capaci di interagire con gli utenti attraverso conversazioni dinamiche e immediate.

Questo modello rappresenta una soluzione dedicata soprattutto agli scenari in cui velocità e affidabilità sono elementi fondamentali. Le sue caratteristiche lo rendono adatto alla realizzazione di strumenti vocali integrati in diversi servizi digitali, dalle applicazioni aziendali agli assistenti personali.

Google punta così a rafforzare il ruolo dell’intelligenza artificiale conversazionale all’interno del proprio ecosistema, includendo applicazioni come la ricerca online, l’assistente Gemini e gli strumenti della piattaforma Workspace.

Gemini 3.8 Live Extended Thinking introduce il ragionamento avanzato

Accanto alla versione standard arriva Gemini 3.8 Live Extended Thinking, un modello progettato per affrontare attività che richiedono una maggiore capacità di analisi. La tecnologia permette infatti di sviluppare processi di ragionamento composti da più passaggi, offrendo un supporto più efficace nella gestione di richieste complesse.

Questa variante è destinata a situazioni in cui non basta una risposta immediata, ma è necessario valutare più elementi contemporaneamente. Le sue capacità possono essere sfruttate per applicazioni professionali, strumenti aziendali e sistemi AI che devono affrontare problemi articolati.

Secondo i dati diffusi da Google, il modello ha ottenuto risultati rilevanti nei test comparativi. Gemini 3.8 Live Extended Thinking ha raggiunto il primo posto nell’Artificial Analysis Speech to Speech Quality Index con un punteggio dell’82,6%, evidenziando prestazioni elevate nella qualità delle interazioni vocali.

Nuove opportunità per agenti vocali e servizi Google

I due nuovi modelli saranno alla base di una nuova generazione di agenti vocali intelligenti, progettati per comprendere meglio il contesto delle conversazioni e offrire risposte più pertinenti.

Google prevede l’integrazione delle tecnologie Gemini 3.8 Live all’interno di diversi prodotti e servizi. Tra questi figurano l’app Gemini, la ricerca con funzionalità live e gli strumenti di produttività inclusi in Google Workspace.

La diffusione dei nuovi modelli riguarda diversi destinatari: sviluppatori, aziende e utenti finali potranno accedere alle funzionalità attraverso canali differenti.

Distribuzione di Gemini 3.8 Live e Extended Thinking

Gemini 3.8 Live è già disponibile per gli sviluppatori tramite l’API Gemini e Google AI Studio, oltre che per alcuni clienti enterprise attraverso programmi di anteprima. Il modello sarà inoltre utilizzabile dagli utenti nella ricerca live di Google.

Per quanto riguarda Gemini 3.8 Live Extended Thinking, la distribuzione coinvolge gli sviluppatori attraverso gli stessi strumenti, mentre sul fronte aziendale arriverà inizialmente in anteprima privata per Gemini Enterprise e successivamente per Gemini Enterprise for Customer Experience e gli account business di Google Workspace.

Gli utenti potranno utilizzare il modello anche attraverso Gemini Live, Google AI Pro con abbonamento Ultra, Docs all’interno di Workspace e i servizi Gmail e Keep inclusi nei vari piani disponibili.

Sicurezza dei contenuti AI con il watermark SynthID

Google ha inoltre confermato che l’audio generato dai nuovi modelli sarà contrassegnato tramite SynthID, il sistema di watermark sviluppato dall’azienda per identificare contenuti prodotti dall’intelligenza artificiale.

La tecnologia inserisce un segnale nascosto all’interno del flusso audio, senza modificarne la qualità percepita dagli ascoltatori. Lo scopo è facilitare il riconoscimento dei contenuti sintetici e contribuire alla riduzione dei rischi legati a utilizzi impropri dell’AI, come la diffusione di audio falsificati o contenuti ingannevoli.

Con Gemini 3.8 Live e Live Extended Thinking, Google continua quindi lo sviluppo di modelli multimodali orientati alla conversazione naturale, puntando su maggiore precisione, capacità di ragionamento e integrazione nei servizi digitali quotidiani.

Condividi l'Articolo:

Immagine di Redazione

Redazione

Le persone del Sì! Magazine, il blog di Pagine Sì! dedicato alla realtà digitale. Scriviamo guide, informazioni, approfondimenti e notizie sul nostro mondo. Qui trovi le piccole e grandi storie di successo, gli importanti dibattiti sull’innovazione, i temi legati alla trasformazione digitale, gli strumenti utili legati alla tecnologia e al marketing.