GPT-Live migliora ChatGPT Voce con conversazioni più naturali

Articolo Precedente

precedente
Articolo Successivo

successivo

Redazione Scienza e Tecnologia Redazione Scienza e Tecnologia   -   GPT-Live migliora ChatGPT Voce introducendo conversazioni vocali più fluide, con un sistema capace di ascoltare e parlare contemporaneamente. La nuova tecnologia di OpenAI arriva per rendere il dialogo con l’intelligenza artificiale più simile a una conversazione tra persone, superando alcuni limiti delle precedenti modalità vocali basate su turni separati. La funzione permette infatti di mantenere attivo lo scambio anche quando l’utente interrompe, cambia idea o inserisce nuove informazioni durante la risposta.

Il nuovo modello vocale supera le interruzioni delle vecchie modalità

Prima dell’arrivo di GPT-Live, chi utilizzava la modalità vocale di ChatGPT doveva spesso gestire una dinamica meno naturale: l’utente parlava, il modello ascoltava, poi arrivava la risposta dell’intelligenza artificiale. Questo funzionamento poteva creare problemi soprattutto quando il sistema interpretava una pausa, un rumore di fondo o una parola pronunciata da qualcun altro nella stanza come un nuovo intervento dell’utente. In questi casi l’assistente poteva interrompere la risposta già iniziata oppure ricominciare da capo.

Il problema non era legato soltanto a ChatGPT, ma riguardava in generale gli assistenti vocali che utilizzano il rilevamento del silenzio per capire quando una persona ha terminato il proprio turno. Una pausa per riflettere o un momento di attesa potevano quindi essere interpretati come la conclusione della frase, creando conversazioni meno naturali e più simili a uno scambio a comandi. GPT-Live nasce proprio per modificare questo approccio e rendere il dialogo più continuo.

GPT-Live introduce un’architettura full-duplex per ChatGPT

La novità principale di GPT-Live riguarda l’architettura full-duplex, che consente al sistema di ascoltare e parlare nello stesso momento, in modo simile a quanto accade durante una telefonata. Questo cambiamento permette all’intelligenza artificiale di partecipare alla conversazione senza dover aspettare necessariamente la fine completa dell’intervento dell’utente, rendendo lo scambio più dinamico e vicino al linguaggio quotidiano.

OpenAI ha presentato GPT-Live come una nuova generazione di modelli vocali destinata a sostituire la modalità vocale avanzata di ChatGPT introdotta nel 2024 con GPT-4o. Per le richieste più complesse, GPT-Live collabora con GPT-5.5, mantenendo il dialogo attivo mentre il modello elabora la risposta o svolge attività avanzate. Il sistema punta quindi a combinare capacità di elaborazione e continuità nella conversazione.

La nuova funzione arriva per tutti gli utenti ChatGPT

GPT-Live è disponibile dall’8 luglio 2026 per gli utenti di ChatGPT, inclusi quelli con account gratuito. Il rilascio segna un cambiamento nel modo in cui le persone possono utilizzare la voce con l’intelligenza artificiale, passando da una modalità basata su comandi vocali separati a un’interazione più vicina a una chiacchierata continua.

Con GPT-Live ChatGPT Voce punta quindi a eliminare le conversazioni a scatti e a migliorare la gestione delle interruzioni, del tono e del ritmo dello scambio. La nuova esperienza vocale si concentra sulla capacità dell’assistente di seguire il filo del dialogo mentre ascolta, risponde e adatta il proprio comportamento all’andamento della conversazione.

Puoi condividere questo articolo o riprenderne i contenuti, anche parzialmente, citando la fonte con link attivo a informazione.news, il portale online di notizie e approfondimenti.