La mia esperienza con la modalità vocale avanzata di ChatGPT: incredibilmente naturale
Scopri la mia esperienza con la modalità vocale avanzata di ChatGPT. Le conversazioni risultano più naturali e realistiche, dandoti la sensazione di parlare con una persona reale.
Le cose più importanti che devi sapere
- GPT-Live consente di parlare e ascoltare contemporaneamente, permettendo interruzioni e offrendo un'esperienza di conversazione più naturale con risposte più rapide.
- È in grado di gestire attività complesse in background e di fornire traduzioni in tempo reale mentre parli, ignorando i rumori di sottofondo.
- È possibile regolare il livello di "intelligenza" vocale di ChatGPT su tre modalità (istantanea, media, alta) per bilanciare velocità di risposta e precisione.
L'ultimo aggiornamento di ChatGPT, ora in fase di distribuzione a tutti gli utenti, è GPT-Live. OpenAI lo descrive come una "nuova generazione" di modelli vocali per interagire con i chatbot basati sull'intelligenza artificiale, e potresti scoprire che ti incoraggia a trascorrere più tempo a chattare piuttosto che a digitare, esplorando così le migliori funzionalità di ChatGPT.

L'input vocale in ChatGPT non è una novità, ma storicamente ha rappresentato un livello relativamente basilare rispetto all'input e all'output di testo standard. È stato descritto come un modo più naturale di interagire con l'IA, ma GPT-Live promette di portare questa fluidità a un livello completamente nuovo.
Per la prima volta, la modalità audio sarà in grado di elaborare le informazioni in background mentre la conversazione continua. Ti darà anche più spazio per fare delle pause quando necessario e indicherà che è ancora in ascolto con frasi come "Mmm" o "Sì".
L'aggiornamento dovrebbe essere disponibile su dispositivi mobili e web da ora (o a breve). Gli utenti gratuiti avranno accesso a GPT-Live-1 mini, mentre gli abbonati ai piani a pagamento avranno accesso alla versione più avanzata di GPT-Live-1.
Come funziona GPT-Live?
L'obiettivo finale di OpenAI è far sì che parlare con ChatGPT dia la sensazione di parlare con una persona reale, e GPT-Live si sta avvicinando sempre di più a questo risultato. In origine, l'interazione vocale con l'IA richiedeva un modello specifico per la conversione da parlato a testo, un altro per la risposta effettiva alla domanda e un altro ancora per la conversione da testo a parlato.
Il precedente modello vocale di ChatGPT integrava tutto questo in un unico modello di intelligenza artificiale, ma era comunque basato sui turni: tu parlavi, il chatbot rispondeva, poi tu parlavi di nuovo. Con GPT-Live, ChatGPT può parlare e ascoltare simultaneamente. Puoi interromperlo quando necessario e le risposte dovrebbero essere più rapide e precise.
La nuova modalità vocale dovrebbe essere più intelligente nel distinguere tra una pausa a metà di un pensiero e il completamento effettivo della domanda. Il modello ora ricalcola più volte al secondo se parlare, continuare ad ascoltare, mettere in pausa, interrompere o chiamare uno strumento.
Fonte: OpenAI
Un ulteriore vantaggio di questo aggiornamento è la possibilità di inviare in background ai server di ChatGPT anche attività complesse e processi di riflessione approfonditi, senza interrompere la conversazione. È inoltre possibile chiedere a ChatGPT di mettere in pausa o rallentare la risposta; anche le risposte visive sono state migliorate, consentendo ad esempio la visualizzazione di schede a comparsa con informazioni su località, previsioni del tempo e risultati sportivi.
Ora puoi anche chiedere a GPT-Live di tradurre qualcosa in una lingua straniera mentre parli. Grazie a queste nuove funzionalità, ascolterai una traduzione istantanea nell'altra lingua mentre parli, senza pause o interruzioni. Sono stati inoltre apportati miglioramenti per filtrare i rumori di sottofondo (come il traffico o le conversazioni vicine).
Esperienza GPT-Live
Per accedere alla modalità audio nell'app mobile, tocca l'icona dell'onda sonora a destra del campo di input. La nuova modalità è molto simile alla precedente, ma con questo aggiornamento dovresti vedere la scritta "Live" nella parte superiore dello schermo (almeno per ora, puoi toccarla per tornare alla modalità precedente).
Fin da subito, la modalità vocale aggiornata risulta più realistica e naturale. ChatGPT parlerà in modo vario ed espressivo, aggiungendo suggerimenti utili come "Lasciami controllare" quando sta cercando qualcosa. A volte esiterà e prolungherà le parole.
Ho parlato con GPT-Live per diversi minuti di film in uscita, recenti partite di calcio e notizie tecnologiche, e ho ricevuto risposte rispettose, concise e logiche (la modalità audio rimane un'ottima alternativa per chi non vuole leggere lunghi testi per ogni risposta).
Sono disponibili tre livelli di "intelligenza" tra cui scegliere. Fonte: OpenAI
Ci sono stati alcuni momenti in cui la conversazione si è interrotta, ma ciò è accaduto solo durante circa mezz'ora di chat (e questi inconvenienti dovrebbero essere corretti col tempo). Anche le interruzioni vengono gestite in modo eccellente: l'IA si ferma per prendere atto di ciò che hai detto e poi riprende il flusso del suo pensiero.
È possibile regolare il livello di intelligenza applicato da ChatGPT nella nuova modalità vocale: fare clic sull'icona del cursore (in alto a destra), quindi su Intelligenza . Sono disponibili tre modalità tra cui scegliere: Istantanea , Media e Alta , con diversi livelli di equilibrio tra reattività, dettaglio e precisione.
I commenti sono chiusi.