I miglioramenti in questi ultimi due anni sono stati innegabili, ma parlare con un assistente vocale significa ancora, troppo spesso, rispettare i suoi tempi, e non sempre sono a misura d'uomo. Facciamo una domanda, aspettiamo che capisca di aver ricevuto il turno e infine arriva la risposta, ma basta interromperlo o esitare qualche secondo perché quella che dovrebbe essere una conversazione inizi a sembrare un dialogo via radio.
Il problema non riguarda soltanto la qualità della voce, perché dietro molti sistemi ci sono infatti diversi passaggi. Il parlato viene trasformato in testo, un modello elabora la richiesta e un altro sistema genera nuovamente l’audio.
GPT-Live-1, il modello vocale che OpenAI ha ora reso disponibile agli sviluppatori attraverso le API, dovrebbe migliorare le problematiche sopra descritte. La caratteristica fondamentale è il cosiddetto full duplex, ciò significa che in pratica può ascoltare mentre sta parlando, avvicinando il comportamento dell’AI a quello di una normale conversazione tra persone.
Il TOP Android senza compromessi? Samsung Galaxy S25 Ultra, compralo al miglior prezzo da Rimediashop.it a 677 euro.
CLICCA QUI PER CONTINUARE A LEGGERE
Testi ed immagini Copyright Hdblog.it
