OpenAI ha presentado GPT-Live, una actualización del modo de voz de ChatGPT que mejora la interacción en conversaciones. Durante una demostración, Greg Brockman, cofundador de OpenAI, mostró cómo el sistema puede interrumpir y responder de manera más natural, ajustando su reacción a las interrupciones.
GPT-Live no solo ofrece una calidad de sonido mejorada, sino que introduce una nueva arquitectura llamada full-duplex, que permite a la inteligencia artificial escuchar y generar respuestas simultáneamente. Esta evolución busca reducir la rigidez de las interacciones anteriores, donde el sistema operaba en turnos de conversación.
Desde 2022, OpenAI ha estado transformando la relación con sus modelos, pasando de interacciones basadas en texto a formas más naturales de comunicación. El anuncio de GPT-Live se produce tras el lanzamiento de versiones anteriores que han ido mejorando la experiencia del usuario.
En la práctica, los usuarios podrán interrumpir al sistema con preguntas, hacer pausas para pensar y solicitar que hable más despacio. GPT-Live también puede utilizar señales breves para indicar que sigue escuchando y ha mejorado su capacidad para centrarse en la voz del usuario en entornos ruidosos. Además, se han remasterizado nueve voces de ChatGPT y se han introducido respuestas visuales para consultas rápidas.
GPT-Live es capaz de delegar tareas más complejas a otros modelos, manteniendo la conversación activa. En su lanzamiento, utilizará GPT-5.5 como soporte, con planes de actualizar este modelo a medida que se desarrollen nuevas versiones. También se ofrecerán diferentes niveles de razonamiento para las respuestas.
Según evaluaciones internas de OpenAI, GPT-Live-1 y GPT-Live-1 mini han demostrado ser superiores al modo de voz avanzado en aspectos como fluidez y naturalidad durante conversaciones de cinco a diez minutos. Sin embargo, estos resultados son preliminares y provienen de la propia compañía.
El despliegue de GPT-Live comienza hoy para usuarios de ChatGPT en iOS, Android y ChatGPT.com, con un lanzamiento global. Las cuentas de pago utilizarán GPT-Live-1, mientras que las cuentas gratuitas accederán a GPT-Live-1 mini. La API estará disponible más adelante, aunque no se ha especificado una fecha.
Es importante señalar que, en esta fase, GPT-Live no admite interacciones de voz con vídeo ni pantalla compartida, aunque OpenAI planea añadir estas funciones en el futuro.





