OpenAI ha presentado GPT-Live, una nueva etapa del modo de voz de ChatGPT que busca mejorar la interacción en conversaciones. Durante una demostración, Greg Brockman, cofundador de OpenAI, mostró cómo el sistema puede interrumpirse de manera más natural en comparación con versiones anteriores.
GPT-Live no solo ofrece una calidad de sonido mejorada, sino que introduce una arquitectura llamada full-duplex, que permite a la inteligencia artificial escuchar y generar respuestas simultáneamente. Esto, según la compañía, reduce la rigidez de los turnos tradicionales en la conversación.
Desde 2022, OpenAI ha evolucionado su enfoque hacia interacciones más naturales con sus modelos. ChatGPT marcó un hito en la interacción con modelos de texto, seguido por funciones de voz que buscaban una experiencia más fluida. GPT-Live se presenta como una solución para mantener conversaciones que no se sientan como una serie de comandos.
El nuevo modo de voz de ChatGPT permite interrumpir con preguntas, hacer pausas para pensar y recibir respuestas breves que indican que el sistema sigue escuchando. Además, se han mejorado las capacidades de reconocimiento de voz en entornos ruidosos. GPT-Live también incluye nueve voces remasterizadas y respuestas visuales en forma de tarjetas para consultas rápidas.
Cuando la conversación requiere más que una respuesta rápida, GPT-Live puede delegar tareas complejas a modelos avanzados, como GPT-5.5, mientras mantiene la interacción con el usuario. También se ofrecen diferentes niveles de razonamiento para las respuestas, adaptándose a la necesidad del momento.
OpenAI ha evaluado internamente que GPT-Live-1 y GPT-Live-1 mini superan al modo de voz avanzado en aspectos como fluidez y naturalidad en conversaciones de cinco a diez minutos. Sin embargo, estos resultados son preliminares y provienen de la propia OpenAI.
GPT-Live comienza su despliegue hoy para usuarios de ChatGPT en iOS, Android y ChatGPT.com, aunque no se ha especificado una exclusión para la Unión Europea. GPT-Live-1 será el modelo predeterminado para usuarios de Go, Plus y Pro, mientras que las cuentas gratuitas utilizarán GPT-Live-1 mini. La API estará disponible más adelante, sin una fecha concreta.
Por el momento, GPT-Live no admite funciones de voz con vídeo ni pantalla compartida, aunque OpenAI ha indicado que trabaja en su implementación futura.





