La compañía introduce una nueva generación de su modo de voz que permite mantener conversaciones más naturales, con respuestas en tiempo real, interrupciones fluidas y una mayor capacidad para adaptarse al ritmo del usuario.
OpenAI continúa evolucionando la experiencia conversacional de ChatGPT con el lanzamiento de GPT-Live, una nueva tecnología diseñada para hacer que las interacciones por voz sean más naturales y dinámicas. La principal novedad reside en que el asistente ya no espera a que el usuario termine de hablar para responder, sino que es capaz de escuchar y generar respuestas de forma simultánea, acercando la conversación a la que tendría lugar entre dos personas.
Hasta ahora, el modo de voz funcionaba mediante un sistema de turnos: el usuario hablaba, la inteligencia artificial procesaba la información y, una vez finalizado ese proceso, emitía su respuesta. GPT-Live rompe con esa dinámica gracias a una arquitectura denominada full-duplex, que permite al modelo decidir continuamente si debe responder, guardar silencio, esperar o continuar escuchando.
Este cambio se traduce en una interacción mucho más fluida. Los usuarios pueden interrumpir al asistente mientras habla, hacer pausas durante la conversación o pedirle que adapte la velocidad de sus respuestas sin que el diálogo resulte artificial. Además, el sistema incorpora pequeñas señales conversacionales que transmiten que sigue atento a la conversación, incluso cuando el usuario está pensando qué decir.
Otra de las mejoras anunciadas por OpenAI afecta a la comprensión del contexto. GPT-Live mejora la detección de la voz principal incluso en entornos con ruido ambiental y mantiene integradas las funciones ya disponibles en ChatGPT, como la búsqueda web, la memoria, la generación de imágenes, la carga de archivos o las respuestas visuales para consultas rápidas sobre información como el tiempo, resultados deportivos o mercados financieros.
Cuando una conversación requiere un razonamiento más complejo, el sistema puede apoyarse automáticamente en modelos más avanzados de la compañía sin interrumpir la interacción. Además, los usuarios podrán elegir distintos niveles de razonamiento en función del tipo de consulta, priorizando la rapidez o un análisis más profundo.
Según OpenAI, las pruebas realizadas muestran mejoras en aspectos como la naturalidad de las conversaciones, la gestión de interrupciones, la fluidez del diálogo y la experiencia general de uso frente al anterior modo de voz.
El despliegue de GPT-Live ya ha comenzado para los usuarios de ChatGPT en dispositivos iOS, Android y la versión web. Los suscriptores de los planes Go, Plus y Pro dispondrán del modelo GPT-Live-1, mientras que las cuentas gratuitas accederán a GPT-Live-1 mini.
Por el momento, la nueva experiencia de voz no incluye funciones como el vídeo en directo o el uso compartido de pantalla durante la conversación, aunque OpenAI ha confirmado que ambas capacidades forman parte de su hoja de ruta para futuras actualizaciones.
Rincón del CISO
28 Julio 2026
Podcast de Cyberlideria MGZN.
Todos los jueves, a partir de las 22:00, estará disponible en CyberLideria MGZN una nueva entrevista, donde un prestigioso CISO colaborador charlará con una personalidad inspiradora, importante, y líder empresarial, tanto del ámbito privado como público.
Manténgase informado sobre la ciberseguridad, tecnología, las tendencias y las noticias que afectan a los líderes de TI.
Suscríbete GRATIS y disfruta de contenido ilimitado sobre ciberseguridad y personas