GPT-Live: OpenAI lanza por sorpresa la voz de ChatGPT en tiempo real
OpenAI ha presentado GPT-Live, una nueva generación de modelos de voz que sustituye al Modo de Voz Avanzado de ChatGPT. El anuncio, realizado el 8 de julio de 2026, introduce una arquitectura full-duplex: el sistema puede escuchar y hablar al mismo tiempo, en lugar de esperar turnos como hacían las versiones anteriores.
Qué cambia con GPT-Live
Hasta ahora, ChatGPT Voice funcionaba por turnos: el usuario hablaba, el sistema detectaba el silencio y respondía. Con GPT-Live, el modelo procesa audio de forma continua y puede tomar decisiones —hablar, escuchar, hacer una pausa, dejarse interrumpir o usar una herramienta— varias veces por segundo. En la práctica, esto permite interrumpir al asistente, pedirle que hable más despacio, o dejar que emita señales breves de escucha (tipo «ajá» o «sí») mientras el usuario piensa en voz alta.
Dos versiones y despliegue por planes
OpenAI ha lanzado dos variantes: GPT-Live-1, que llega por defecto a los planes de pago Go, Plus y Pro, y GPT-Live-1 mini, disponible para las cuentas gratuitas. El despliegue arrancó el 8 de julio en iOS, Android y la versión web de ChatGPT, y la compañía prevé llevarlo próximamente a su API para desarrolladores.
Delegación a GPT-5.5 para tareas complejas
Cuando una consulta requiere búsqueda web, razonamiento profundo o capacidades más agénticas, GPT-Live delega esa tarea en segundo plano a GPT-5.5, manteniendo la conversación fluida mientras se procesa la respuesta. El usuario puede elegir el nivel de razonamiento —Instant, Medium o High— según necesite rapidez o profundidad. OpenAI ha indicado que actualizará este motor de fondo a medida que publique nuevos modelos.
Respuestas visuales y otras mejoras
Durante una conversación de voz, ChatGPT puede ahora mostrar tarjetas visuales con información sobre el tiempo, resultados deportivos, cotizaciones bursátiles o mapas, sin interrumpir el flujo de la conversación. Las nueve voces disponibles han sido remasterizadas y el sistema mejora su capacidad de distinguir la voz del usuario en entornos con ruido de fondo.
Limitaciones en el lanzamiento
GPT-Live no admite todavía voz combinada con vídeo o pantalla compartida, una función que OpenAI dice estar trabajando para incorporar próximamente. La compañía también ha añadido salvaguardas específicas para conversaciones de voz: protecciones adicionales para usuarios adolescentes, controles parentales que permiten decidir si un menor puede usar la función, y notificaciones a los padres vinculados ante señales de riesgo de autolesión.
Contexto: coincide con el despliegue de GPT-5.6
El lanzamiento de GPT-Live se produce en la misma semana en que OpenAI ha comenzado a desplegar de forma gradual su familia GPT-5.6 (Sol, Terra y Luna), tras un periodo de evaluación restringida solicitado por el gobierno de Estados Unidos. Ambos anuncios refuerzan la estrategia de OpenAI de acelerar la integración de sus modelos más avanzados en el uso cotidiano de ChatGPT.
Fuentes
- OpenAI — «Presentamos GPT-Live» (openai.com, 8 de julio de 2026)
- MacRumors — «OpenAI Introduces GPT-Live to Make ChatGPT Voice Feel Like a Real Conversation» (8 de julio de 2026)
- wwwhatsnew.com — «GPT Live: ChatGPT aprende por fin a escuchar mientras habla» (9 de julio de 2026)
- Enter.co — «OpenAI lanza GPT-Live: así funciona la nueva experiencia de voz de ChatGPT»
Este artículo ha sido elaborado con apoyo de herramientas de inteligencia artificial y revisado editorialmente por el equipo de IAGeducación, en cumplimiento del Artículo 50 del Reglamento (UE) de IA sobre transparencia con contenidos generados o asistidos por IA.








