OpenAI lanzó GPT-Live: ChatGPT ahora escucha y habla simultáneamente
OpenAI lanzó GPT-Live—una nueva versión del sistema de voz de ChatGPT que escucha y habla simultáneamente, sin esperar a que el usuario termine de hablar. Anteriormente, ChatGPT funcionaba en modo: usuario habla—pausa—modelo responde. GPT-Live permite una comunicación más natural y similar a la humana. Se lanzaron dos versiones: GPT-Live-1 completo y GPT-Live-1 mini ligero. Los modelos están disponibles para todos los usuarios de ChatGPT en todo el mundo a partir del 8 de julio de 2026.
Procesado por IA desde TNW; editado por Hamidun News
El 8 de julio de 2026, OpenAI lanzó GPT-Live — una nueva generación de modelos de voz para la plataforma ChatGPT. La innovación principal: comunicación full-duplex — el modelo puede escuchar y hablar simultáneamente sin requerir pausas entre las enunciaciones del usuario.
Cómo funciona
En la versión anterior de las interfaces de voz de ChatGPT, el modelo utilizaba modo half-duplex: el usuario habla, el modelo espera una pausa en el habla, luego proporciona una respuesta. Esto creaba una sensación poco natural. GPT-Live elimina esta limitación: el modelo procesa el flujo de audio entrante en tiempo real y puede responder sin esperar a que el usuario termine su oración.
Esto acerca la interacción a la conversación humana natural, donde las personas a menudo comienzan a responder antes de que el hablante termine su oración.
Dos versiones de modelos
OpenAI lanzó dos versiones:
- GPT-Live-1 — modelo completo con todas las capacidades de ChatGPT
- GPT-Live-1 mini — versión ligera para dispositivos móviles y dispositivos con recursos limitados
Ambas versiones están disponibles para todos los usuarios de ChatGPT en todo el mundo desde el momento del lanzamiento (8 de julio de 2026).
Qué significa para la IA conversacional
La comunicación full-duplex es un paso significativo hacia la interacción natural con la IA. Hasta ahora, la mayoría de asistentes de voz (Siri, Alexa, Google Assistant) operaban en modo half-duplex. OpenAI demuestra que la tecnología full-duplex es técnicamente viable en modelos de lenguaje grandes.
Esto también muestra que las empresas están invirtiendo en mejorar las interfaces conversacionales — probablemente porque la voz se está convirtiendo en el método principal de interacción con la IA en dispositivos móviles.
Por qué es importante
Un asistente de IA móvil que hable como un humano (sin pausas incómodas) puede atraer a millones de usuarios. Esto es especialmente relevante para mercados donde la interfaz de texto es menos conveniente (países en desarrollo, personas mayores, multitarea).
Los requisitos de CPU/GPU para el procesamiento full-duplex son mayores que para half-duplex, pero la versión ligera GPT-Live-1 mini permite implementar el modelo en dispositivos móviles.
Lo que significa
La comunicación full-duplex en ChatGPT es un paso intermedio hacia asistentes de IA personales que funcionan como conversadores naturales. La industria se está moviendo hacia reducir la fricción entre humanos y modelos. OpenAI demuestra que el límite entre "máquina que habla" y "asistente inteligente" se está difuminando.
¿Quieres dejar de leer sobre IA y empezar a usarla?
AI News es un feed curado de noticias de IA. Hamidun Academy te enseña a usar la IA en tu trabajo.
Lo esencial de la IA — una vez por semana
Siete historias que de verdad importaron, elegidas a mano. Sin ruido ni notas de prensa.
¡Listo! Revisa tu correo para la confirmación.