OpenAI ha presentado GPT-Live, una nueva generación del modo de voz de ChatGPT basada en una arquitectura full-duplex que permite a la IA escuchar mientras genera una respuesta, abandonando la lógica de turnos rígidos. Greg Brockman mostró la tecnología en un directo interrumpiendo al sistema; en lugar de cortarse en seco, la voz reajustó su intervención. El modelo decide varias veces por segundo si hablar, escuchar, pausar o usar una herramienta, lo que admite interrumpir con preguntas, hacer pausas, pedir un ritmo más lento y responder con señales breves como "mmm" o "sí" cuando hay ruido de fondo.
GPT-Live llega con nueve voces remasterizadas, respuestas visuales en tarjetas para consultas rápidas y soporte para búsqueda, memoria, imágenes y archivos. En tareas complejas delega en GPT-5.5 como modelo frontera y permite elegir entre niveles de razonamiento Instant, Medium y High. En sus evaluaciones internas, las variantes GPT-Live-1 y GPT-Live-1 mini superan al modo de voz avanzado en preferencia, fluidez y gestión de turnos en conversaciones de cinco a diez minutos, aunque los datos los aporta la propia OpenAI.
El despliegue comienza hoy para usuarios de ChatGPT en iOS, Android y la web a escala global. GPT-Live-1 queda como modelo por defecto para suscriptores Go, Plus y Pro, mientras las cuentas gratuitas acceden a GPT-Live-1 mini. La API llegará más tarde sin fecha concreta. En el lanzamiento no hay soporte para voz con vídeo ni pantalla compartida, capacidades que OpenAI prevé añadir después.
