OpenAI presenta GPT-Live, una nueva generación de modelos de voz para ChatGPT Voice con conversación más fluida, escucha simultánea y respuesta en tiempo real.
OpenAI ha presentado GPT-Live, una nueva generación de modelos de voz que empieza a impulsar ChatGPT Voice en iOS, Android y ChatGPT.com. La compañía lo plantea como un salto hacia conversaciones más naturales, con menos sensación de turno rígido entre usuario y asistente.
La principal novedad está en su arquitectura de conversación en tiempo real. GPT-Live puede escuchar y hablar de forma simultánea, lo que permite interrupciones, confirmaciones breves y una dinámica más parecida a una conversación humana. OpenAI menciona comportamientos como asentir verbalmente mientras el usuario sigue hablando.
El modelo está diseñado para mantener la conversación fluida mientras delega tareas más complejas a modelos de razonamiento en segundo plano. Esto permite que la voz no se bloquee cada vez que la petición requiere más cálculo, análisis o una respuesta más elaborada.
OpenAI anuncia dos variantes: GPT-Live-1 y GPT-Live-1 mini. La primera se orienta a usuarios de pago y la versión mini se despliega para usuarios gratuitos, con el objetivo de llevar mejoras de voz a un público más amplio.
El despliegue empieza en ChatGPT Voice y OpenAI indica que el acceso por API llegará más adelante. Esto es relevante para desarrolladores y empresas que quieran construir asistentes de voz propios con una interacción más rápida y natural.
Para usuarios prácticos, la mejora afecta directamente a casos como practicar idiomas, preparar reuniones, estudiar en voz alta, recibir ayuda mientras se trabaja o mantener conversaciones más largas sin depender solo del texto.