Este nuevo modelo de voz de ChatGPT permite conversaciones más naturales gracias a su capacidad para escuchar y hablar al mismo tiempo, incorporar medidas de seguridad y apoyarse en GPT-5.5 cuando se requiere mayor razonamiento.
Con el objetivo de ofrecer conversaciones en vivo más naturales, OpenAI lanzó GPT-Live, una nueva generación de modelos de voz diseñada para que hablar con la IA se sienta como una conversación real. Con este lanzamiento, GPT-Live de OpenAI busca ofrecer interacciones más fluidas, naturales y cercanas a una conversación entre personas.
¿Qué cambia con ChatGPT Voice?
Uno de los principales cambios en ChatGPT Voice es su diseño dúplex completo, que le permite escuchar y hablar de manera simultánea, enviar señales de escucha activa y permanecer en silencio cuando el usuario está pensando.
Este cambio corrige las limitaciones de los sistemas en cascada conlos que funcionaba el modelo anteriormente, los cuales provocaban pérdida de información y respuestas lentas o forzadas. Ahora, GPT-Live es capaz de tomar varias decisiones por segundo, como hablar, escuchar, hacer pausas e interrumpir cuando es necesario.
¿Cómo funciona GPT-Live de OpenAI durante una conversación?
Además, cuando una conversación requiere un razonamiento más profundo o la realización de búsquedas, GPT-Live de OpenAI transfiere la petición a GPT-5.5 y devuelve el resultado en medio de la conversación. Conforme se incorporen más modelos, estos también podrán utilizarse de la misma forma dentro de GPT-Live
¿Qué medidas de seguridad incorpora el nuevo modelo?
En ocasiones, los usuarios recurren a la IA para buscar ayuda en situaciones complejas. Por ello, la empresa incorporó evaluaciones de audio relacionadas con autolesiones, psicosis, manía, dependencia emocional, violencia y contenido sexual. Asimismo, el sistema es capaz de modificar su respuesta durante la conversación, acceder a recursos de crisis o finalizar una sesión cuando detecta una situación de alto riesgo.
En el caso de los menores de edad, el modelo incorpora protección mediante controles parentales y notificaciones sobre posibles señales de peligro.
¿Quiénes podrán utilizar GPT-Live?
Este nuevo modelo cuenta con dos versiones: GPT-Live-1, disponible para usuarios con cuentas Go, Plus y Pro; y GPT-Live-1-mini, que será la versión predeterminada para las cuentas gratuitas, dejando atrás el modo de voz avanzado.
¿Cuál es la apuesta de OpenAI para el futuro de la voz?
Durante la presentación del producto, el jefe de producto de ChatGPT Voice, el abogado Atty Eleti, mencionó que había mantenido conversaciones de entre 30 y 40 minutos con el sistema y apostó a que, en el futuro, la voz será la interfaz principal para la computación de operaciones complejas.
“Con el tiempo, creemos que esto también permitirá utilizar la voz como una especie de interfaz principal para la informática y para gestionar tareas de agentes cada vez más complejas y de larga duración. Creemos que la voz puede ser la interfaz del futuro para todo tipo de trabajo”, dijo Eleti.
A medida que las necesidades de los usuarios crecen, empresas como Apple y Amazon también se encuentran actualizando sus asistentes para hacerlos más conversacionales, al tiempo que realizan tareas en segundo plano, una tendencia en la que GPT-Live de OpenAI busca marcar el rumbo de las futuras interfaces de voz.








