OpenAI ha presentado oficialmente su línea más reciente de modelos de voz, a saber, GPT-Live-1 y su versión más compacta, GPT-Live-1 mini. Esta innovación está diseñada para ofrecer una experiencia de interacción con inteligencia artificial (IA) mucho más fluida, receptiva y cercana a los patrones de comunicación humana en tiempo real.

Una de las actualizaciones fundamentales de este modelo es la implementación de la tecnología full-duplex. Con el soporte de este sistema, los dispositivos ahora pueden escuchar y procesar respuestas simultáneamente. Esto otorga a los usuarios la libertad de interrumpir la conversación cuando sea necesario, además de respaldar la efectividad de las funciones de traducción de idiomas en directo sin demoras significativas.

El líder de producto de ChatGPT Voice, Atty Eleti, declaró que la visión a largo plazo de la empresa es convertir la voz en la interfaz de usuario principal para comunicarse con las computadoras. Más que una simple herramienta de comunicación, se proyecta que este modelo se convierta en un asistente capaz de ejecutar tareas complejas de forma autónoma durante periodos más prolongados.

Como paso de transición, OpenAI ha establecido GPT-Live-1 mini como el nuevo estándar para la función de voz en ChatGPT. Mientras tanto, los usuarios de servicios de pago obtendrán acceso exclusivo al modelo GPT-Live-1, que cuenta con una mayor capacidad de procesamiento.

A diferencia de su sistema predecesor, que aún dependía de un flujo de trabajo convencional de conversión de voz a texto por etapas, este último modelo está integrado directamente con generaciones de IA de vanguardia, incluido GPT-5.5. Esta integración permite al sistema realizar razonamientos, búsqueda de datos y ejecución de tareas de agentes en segundo plano sin interrumpir el flujo de conversación en curso.