Tecnovisión

OpenAI presenta GPT-Live, su nueva generación de inteligencia artificial por voz

OpenAI lanzó GPT-Live, una nueva familia de modelos diseñada para ofrecer conversaciones por voz más naturales y fluidas dentro de ChatGPT. La tecnología puede escuchar y hablar simultáneamente, lo que permite a los usuarios interrumpir, hacer pausas o cambiar el ritmo de la conversación sin esperar turnos rígidos.

La compañía presentó dos versiones: GPT-Live-1 y GPT-Live-1 mini. Ambas utilizan una arquitectura denominada “full-duplex”, capaz de procesar continuamente la voz del usuario mientras el sistema genera sus respuestas.

Entre sus funciones se encuentran las respuestas breves de reconocimiento mientras escucha, como expresiones de atención, y la posibilidad de permanecer en silencio cuando detecta que la persona todavía está pensando o no ha terminado de hablar.

La actualización también mejora la traducción en tiempo real y busca facilitar conversaciones en distintos idiomas. Esta capacidad permitiría emplear ChatGPT como intérprete durante viajes, reuniones, actividades educativas y comunicaciones internacionales.

GPT-Live-1 y su versión más ligera comenzaron a distribuirse globalmente el 8 de julio de 2026, según información divulgada durante la presentación de OpenAI.

Con este lanzamiento, la empresa busca que la voz se convierta en una forma más intuitiva de interactuar con la inteligencia artificial, superando las pausas y las interrupciones que caracterizaban a generaciones anteriores de asistentes digitales.

Fuentes varias