OpenAI ha presentado oficialmente GPT-Live, una evolución significativa en el modo de voz de ChatGPT diseñada para eliminar la rigidez de las conversaciones tradicionales con inteligencia artificial. A diferencia de las versiones anteriores, que operaban mediante turnos estrictos, esta nueva arquitectura permite una interacción mucho más fluida y humana.

El cambio principal reside en la tecnología full-duplex, que permite a la IA escuchar al usuario mientras genera su propia respuesta. Esto significa que ahora es posible interrumpir al asistente, solicitar pausas o pedir que ajuste su velocidad de habla sin que el sistema se bloquee o requiera un nuevo comando. Según OpenAI, esta capacidad permite decidir varias veces por segundo si el modelo debe hablar, escuchar o procesar información adicional.
El despliegue de GPT-Live incluye nueve voces remasterizadas y una mejor gestión del ruido de fondo. Para los usuarios, esto se traduce en una experiencia donde la IA puede emitir señales de retroalimentación como "mmm" o "sí" para confirmar que sigue activa en la conversación. Además, el sistema integra tarjetas visuales para consultas rápidas sobre el tiempo, deportes o datos financieros, optimizando el acceso a la información.

En cuanto al razonamiento, GPT-Live permite delegar tareas complejas a modelos avanzados como GPT-5.5 mientras mantiene el hilo de la conversación. Los usuarios podrán elegir entre diferentes niveles de procesamiento: Instant para respuestas inmediatas, o Medium y High para consultas que requieran un mayor esfuerzo lógico.
El despliegue global de esta función comienza hoy para usuarios de iOS, Android y ChatGPT.com. Mientras que los suscriptores de los planes Go, Plus y Pro tendrán acceso al modelo GPT-Live-1, las cuentas gratuitas utilizarán la versión optimizada GPT-Live-1 mini. Por el momento, esta actualización no admite voz con vídeo ni pantalla compartida, capacidades que la compañía espera integrar en futuras versiones.

El cambio principal reside en la tecnología full-duplex, que permite a la IA escuchar al usuario mientras genera su propia respuesta. Esto significa que ahora es posible interrumpir al asistente, solicitar pausas o pedir que ajuste su velocidad de habla sin que el sistema se bloquee o requiera un nuevo comando. Según OpenAI, esta capacidad permite decidir varias veces por segundo si el modelo debe hablar, escuchar o procesar información adicional.
Interacción continua y capacidades mejoradas
El despliegue de GPT-Live incluye nueve voces remasterizadas y una mejor gestión del ruido de fondo. Para los usuarios, esto se traduce en una experiencia donde la IA puede emitir señales de retroalimentación como "mmm" o "sí" para confirmar que sigue activa en la conversación. Además, el sistema integra tarjetas visuales para consultas rápidas sobre el tiempo, deportes o datos financieros, optimizando el acceso a la información.

En cuanto al razonamiento, GPT-Live permite delegar tareas complejas a modelos avanzados como GPT-5.5 mientras mantiene el hilo de la conversación. Los usuarios podrán elegir entre diferentes niveles de procesamiento: Instant para respuestas inmediatas, o Medium y High para consultas que requieran un mayor esfuerzo lógico.
El despliegue global de esta función comienza hoy para usuarios de iOS, Android y ChatGPT.com. Mientras que los suscriptores de los planes Go, Plus y Pro tendrán acceso al modelo GPT-Live-1, las cuentas gratuitas utilizarán la versión optimizada GPT-Live-1 mini. Por el momento, esta actualización no admite voz con vídeo ni pantalla compartida, capacidades que la compañía espera integrar en futuras versiones.



!Advertencia! Tenemos problemas...
Debes iniciar sesión para poder comentar.. Iniciar sesión o Registrarme