OpenAI ha lanzado GPT-Live, un nuevo modo de voz para ChatGPT que transforma la interacción con la inteligencia artificial. Ahora los usuarios pueden interrumpir, pedir que hable más despacio o hacer pausas sin esperar turnos. La IA responde con sonidos como mmm para indicar que escucha, logrando un diálogo más natural y práctico para el uso diario.
Cómo funciona la nueva arquitectura de voz en tiempo real 🎙️
Técnicamente, GPT-Live integra un modelo de procesamiento de audio continuo que elimina los tiempos muertos entre respuestas. El sistema detecta pausas, cambios de tono y solapamientos de voz para gestionar interrupciones sin reiniciar el contexto. Esto se logra mediante un buffer de atención dinámico que prioriza la última intervención del usuario, permitiendo que la IA ajuste su velocidad o añada sonidos de escucha en milisegundos.
Ahora la IA también te hace mmm mientras finge escuchar 🤫
Por fin, la inteligencia artificial aprende lo que llevamos años haciendo en las reuniones de Zoom: fingir que escuchamos mientras pensamos en otra cosa. El nuevo modo incluye un mmm estratégico que sugiere atención, aunque en realidad el modelo ya esté procesando tu siguiente frase. Próximo paso: que ChatGPT suspire cuando le cuentes lo que hiciste el fin de semana.