Mejoras en la interacción de voz con IA
Nuevos modelos permiten conversaciones más fluidas
OpenAI ha introducido dos modelos avanzados de voz, GPT-Live-1 y GPT-Live-1 mini, diseñados para optimizar la interacción en tiempo real con sistemas de inteligencia artificial. Estos modelos abordan las limitaciones del Modo de Voz Avanzado lanzado previamente, como las conversaciones entrecortadas y los malentendidos debido a pausas. La nueva arquitectura…

OpenAI ha introducido dos modelos avanzados de voz, GPT-Live-1 y GPT-Live-1 mini, diseñados para optimizar la interacción en tiempo real con sistemas de inteligencia artificial. Estos modelos abordan las limitaciones del Modo de Voz Avanzado lanzado previamente, como las conversaciones entrecortadas y los malentendidos debido a pausas. La nueva arquitectura dúplex permite procesar y generar respuestas simultáneamente, lo que mejora la fluidez de las conversaciones y permite traducciones en tiempo real.
Los modelos ofrecen características adicionales como la posibilidad de ajustar la velocidad de respuesta, interrumpir en cualquier momento y reconocer verbalmente que están escuchando. También se han optimizado para ignorar ruidos de fondo y generar visuales informativos sobre diversos temas. Estas mejoras no solo enriquecen la experiencia del usuario, sino que también se integran con otros sistemas de OpenAI para ofrecer un razonamiento más profundo cuando sea necesario.
Además, OpenAI ha fortalecido las medidas de seguridad, permitiendo redirigir o finalizar conversaciones potencialmente inseguras y proporcionando controles parentales para proteger a los usuarios jóvenes. La implementación de estos modelos está prevista para dispositivos Android, iOS y la web, con diferentes versiones según el plan de suscripción del usuario. Este avance representa un paso importante en la evolución de la interacción entre humanos y máquinas, haciendo la tecnología más accesible y segura para todos.


