OpenAI lanza GPT-Live-1, modelo de voz en tiempo real para API
Resumen En qué punto está
OpenAI presentó GPT-Live-1, un modelo de voz full-duplex disponible en su API que permite conversaciones naturales con escucha y habla simultáneas. El modelo mejora notablemente el seguimiento de instrucciones, reduce la latencia de turnos a 0,8 segundos y eleva la precisión en llamadas a herramientas al 87%, frente a cifras muy inferiores de su predecesor. Tiene un precio de 0,05 dólares por minuto y ya cuenta con un cliente comercial, Yelp, que lo usa para reservas telefónicas. El lanzamiento amplía las posibilidades de construir asistentes de voz y sistemas de atención telefónica más realistas.
Resumen generado mediante IA a partir de las 2 noticias de la historia. Última actualización: hace 56 min.
Enviar esta historia por correo
Línea temporal
-
OpenAI lanza API de GPT-Live-1, modelo de voz full-duplex para desarrolladores
OpenAI ha publicado GPT-Live-1 como API para desarrolladores, un modelo de voz full-duplex que puede escuchar y hablar simultáneamente. En benchmarks internos alcanza 80,1% en interactividad frente a 45,4% de su…
-
OpenAI lanza GPT-Live-1, modelo de voz en tiempo real para la API
OpenAI presentó GPT-Live-1, un modelo disponible en su API para conversaciones de voz naturales en modo full-duplex. Ofrece mejor seguimiento de instrucciones, voces personalizadas y soporte de telefonía.