OpenAI lanza API de GPT-Live-1, modelo de voz full-duplex para desarrolladores

Hecho Qué ha ocurrido
OpenAI ha publicado GPT-Live-1 como API para desarrolladores, un modelo de voz full-duplex que puede escuchar y hablar simultáneamente. En benchmarks internos alcanza 80,1% en interactividad frente a 45,4% de su predecesor, reduce la latencia de turnos a 0,8 segundos y mejora la precisión en llamadas a herramientas al 87%. El precio es de 0,05 dólares por minuto, y Yelp ya lo usa para reservas telefónicas.
Resumen generado mediante IA a partir de The Decoder (original en inglés). Naturaleza de la información: declaración de parte interesada.
Análisis Por qué importa
Un modelo de voz con menor latencia y mejor gestión de turnos permite construir asistentes telefónicos y de atención al cliente más naturales y funcionales, algo clave para call centers y automatización de soporte.
- Quién se ve afectado
- Empresas de atención al cliente, desarrolladores de aplicaciones de voz y sectores con soporte telefónico intensivo como banca, reservas y hostelería.
- Qué puede cambiar
- Se facilita crear asistentes de voz capaces de interrupciones y conversaciones naturales, reduciendo fricción frente a sistemas de voz turn-based anteriores.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Habrá que vigilar la adopción real más allá de casos como Yelp, la evolución de precios y si aparecen alternativas competidoras de menor coste.
Recomendación Qué debería hacer una empresa
Empresas con atención telefónica intensiva deberían evaluar un piloto con GPT-Live-1 en los próximos 3-6 meses para medir mejoras en tasa de resolución y costes frente a soluciones actuales.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: The Decoder. La referencia es siempre el artículo original.
Ver fuente original ↗vozLLM OpenAIYelp APIGPT-Live-1OpenAIvozYelp
Forma parte de la historia OpenAI lanza GPT-Live-1, modelo de voz en tiempo real para API (2 noticias, estado: en evolución).
Tu opinión
0 comentarios
Relacionadas
OpenAI lanza GPT-Live-1, modelo de voz en tiempo real para la API
OpenAI presentó GPT-Live-1, un modelo disponible en su API para conversaciones de voz naturales en modo full-duplex. Ofrece mejor seguimiento de instrucciones…
Por qué importaFacilita a desarrolladores construir asistentes de voz más realistas y con integración telefónica, ampliando los casos de uso comerciales de la IA…
AWS lanza en general disponibilidad el asistente de IA Amazon Quick para escritorio
AWS anunció la disponibilidad general de la aplicación de escritorio Amazon Quick para macOS y Windows, además de un feed de actividad para móviles iOS y…
Por qué importaEs un movimiento de AWS para competir en el mercado de asistentes de IA empresariales frente a Microsoft Copilot y Google Workspace, apostando por…
NVIDIA lanza CUDA 13.4 con soporte para Windows on Arm y acceso anticipado a Rubin
NVIDIA ha publicado CUDA 13.4, que añade soporte para desarrollar aplicaciones sobre Windows on Arm y acceso preliminar a la próxima arquitectura Vera Rubin…
Por qué importaPrepara el terreno de software para nuevas plataformas de PC con IA local y para la próxima generación de hardware de centros de datos, reduciendo el…
Apple detalla las nuevas funciones de Siri AI que llegarán con iOS 27
Apple presenta Siri AI, una renovación de su asistente que procesará información en el propio dispositivo (mensajes, correos, calendarios, fotos) sin enviarla…
Por qué importaApple intenta cerrar la brecha frente a asistentes de IA generativa como ChatGPT, Gemini o Claude, apostando por procesamiento on-device como…



