Google DeepMind lanza Gemini 3.8 Live y Live Extended Thinking para voz en tiempo real

Hecho Qué ha ocurrido
Google DeepMind presenta Gemini 3.8 Live y 3.8 Live Extended Thinking, sus modelos de diálogo en vivo más avanzados, disponibles vía API, Google Workspace y app Gemini. Extended Thinking lidera el índice Speech to Speech Quality de Artificial Analysis (82.6) y logra 68.6% en τ-Voice y 97.7% en Big Bench Audio; 3.8 Live queda segundo en Speech Agent Arena. Los modelos procesan contexto visual casi en tiempo real, detectan 97 idiomas y ejecutan tareas en segundo plano sin interrumpir la conversación.
Resumen generado mediante IA a partir de Google DeepMind (original en inglés). Naturaleza de la información: declaración de parte interesada.
Análisis Por qué importa
Estos modelos acercan la voz como interfaz principal para agentes empresariales capaces de ejecutar tareas complejas mientras mantienen conversación fluida, algo clave para atención al cliente y productividad.
- Quién se ve afectado
- Desarrolladores de agentes de voz, empresas de atención al cliente, banca, y plataformas como LiveKit, Salesforce o Genspark.
- Qué puede cambiar
- Se facilita construir asistentes de voz de producción con razonamiento en paralelo y llamadas a herramientas sin cortar el diálogo, reduciendo la latencia percibida.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Vigilar adopción por integradores (Agora, LangChain, Vercel), precios frente a competidores como OpenAI y Sierra, y evolución de benchmarks de agentes de voz como EVA-Bench.
Recomendación Qué debería hacer una empresa
Empresas con atención al cliente por voz deberían evaluar pilotos con estas APIs en los próximos 3-6 meses para medir mejoras en resolución de tareas y latencia.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: Google DeepMind (fuente primaria). La referencia es siempre el artículo original.
Ver fuente original ↗vozagentesmultimodalLLM Google DeepMindSalesforceGensparkLumerisLiveKit agentes de IAGeminiGoogle DeepMindGoogle Workspacevoz
Forma parte de la historia Google lanza modelos de voz Gemini 3.8 Live (3 noticias, estado: alto impacto).
Tu opinión
0 comentarios
Relacionadas
Google lanza Gemini 3.8 Live, modelos de voz en tiempo real vía WebSockets
Google presentó Gemini 3.8 Live y 3.8 Live Extended Thinking, dos modelos speech-to-speech comparables a la familia GPT-Live de OpenAI. El desarrollador Simon…
Por qué importaLos modelos de voz en tiempo real son clave para asistentes conversacionales y atención al cliente automatizada, y esta demo muestra lo accesible que…
Google lanza Gemini 3.8 Live, modelo de voz que compite con GPT-Live-1 de OpenAI a menor precio
Google DeepMind lanzó Gemini 3.8 Live y su variante Extended Thinking, dos modelos de voz disponibles vía API y Google AI Studio. La variante Extended Thinking…
Por qué importaEl precio agresivo de Google puede acelerar la adopción de agentes de voz en aplicaciones empresariales, aunque OpenAI mantendría ventaja en…
Apple lanzará Siri con IA en español a partir de octubre de 2026 tras el estreno de iOS 27
Apple confirmó que la nueva Siri con inteligencia artificial, incluida en iOS 27.0 lanzado el 14 de septiembre de 2026, llegará al español, francés, japonés…
Por qué importaEs una actualización de producto de consumo masivo que amplía el acceso de IA conversacional integrada al ecosistema Apple para millones de usuarios…
Salesforce y NVIDIA presentan Koa, modelo de razonamiento CRM basado en Nemotron 3 Super
En Dreamforce, Salesforce presentó Koa, su primer modelo de razonamiento para CRM, construido mediante post-entrenamiento de NVIDIA Nemotron 3 Super sobre…
Por qué importaIlustra la tendencia de grandes empresas de software a construir modelos propios sobre bases abiertas para controlar datos y costes, en lugar de…



