Ir al contenido
IA para hoy
Herramientas y productos Lanzamiento 5/5 · Confirmado por varias fuentes

Google DeepMind lanza Gemini 3.8 Live y Live Extended Thinking para voz en tiempo real

Google DeepMind lanza Gemini 3.8 Live y Live Extended Thinking para voz en tiempo real
Foto: Anete Lusina · Licencia Pexels · Pexels

Hecho Qué ha ocurrido

Google DeepMind presenta Gemini 3.8 Live y 3.8 Live Extended Thinking, sus modelos de diálogo en vivo más avanzados, disponibles vía API, Google Workspace y app Gemini. Extended Thinking lidera el índice Speech to Speech Quality de Artificial Analysis (82.6) y logra 68.6% en τ-Voice y 97.7% en Big Bench Audio; 3.8 Live queda segundo en Speech Agent Arena. Los modelos procesan contexto visual casi en tiempo real, detectan 97 idiomas y ejecutan tareas en segundo plano sin interrumpir la conversación.

Resumen generado mediante IA a partir de Google DeepMind (original en inglés). Naturaleza de la información: declaración de parte interesada.

Análisis Por qué importa

Estos modelos acercan la voz como interfaz principal para agentes empresariales capaces de ejecutar tareas complejas mientras mantienen conversación fluida, algo clave para atención al cliente y productividad.

Quién se ve afectado
Desarrolladores de agentes de voz, empresas de atención al cliente, banca, y plataformas como LiveKit, Salesforce o Genspark.
Qué puede cambiar
Se facilita construir asistentes de voz de producción con razonamiento en paralelo y llamadas a herramientas sin cortar el diálogo, reduciendo la latencia percibida.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Vigilar adopción por integradores (Agora, LangChain, Vercel), precios frente a competidores como OpenAI y Sierra, y evolución de benchmarks de agentes de voz como EVA-Bench.

Recomendación Qué debería hacer una empresa

Empresas con atención al cliente por voz deberían evaluar pilotos con estas APIs en los próximos 3-6 meses para medir mejoras en resolución de tareas y latencia.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta noticia por correo

Se envía esta noticia con su análisis. La dirección se usa solo para ese envío y no se guarda.

Fuente original: Google DeepMind (fuente primaria). La referencia es siempre el artículo original.

Ver fuente original ↗

vozagentesmultimodalLLM Google DeepMindSalesforceGensparkLumerisLiveKit agentes de IAGeminiGoogle DeepMindGoogle Workspacevoz

Fuentes de esta historia

Esta noticia forma parte de una historia cubierta por 3 publicaciones. La fiabilidad sube cuando varias fuentes independientes la confirman.

  1. Google DeepMind estás leyendo esta
    · confirmado por varias fuentes · artículo original ↗
  2. The Decoder
    · confirmado por varias fuentes · artículo original ↗
  3. Simon Willison
    · confirmado por varias fuentes · artículo original ↗

Ver la historia completa con su línea temporal →

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

Herramientas y productos

Google lanza Gemini 3.8 Live, modelos de voz en tiempo real vía WebSockets

Google presentó Gemini 3.8 Live y 3.8 Live Extended Thinking, dos modelos speech-to-speech comparables a la familia GPT-Live de OpenAI. El desarrollador Simon…

Por qué importaLos modelos de voz en tiempo real son clave para asistentes conversacionales y atención al cliente automatizada, y esta demo muestra lo accesible que…

Impacto bajo Fiabilidad confirmado por varias fuentes Simon Willison
Herramientas y productos

Google lanza Gemini 3.8 Live, modelo de voz que compite con GPT-Live-1 de OpenAI a menor precio

Google DeepMind lanzó Gemini 3.8 Live y su variante Extended Thinking, dos modelos de voz disponibles vía API y Google AI Studio. La variante Extended Thinking…

Por qué importaEl precio agresivo de Google puede acelerar la adopción de agentes de voz en aplicaciones empresariales, aunque OpenAI mantendría ventaja en…

Impacto medio Fiabilidad confirmado por varias fuentes The Decoder

Apple lanzará Siri con IA en español a partir de octubre de 2026 tras el estreno de iOS 27

Apple confirmó que la nueva Siri con inteligencia artificial, incluida en iOS 27.0 lanzado el 14 de septiembre de 2026, llegará al español, francés, japonés…

Por qué importaEs una actualización de producto de consumo masivo que amplía el acceso de IA conversacional integrada al ecosistema Apple para millones de usuarios…

Impacto bajo Fiabilidad declaración interesada Infobae Tecno
Herramientas y productos

Salesforce y NVIDIA presentan Koa, modelo de razonamiento CRM basado en Nemotron 3 Super

En Dreamforce, Salesforce presentó Koa, su primer modelo de razonamiento para CRM, construido mediante post-entrenamiento de NVIDIA Nemotron 3 Super sobre…

Por qué importaIlustra la tendencia de grandes empresas de software a construir modelos propios sobre bases abiertas para controlar datos y costes, en lugar de…

Impacto medio Fiabilidad confirmado por varias fuentes NVIDIA Blog