Ir al contenido
IA para hoy
Herramientas y productos Lanzamiento

Google lanza Gemini 3.1 Flash Live con mejor comprensión de audio y menor latencia

Hecho Qué ha ocurrido

Google DeepMind ha presentado Gemini 3.1 Flash Live, su modelo de audio y voz de más alta calidad, diseñado para diálogos en tiempo real más naturales y precisos. El modelo logra un 90,8% en ComplexFuncBench Audio (frente a modelos anteriores) y 36,1% en Scale AI's Audio MultiChallenge con razonamiento activado. Gemini 3.1 Flash Live está disponible en Gemini Live API, Google AI Studio, y ya se usa en productos de consumo como Gemini Live y Search Live, que ahora llega a más de 200 países; empresas como Verizon, LiveKit y The Home Depot lo han probado con retroalimentación positiva.

Resumen generado mediante IA a partir de Google DeepMind (original en inglés). Naturaleza de la información: hecho documentado.

Análisis Por qué importa

La mejora en comprensión de matices tonales, latencia reducida y capacidad multilingüe hace que la interacción por voz sea más viable para agentes empresariales que manejen tareas complejas en tiempo real. Esto reduce fricciones técnicas en experiencias de cliente y abre nuevos casos de uso en atención automatizada y operaciones.

Quién se ve afectado
Empresas que desarrollan agentes conversacionales, centros de atención al cliente, plataformas de búsqueda y asistentes digitales; desarrolladores de aplicaciones con API Gemini.
Qué puede cambiar
Los sistemas de voz pueden ahora procesar instrucciones complejas e interrupciones naturales con mayor precisión, reduciendo necesidad de correcciones y mejorando flujo de conversación. La disponibilidad global en 200+ países acelera despliegues internacionales de soluciones basadas en voz.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Adopción en aplicaciones empresariales de atención al cliente y agentes complejos; benchmarks independientes de modelos de audio competidores (OpenAI, Anthropic); evolución de latencia real en producción; regulación sobre marcas de agua de audio (SynthID) para detección de contenido sintético.

Recomendación Qué debería hacer una empresa

Evaluar integración de Gemini 3.1 Flash Live en flujos de atención al cliente o agentes internos en los próximos 3-6 meses si se operan sistemas multilingües o tareas complejas por voz. Considerar pruebas piloto en mercados donde Google expande Search Live.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta noticia por correo

Se envía esta noticia con su análisis. La dirección se usa solo para ese envío y no se guarda.

Fuente original: Google DeepMind (fuente primaria). La referencia es siempre el artículo original.

Ver fuente original ↗

audiovozLLM multilingüetiempo realwatermarking (SynthID) Google DeepMindVerizonLiveKitThe Home Depot agentes conversacionalesatención al clienteGemini 3.1 Flash LiveGooglevoz

Fuentes de esta historia

Esta noticia forma parte de una historia cubierta por 2 publicaciones. La fiabilidad sube cuando varias fuentes independientes la confirman.

  1. Google DeepMind estás leyendo esta
    · confirmado por varias fuentes · artículo original ↗
  2. Google DeepMind
    · confirmado por varias fuentes · artículo original ↗

Ver la historia completa con su línea temporal →

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

Herramientas y productos 2 fuentes

Google lanza Gemini 3.1 Flash TTS, modelo de voz con control granular y marca SynthID

Google DeepMind presentó Gemini 3.1 Flash TTS, un modelo de texto a voz con etiquetas de audio para controlar estilo, ritmo y entonación en más de 70 idiomas…

Por qué importaMejora la calidad y control de voz sintética a bajo coste, facilitando su adopción en aplicaciones comerciales de audio y doblaje multilingüe.

Impacto medio Fiabilidad confirmado por varias fuentes Google DeepMind

Suno lanza v6, su primer modelo musical de IA con licencias de discográficas

Suno ha lanzado v6, la nueva versión de su modelo de generación musical con IA, entrenado con datos que incluyen contenido licenciado de Warner Music Group…

Por qué importaEs el primer modelo de Suno respaldado por acuerdos de licencia con la industria discográfica, tras años de disputas legales por uso no autorizado de…

Impacto bajo Fiabilidad una fuente fiable The Verge AI
Herramientas y productos 10 fuentes

Apple lanza el iPhone Duo plegable y el iPhone 18 Pro con Siri AI mejorada

Apple presentó el iPhone Duo, su primer smartphone plegable, junto con el iPhone 18 Pro con cámara de apertura variable y chip A20 Pro. El evento marcó el…

Por qué importaEl lanzamiento consolida la apuesta de Apple por la IA on-device y abre la categoría de plegables premium, con implicaciones para fabricantes de…

Impacto bajo Fiabilidad confirmado por varias fuentes El Español Omicrono
Herramientas y productos 2 fuentes

Apple confirma fecha de lanzamiento de iOS 27 con Siri AI, ausente en la UE

Apple confirmó que iOS 27, que incluye a Siri AI como principal novedad, se lanzará el 14 de septiembre para modelos desde iPhone 11 en adelante. Siri AI solo…

Por qué importaConfirma que las restricciones regulatorias europeas siguen limitando el despliegue de funciones de IA de Apple, afectando a millones de usuarios y…

Impacto bajo Fiabilidad varias fuentes Hipertextual