Google despliega Gemini 3.5 Live Translate para traducción de voz en tiempo real en más de 70 idiomas

Hecho Qué ha ocurrido
Google confirmó que Gemini 3.5 Live Translate funciona en Google Translate para Android e iOS en más de 70 idiomas, y también llegó a Google Meet, con más de 2.000 combinaciones de idiomas, y a Gemini Live desde el 1 de septiembre. El modelo detecta el idioma automáticamente y traduce de forma continua conservando tono y ritmo, con pocos segundos de retraso. Grab, plataforma de transporte del sudeste asiático con más de 10 millones de llamadas mensuales, ya lo prueba, junto con CJ ENM y LiveKit. El audio generado incluye la marca SynthID para identificar contenido creado por IA.
Resumen generado mediante IA a partir de Infobae Tecno. Naturaleza de la información: declaración de parte interesada.
Análisis Por qué importa
Reduce barreras de comunicación en tiempo real para empresas con operaciones multilingües, especialmente en atención al cliente, transporte y videollamadas corporativas.
- Quién se ve afectado
- Empresas con equipos o clientes multilingües, plataformas de transporte y delivery, proveedores de videollamadas y desarrolladores que integran APIs de voz.
- Qué puede cambiar
- La traducción por voz deja de requerir turnos de habla completos y se vuelve continua y casi simultánea, ampliando su uso en atención al cliente y reuniones internacionales.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Vigilar la expansión a más clientes empresariales de Workspace, la disponibilidad en iOS para Gemini Live y la adopción por parte de otras plataformas tras el caso de Grab.
Recomendación Qué debería hacer una empresa
Empresas con soporte multilingüe o operaciones internacionales pueden evaluar pilotos con la Gemini Live API en los próximos 3-6 meses para atención al cliente o videollamadas.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: Infobae Tecno. La referencia es siempre el artículo original.
Ver fuente original ↗vozmultimodaltraducción en tiempo real GoogleGrabCJ ENMLiveKit Gemini LiveGoogle MeetGoogle Translatetraducción por voz
Tu opinión
0 comentarios
Relacionadas
Qualcomm lanza chip Snapdragon Sound Elite Gen 2 para que auriculares usen IA sin el móvil
Qualcomm presentó en su Snapdragon Summit la plataforma Snapdragon Sound Elite Gen 2, un chip para auriculares con módulo Wi-Fi 6E de bajo consumo que permite…
Por qué importaEl chip abre la puerta a que los auriculares se conviertan en dispositivos independientes para interactuar con asistentes de IA, incluyendo futuras…
OpenAI integra correo, calendario y Slack en el modo de voz de ChatGPT
OpenAI actualizó ChatGPT Voice para integrar plugins como correo, calendario y Slack, permitiendo gestionarlos por voz sin cambiar a texto. La actualización…
Por qué importaConvertir la voz en interfaz para tareas agénticas complejas puede cambiar cómo los profesionales gestionan correo y agenda en el día a día…
Apple prueba internamente su smart display Home Hub con Siri AI y reconocimiento facial
Según Mark Gurman de Bloomberg, Apple está probando internamente en casas de empleados el dispositivo J490, un smart display para el hogar con reconocimiento…
Por qué importaApple llega tarde al mercado de smart displays frente a Amazon y Google, pero podría diferenciarse con procesamiento on-device de datos biométricos…
NVIDIA detalla cómo usar Warp y MJWarp para acelerar simulación robótica en GPU
NVIDIA publica un tutorial técnico sobre cómo usar NVIDIA Warp y MJWarp, una implementación de la física de MuJoCo sobre GPU, para paralelizar hasta 2.048…
Por qué importaAcelerar la simulación física es clave para entrenar políticas de robótica mediante aprendizaje por refuerzo a gran escala, reduciendo tiempos y…



