Google lanza Gemini 3.1 Flash TTS con control granular de voz
Enviar esta historia por correo
Línea temporal
-
Google lanza Gemini 3.1 Flash TTS, modelo de voz con control granular y marca SynthID
Google DeepMind presentó Gemini 3.1 Flash TTS, un modelo de texto a voz con etiquetas de audio para controlar estilo, ritmo y entonación en más de 70 idiomas. El modelo obtuvo un Elo de 1.211 en el leaderboard de…
-
Google lanza Gemini 3.1 Flash Live con mejor comprensión de audio y menor latencia
Google DeepMind ha presentado Gemini 3.1 Flash Live, su modelo de audio y voz de más alta calidad, diseñado para diálogos en tiempo real más naturales y precisos. El modelo logra un 90,8% en ComplexFuncBench Audio…