Google DeepMind lanza Gemini 3.8 Flash TTS y Flash-Lite TTS con voces personalizables

Hecho Qué ha ocurrido
Google DeepMind presentó Gemini 3.8 Flash TTS y Flash-Lite TTS, sus nuevos modelos de texto a voz que permiten crear voces de personaje personalizadas y dirigir diálogos de escena, disponibles en Google AI Studio, Gemini API, Gemini Enterprise, Gemini Notebook y Google Vids. Gemini 3.8 Flash TTS ocupó el puesto #1 en el Voice Design Benchmark de Hume AI (71.4) y lidera también en modelado de acentos (60.8), además de posicionarse #1 y #2 en el Overall Quality Index. Los modelos soportan más de 100 idiomas y ya trabajan con socios como Figma, HeyGen, Wondercraft y 99.co, además de plataformas como Agora, LiveKit y Vercel.
Resumen generado mediante IA a partir de Google DeepMind (original en inglés). Naturaleza de la información: declaración de parte interesada.
Análisis Por qué importa
La generación de voz sintética de alta calidad y personalizable abre nuevas posibilidades para doblaje global, agentes de voz conversacionales y contenido multimedia, reduciendo costes de producción de audio profesional.
- Quién se ve afectado
- Empresas de medios, doblaje, videojuegos, atención al cliente y desarrolladores que integran voz en productos.
- Qué puede cambiar
- Se reduce la dependencia de locutores profesionales para ciertos casos de uso y se facilita la localización de contenido en múltiples idiomas con acentos regionales.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Habrá que vigilar la adopción real por parte de estudios y empresas, la evolución de la competencia (ElevenLabs, OpenAI, Alibaba) y el debate sobre uso ético de voces sintéticas y consentimiento.
Recomendación Qué debería hacer una empresa
Empresas con necesidades de localización de audio o atención al cliente por voz deberían evaluar Gemini 3.8 TTS en los próximos 3-6 meses frente a alternativas como ElevenLabs.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: Google DeepMind (fuente primaria). La referencia es siempre el artículo original.
Ver fuente original ↗voztexto a vozmultimodal Google DeepMindFigmaHeyGenWondercraftAgora GeminiGoogle DeepMindIA de voztexto a voz
Tu opinión
0 comentarios
Relacionadas
YouTube amplía Creator Studio con herramientas de IA para guion, edición y traducción
YouTube añade a Creator Studio un asistente de storytelling que analiza guiones y montajes, miniaturas dinámicas con pruebas A/B, y Gemini como asistente de…
Por qué importaConsolida la integración de IA generativa en herramientas de producción de contenido masivo, acelerando flujos de creación y personalización para…
Tesla integra el asistente Grok en sus autos para gestionar correo, calendario y documentos por voz
Tesla integró Grok Bot en sus vehículos, permitiendo a los usuarios gestionar correo electrónico, calendario y documentos mediante comandos de voz sin usar las…
Por qué importaMuestra cómo los fabricantes de autos convierten el vehículo en un punto de acceso más para asistentes de IA agénticos, ampliando el ecosistema de…
Anthropic lanza Claude Opus 5.5 con reducción de costos y mejoras de rendimiento
Anthropic lanzó Claude Opus 5.5, sucesor de Opus 5, con tarifas de tokens un 20% menores y un ahorro estimado del 40% en trabajos habituales. En pruebas de…
Por qué importaPara empresas que usan IA en tareas prolongadas de programación, la combinación de menor costo por token y mayor eficiencia puede reducir…
YouTube presenta en Made on YouTube 2026 herramientas de IA para descubrimiento, producción y monetización
YouTube presentó en el evento Made on YouTube 2026 una serie de funciones basadas en IA: Custom Feeds personalizados por conversación, expansión de Ask…
Por qué importaEstas herramientas reconfiguran cómo se descubre, produce y monetiza contenido en la mayor plataforma de video del mundo, afectando directamente a…



