Ir al contenido
IA para hoy
Herramientas y productos Producto

DeepMind recrea la voz original de una persona con ELA usando WaveNet

Imagen: Google DeepMind

Hecho Qué ha ocurrido

Google DeepMind ha desarrollado un sistema de síntesis de voz que recrea la voz natural de Tim Shaw, exjugador de la NFL diagnosticado con esclerosis lateral amiotrófica (ELA), utilizando solo treinta minutos de grabaciones de audio de su carrera deportiva. El proyecto aplica técnicas de WaveNet y fine-tuning con modelo WaveRNN para entrenar voces personalizadas con cantidades mínimas de datos de entrenamiento, permitiendo que Shaw escuchara su voz original después de años.

Resumen generado mediante IA a partir de Google DeepMind (original en inglés). Naturaleza de la información: hecho documentado.

Análisis Por qué importa

Para millones de personas con ELA y otros trastornos del habla, recuperar o preservar la propia voz es crucial para mantener su identidad y capacidad de comunicación. Este avance demuestra que la IA generativa puede personalizar voces naturales con muy pocos datos, sustituyendo la actual práctica limitada del "message banking" por síntesis más flexible y significativa emocionalmente.

Quién se ve afectado
Personas con ELA, esclerosis múltiple, parálisis cerebral u otros trastornos neuromusculares que afecten al habla, así como sanitarios y profesionales de logopedia.
Qué puede cambiar
Las personas con pérdida progresiva de voz podrán acceder a síntesis personalizadas basadas en grabaciones breves de su voz natural, en lugar de limitarse a frases pregrabadas o voces genéricas. Esta capacidad también abre usos en medicina, accesibilidad y aplicaciones que requieran autenticidad vocal.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

La disponibilidad futura de esta tecnología en aplicaciones de asistencia (AAC), el tiempo hasta integración en plataformas accesibles de bajo coste, y la adopción por organizaciones de ELA y fisioterapia. También vigilar mejoras en velocidad de síntesis y tolerancia a degradación progresiva de la voz original.

Recomendación Qué debería hacer una empresa

Las organizaciones sanitarias y empresas de tecnología asistiva deberían evaluar integración de estas técnicas en plataformas AAC (comunicación alternativa y aumentativa) en los próximos 12-18 meses, en coordinación con asociaciones de ELA y pacientes.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Fuente original: Google DeepMind (fuente primaria). La referencia es siempre el artículo original.

Ver fuente original ↗

WaveNetWaveRNNtext-to-speechfine-tuningsíntesis de voz accesibilidadDeepMindELAIA médicasíntesis de voz

Relacionadas

Lenovo apuesta por IA híbrida local con su asistente Qira en IFA 2026

En IFA de Berlín, Lenovo presentó su visión de IA centrada en Qira, un asistente personal que funciona a través de PC, móviles, tablets y el Moto Watch Ultra…

Por qué importaLa estrategia de Lenovo refleja una tendencia hacia modelos de IA local que priorizan privacidad y reducción de dependencia de la nube, algo…

Impacto bajo Fiabilidad una fuente fiable Xataka

Google y Cathay Pacific amplían pruebas de IA para evitar estelas de condensación

Google Research está ampliando con Cathay Pacific un programa piloto que usa IA, imágenes satelitales y datos meteorológicos para ajustar ligeramente la…

Por qué importaEs un ejemplo de aplicación de IA a un problema climático concreto en un sector con difícil descarbonización, usando infraestructura existente sin…

Impacto bajo Fiabilidad una fuente fiable Google AI

Gemini Spark de Google ya puede gestionar bibliotecas de Google Photos

Google anunció que su agente personal Gemini Spark puede ejecutar tareas en Google Photos, como editar imágenes, curar álbumes, crear álbumes compartidos…

Por qué importaEs un ejemplo más de cómo las grandes tecnológicas integran agentes de IA en servicios de consumo masivo, buscando justificar el valor de las…

Impacto muy bajo Fiabilidad una fuente fiable TechCrunch AI