La enfermedad de Parkinson provoca cambios graduales en la respiración, la fonación, la intensidad y la entonación del habla a medida que avanza. Estas alteraciones no necesariamente se presentan de la misma forma en todas las personas, pero habitualmente afectan la naturalidad y la inteligibilidad de la comunicación. La generación controlada de estos rasgos ha ayudado en el pasado a comprender cómo contribuye cada uno de ellos al sonido resultante; en el futuro debe permitirnos desarrollar herramientas para la investigación, la formación y la evaluación de sistemas de análisis del habla.
Se propone desarrollar y evaluar un modelo físico simplificado de la producción de voz. El sistema combinará una fuente glotal modificada basada en el modelo de Liljencrants–Fant con un modelo de guía de onda para la propagación, inspirado en la estructura de Kelly–Lochbaum del tracto vocal. A partir de una configuración normofónica de referencia, se incorporarán controles que modifiquen progresivamente aspectos descritos en la literatura científica, como el soporte respiratorio, la presencia de aire en la voz y el rango prosódico.
El modelo se integrará en una herramienta interactiva desde la que se podrán escuchar y visualizar los efectos de cada parámetro. Además, se estudiarán procedimientos de optimización para estimar los parámetros del modelo que permitan aproximar los sonidos generados por el propio modelo a registros reales, realizando un primer ajuste a grabaciones de pacientes diagnosticados con esta enfermedad.
El objetivo es verificar cómo un conjunto reducido de parámetros, imbricados en puntos físicamente coherentes del modelo, permite generar y aproximar algunos de los rasgos descritos en el habla parkinsoniana.
El estudiante abordará las siguientes tareas:
• Familiarización con las principales alteraciones del habla asociadas a la enfermedad de Parkinson.
• Estudio de modelos físicos simplificados de la producción de voz.
• Revisión del modelo Kelly–Lochbaum y de la fuente glotal de Liljencrants–Fant.
• Adaptación y extensión de estos modelos al habla parkinsoniana.
• Desarrollo de una configuración normofónica de referencia.
• Incorporación de controles del soporte respiratorio, de la presencia de aire y de la evolución prosódica.
• Evaluación de la sensibilidad y la independencia de los parámetros.
Resultados esperados
• Un modelo físico simplificado de producción de voz.
• Un conjunto reducido de parámetros interpretables para controlar diversas alteraciones del habla.
• Un repositorio de código documentado y reproducible.
• Una herramienta web interactiva.
Perfil recomendado
El TFG está dirigido a estudiantes interesados en el procesamiento de voz, el estudio de patologías clínicas, la síntesis de audio y el aprendizaje automático. Se valorará el interés en el desarrollo de interfaces gráficas interactivas y en las aplicaciones biomédicas.
Interesados
Contactar con el tutor por correo electrónico, incluyendo: (1) CV actualizado, (2) carta de motivación personal, (3) certificado de calificaciones (el disponible en UPM virtual es suficiente).







