Resumen
The invention relates to a method and system of calculation for voice recording and analysis, which makes it possible to calculate a series of phonation parameters. These convey relevant information concerning influences caused by organic disorders (that affect the physiology of the larynx) or neurological disorders (that affect speech centres in the brain). Also considered to be an essential part of the invention are the classification methods that allow estimates to be obtained of the dysfunction present and of identity allocation. The invention is of use in possible applications for estimating dysfunction in primary medical care centres for screening patients for transfer to specialist centres, thereby simplifying exploration protocols, saving costs and shortening waiting lists. This methodology can also be applied to the detection of a speaker's identity, based on voice, making it possible to provide access to facilities or services.
Reivindicaciones
1. 1. Método para la estimación de parámetrosfisiológicos de la fonación a partir de una señal de vozcaracterizado por que comprende: 2. - compensar la radiación de los labios en laseñal de voz mediante la cancelación del polo de primer ordengenerado por dicha radiación en el espectro de la señal de voz (12) , 3. - efectuar un filtrado inverso (13, 14, 15, 16) de al menos un segmento fonado en un ciclo de fonación para unaseñal de voz compensada, donde dicho filtrado inverso comprende a suvez: 4. 2. Método de acuerdo con la reivindicación 1, caracterizado por que la etapa de compensar la radiación delos labios comprende además: 5. - modelar la inversión espectral (13) del tractovocal mediante una pluralidad de filtros de celosías adaptativas yencadenables entre sí, dichos filtros configurados para dividir laseñal de voz en dos señales (27, 28) sobre las que se calcula lacorrelación cruzada (29, 30) entre las dos señales divididasdesfasadas (27, 28) cancelando el efecto de la radiación en loslabios y generando una señal libre de radiación (31) . 6. 3. Método de acuerdo con la reivindicación 1 ó2, caracterizado por que la etapa de modelar la inversiónespectral de una señal (14, 15) comprende además: 7. - implementar una pluralidad de filtrosmodelo-espejo (13, 14) configurados para estimar lacorrelación parcial (34) y eliminar dicha correlación parcial (38) de la señal glótica (37, 37') debida al tracto vocal generandonuevas señales glóticas (39, 39') sin influencia sustancial deltracto vocal. 8. 4. Método de acuerdo con una cualquiera de lasreivindicaciones anteriores, caracterizado por que comprendecalcular la onda glótica sqi (n) medianteintegración de la señal residual de onda glóticasri (n) . 9. 5. Método de acuerdo con la reivindicación 4, que comprende estimar al menos uno de los siguientes parámetrostemporales (19) sobre la onda glótica sqi (n) : 10. - inicio del ciclo glótico; 11. - instante de recuperación Tr; 12. - instante de inicio de apertura de la cuerdasvocales To; 13. - instante de máxima presión supraglóticaTm; 14. - instante de inicio del cierre de los plieguesvocales Tc; 15. - instante final del ciclo glótico con mínimapresión supraglótica Tg; 16. - coeficientes ODQ, CDQ y GEQ. 17. 6. Método de acuerdo con la reivindicación 4 ó5, que comprende estimar al menos uno de los siguientes parámetrosde distorsión (20) sobre la onda glóticasqi (n) : 18. - jitter, 19. - shimmer de amplitud, 20. - shimmer de área, 21. - agudeza del cierre, 22. - relación cubierta/cuerpo. 23. 7. Método de acuerdo con una cualquiera de lasreivindicaciones 4 a 6, caracterizado por que comprendeestimar la onda acústica promedio vqi (n) paraestimar al menos uno de los siguientes conjuntos de parámetrosbiométricos (22, 23) sobre la onda glótica sqi (n) mediante la detección de onda acústica promedio (21) : 24. - densidad espectral de potencia del correlatode onda mucosa, 25. - coeficientes cepstrales del correlato glóticode onda mucosa, 26. - singularidades de la envolvente de la densidadespectral de potencia del correlato glótico de onda mucosa. 27. 8. Método de acuerdo con una cualquiera de lasreivindicaciones 4 a 7, caracterizado por que comprendeestimar la onda acústica promedio vqi (n) para almenos uno de los siguientes parámetros biomecánicos (24, 25) sobrela onda glótica sqi (n) mediante la detección deonda acústica promedio (21) : 28. - parámetro de pérdidas, 29. - parámetro de masa dinámica equivalente delcuerpo de la cuerda, 30. - parámetro de elasticidad, 31. - desbalances entre ciclos de fonación respectode: 32. 9. Sistema para la estimación de parámetrosfisiológicos de la fonación a partir de una señal de voz quecomprende: 33. - medios configurados para compensar laradiación de los labios en la señal de voz mediante la cancelacióndel polo de primer orden generado por dicha radiación en el espectrode la señal de voz, 34. - medios configurados para efectuar un filtradoinverso (13, 14, 15, 16) de al menos un segmento fonado en un ciclo defonación para una señal de voz compensada, donde dicho filtradoinverso comprende a su vez: 35. 10. Sistema de acuerdo con la reivindicación 9, caracterizado por que los medios configurados para compensarla radiación de los labios comprenden además: 36. - medios configurados para modelar la inversiónespectral (13) del tracto vocal comprendiendo a su vez unapluralidad de filtros de celosías adaptativas y encadenables entresí, donde dichos filtros están configurados para dividir la señal devoz en dos señales (27, 28) sobre las que se calcula la correlacióncruzada (29, 30) entre las dos señales divididas desfasadas (27, 28) cancelando el efecto de la radiación en los labios ygenerando una señal libre de radiación (31) . 37. 11. Sistema de acuerdo con la reivindicación 9 ó10, caracterizado por que los medios configurados paramodelar la inversión espectral de una señal (14, 15) comprendenademás: 38. - una pluralidad de filtrosmodelo-espejo (13, 14) configurados para estimar lacorrelación parcial debida al tracto vocal (34) y eliminar dichacorrelación parcial de la señal glótica (38) . 39. 12. Sistema de acuerdo con una cualquiera de lasreivindicaciones 9 a 11, caracterizado por que lasestimaciones se realizan sobre al menos un Modelo de LocutorNormofónico y son almacenadas en unos medios de almacenamiento paraser comparadas con las estimaciones de un locutor cualquiera paradeterminar la presencia y grado de la disfonía de acuerdo con ladesviación existente entre ambas estimaciones. 40. 13. Sistema de acuerdo con una cualquiera de lasreivindicaciones 9 a 11, caracterizado por que lasestimaciones de un locutor cualquiera se almacenan en unos medios dealmacenamiento para identificar unívocamente a dicho locutor.