Articulo de referencia

Modelo fuente-filtro

El modelo fuente-filtro representa el habla como una combinación de una fuente sonora, como las cuerdas vocales , y un filtro acústico lineal, el tracto vocal . Aunque solo es u...

El modelo fuente-filtro representa el habla como una combinación de una fuente sonora, como las cuerdas vocales , y un filtro acústico lineal, el tracto vocal . Aunque solo es una aproximación, el modelo se utiliza ampliamente en diversas aplicaciones, como la síntesis y el análisis del habla , debido a su relativa simplicidad. También está relacionado con la predicción lineal . El desarrollo del modelo se debe, en gran parte, al trabajo inicial de Gunnar Fant , aunque otros, en particular Ken Stevens , también han contribuido sustancialmente a los modelos subyacentes al análisis acústico del habla y la síntesis del habla. [ 1 ] Fant se basó en el trabajo de Tsutomu Chiba y Masato Kajiyama, quienes fueron los primeros en demostrar la relación entre las propiedades acústicas de una vocal y la forma del tracto vocal. [ 1 ]

Una suposición importante que se suele hacer al usar el modelo fuente-filtro es la independencia de la fuente y el filtro. En tales casos, el modelo debería denominarse con mayor precisión "modelo fuente-filtro independiente". [ 1 ]

Historia

En 1942, Chiba y Kajiyama publicaron su investigación sobre la acústica de las vocales y el tracto vocal en su libro « La vocal: su naturaleza y estructura» . Mediante la creación de modelos del tracto vocal utilizando radiografías , lograron predecir las frecuencias de los formantes de diferentes vocales, estableciendo una relación entre ambas. Gunnar Fant, un científico pionero en el estudio del habla, utilizó la investigación de Chiba y Kajiyama sobre radiografías del tracto vocal para interpretar sus propios datos de sonidos del habla rusa en « Teoría acústica de la producción del habla» , que estableció el modelo fuente-filtro. [ 2 ]

Aplicaciones

En distintos grados, los diferentes fonemas pueden distinguirse por las propiedades de su(s) fuente(s) y su forma espectral . Los sonidos sonoros (p. ej., vocales) tienen al menos una fuente debido a la excitación glótica mayormente periódica, que puede aproximarse mediante un tren de impulsos en el dominio del tiempo y mediante armónicos en el dominio de la frecuencia, y un filtro que depende, por ejemplo, de la posición de la lengua y la protrusión de los labios. [ 3 ] Por otro lado, las fricativas , como [s] y [f] , tienen al menos una fuente debido al ruido turbulento producido en una constricción en la cavidad oral o faringe . Las llamadas fricativas sonoras , como [z] y [v] , tienen dos fuentes: una en la glotis y otra en la constricción supraglótica.

Síntesis de voz

En la implementación del modelo fuente-filtro para la producción del habla, la fuente sonora, o señal de excitación, se suele modelar como un tren de impulsos periódicos para el habla sonora o como ruido blanco para el habla sorda. El filtro del tracto vocal se aproxima, en el caso más simple, mediante un filtro de polos, cuyos coeficientes se obtienen mediante predicción lineal para minimizar el error cuadrático medio de la señal de habla que se va a reproducir. La convolución de la señal de excitación con la respuesta del filtro produce entonces el habla sintetizada.

Modelado de la producción del habla humana

Una posible combinación de fuente y filtro en el tracto vocal humano

En la producción del habla humana, la fuente sonora son las cuerdas vocales , que pueden producir un sonido periódico al contraerse o un sonido aperiódico (ruido blanco) al relajarse. [ 4 ] El filtro es el resto del tracto vocal, que puede cambiar de forma mediante la manipulación de la faringe , la boca y la cavidad nasal. [ 3 ] Fant compara, a grandes rasgos, la fuente y el filtro con la fonación y la articulación , respectivamente. La fuente produce una serie de armónicos de amplitud variable , que viajan a través del tracto vocal y se amplifican o atenúan para producir un sonido del habla. [ 4 ]

Véase también

Referencias

  1. 1 2 3 Arai, Takayuki (2004). "Historia de Chiba y Kajiyama y su influencia en la ciencia moderna del habla". Del sonido al sentido: más de 50 años de descubrimientos en la comunicación del habla (PDF) . págs. 115–120 . 
  2. Fant, Gunnar (2001). "T. Chiba y M. Kajiyama, pioneros en acústica del habla" . Revista de la Sociedad Fonética de Japón . 5 (2). doi : 10.24467/onseikenkyu.5.2_4 . Consultado el 3 de julio de 2020 .
  3. 1 2 Fant, Gunnar (1970). Teoría acústica de la producción del habla con cálculos basados ​​en estudios de rayos X de las articulaciones rusas . De Gruyter.
  4. 1 2 Zsiga, Elizabeth C. (2012). Los sonidos del lenguaje: Una introducción a la fonética y la fonología . John Wiley & Sons. ISBN 978-1-118-34060-8.
  • Chiba, T.; Kajiyama, M. (1942). La vocal: su naturaleza y estructura . Tokio: Tokyo-Kaiseikan Pub. Co., Ltd.(Hubo una edición reimpresa en 1952 y una edición traducida al japonés en 2003 como ISBN 4-00-002107-9)
  • Stevens, KN ​​(2001). "El libro de Chiba y Kajiyama como precursor de la teoría acústica de la producción del habla" . Revista de la Sociedad Fonética de Japón . 5 (2): 6– 7.
  • Stevens, KN ​​(1998). Fonética acústica . Cambridge, MA: MIT Press . ISBN 978-0-262-19404-4(Tapa dura en 1999) / (Tapa blanda en 2000).