
En ciencia del habla y fonética , un formante es el máximo espectral amplio que resulta de una resonancia acústica del tracto vocal humano . [ 1 ] [ 2 ] En acústica , un formante se define generalmente como un pico amplio, o máximo local, en el espectro. [ 3 ] [ 4 ] Para sonidos armónicos, con esta definición, la frecuencia del formante a veces se toma como la del armónico que es más aumentado por una resonancia. La diferencia entre estas dos definiciones reside en si los "formantes" caracterizan los mecanismos de producción de un sonido o el sonido producido en sí. En la práctica, la frecuencia de un pico espectral difiere ligeramente de la frecuencia de resonancia asociada, excepto cuando, por casualidad, los armónicos están alineados con la frecuencia de resonancia, o cuando la fuente de sonido es mayoritariamente no armónica, como en el susurro y el canto rasposo .
Se puede decir que una habitación posee formantes característicos de esa habitación en particular, debido a sus resonancias, es decir, a la forma en que el sonido se refleja en sus paredes y objetos. Los formantes de la habitación de esta naturaleza se refuerzan a sí mismos enfatizando frecuencias específicas y absorbiendo otras, como lo aprovecha, por ejemplo, Alvin Lucier en su pieza I Am Sitting in a Room . En el procesamiento digital de señales acústicas , la forma en que un conjunto de formantes (como una habitación) afecta una señal se puede representar mediante una respuesta impulsional .
Tanto en el habla como en las salas, los formantes son características propias de las resonancias del espacio. Se dice que son excitados por fuentes acústicas como la voz y que modifican (filtran) los sonidos de dichas fuentes, pero no son fuentes en sí mismos.
Historia
Desde un punto de vista acústico, la fonética tenía un serio problema con la idea de que la longitud efectiva del tracto vocal modificaba las vocales. [ 5 ] De hecho, cuando la longitud del tracto vocal cambia, todos los resonadores acústicos formados por las cavidades bucales se escalan, y también lo hacen sus frecuencias de resonancia. Por lo tanto, no estaba claro cómo las vocales podían depender de las frecuencias cuando hablantes con diferentes longitudes de tracto vocal, por ejemplo, cantantes de bajo y soprano , pueden producir sonidos que se perciben como pertenecientes a la misma categoría fonética. Tenía que haber alguna manera de normalizar la información espectral que sustenta la identidad de la vocal. Hermann propuso una solución a este problema en 1894, acuñando el término «formante». Una vocal, según él, es un fenómeno acústico especial, que depende de la producción intermitente de un parcial especial, o «formante», o rasgo «característico». La frecuencia del «formante» puede variar ligeramente sin alterar el carácter de la vocal. Por ejemplo, para la “e larga” ( ee o iy ), el “formante” de menor frecuencia puede variar de 350 a 440 Hz incluso en la misma persona. [ 6 ]
Fonética
Los formantes son componentes de frecuencia distintivas de la señal acústica producida por el habla, los instrumentos musicales [ 8 ] o el canto . La información que los humanos necesitan para distinguir entre los sonidos del habla se puede representar de forma puramente cuantitativa especificando los picos en el espectro de frecuencias. La mayoría de estos formantes se producen por resonancia de tubos y cámaras , pero algunos tonos de silbido derivan del colapso periódico de zonas de baja presión del efecto Venturi . [ 9 ]
El formante con la frecuencia más baja se llama F1 , el segundo F2 , el tercero F3 , y así sucesivamente. La frecuencia fundamental o tono de la voz a veces se denomina F0 , pero no es un formante. Generalmente, los dos primeros formantes, F1 y F2, son suficientes para identificar la vocal. La relación entre la calidad vocal percibida y las frecuencias de los dos primeros formantes se puede apreciar escuchando " vocales artificiales" que se generan al pasar un tren de clics (para simular el tren de pulsos glóticos) a través de un par de filtros de paso de banda (para simular resonancias del tracto vocal). Las vocales anteriores tienen un F2 más alto , mientras que las vocales bajas tienen un F1 más alto . El redondeo de los labios tiende a disminuir F1 y F2 en las vocales posteriores y F2 y F3 en las vocales anteriores. [ 10 ] La disminución de F3 también es una característica principal de las vocales coloreadas con r . [ 11 ]
Las consonantes nasales suelen tener un formante adicional alrededor de 2500 Hz. La líquida [l] suele tener un formante adicional a 1500 Hz, mientras que el sonido de la "r" inglesa ( [ɹ] ) se distingue por un tercer formante muy bajo (muy por debajo de 2000 Hz).
Las oclusivas (y, en cierta medida, las fricativas ) modifican la posición de los formantes en las vocales circundantes. Los sonidos bilabiales (como / b / y /p/ en "ball" o "sap") provocan un descenso de los formantes; en los espectrogramas, los sonidos velares ( /k/ y /ɡ/ en inglés) casi siempre muestran que F2 y F3 se unen en una "contracción velar" antes de la velar y se separan de la misma "contracción" cuando la velar se libera; los sonidos alveolares ( /t/ y /d/ en inglés ) provocan menos cambios sistemáticos en los formantes vocálicos vecinos, dependiendo parcialmente de qué vocal esté presente exactamente. La evolución temporal de estos cambios en las frecuencias de los formantes vocálicos se denomina "transiciones de formantes".
En el habla normal, la vibración subyacente producida por las cuerdas vocales se asemeja a una onda de diente de sierra , rica en armónicos . Si la frecuencia fundamental o (más a menudo) uno de los armónicos es superior a la frecuencia de resonancia del sistema, la resonancia se excitará débilmente y el formante que normalmente produce se perderá casi por completo. Esto se observa con mayor claridad en el caso de las sopranos de ópera , que cantan en tonos tan agudos que sus vocales resultan muy difíciles de distinguir.
El control de las resonancias es un componente esencial de la técnica vocal conocida como canto de armónicos , en la que el intérprete canta un tono fundamental bajo y crea resonancias agudas para seleccionar armónicos superiores , dando la impresión de que se cantan varios tonos a la vez.
Los espectrogramas pueden utilizarse para visualizar formantes. En los espectrogramas, puede resultar difícil distinguir los formantes de los armónicos naturales al cantar. Sin embargo, es posible escuchar los formantes naturales en una vocal mediante técnicas atonales como el registro grave (vocal fry) .
Estimación de formantes
Los formantes, ya sean vistos como resonancias acústicas del tracto vocal o como máximos locales en el espectro del habla, como filtros de paso de banda , se definen por su frecuencia y por su ancho espectral ( ancho de banda ).
Existen diferentes métodos para obtener esta información. Las frecuencias de los formantes, en su definición acústica, pueden estimarse a partir del espectro de frecuencias del sonido, utilizando un espectrograma (en la figura) o un analizador de espectro. Sin embargo, para estimar las resonancias acústicas del tracto vocal (es decir, la definición de formantes en el habla) a partir de una grabación de voz, se puede utilizar la codificación predictiva lineal . Un enfoque intermedio consiste en extraer la envolvente espectral neutralizando la frecuencia fundamental [ 12 ] y solo entonces buscar máximos locales en la envolvente espectral.
Gráficos de formantes

Los dos primeros formantes son importantes para determinar la calidad de las vocales y se suele decir que corresponden a las dimensiones de apertura-cierre (o baja-alta) y anterior-posterior (que tradicionalmente se han asociado con la forma y la posición de la lengua ) . Así, el primer formante F1 tiene una frecuencia más alta para una vocal abierta o baja como [a] y una frecuencia más baja para una vocal cerrada o alta como [i] o [u] ; y el segundo formante F2 tiene una frecuencia más alta para una vocal anterior como [i] y una frecuencia más baja para una vocal posterior como [u] . [ 13 ] [ 14 ]
Las vocales casi siempre tendrán cuatro o más formantes distinguibles, y a veces más de seis. Sin embargo, los dos primeros formantes son los más importantes para determinar la calidad vocálica y a menudo se representan gráficamente uno frente al otro en los diagramas vocálicos, [ 15 ] aunque esta simplificación no logra capturar algunos aspectos de la calidad vocálica, como el redondeo. [ 16 ]
Muchos autores han abordado el problema de encontrar una alineación óptima de las posiciones de las vocales en los diagramas de formantes con las del cuadrilátero vocálico convencional. El trabajo pionero de Ladefoged [ 17 ] utilizó la escala Mel porque se afirmó que esta escala se correspondía más estrechamente con la escala auditiva de tono que con la medida acústica de la frecuencia fundamental expresada en Hertz. Dos alternativas a la escala Mel son la escala Bark y la escala ERB-rate . [ 18 ] Otra estrategia ampliamente adoptada es representar la diferencia entre F1 y F2 en lugar de F2 en el eje horizontal.
Formante de Singer
Estudios del espectro de frecuencia de hablantes entrenados y cantantes clásicos , especialmente cantantes masculinos, indican un formante claro alrededor de 3000 Hz (entre 2800 y 3400 Hz) que está ausente en el habla o en los espectros de hablantes o cantantes no entrenados. Se cree que está asociado con una o más de las resonancias más altas del tracto vocal. [ 19 ] [ 20 ] Es este aumento de energía en 3000 Hz lo que permite que los cantantes sean escuchados y comprendidos por encima de una orquesta . Este formante se desarrolla activamente a través del entrenamiento vocal , por ejemplo a través de los llamados ejercicios de voce di strega o "voz de bruja" [ 21 ] y es causado por una parte del tracto vocal que actúa como un resonador . [ 22 ] En la música clásica y la pedagogía vocal, este fenómeno también se conoce como squillo .
Véase también
Referencias
- ↑ Titze, IR (1994). Principios de producción vocal, Prentice Hall, ISBN 978-0-13-717893-3.
- ^ Titze, IR, Baken, RJ Bozeman, KW, Granqvist, S. Henrich, N., Herbst, CT, Howard, DM, Hunter, EJ, Kaelin, D., Kent, RD, Löfqvist, A., McCoy, S., Miller, DG, Noé, H., Scherer, RC, Smith, JR, Story, BH, Švec, JG, Ternström, S. y Wolfe, J. (2015) "Hacia un consenso sobre la notación simbólica de armónicos, resonancias y formantes en la vocalización". J. acústico. Soc. América. 137, 3005–3007.
- ↑ Jeans, JH (1938) Ciencia y música, reimpreso por Dover, 1968.
- ↑ Secretaría de Normas, Sociedad Acústica de América, (1994). ANSI S1.1-1994 (R2004) Norma Nacional Estadounidense de Terminología Acústica, (12.41) Sociedad Acústica de América, Melville, NY.
- ^ Hermann, Ludimar (1894). Phonophotographische Untersuchungen [ Estudios fonofotográficos ] (en alemán) (5ª ed.).
- ↑ McKendrick, JG (1903). Fonética experimental. En Informe anual de la junta de regentes de la institución Smithsonian para el año que finalizó el 30 de junio de 1902 (págs. 241–259). Institución Smithsonian.
- ↑ Catford, John Cunnison (2001). Introducción práctica a la fonética (2.ª ed.). Oxford: Oxford University Press. pág. 154. ISBN 0-19-924635-1.
- ↑ Reuter, Christoph (2009): El papel de las posiciones de los formantes y las micromodulaciones en la mezcla y el enmascaramiento parcial de instrumentos musicales. En: Journal of the Acoustical Society of America (JASA), Vol. 126,4, p. 2237
- ↑ Flanagan, James L. (1972). Análisis, síntesis y percepción del habla . doi : 10.1007/978-3-662-01562-9 . ISBN 978-3-662-01564-3.
- ↑ Thomas, Erik R. (2011). Sociophonetics: An Introduction . Palgrave Macmillan. p. 145. ISBN 978-0-230-22455-1.
- ↑ Ladefoged, Peter ; Maddieson, Ian (1996). Los sonidos de las lenguas del mundo . Oxford: Blackwell. pág. 313. ISBN 0-631-19815-6.
- ↑ Kawahara, Hideki; Masuda-Katsuse, Ikuyo; de Cheveigné, Alain (abril de 1999). "Reestructuración de las representaciones del habla mediante un suavizado tiempo-frecuencia adaptativo al tono y una extracción de F0 basada en la frecuencia instantánea: posible papel de una estructura repetitiva en los sonidos". Speech Communication . 27 ( 3–4 ): 187–207 . doi : 10.1016/S0167-6393(98)00085-5 .
- ↑ Ladefoged, Peter (2006) A Course in Phonetics (Quinta edición) , Boston, MA: Thomson Wadsworth, pág. 188. ISBN 1-4130-2079-8
- ↑ Ladefoged, Peter (2001) Vocales y consonantes: Una introducción a los sonidos del lenguaje , Maldern, MA: Blackwell, pág. 40. ISBN 0-631-21412-7
- ↑ Deterding, David (1997) 'Los formantes de las vocales monoptongas en la pronunciación estándar del inglés británico del sur', Journal of the International Phonetic Association , 27, pp. 47–55.
- ↑ Hayward, Katrina (2000) Fonética experimental , Harlow, Reino Unido: Pearson, pág. 149. ISBN 0-582-29137-2
- ↑ Ladefoged, P. (1967). Tres áreas de la fonética experimental . Oxford. pág. 87.
- ↑ Hayward, K. (2000). Fonética experimental . Longman. ISBN 0-582-29137-2.
- ↑ Sundberg, J. (1974). "Interpretación articulatoria del 'formante cantado'", Journal of the Acoustical Society of America , 55, 838–844.
- ↑ Bele, Irene Velsvik (diciembre de 2006). "El formante del hablante". J. Voice . 20 (4): 555– 578. doi : 10.1016/j.jvoice.2005.07.001 . PMID 16325374 .
- ↑ Frisell, Anthony (2007). Baritone Voice . Boston: Branden Books. p. 84. ISBN 978-0-8283-2181-5.
- ↑ Sundberg, Johan (1987). La ciencia de la voz cantada . DeKalb, Ill: Northern Illinois University Press . ISBN 0-87580-542-6.
Enlaces externos
- Formantes para divertirse y obtener beneficios.
- Formantes y pedales wah-wah
- ¿Qué es un formante? Un análisis de los tres significados diferentes de la palabra "formante".
- Afinación de formantes por cantantes soprano de la Universidad de Nueva Gales del Sur
- La acústica del canto armónico o de sobretonos de la Universidad de Nueva Gales del Sur
- Materiales para medir y graficar formantes vocálicos
- Voz humana
- Tipos de síntesis de sonido
- Acústica