Articulo de referencia

Umbral de enmascaramiento

El umbral de enmascaramiento en acústica (una rama de la física que se ocupa de temas como la vibración , el sonido , el ultrasonido y el infrasonido ) se refiere a un proceso e...

El umbral de enmascaramiento en acústica (una rama de la física que se ocupa de temas como la vibración , el sonido , el ultrasonido y el infrasonido ) se refiere a un proceso en el que, si hay dos sonidos simultáneos y uno es más fuerte que el otro, una persona puede ser incapaz de oír el sonido suave porque está enmascarado por el sonido más fuerte. [ 1 ]

El umbral de enmascaramiento es el nivel de presión sonora necesario para que un sonido sea audible en presencia de otro ruido, denominado «enmascarador». Este umbral depende de la frecuencia , el tipo de enmascarador y el tipo de sonido que se intenta enmascarar. El efecto es más intenso entre dos sonidos de frecuencias similares.

En el contexto de la transmisión de audio, la incapacidad de percibir un sonido presenta algunas ventajas. En la codificación de audio , por ejemplo, se puede lograr una mejor compresión omitiendo los tonos inaudibles. Esto requiere menos bits para codificar el sonido y reduce el tamaño del archivo final.

Aplicaciones en compresión de audio

Es poco común trabajar con un solo tono . La mayoría de los sonidos se componen de múltiples tonos. Puede haber muchos enmascaradores posibles en la misma frecuencia. En esta situación, sería necesario calcular el umbral de enmascaramiento global mediante una transformada rápida de Fourier de alta resolución con 512 o 1024 puntos para determinar las frecuencias que componen el sonido. Dado que existen anchos de banda que los humanos no pueden oír, es necesario conocer el nivel de la señal, el tipo de enmascarador y la banda de frecuencia antes de calcular los umbrales individuales. Para evitar que el umbral de enmascaramiento esté por debajo del umbral en silencio, se añade este último al cálculo de los umbrales parciales. Esto permite calcular la relación señal-máscara (SMR).

Diagrama de espectro
El espectro de un tono de 1  kHz. Un sonido no se oirá si está por debajo del umbral en silencio. Este límite varía alrededor de la frecuencia del enmascarador, lo que dificulta oír un tono cercano. La pendiente del umbral de enmascaramiento es más pronunciada hacia las frecuencias bajas que hacia las altas, lo que significa que es más fácil enmascarar con tonos de alta frecuencia.

El modelo psicoacústico

El proceso de codificación de audio MPEG aprovecha el umbral de enmascaramiento. En este proceso, existe un bloque llamado "Modelo psicoacústico". Este se comunica con el filtro de banda y el bloque de cuantificación. El modelo psicoacústico analiza las muestras que le envía el filtro de banda, calculando el umbral de enmascaramiento en cada banda de frecuencia mediante una transformada rápida de Fourier. El número de puntos utilizados depende de la capa MPEG. Utilizando estos umbrales, se determina la relación señal-máscara y se envía al cuantificador. El cuantificador asigna más o menos bits en cada bloque en función de la relación señal-máscara. El bloque con la relación señal-máscara más alta se codificará con el número máximo de bits .

Referencias

  1. "Enmascaramiento - Más información sobre la propagación ascendente del enmascaramiento | hear-it.org" . www.hear-it.org . Archivado del original el 18 de noviembre de 2023. Consultado el 21 de abril de 2022 .