Articulo de referencia

Predicción lineal excitada por suma vectorial

La predicción lineal excitada por suma vectorial ( VSELP ) es un método de codificación de voz utilizado en varios estándares celulares. El algoritmo VSELP es una técnica de cod...

La predicción lineal excitada por suma vectorial ( VSELP ) es un método de codificación de voz utilizado en varios estándares celulares. El algoritmo VSELP es una técnica de codificación de análisis por síntesis y pertenece a la clase de algoritmos de codificación de voz conocidos como CELP (Code Excited Linear Prediction). [ 1 ]

Variantes de este códec se han utilizado en varios estándares de telefonía celular 2G , incluidos IS-54 , IS-136 (D-AMPS), PDC (RCR-STD-27 Full Rate speech), GSM ( Half Rate speech) e iDEN . También se utilizó en la primera versión de RealAudio para audio a través de Internet . El estándar IS-54 VSELP fue publicado por la Asociación de la Industria de las Telecomunicaciones en 1989.

El protocolo VSELP de D-AMPS (IS-54 e IS-136) especifica la codificación de cada 20 ms de voz en tramas de 159 bits, logrando así una velocidad de datos bruta de 7,95  kbit/s. En un teléfono móvil TDMA real, la salida del vocoder se empaqueta con información de corrección de errores y señalización, lo que resulta en una velocidad de datos inalámbrica de 16,2  kbit/s. Para el audio de internet, cada trama de 159 bits se almacena en 20 bytes, dejando 1 bit sin usar. El archivo resultante tiene, por lo tanto, una velocidad de datos de exactamente 8  kbit/s.

La especificación VSELP de PDC (RCR-STD-27) codifica cada 20 ms de voz en tramas de 134 bits, logrando así una velocidad de datos bruta de 6,7 kbit/s. En un teléfono celular TDMA real, la salida del vocoder se empaqueta con información de corrección de errores y señalización, lo que resulta en una velocidad de datos inalámbrica de 11,2 kbit/s.

El protocolo VSELP de media velocidad GSM (GSM 06.20) utiliza tramas de 20 ms con 112 bits por trama, lo que proporciona una velocidad de datos bruta de 5,6  kbit/s. El codificador VSELP de iDEN tiene tres modos:

  • tramas de 30 ms a 126 bits por trama con una tasa de datos sin procesar de 4,2  kbit/s,
  • tramas de 22,5 ms a 99 bits por trama con una tasa de datos sin procesar de 4,4  kbit/s y
  • Tramas de 22,5 ms a 180 bits por trama con una tasa de datos sin procesar de 8,0  kbit/s.

Una desventaja importante de VSELP es su limitada capacidad para codificar sonidos que no son de habla, por lo que su rendimiento es deficiente al codificar habla en presencia de ruido de fondo. Por este motivo, el uso de VSELP se ha ido eliminando gradualmente en favor de códecs más modernos.

VSELP es también el vocoder digital propietario utilizado en los primeros productos Motorola ASTRO. Fue reemplazado gradualmente por el método IMBE más reciente , utilizado para P25.

Referencias

  • Ira A. Gerson y Mark A. Jasiuk, Predicción lineal excitada por suma vectorial (VSELP), Taller IEEE sobre codificación de voz para telecomunicaciones, septiembre de 1989, págs. 66-68.
  • Ira A. Gerson y Mark A. Jasiuk, Codificación de voz por predicción lineal excitada por suma vectorial (VSELP) a 8  kbps, Actas de la Conferencia Internacional IEEE de 1990 sobre Acústica, Habla y Procesamiento de Señales (ICASSP-90), abril de 1990, págs. 461–464
  1. ETSI, EN 300 969 - Transcodificación de voz a media velocidad (GSM 06.20 versión 8.0.1 Release 1999) , consultado el 11 de julio de 2009.
  • Sitio web de la Asociación de la Industria de las Telecomunicaciones