El suavizado exponencial o media móvil exponencial (EMA) es una técnica para suavizar datos de series temporales mediante la función de ventana exponencial . Mientras que en la media móvil simple las observaciones pasadas se ponderan por igual, las funciones exponenciales asignan ponderaciones que disminuyen exponencialmente con el tiempo. Es un procedimiento fácil de aprender y aplicar para realizar determinaciones basadas en supuestos previos del usuario, como la estacionalidad. El suavizado exponencial se utiliza frecuentemente para el análisis de datos de series temporales.
El suavizado exponencial es una de las muchas funciones de ventana que se aplican comúnmente para suavizar datos en el procesamiento de señales , actuando como filtros de paso bajo para eliminar el ruido de alta frecuencia . Este método tiene precedentes: el uso que hizo Poisson de funciones de ventana exponenciales recursivas en convoluciones desde el siglo XIX, así como el uso que hicieron Kolmogorov y Zurbenko de promedios móviles recursivos en sus estudios sobre la turbulencia en la década de 1940.
La secuencia de datos sin procesar a menudo se representa mediantecomenzando en el tiempoy la salida del algoritmo de suavizado exponencial se suele escribir como, que puede considerarse como una mejor estimación de cuál será el siguiente valor deserá. Cuando la secuencia de observaciones comience en el tiempo, la forma más simple de suavizado exponencial viene dada por las siguientes fórmulas: [ 1 ]
dóndees el factor de suavizado y. Sise sustituye encontinuamente para que la fórmula dese expresa completamente en términos deluego factores de ponderación que disminuyen exponencialmente en cada dato brutoSe revela, mostrando cómo se denomina el suavizado exponencial.
El suavizado exponencial simple no puede predecir lo que se observaría enbasado en los datos brutos hasta, mientras que el suavizado exponencial doble y el suavizado exponencial triple se pueden utilizar para la predicción debido a la presencia decomo la secuencia de mejores estimaciones de la tendencia lineal.
Suavizado exponencial básico (simple)
El uso de la función de ventana exponencial se atribuye por primera vez a Poisson [ 2 ] como una extensión de una técnica de análisis numérico del siglo XVII, y posteriormente fue adoptada por la comunidad de procesamiento de señales en la década de 1940. Aquí, el suavizado exponencial es la aplicación de la función de ventana exponencial o de Poisson . El suavizado exponencial fue sugerido en la literatura estadística sin citar trabajos previos de Robert Goodell Brown en 1956, [ 3 ] y ampliado por Charles C. Holt en 1957. [ 4 ] La formulación que se presenta a continuación, que es la que se usa comúnmente, se atribuye a Brown y se conoce como "suavizado exponencial simple de Brown". [ 5 ] Todos los métodos de Holt, Winters y Brown pueden verse como una aplicación simple del filtrado recursivo , descubierto por primera vez en la década de 1940 [ 2 ] para convertir filtros de respuesta de impulso finito (FIR) en filtros de respuesta de impulso infinito .
La forma más simple de suavizado exponencial viene dada por la fórmula:
dóndees el factor de suavizado , conEn otras palabras, la estadística suavizadaes un promedio ponderado simple de la observación actualy la estadística suavizada anteriorEl suavizado exponencial simple se aplica fácilmente y produce una estadística suavizada tan pronto como se dispone de dos observaciones. El término factor de suavizado se aplica aAquí hay algo de nombre inapropiado, ya que valores mayores deen realidad reducen el nivel de suavizado y en el caso límite con= 1 La serie de salida suavizada es simplemente la observación actual. Valores deLos valores cercanos a 1 tienen un menor efecto suavizador y dan mayor peso a los cambios recientes en los datos, mientras que los valores deLos valores más cercanos a 0 tienen un mayor efecto suavizante y son menos sensibles a los cambios recientes. En el caso límite con= 0, la serie de salida es simplemente plana o constante como la observaciónal comienzo del proceso de alisado.
El método para elegirdebe ser decidido por el modelador. A veces se utiliza el criterio del estadístico para elegir un factor apropiado. Alternativamente, se puede utilizar una técnica estadística para optimizar el valor de. Por ejemplo, el método de mínimos cuadrados podría utilizarse para determinar el valor depara la cual la suma de las cantidadesse minimiza. [ 6 ]
A diferencia de otros métodos de suavizado, como la media móvil simple, esta técnica no requiere un número mínimo de observaciones para empezar a producir resultados. Sin embargo, en la práctica, no se obtendrá una "buena media" hasta que se hayan promediado varias muestras; por ejemplo, una señal constante tardará aproximadamenteetapas para alcanzar el 95 % del valor real. Para reconstruir con precisión la señal original sin pérdida de información, todas las etapas de la media móvil exponencial deben estar disponibles, ya que las muestras más antiguas pierden peso exponencialmente. Esto contrasta con una media móvil simple, en la que se pueden omitir algunas muestras sin tanta pérdida de información debido a la ponderación constante de las muestras dentro de la media. Si se va a omitir un número conocido de muestras, también se puede ajustar una media ponderada para ello, asignando el mismo peso a la nueva muestra y a todas las que se omitirán.
Esta forma simple de suavizado exponencial también se conoce como media móvil ponderada exponencialmente (EWMA). Técnicamente, también puede clasificarse como un modelo autorregresivo integrado de media móvil (ARIMA) (0,1,1) sin término constante. [ 7 ]
constante de tiempo
La constante de tiempo de una media móvil exponencial es la cantidad de tiempo que tarda la respuesta suavizada de una función escalón unitario en alcanzarde la señal final. La relación entre esta constante de tiempo,y el factor de suavizado,, viene dada por la siguiente fórmula:
- , de este modo
dóndees el intervalo de tiempo de muestreo de la implementación de tiempo discreto. Si el tiempo de muestreo es rápido en comparación con la constante de tiempo () luego, utilizando la expansión de Taylor de la función exponencial ,
- , de este modo
Elegir el valor suavizado inicial
Tenga en cuenta que en la definición anterior,(la salida inicial del algoritmo de suavizado exponencial) se está inicializando a(los datos brutos iniciales o la observación). Porque el suavizado exponencial requiere que, en cada etapa, tengamos la previsión anterior.No es obvio cómo empezar con el método. Podríamos suponer que el pronóstico inicial es igual al valor inicial de la demanda; sin embargo, este enfoque tiene un serio inconveniente. El suavizado exponencial otorga un peso sustancial a las observaciones pasadas, por lo que el valor inicial de la demanda tendrá un efecto irrazonablemente grande en los pronósticos iniciales. Este problema se puede superar permitiendo que el proceso evolucione durante un número razonable de períodos (10 o más) y utilizando el promedio de la demanda durante esos períodos como pronóstico inicial. Hay muchas otras formas de establecer este valor inicial, pero cuanto menor sea el valor deCuanto más sensible sea el pronóstico a la selección de este valor inicial más suave, mayor será la sensibilidad del pronóstico.. [ 8 ] [ 9 ]
Mejoramiento
Para cada método de suavizado exponencial, también necesitamos elegir el valor de los parámetros de suavizado. Para el suavizado exponencial simple, solo hay un parámetro de suavizado ( α ), pero para los métodos que siguen, generalmente hay más de un parámetro de suavizado.
En algunos casos, los parámetros de suavizado pueden elegirse de forma subjetiva; el analista especifica su valor basándose en su experiencia previa. Sin embargo, una manera más sólida y objetiva de obtener los valores de los parámetros desconocidos incluidos en cualquier método de suavizado exponencial es estimarlos a partir de los datos observados.
Los parámetros desconocidos y los valores iniciales para cualquier método de suavizado exponencial pueden estimarse minimizando la suma de los errores cuadráticos (SSE). Los errores se especifican comopara(los errores de pronóstico dentro de la muestra de un paso adelante) dondeyson una variable que se debe predecir eny una variable como resultado de la predicción en(basándonos en los datos previos o en la predicción), respectivamente. Por lo tanto, encontramos los valores de los parámetros desconocidos y los valores iniciales que minimizan
A diferencia del caso de regresión (donde tenemos fórmulas para calcular directamente los coeficientes de regresión que minimizan la suma de los cuadrados de los errores), esto implica un problema de minimización no lineal, y necesitamos utilizar una herramienta de optimización para llevarlo a cabo.
Nomenclatura "exponencial"
El nombre de suavizado exponencial se atribuye al uso de la función exponencial como respuesta impulsional del filtro en la convolución .
Al sustituir directamente la ecuación que define el suavizado exponencial simple en sí misma, encontramos que
En otras palabras, a medida que pasa el tiempo, la estadística suavizadase convierte en el promedio ponderado de un número cada vez mayor de observaciones pasadas.y los pesos asignados a las observaciones previas son proporcionales a los términos de la progresión geométrica.
Una progresión geométrica es la versión discreta de una función exponencial , por lo que, según la tradición estadística , de ahí proviene el nombre de este método de suavizado .
Comparación con la media móvil
El suavizado exponencial y la media móvil presentan defectos similares, como la introducción de un retardo con respecto a los datos de entrada. Si bien esto puede corregirse desplazando el resultado la mitad de la longitud de la ventana para un núcleo simétrico, como una media móvil o una gaussiana, este enfoque no es posible para el suavizado exponencial, ya que se trata de un filtro IIR y, por lo tanto, tiene un núcleo asimétrico y un retardo de grupo dependiente de la frecuencia . Esto significa que cada frecuencia constituyente se desplaza en una cantidad diferente y, por consiguiente, no existe un número único de muestras que pueda utilizarse para desplazar la señal de salida y compensar el retardo.
Ambos filtros también presentan aproximadamente la misma distribución del error de pronóstico cuando α = 2/( k + 1), donde k es el número de puntos de datos pasados en la media móvil. Se diferencian en que el suavizado exponencial tiene en cuenta todos los datos pasados, mientras que la media móvil solo considera k puntos de datos pasados. Computacionalmente hablando, también se diferencian en que la media móvil requiere que se conserven los k puntos de datos pasados, o el punto de datos con retardo k + 1 más el valor de pronóstico más reciente, mientras que el suavizado exponencial solo necesita que se conserve el valor de pronóstico más reciente. [ 11 ]
En la literatura sobre procesamiento de señales , el uso de filtros no causales (simétricos) es habitual, y la función de ventana exponencial se utiliza ampliamente de esta manera, pero se emplea una terminología diferente: el suavizado exponencial es equivalente a un filtro de respuesta de impulso infinita (IIR) de primer orden y la media móvil es equivalente a un filtro de respuesta de impulso finita con factores de ponderación iguales.
Suavizado exponencial doble (Holt lineal)
El suavizado exponencial simple no funciona bien cuando hay una tendencia en los datos. [ 1 ] En tales situaciones, se idearon varios métodos bajo el nombre de "suavizado exponencial doble" o "suavizado exponencial de segundo orden", que es la aplicación recursiva de un filtro exponencial dos veces, de ahí que se denomine "suavizado exponencial doble". La idea básica detrás del suavizado exponencial doble es introducir un término para tener en cuenta la posibilidad de que una serie exhiba algún tipo de tendencia. Este componente de pendiente se actualiza a su vez mediante suavizado exponencial.
Un método funciona de la siguiente manera: [ 12 ]
Nuevamente, la secuencia de datos brutos de observaciones está representada por, comenzando en el tiempo. Usamospara representar el valor suavizado para el tiempo, yes nuestra mejor estimación de la tendencia en el momento. El resultado del algoritmo ahora se escribe como, una estimación del valor deen ese momentobasado en los datos brutos hasta el momentoEl suavizado exponencial doble viene dado por las fórmulas
y parapor
dónde() es el factor de suavizado de datos y() es el factor de suavizado de la tendencia .
Para pronosticar más alláviene dada por la siguiente aproximación:
- .
Establecer el valor iniciales cuestión de preferencia. Una opción distinta a la mencionada anteriormente espara algunos.
Tenga en cuenta que F 0 no está definido (no hay estimación para el tiempo 0), y según la definición F 1 = s 0 + b 0 , que está bien definida, por lo que se pueden evaluar otros valores.
Un segundo método, conocido como suavizado exponencial lineal de Brown (LES) o suavizado exponencial doble de Brown, tiene solo un factor de suavizado,: [ 13 ]
donde a t , el nivel estimado en el tiempo t , y b t , la tendencia estimada en el tiempo t , vienen dadas por
Suavizado exponencial triple (Holt-Winters)
El suavizado exponencial triple aplica el suavizado exponencial tres veces, lo cual se usa comúnmente cuando hay tres señales de alta frecuencia que deben eliminarse de una serie temporal en estudio. Existen diferentes tipos de estacionalidad: multiplicativa y aditiva. La estacionalidad multiplicativa significa que la magnitud del efecto estacional depende del nivel actual, mientras que los efectos estacionales aditivos no.
Si cada verano vendemos 10 000 bolas de helado más que en invierno, la estacionalidad es aditiva . Sin embargo, si vendemos 6 veces más helado en verano que en invierno, la diferencia en las cantidades vendidas varía con el nivel de ventas: en años con un consumo total mayor, la diferencia entre verano e invierno es mayor, y viceversa. Por lo tanto, el efecto es multiplicativo . La estacionalidad multiplicativa puede representarse como un factor constante, mientras que la estacionalidad aditiva se representa como una cantidad absoluta. [ 14 ]
El suavizado exponencial triple fue sugerido por primera vez por el alumno de Holt, Peter Winters, en 1960, después de leer un libro de procesamiento de señales de la década de 1940 sobre suavizado exponencial. [ 15 ] La novedosa idea de Holt fue repetir el filtrado un número impar de veces mayor que 1 y menor que 5, lo cual era popular entre los académicos de épocas anteriores. [ 15 ] Si bien el filtrado recursivo se había utilizado previamente, se aplicó dos y cuatro veces para coincidir con la conjetura de Hadamard , mientras que la aplicación triple requería más del doble de operaciones que la convolución singular. El uso de una aplicación triple se considera una técnica empírica , más que una basada en fundamentos teóricos, y a menudo ha sido sobrevalorada por los profesionales.
Supongamos que tenemos una secuencia de observacionescomenzando en el tiempocon un ciclo de cambio estacional de duraciónEl método calcula una línea de tendencia para los datos, así como índices estacionales que ponderan los valores en la línea de tendencia en función de dónde cae ese punto temporal en el ciclo de duración..
Dejarrepresenta el valor suavizado de la parte constante para el tiempo,es la secuencia de mejores estimaciones de la tendencia lineal que se superponen a los cambios estacionales, yes la secuencia de factores de corrección estacional. Deseamos estimaren cada momentomoden el ciclo que siguen las observaciones. Como regla general, un mínimo de dos temporadas completas (oSe necesitan varios periodos de datos históricos para inicializar un conjunto de factores estacionales.
La salida del algoritmo se escribe de nuevo como, una estimación del valor deen ese momentobasado en los datos brutos hasta el momento. El suavizado exponencial triple con estacionalidad multiplicativa viene dado por las fórmulas [ 1 ].
dónde() es el factor de suavizado de datos ,() es el factor de suavizado de tendencia y() es el factor de suavizado del cambio estacional .
La fórmula general para la estimación de la tendencia iniciales
- .
Establecimiento de las estimaciones iniciales para los índices estacionalesparaes un poco más complicado. Sies el número de ciclos completos presentes en sus datos, entonces
dónde
- .
Tenga en cuenta quees el valor promedio deen elciclo de tus datos.
Esto da como resultado
El suavizado exponencial triple con estacionalidad aditiva viene dado por
Implementaciones en paquetes estadísticos
- R : la función HoltWinters en el paquete stats [ 16 ] y la función ets en el paquete forecast [ 17 ] (una implementación más completa, que generalmente resulta en un mejor rendimiento [ 18 ] ).
- Python : el módulo holtwinters del paquete statsmodels permite el suavizado exponencial simple, doble y triple.
- IBM SPSS incluye los métodos Simple, Simple Seasonal, Holt's Linear Trend, Brown's Linear Trend, Damped Trend, Winters' Additive y Winters' Multiplicative en el procedimiento de modelado de series temporales dentro de sus paquetes estadísticos Statistics y Modeler. La función Expert Modeler predeterminada evalúa los siete modelos de suavizado exponencial y los modelos ARIMA con un rango de valores p , d y q estacionales y no estacionales , y selecciona el modelo con el menor valor del criterio de información bayesiano .
- Stata : comando tssmooth [ 19 ]
- LibreOffice 5.2 [ 20 ]
- Microsoft Excel 2016 [ 21 ]
- Julia : el paquete TrendDecomposition.jl [ 22 ] implementa el suavizado exponencial simple y doble y el procedimiento de pronóstico de Holts-Winters.
Véase también
Notas
- 1 2 3 "NIST/SEMATECH e-Handbook of Statistical Methods" . NIST . Consultado el 23 de mayo de 2010 .
- 1 2 Oppenheim, Alan V.; Schafer, Ronald W. (1975). Procesamiento digital de señales . Prentice Hall . pág. 5. ISBN 0-13-214635-5.
- ↑ Brown, Robert G. (1956). Suavizado exponencial para la predicción de la demanda . Cambridge, Massachusetts: Arthur D. Little Inc. pág. 15.
- ↑ Holt, Charles C. (1957). "Pronóstico de tendencias y estacionalidad mediante promedios ponderados exponencialmente". Memorando de la Oficina de Investigación Naval . 52 .Reimpreso en Holt, Charles C. (enero-marzo de 2004). "Pronóstico de tendencias y estacionalidad mediante promedios ponderados exponencialmente". International Journal of Forecasting . 20 (1): 5– 10. doi : 10.1016/j.ijforecast.2003.09.015 .
- ↑ Brown, Robert Goodell (1963). Smoothing Forecasting and Prediction of Discrete Time Series . Englewood Cliffs, NJ: Prentice-Hall.
- ↑ "NIST/SEMATECH e-Handbook of Statistical Methods, 6.4.3.1. Single Exponential Smoothing" . NIST . Consultado el 5 de julio de 2017 .
- ↑ Nau, Robert. "Modelos de promedio y suavizado exponencial" . Consultado el 26 de julio de 2010 .
- ↑ "Análisis de producción y operaciones" Nahmias. 2009.
- ↑ Čisar, P., & Čisar, SM (2011). "Métodos de optimización de las estadísticas EWMA." Acta Polytechnica Hungarica , 8(5), 73–87. Página 78.
- ↑ 7.1 Suavizado exponencial simple | Pronóstico: Principios y práctica .
- ↑ Nahmias, Steven; Olsen, Tava Lennon. Análisis de producción y operaciones (7.ª ed.). Waveland Press. pág . 53. ISBN 9781478628248.
- ↑ "6.4.3.3. Suavizado exponencial doble" . itl.nist.gov . Consultado el 25 de septiembre de 2011 .
- ↑ "Modelos de promedio y suavizado exponencial" . duke.edu . Consultado el 25 de septiembre de 2011 .
- ↑ Kalehar, Prajakta S. "Pronóstico de series temporales mediante suavizado exponencial de Holt-Winters" (PDF) . Consultado el 23 de junio de 2014 .
- 1 2 Winters, PR (abril de 1960). "Pronóstico de ventas mediante promedios móviles ponderados exponencialmente". Management Science . 6 (3): 324– 342. doi : 10.1287/mnsc.6.3.324 .
- ↑ "R: Filtrado de Holt-Winters" . stat.ethz.ch. Consultado el 5 de junio de 2016 .
- ↑ "ets {forecast} | inside-R | Un sitio comunitario para R" . inside-r.org . Archivado del original el 16 de julio de 2016. Consultado el 5 de junio de 2016 .
- ↑ "Comparando HoltWinters() y ets()" . Hyndsight . 29 de mayo de 2011. Consultado el 5 de junio de 2016 .
- ↑ tssmooth en el manual de Stata
- ↑ "LibreOffice 5.2: Notas de la versión – la Wiki de Document Foundation" .
- ↑ "Funciones de previsión de Excel 2016 | Estadísticas reales con Excel" .
- ↑ TrendDecomposition.jl Implementación en Julia del procedimiento de suavizado exponencial y pronóstico de Holt-Winters.
Enlaces externos
- Apuntes de clase sobre suavizado exponencial (Robert Nau, Universidad de Duke)
- Suavizado de datos por Jon McLoone, Proyecto de Demostraciones de Wolfram
- El método Holt-Winters para el suavizado exponencial: 50 años de antigüedad y aún vigente, por Paul Goodwin (2010) Foresight: The International Journal of Applied Forecasting
- Algoritmos para series temporales con intervalos irregulares: medias móviles y otros operadores de desplazamiento, por Andreas Eckner.
- Series temporales