En estadística , el método de mínimos cuadrados generalizados ( GLS ) se utiliza para estimar los parámetros desconocidos en un modelo de regresión lineal . Se emplea cuando existe una correlación no nula entre los residuos del modelo de regresión. El GLS se utiliza para mejorar la eficiencia estadística y reducir el riesgo de obtener inferencias erróneas, en comparación con los métodos convencionales de mínimos cuadrados y mínimos cuadrados ponderados . Fue descrito por primera vez por Alexander Aitken en 1935. [ 1 ]
Requiere conocer la matriz de covarianza de los residuos. Si se desconoce, estimar dicha matriz da lugar al método de mínimos cuadrados generalizados factibles (FGLS). Sin embargo, FGLS ofrece menos garantías de mejora.
Método
En los modelos de regresión lineal estándar , se observan datosen n unidades estadísticas con k − 1 valores predictores y un valor de respuesta cada una.
Los valores de respuesta se colocan en un vector, y los valores predictivos se colocan en la matriz de diseño , donde cada fila es un vector de losvariables predictoras (incluida una constante) para lapunto de datos.
El modelo supone que la media condicional dedadoser una función lineal dey que la varianza condicional del término de error dadoes una matriz de covarianza no singular conocida ,. Eso es, dóndees un vector de constantes desconocidas, llamadas "coeficientes de regresión", que se estiman a partir de los datos.
Sies una estimación candidata para, entonces el vector residual paraesEl método de mínimos cuadrados generalizados estimaminimizando la longitud de Mahalanobis al cuadrado de este vector residual:lo cual es equivalente aque es un problema de programación cuadrática . El punto estacionario de la función objetivo ocurre cuandopor lo tanto el estimador esLa cantidadse conoce como matriz de precisión (o matriz de dispersión ), una generalización de la matriz de pesos diagonal .
Propiedades
El estimador GLS es insesgado , consistente , eficiente y asintóticamente normal conGLS es equivalente a aplicar mínimos cuadrados ordinarios (OLS) a una versión transformada linealmente de los datos. Esto se puede ver factorizandoutilizando un método como la descomposición de Cholesky . Multiplicando por la izquierda ambos lados deporproduce un modelo lineal equivalente:En este modelo,, dóndees la matriz identidad . Entonces,puede estimarse de manera eficiente aplicando MCO a los datos transformados, lo que requiere minimizar el objetivo, Esta transformación estandariza eficazmente la escala y descorrelaciona los errores. Cuando se utiliza MCO en datos con errores homocedásticos , se aplica el teorema de Gauss-Markov , por lo que la estimación MLS es el mejor estimador lineal insesgado para.
mínimos cuadrados ponderados
Un caso especial de GLS, denominado mínimos cuadrados ponderados (WLS), se produce cuando todos los elementos fuera de la diagonal de Ω son 0. Esta situación surge cuando las varianzas de los valores observados son desiguales o cuando existe heterocedasticidad , pero no hay correlaciones entre las varianzas observadas. El peso para la unidad i es proporcional al recíproco de la varianza de la respuesta para la unidad i . [ 2 ]
Derivación mediante estimación de máxima verosimilitud
Los mínimos cuadrados ordinarios pueden interpretarse como una estimación de máxima verosimilitud con la distribución a priori de que los errores son independientes y se distribuyen normalmente con media cero y varianza común. En GLS, la distribución a priori se generaliza al caso en que los errores pueden no ser independientes y pueden tener varianzas diferentes . Para parámetros de ajuste dadosSe supone que la función de densidad de probabilidad condicional de los errores es: Por el teorema de Bayes ,En GLS, se toma una distribución a priori uniforme (impropia) paray comoes una distribución marginal, no depende dePor lo tanto, la probabilidad logarítmica esdonde los términos ocultos son aquellos que no dependen de, yes la log-verosimilitud . La estimación de máxima a posteriori (MAP) es entonces la estimación de máxima verosimilitud (MLE), que es equivalente al problema de optimización anterior,
donde el problema de optimización se ha reescrito utilizando el hecho de que el logaritmo es una función estrictamente creciente y la propiedad de que el argumento que resuelve un problema de optimización es independiente de los términos de la función objetivo que no involucran dichos términos. Sustituyendopara,
Mínimos cuadrados generalizados factibles
Si la covarianza de los erroreses desconocido, se puede obtener una estimación consistente de, decir, [ 3 ] utilizando una versión implementable de GLS conocida como el estimador de mínimos cuadrados generalizados factibles ( FGLS ).
En FGLS, el modelado se lleva a cabo en dos etapas:
- El modelo se estima mediante MCO u otro estimador consistente (pero ineficiente), y los residuos se utilizan para construir un estimador consistente de la matriz de covarianza de los errores (para ello, a menudo es necesario examinar el modelo añadiendo restricciones adicionales; por ejemplo, si los errores siguen un proceso de series temporales, un estadístico generalmente necesita algunos supuestos teóricos sobre este proceso para garantizar que se disponga de un estimador consistente).
- Luego, utilizando el estimador consistente de la matriz de covarianza de los errores, se pueden implementar ideas de Mínimos Cuadrados Generalizados (MGL).
Si bien GLS es más eficiente que OLS bajo heterocedasticidad (también escrito heteroskedasticity) o autocorrelación , esto no es cierto para FGLS. El estimador factible es asintóticamente más eficiente (siempre que la matriz de covarianza de los errores se estime de forma consistente), pero para una muestra pequeña o mediana, puede ser en realidad menos eficiente que OLS. Por esta razón, algunos autores prefieren usar OLS y reformular sus inferencias simplemente considerando un estimador alternativo para la varianza del estimador robusto a la heterocedasticidad o la autocorrelación serial. Sin embargo, para muestras grandes, FGLS es preferible a OLS bajo heterocedasticidad o autocorrelación serial. [ 3 ] [ 4 ] Una advertencia es que el estimador FGLS no siempre es consistente. Un caso en el que FGLS podría ser inconsistente es si hay efectos fijos específicos de cada individuo. [ 5 ]
En general, este estimador tiene propiedades diferentes a las de GLS. Para muestras grandes (es decir, asintóticamente), todas las propiedades son (bajo condiciones apropiadas) comunes con respecto a GLS, pero para muestras finitas, las propiedades de los estimadores FGLS son desconocidas: varían drásticamente con cada modelo particular y, por regla general, sus distribuciones exactas no pueden derivarse analíticamente. Para muestras finitas, FGLS puede ser menos eficiente que OLS en algunos casos. Por lo tanto, si bien GLS puede ser factible, no siempre es prudente aplicar este método cuando la muestra es pequeña. Un método utilizado para mejorar la precisión de los estimadores en muestras finitas es iterar; es decir, tomar los residuos de FGLS para actualizar el estimador de covarianza de los errores y luego actualizar la estimación FGLS, aplicando la misma idea iterativamente hasta que los estimadores varíen menos que cierta tolerancia. Sin embargo, este método no necesariamente mejora mucho la eficiencia del estimador si la muestra original era pequeña.
Una opción razonable cuando las muestras no son demasiado grandes es aplicar MCO pero descartar el estimador de varianza clásico.
(lo cual es inconsistente en este marco) y en su lugar usar un estimador HAC (consistente con heterocedasticidad y autocorrelación). En el contexto de la autocorrelación, se puede usar el estimador de Newey-West , y en contextos heterocedásticos, se puede usar el estimador de Eicker-White . Este enfoque es mucho más seguro y es el camino apropiado a seguir a menos que la muestra sea grande, donde "grande" a veces es un tema resbaladizo (por ejemplo, si la distribución del error es asimétrica, la muestra requerida será mucho mayor).
El estimador de mínimos cuadrados ordinarios (MCO) se calcula mediante:
y estimaciones de los residuosse construyen.
Para simplificar, consideremos el modelo para errores heterocedásticos y no autocorrelacionados. Supongamos que la matriz de varianza-covarianzadel vector de error es diagonal, o equivalentemente que los errores de observaciones distintas no están correlacionados. Entonces cada entrada diagonal puede estimarse mediante los residuos ajustados.entoncespuede ser construido por:
Es importante destacar que los residuos al cuadrado no pueden utilizarse en la expresión anterior; se necesita un estimador de las varianzas de los errores. Para ello, se puede emplear un modelo de heterocedasticidad paramétrico o un estimador no paramétrico.
Estimarusandoutilizando [ 4 ] mínimos cuadrados ponderados :
El procedimiento puede repetirse. La primera iteración viene dada por:
Esta estimación depuede iterarse hasta la convergencia.
Bajo ciertas condiciones de regularidad, el estimador FGLS (o el estimador de sus iteraciones, si se realiza un número finito de iteraciones) se distribuye asintóticamente como:
dóndees el tamaño de la muestra y
dóndesignifica límite en probabilidad .
Véase también
Referencias
- ↑ Aitken, AC (1935). "Sobre mínimos cuadrados y combinaciones lineales de observaciones". Actas de la Real Sociedad de Edimburgo . 55 : 42–48 . doi : 10.1017/s0370164600014346 .
- ↑ Strutz, T. (2016). Ajuste de datos e incertidumbre (Una introducción práctica a los mínimos cuadrados ponderados y más allá) . Springer Vieweg. ISBN 978-3-658-11455-8.capítulo 3
- 1 2 Baltagi, BH (2008). Econometría (4.ª ed.). Nueva York: Springer.
- 1 2 Greene, WH (2003). Análisis econométrico (5.ª ed.). Upper Saddle River, NJ: Prentice Hall.
- ↑ Hansen, Christian B. (2007). "Inferencia generalizada de mínimos cuadrados en modelos de panel y multinivel con autocorrelación y efectos fijos". Journal of Econometrics . 140 (2): 670– 694. doi : 10.1016/j.jeconom.2006.07.011 .
Lecturas adicionales
- Amemiya, Takeshi (1985). "Teoría generalizada de mínimos cuadrados" . Econometría avanzada . Harvard University Press. ISBN 0-674-00560-0.
- Johnston, John (1972). "Mínimos cuadrados generalizados" . Métodos econométricos (segunda edición). Nueva York: McGraw-Hill. págs. 208–242 .
- Kmenta, Jan (1986). «Modelo de regresión lineal generalizado y sus aplicaciones» . Elementos de econometría (segunda edición). Nueva York: Macmillan. págs. 607–650 . ISBN 0-472-10886-7.
- Beck, Nathaniel; Katz, Jonathan N. (septiembre de 1995). "Qué hacer (y qué no hacer) con datos de series temporales de sección transversal" . American Political Science Review . 89 (3): 634– 647. doi : 10.2307/2082979 . ISSN 1537-5943 . JSTOR 2082979. S2CID 63222945 .
- Mínimos cuadrados
- Métodos de estimación
- Regresión con estructura de series temporales