Los mínimos cuadrados ponderados ( WLS ), también conocidos como regresión lineal ponderada , [ 1 ] [ 2 ] son una generalización de los mínimos cuadrados ordinarios y la regresión lineal en la que se incorpora a la regresión el conocimiento de la varianza desigual de las observaciones ( heterocedasticidad ). Los WLS son también una especialización de los mínimos cuadrados generalizados , cuando todos los elementos fuera de la diagonal de la matriz de covarianza de los errores son nulos.
Formulación
El ajuste de un modelo a un punto de datos se mide por su residuo ,, definida como la diferencia entre un valor medido de la variable dependiente,y el valor predicho por el modelo,:
Si los errores no están correlacionados y tienen varianza igual, entonces la función se minimiza en, de tal manera que.
El teorema de Gauss-Markov muestra que, cuando esto es así,es un estimador lineal insesgado óptimo ( BLUE ). Sin embargo, si las mediciones no están correlacionadas pero tienen diferentes incertidumbres, se podría adoptar un enfoque modificado. Aitken demostró que cuando se minimiza una suma ponderada de residuos al cuadrado,es AZUL si cada peso es igual al recíproco de la varianza de la medición
Las ecuaciones de gradiente para esta suma de cuadrados son
que, en un sistema de mínimos cuadrados lineales, dan las ecuaciones normales modificadas , La matrizLo anterior se define en la discusión correspondiente sobre mínimos cuadrados lineales .
Cuando los errores de observación no están correlacionados y la matriz de ponderación , W = Ω −1 , es diagonal, estos pueden escribirse como
Si los errores están correlacionados, el estimador resultante es el BLUE si la matriz de ponderación es igual a la inversa de la matriz de varianza-covarianza de las observaciones.
Cuando los errores no están correlacionados, es conveniente simplificar los cálculos factorizando la matriz de pesos comoLas ecuaciones normales se pueden escribir entonces de la misma forma que los mínimos cuadrados ordinarios:
donde definimos la siguiente matriz y vector escalados:
Este es un tipo de transformación blanqueadora ; la última expresión implica una división por entradas .
Para sistemas de mínimos cuadrados no lineales, un argumento similar muestra que las ecuaciones normales deben modificarse de la siguiente manera.
Cabe señalar que, para las pruebas empíricas, el valor de W apropiado no se conoce con certeza y debe estimarse. Para ello, se pueden utilizar técnicas de mínimos cuadrados generalizados factibles (FGLS); en este caso, se especializan para una matriz de covarianza diagonal, lo que da como resultado una solución de mínimos cuadrados ponderados factibles.
Si la incertidumbre de las observaciones no se conoce a partir de fuentes externas, entonces los pesos podrían estimarse a partir de las observaciones dadas. Esto puede ser útil, por ejemplo, para identificar valores atípicos. Después de eliminar los valores atípicos del conjunto de datos, los pesos deben restablecerse a uno. [ 3 ]
Motivación
En algunos casos, las observaciones pueden estar ponderadas; por ejemplo, pueden no ser igualmente fiables. En este caso, se puede minimizar la suma ponderada de los cuadrados: donde w i > 0 es el peso de la i- ésima observación, y W es la matriz diagonal de dichos pesos.
Los pesos deberían, idealmente, ser iguales al recíproco de la varianza de la medición. (Esto implica que las observaciones no están correlacionadas. Si las observaciones están correlacionadas , la expresiónSe aplica. En este caso, la matriz de ponderación idealmente debería ser igual a la inversa de la matriz de varianza-covarianza de las observaciones). [ 3 ] Las ecuaciones normales son entonces:
Este método se utiliza en el método de mínimos cuadrados ponderados iterativamente .
Solución
Errores de parámetros y correlación
Los valores de los parámetros estimados son combinaciones lineales de los valores observados.
Por lo tanto, se puede obtener una expresión para la matriz de varianza-covarianza estimada de las estimaciones de los parámetros mediante la propagación de errores a partir de los errores en las observaciones. Sea M la matriz de varianza-covarianza para las observaciones y M β la de los parámetros estimados . Entonces
Cuando W = M −1 , esto se simplifica a
Cuando se utilizan ponderaciones unitarias ( W = I , la matriz identidad ), se sobreentiende que los errores experimentales no están correlacionados y son todos iguales: M = σ²I , donde σ² es la varianza a priori de una observación. En cualquier caso, σ² se aproxima mediante el chi -cuadrado reducido .:
donde S es el valor mínimo de la función objetivo ponderada :
El denominador,, es el número de grados de libertad ; véase grados de libertad efectivos para generalizaciones en el caso de observaciones correlacionadas.
En todos los casos, la varianza de la estimación del parámetroes dado pory la covarianza entre las estimaciones de los parámetrosyes dado porLa desviación estándar es la raíz cuadrada de la varianza.y el coeficiente de correlación viene dado porEstas estimaciones de error reflejan únicamente errores aleatorios en las mediciones. La verdadera incertidumbre en los parámetros es mayor debido a la presencia de errores sistemáticos , que, por definición, no pueden cuantificarse. Cabe señalar que, si bien las observaciones pueden no estar correlacionadas, los parámetros suelen estar correlacionados .
Límites de confianza de los parámetros
A menudo se asume , a falta de evidencia concreta pero recurriendo frecuentemente al teorema del límite central —véase Distribución normal#Ocurrencia y aplicaciones— que el error en cada observación pertenece a una distribución normal con una media de cero y desviación estándarBajo esa suposición, se pueden derivar las siguientes probabilidades para una estimación de un único parámetro escalar en términos de su error estándar estimado.(presentado aquí ):
- 68% que el intervaloabarca el verdadero valor del coeficiente
- 95% de que el intervaloabarca el verdadero valor del coeficiente
- 99% de que el intervaloabarca el verdadero valor del coeficiente
La suposición no es descabellada cuando n >> m . Si los errores experimentales se distribuyen normalmente, los parámetros pertenecerán a una distribución t de Student con n − m grados de libertad . Cuando n ≫ m, la distribución t de Student se aproxima a una distribución normal. Sin embargo, cabe señalar que estos límites de confianza no pueden tener en cuenta el error sistemático. Además, los errores de los parámetros deben citarse con una sola cifra significativa, ya que están sujetos a error de muestreo . [ 4 ]
Cuando el número de observaciones es relativamente pequeño, la desigualdad de Chebyshev puede utilizarse como límite superior para las probabilidades, independientemente de cualquier suposición sobre la distribución de los errores experimentales: las probabilidades máximas de que un parámetro se desvíe más de 1, 2 o 3 desviaciones estándar de su valor esperado son del 100%, 25% y 11% respectivamente.
Valores residuales y correlación
Los residuos están relacionados con las observaciones por
donde H es la matriz idempotente conocida como matriz sombrero :
y I es la matriz identidad . La matriz de varianza-covarianza de los residuos, M r, viene dada por
Por lo tanto, los residuos están correlacionados, incluso si las observaciones no lo están.
Cuando,
La suma de los valores residuales ponderados es igual a cero siempre que la función del modelo contenga un término constante. Multiplique por la izquierda la expresión de los residuos por X T W T :
Digamos, por ejemplo, que el primer término del modelo es una constante, de modo quepara todo i . En ese caso se deduce que
Así pues, en el ejemplo motivacional anterior, el hecho de que la suma de los valores residuales sea igual a cero no es accidental, sino que es consecuencia de la presencia del término constante α en el modelo.
Si el error experimental sigue una distribución normal , entonces, debido a la relación lineal entre los residuos y las observaciones, los residuos también deberían seguirla [ 5 ]. Sin embargo, dado que las observaciones son solo una muestra de la población de todas las observaciones posibles, los residuos deberían pertenecer a una distribución t de Student . Los residuos estudentizados son útiles para realizar una prueba estadística de un valor atípico cuando un residuo en particular parece ser excesivamente grande.
Véase también
Referencias
- ↑ "Regresión ponderada" . Archivado del original el 21/04/2022 . Consultado el 16/10/2018 .
- ↑ "Visualizar una regresión ponderada" .
- 1 2 Strutz, T. (2016). "3". Ajuste de datos e incertidumbre (Una introducción práctica a los mínimos cuadrados ponderados y más allá) . Springer Vieweg. ISBN 978-3-658-11455-8.
- ↑ Mandel, John (1964). El análisis estadístico de datos experimentales . Nueva York: Interscience.
- ↑ Mardia, KV; Kent, JT; Bibby, JM (1979). Análisis multivariante . Nueva York: Academic Press. ISBN 0-12-471250-9.
- Mínimos cuadrados