En estadística , el concepto de estimador invariante es un criterio que se puede usar para comparar las propiedades de diferentes estimadores para la misma cantidad. Es una forma de formalizar la idea de que un estimador debe tener ciertas cualidades intuitivamente atractivas. Estrictamente hablando, "invariante" significaría que las estimaciones en sí mismas no cambian cuando tanto las mediciones como los parámetros se transforman de manera compatible, pero el significado se ha extendido para permitir que las estimaciones cambien de maneras apropiadas con tales transformaciones. [ 1 ] El término estimador equivariante se usa en contextos matemáticos formales que incluyen una descripción precisa de la relación de cómo cambia el estimador en respuesta a cambios en el conjunto de datos y la parametrización: esto corresponde al uso de " equivariancia " en matemáticas más generales.
Configuración general
Fondo
En inferencia estadística , existen varios enfoques de la teoría de la estimación que permiten determinar de inmediato qué estimadores deben utilizarse. Por ejemplo, las ideas de la inferencia bayesiana conducen directamente a los estimadores bayesianos . De manera similar, la teoría de la inferencia estadística clásica a veces permite llegar a conclusiones sólidas sobre qué estimador debe utilizarse. Sin embargo, la utilidad de estas teorías depende de contar con un modelo estadístico completamente definido y también puede depender de tener una función de pérdida relevante para determinar el estimador. Así, se podría realizar un análisis bayesiano , que dé lugar a una distribución posterior para los parámetros relevantes, pero el uso de una función de utilidad o pérdida específica puede resultar poco claro. En ese caso, se pueden aplicar ideas de invariancia para resumir la distribución posterior. En otros casos, se realizan análisis estadísticos sin un modelo estadístico completamente definido o la teoría clásica de la inferencia estadística no se puede aplicar fácilmente porque la familia de modelos que se está considerando no se presta a tal tratamiento. Además de estos casos en los que la teoría general no prescribe un estimador, el concepto de invariancia de un estimador puede aplicarse al buscar estimadores de formas alternativas, ya sea por el bien de la simplicidad de la aplicación del estimador o para que el estimador sea robusto .
El concepto de invarianza se utiliza a veces de forma aislada para elegir entre estimadores, pero esto no es necesariamente definitivo. Por ejemplo, el requisito de invarianza puede ser incompatible con el requisito de que el estimador sea insesgado respecto a la media ; por otro lado, el criterio de insesgadez respecto a la mediana se define en términos de la distribución muestral del estimador y, por lo tanto, es invariante ante muchas transformaciones.
Una aplicación del concepto de invariancia se da cuando se propone una clase o familia de estimadores y se debe seleccionar una formulación específica entre ellos. Un procedimiento consiste en imponer las propiedades de invariancia pertinentes y, a continuación, encontrar la formulación dentro de esta clase que posea las mejores propiedades, lo que da lugar a lo que se denomina el estimador invariante óptimo.
Algunas clases de estimadores invariantes
Existen varios tipos de transformaciones que resultan útiles al trabajar con estimadores invariantes. Cada una da lugar a una clase de estimadores que son invariantes a esos tipos particulares de transformación.
- Invariancia ante cambios: En teoría, las estimaciones de un parámetro de localización deberían ser invariantes ante cambios simples en los valores de los datos. Si todos los valores de los datos aumentan en una cantidad determinada, la estimación debería cambiar en la misma cantidad. Al considerar la estimación mediante un promedio ponderado , este requisito de invariancia implica inmediatamente que la suma de los pesos debe ser igual a uno. Si bien a menudo se obtiene el mismo resultado a partir de un requisito de insesgadez, el uso de "invariancia" no requiere la existencia de un valor medio ni utiliza ninguna distribución de probabilidad.
- Invariancia de escala: Cabe señalar que este tema sobre la invariancia del parámetro de escala del estimador no debe confundirse con la invariancia de escala más general sobre el comportamiento de los sistemas bajo propiedades agregadas (en física).
- Invariancia de transformación de parámetros: Aquí, la transformación se aplica solo a los parámetros. El concepto es que esencialmente se debe realizar la misma inferencia a partir de datos y un modelo que involucre un parámetro θ que a partir de los mismos datos si el modelo utilizara un parámetro φ, donde φ es una transformación biyectiva de θ, φ = h (θ). Según este tipo de invariancia, los resultados de los estimadores invariantes a la transformación también deben estar relacionados por φ = h (θ). Los estimadores de máxima verosimilitud tienen esta propiedad cuando la transformación es monótona . Aunque las propiedades asintóticas del estimador pueden ser invariantes, las propiedades para muestras pequeñas pueden ser diferentes, y es necesario derivar una distribución específica. [ 2 ]
- Invariancia de permutación: Cuando un conjunto de valores de datos puede representarse mediante un modelo estadístico que los representa como resultados de variables aleatorias independientes e idénticamente distribuidas , es razonable imponer el requisito de que cualquier estimador de cualquier propiedad de la distribución común sea invariante a la permutación: específicamente, que el estimador, considerado como una función del conjunto de valores de datos, no cambie si se intercambian elementos de datos dentro del conjunto de datos.
La combinación de invariancia de permutación e invariancia de localización para estimar un parámetro de localización a partir de un conjunto de datos independiente e idénticamente distribuido mediante un promedio ponderado implica que los pesos deben ser idénticos y sumar uno. Por supuesto, otros estimadores distintos al promedio ponderado pueden ser preferibles.
Estimadores invariantes óptimos
En este contexto, se nos proporciona un conjunto de medidas.que contiene información sobre un parámetro desconocidoLas medidasse modelan como una variable aleatoria vectorial que tiene una función de densidad de probabilidadque depende de un vector de parámetros.
El problema es estimardado. La estimación, denotada pores una función de las mediciones y pertenece a un conjuntoLa calidad del resultado se define mediante una función de pérdida .que determina una función de riesgo. Los conjuntos de valores posibles de,, yse denotan por,, y, respectivamente.
En la clasificación
En la clasificación estadística , la regla que asigna una clase a un nuevo elemento de datos puede considerarse un tipo especial de estimador. Se pueden aplicar diversas consideraciones de invariancia al formular el conocimiento previo para el reconocimiento de patrones .
Contexto matemático
Definición
Un estimador invariante es un estimador que obedece las dos reglas siguientes:
- Principio de invariancia racional: La acción tomada en un problema de decisión no debe depender de la transformación de la medida utilizada.
- Principio de invariancia: Si dos problemas de decisión tienen la misma estructura formal (en términos de,,y), entonces se debe utilizar la misma regla de decisión en cada problema.
Para definir formalmente un estimador invariante o equivariante, primero se necesitan algunas definiciones relacionadas con grupos de transformaciones. Seadenota el conjunto de posibles muestras de datos. Un grupo de transformaciones de, que se denotará por, es un conjunto de transformaciones (medibles) 1:1 y sobreyectivas deen sí mismo, que satisface las siguientes condiciones:
- Si yentonces
- Sientonces, dónde(Es decir, cada transformación tiene una inversa dentro del grupo).
- (es decir, hay una transformación de identidad))
conjuntos de datosyenson equivalentes sipara algunos. Todos los puntos equivalentes forman una clase de equivalencia . Dicha clase de equivalencia se llama órbita (en). Elórbita,, es el conjunto. Siconsta de una sola órbita entoncesSe dice que es transitivo.
Una familia de densidadesSe dice que es invariante bajo el gruposi, por cadayexiste un únicode tal manera quetiene densidad.se denotará.
Sies invariante bajo el grupoluego la función de pérdidaSe dice que es invariante bajosi por cadayexiste unde tal manera quea pesar de. El valor transformadose denotará por.
En lo anterior,es un grupo de transformaciones dea sí mismo yes un grupo de transformaciones dea sí mismo.
Un problema de estimación es invariante (equivariante) bajosi existen tres gruposcomo se definió anteriormente.
Para un problema de estimación que es invariante bajoestimadores un estimador invariante bajosi, para todosy,
Propiedades
- La función de riesgo de un estimador invariante,, es constante en las órbitas de. Equivalentementea pesar dey.
- La función de riesgo de un estimador invariante con transitividades constante.
Para un problema dado, el estimador invariante con el menor riesgo se denomina "mejor estimador invariante". El mejor estimador invariante no siempre se puede lograr. Un caso especial para el cual se puede lograr es el caso en el quees transitivo.
Ejemplo: Parámetro de ubicación
Suponeres un parámetro de ubicación si la densidad dees de la forma. Paray, el problema es invariante bajoEl estimador invariante en este caso debe satisfacer
así es de la forma().es transitivo enpor lo que el riesgo no varía con: eso es,El mejor estimador invariante es el que trae el riesgoal mínimo.
En el caso de que L sea el error al cuadrado
Estimador Pitman
El problema de estimación es quetiene densidad, donde θ es un parámetro a estimar y donde la función de pérdida esEste problema es invariante con los siguientes grupos de transformaciones (aditivas):
El mejor estimador invariantees el que minimiza
y este es el estimador de Pitman (1939).
Para el caso de pérdida de error cuadrático, el resultado es
Si(es decir, una distribución normal multivariada con componentes independientes de varianza unitaria) entonces
Si(componentes independientes que tienen una distribución de Cauchy con parámetro de escala σ ) entonces ,. Sin embargo, el resultado es
con
Referencias
- Berger, James O. (1985). Teoría estadística de la decisión y análisis bayesiano (2.ª ed.). Nueva York: Springer-Verlag. ISBN 0-387-96098-8MR 0804611 .
- Freue, Gabriela V. Cohen (2007). "El estimador de Pitman del parámetro de localización de Cauchy". Journal of Statistical Planning and Inference . 137 (6): 1900– 1913. doi : 10.1016/j.jspi.2006.05.002 .
- Pitman, EJG (1939). "La estimación de los parámetros de localización y escala de una población continua de cualquier forma dada". Biometrika . 30 (3/4): 391– 421. doi : 10.1093/biomet/30.3-4.391 . JSTOR 2332656 .
- Pitman, EJG (1939). "Pruebas de hipótesis sobre parámetros de ubicación y escala". Biometrika . 31 (1/2): 200–215 . doi : 10.1093/biomet/31.1-2.200 . JSTOR 2334983 .
- Estimador
- Teoría invariante