En teoría de la probabilidad , la paradoja de Borel-Kolmogorov (a veces conocida como paradoja de Borel ) es una paradoja relacionada con la probabilidad condicional respecto a un evento de probabilidad cero (también conocido como conjunto nulo ). Recibe su nombre de Émile Borel y Andrey Kolmogorov .
Un rompecabezas de círculo máximo
Supongamos que una variable aleatoria tiene una distribución uniforme en una esfera unitaria . ¿Cuál es su distribución condicional en un círculo máximo ? Debido a la simetría de la esfera, cabría esperar que la distribución fuera uniforme e independiente de la elección de coordenadas. Sin embargo, dos análisis dan resultados contradictorios. Primero, observemos que elegir un punto uniformemente en la esfera es equivalente a elegir la longitud.uniformemente desdey eligiendo la latituddecon densidad. [ 1 ] Entonces podemos observar dos círculos máximos diferentes:
- Si las coordenadas se eligen de modo que el círculo máximo sea un ecuador (latitud), la densidad condicional para una longituddefinido en el intervaloes
- Si el círculo máximo es una línea de longitud con, la densidad condicional para en el intervaloes
Una distribución es uniforme sobre el círculo, la otra no. Sin embargo, ambas parecen referirse al mismo círculo máximo en diferentes sistemas de coordenadas.
Se han producido numerosas discusiones bastante inútiles —entre probabilistas por lo demás competentes— sobre cuál de estos resultados es el "correcto".
Explicación e implicaciones
En el caso (1) anterior, la probabilidad condicional de que la longitud λ se encuentre en un conjunto E dado que φ = 0 se puede escribir P ( λ ∈ E | φ = 0 ). La teoría elemental de la probabilidad sugiere que esto se puede calcular como P ( λ ∈ E y φ = 0)/ P ( φ = 0 ), pero esa expresión no está bien definida ya que P ( φ = 0) = 0. La teoría de la medida proporciona una forma de definir una probabilidad condicional, utilizando el límite de eventos R ab = { φ : a < φ < b } que son anillos horizontales (zonas de superficie curvas de segmentos esféricos ) que consisten en todos los puntos con latitud entre a y b .
La resolución de la paradoja consiste en observar que, en el caso (2), P ( φ ∈ F | λ = 0) se define utilizando un límite de los eventos L cd = { λ : c < λ < d }, que son lunas (cuñas verticales), que consisten en todos los puntos cuya longitud varía entre c y d . Así, aunque P ( λ ∈ E | φ = 0) y P ( φ ∈ F | λ = 0) proporcionan cada una una distribución de probabilidad en un círculo máximo, una de ellas se define utilizando límites de anillos y la otra utilizando límites de lunas. Dado que los anillos y las lunas tienen formas diferentes, debería ser menos sorprendente que P ( λ ∈ E | φ = 0) y P ( φ ∈ F | λ = 0) tengan distribuciones diferentes.
El concepto de probabilidad condicional con respecto a una hipótesis aislada cuya probabilidad es igual a 0 es inadmisible. Porque podemos obtener una distribución de probabilidad para [la latitud] en el círculo meridiano solo si consideramos este círculo como un elemento de la descomposición de toda la superficie esférica en círculos meridianos con los polos dados.
— Andrey Kolmogorov [ 2 ]
… el término «círculo máximo» es ambiguo hasta que especifiquemos qué operación límite lo produce. El argumento intuitivo de la simetría presupone el límite ecuatorial; sin embargo, comer rodajas de naranja podría presuponer lo contrario.
Explicación matemática
Perspectiva teórica de la medida
Para comprender el problema, debemos reconocer que una distribución de una variable aleatoria continua se describe mediante una función de densidad f únicamente con respecto a alguna medida μ . Ambas son importantes para la descripción completa de la distribución de probabilidad. O, equivalentemente, necesitamos definir completamente el espacio en el que queremos definir f .
Sean Φ y Λ dos variables aleatorias que toman valores en Ω 1 =respectivamente Ω 2 = [− π , π ]. Un evento {Φ = φ , Λ = λ } da un punto en la esfera S ( r ) con radio r . Definimos la transformación de coordenadas
para el cual obtenemos el elemento de volumen
Además, si φ o λ están fijos, obtenemos los elementos de volumen.
Dejar
denotamos la medida conjunta en, que tiene una densidadcon respecto ay dejar
Si asumimos que la densidades uniforme, entonces
Por eso,tiene una densidad uniforme con respecto apero no con respecto a la medida de Lebesgue . Por otro lado,tiene una densidad uniforme con respecto ay la medida Lebesgue.
Prueba de contradicción
Consideremos un vector aleatorioque se distribuye uniformemente en la esfera unitaria.
Comenzamos parametrizando la esfera con las coordenadas polares esféricas habituales :
dóndey.
Podemos definir variables aleatorias,como los valores de bajo la inversa de esta parametrización, o más formalmente usando la función arctan2 :
Utilizando las fórmulas para el área de superficie de una calota esférica y una cuña esférica , la superficie de una cuña de calota esférica viene dada por
DesdeSi se distribuye uniformemente, la probabilidad es proporcional al área de la superficie, lo que da como resultado la función de distribución acumulativa conjunta.
La función de densidad de probabilidad conjunta viene dada por
Tenga en cuenta queyson variables aleatorias independientes.
Para simplificar, no calcularemos la distribución condicional completa en un círculo máximo, sino solo la probabilidad de que el vector aleatorio se encuentre en el primer octante. Es decir, intentaremos calcular la probabilidad condicional.con
Intentamos evaluar la probabilidad condicional como un límite de condicionamiento en los eventos.
Comoyson independientes, al igual que los eventos.y, por lo tanto
Ahora repetimos el proceso con una parametrización diferente de la esfera:
Esto es equivalente a la parametrización anterior rotada 90 grados alrededor del eje y .
Definir nuevas variables aleatorias
La rotación conserva la medida, por lo que la densidad dey es lo mismo:
- .
Las expresiones para A y B son:
Intentando nuevamente evaluar la probabilidad condicional como un límite de condicionamiento en los eventos
Utilizando la regla de L'Hôpital y la diferenciación bajo el signo integral :
Esto demuestra que la densidad condicional no puede tratarse como condicionada a un evento de probabilidad cero, como se explica en Probabilidad condicional#Condicionamiento a un evento de probabilidad cero .
Véase también
- Teorema de desintegración – Teorema en teoría de la medida
Notas
- 1 2 3 Jaynes 2003 , págs. 1514–1517
- ↑ Originalmente de Kolmogorov (1933) , traducido en Kolmogorov (1956) . Fuente: Pollard (2002).
Referencias
- Jaynes, ET (2003). «15.7 La paradoja de Borel-Kolmogorov». Teoría de la probabilidad: La lógica de la ciencia . Cambridge University Press. pp. 467–470 . ISBN 0-521-59271-2. MR 1992316 .
- Edición fragmentaria (1994) (págs. 1514-1517 ) Archivada el 30 de septiembre de 2018 en Wayback Machine ( formato PostScript )
- Kolmogorov, Andrey (1933). Grundbegriffe der Wahrscheinlichkeitsrechnung (en alemán). Berlín: Julius Springer.
- Traducción: Kolmogorov, Andrey (1956). «Capítulo V, §2. Explicación de una paradoja de Borel» . Fundamentos de la teoría de la probabilidad (2.ª ed.). Nueva York: Chelsea. págs. 50-51 . ISBN 0-8284-0023-7Archivado del original el 14 de septiembre de 2018. Consultado el 12 de marzo de 2009 .
{{cite book}}: Incompatibilidad de ISBN/Fecha ( ayuda )
- Traducción: Kolmogorov, Andrey (1956). «Capítulo V, §2. Explicación de una paradoja de Borel» . Fundamentos de la teoría de la probabilidad (2.ª ed.). Nueva York: Chelsea. págs. 50-51 . ISBN 0-8284-0023-7Archivado del original el 14 de septiembre de 2018. Consultado el 12 de marzo de 2009 .
- Pollard, David (2002). «Capítulo 5. Condicionamiento, Ejemplo 17.». Guía del usuario para la probabilidad basada en la teoría de la medida . Cambridge University Press. págs. 122-123 . ISBN 0-521-00289-3. SR 1873379 .
- Mosegaard, Klaus; Tarantola, Albert (2002). "16 Enfoque probabilístico para problemas inversos". Manual internacional de sismología de terremotos e ingeniería . Geofísica internacional. Vol. 81. pp. 237–265 . doi : 10.1016/S0074-6142(02)80219-4 . ISBN 9780124406520.
- Gal, Yarin. "La paradoja de Borel-Kolmogorov" (PDF) .
- Paradojas de la teoría de la probabilidad