Los modelos de elección discreta dinámica (DDC) , también conocidos como modelos de elección discreta de programación dinámica , modelan las elecciones de un agente sobre opciones discretas que tienen implicaciones futuras. En lugar de suponer que las elecciones observadas son el resultado de la maximización de la utilidad estática, se supone que las elecciones observadas en los modelos DDC son el resultado de la maximización del valor presente de la utilidad por parte de un agente, generalizando así la teoría de la utilidad en la que se basan los modelos de elección discreta . [1]
El objetivo de los métodos DDC es estimar los parámetros estructurales del proceso de decisión del agente. Una vez que se conocen estos parámetros, el investigador puede utilizar las estimaciones para simular cómo se comportaría el agente en un estado contrafáctico del mundo (por ejemplo, cómo cambiaría la decisión de inscripción de un futuro estudiante universitario en respuesta a un aumento de la matrícula).
Representación matemática
El problema de maximización del agente se puede escribir matemáticamente de la siguiente manera:
dónde
- son variables de estado , con la condición inicial del agente
- representa la decisión de entre alternativas discretas
- es el factor de descuento
- es el flujo que recibe la utilidad al elegir la alternativa en el período y depende tanto del estado como de factores no observados
- es el horizonte temporal
- La expectativa se asume tanto en los ' como en los ' . Es decir, el agente no está seguro de las transiciones futuras en los estados, y tampoco está seguro de las realizaciones futuras de factores no observados.
Simplificando suposiciones y notación
Es estándar imponer los siguientes supuestos simplificadores y notación del problema de decisión dinámico:
- 1. La utilidad de flujo es aditivamente separable y lineal en parámetros.
La utilidad de flujo se puede escribir como una suma aditiva, compuesta por elementos deterministas y estocásticos. El componente determinista se puede escribir como una función lineal de los parámetros estructurales .
- 2. El problema de optimización se puede escribir como una ecuación de Bellman.
Definir por la función de valor ex ante para el individuo en el período justo antes de que se revele:
donde el operador de expectativa es sobre el 's, y donde representa la distribución de probabilidad sobre condicional a . La expectativa sobre las transiciones de estado se logra tomando la integral sobre esta distribución de probabilidad.
Es posible descomponer en componentes deterministas y estocásticos:
¿Dónde está el valor de elegir la alternativa en el momento y se escribe como?
donde ahora la expectativa es asumida por el .
- 3. El problema de optimización sigue un proceso de decisión de Markov.
Los estados siguen una cadena de Markov , es decir, la consecución del estado depende únicamente del estado y no de ningún estado anterior.
Funciones de valor condicional y probabilidades de elección
La función de valor de la sección anterior se denomina función de valor condicional , porque es la función de valor condicional a la elección de la alternativa en el período . Escribir la función de valor condicional de esta manera es útil para construir fórmulas para las probabilidades de elección.
Para escribir las probabilidades de elección, el investigador debe hacer una suposición sobre la distribución de las . Al igual que en los modelos de elección discreta estática, se puede suponer que esta distribución es iid Valor extremo tipo I , valor extremo generalizado , probit multinomial o logit mixto .
Para el caso donde es logit multinomial (es decir, extraído de la distribución de valores extremos Tipo I ), las fórmulas para las probabilidades de elección serían:
Estimación
La estimación de modelos dinámicos de elección discreta es particularmente desafiante, debido al hecho de que el investigador debe resolver el problema de recursión hacia atrás para cada estimación de los parámetros estructurales.
Los métodos más comunes utilizados para estimar los parámetros estructurales son la estimación de máxima verosimilitud y el método de momentos simulados .
Además de los métodos de estimación, también existen métodos de solución. Se pueden emplear diferentes métodos de solución según la complejidad del problema. Estos se pueden dividir en métodos de solución completa y métodos sin solución .
Métodos de solución completa
El ejemplo más destacado de un método de solución completa es el algoritmo de punto fijo anidado (NFXP) desarrollado por John Rust en 1987. [2] El algoritmo NFXP se describe con gran detalle en su manual de documentación. [3]
Un trabajo reciente de Che-Lin Su y Kenneth Judd en 2012 [4] implementa otro enfoque (rechazado por Rust en 1987 por considerarlo intratable), que utiliza la optimización restringida de la función de verosimilitud, un caso especial de programación matemática con restricciones de equilibrio (MPEC). En concreto, la función de verosimilitud se maximiza sujeta a las restricciones impuestas por el modelo y se expresa en términos de las variables adicionales que describen la estructura del modelo. Este enfoque requiere un potente software de optimización como Artelys Knitro debido a la alta dimensionalidad del problema de optimización. Una vez resuelto, se encuentran tanto los parámetros estructurales que maximizan la verosimilitud como la solución del modelo.
En el artículo [5], Rust y sus coautores demuestran que la ventaja de velocidad de MPEC en comparación con NFXP no es significativa. Sin embargo, debido a que los cálculos requeridos por MPEC no dependen de la estructura del modelo, su implementación requiere mucho menos trabajo.
A pesar de numerosos contendientes, el estimador de máxima verosimilitud NFXP sigue siendo el método de estimación líder para los modelos de decisión de Markov. [5]
Métodos sin solución
Una alternativa a los métodos de solución completa son los métodos sin solución. En este caso, el investigador puede estimar los parámetros estructurales sin tener que resolver completamente el problema de recursión hacia atrás para cada parámetro. Los métodos sin solución suelen ser más rápidos y requieren más suposiciones, pero las suposiciones adicionales son en muchos casos realistas.
El principal método de no solución es el de probabilidades de elección condicional, desarrollado por V. Joseph Hotz y Robert A. Miller. [6]
Ejemplos
Modelo de reemplazo de motor de autobús
El modelo de reemplazo de motor de autobús desarrollado en el artículo fundamental Rust (1987) es uno de los primeros modelos estocásticos dinámicos de elección discreta estimados utilizando datos reales, y continúa sirviendo como ejemplo clásico de los problemas de este tipo. [4]
El modelo es un problema dinámico estocástico de parada óptima regenerativa simple al que se enfrenta el responsable de la toma de decisiones, Harold Zurcher, superintendente de mantenimiento de la Madison Metropolitan Bus Company en Madison, Wisconsin . Para cada autobús en funcionamiento en cada período de tiempo, Harold Zurcher tiene que decidir si reemplaza el motor y asume el costo asociado de reemplazo, o si continúa operando el autobús a un costo de operación cada vez mayor, que incluye el seguro y el costo de la pérdida de pasajeros en caso de una avería.
Sea la lectura del odómetro (kilometraje) en el período , el costo de operación del autobús que depende del vector de parámetros , el costo de reemplazo del motor y el factor de descuento . Entonces, la utilidad por período está dada por
donde denota la decisión (mantener o reemplazar) y y representan el componente de la utilidad observada por Harold Zurcher, pero no por John Rust. Se supone que y son independientes y se distribuyen de manera idéntica con la distribución de valores extremos de Tipo I , y que son independientes de condicionalmente a .
Entonces las decisiones óptimas satisfacen la ecuación de Bellman
donde y son respectivamente densidades de transición para las variables de estado observadas y no observadas. Los índices de tiempo en la ecuación de Bellman se descartan porque el modelo está formulado en la configuración de horizonte infinito, la política óptima desconocida es estacionaria , es decir, independiente del tiempo.
Dado el supuesto distribucional de , la probabilidad de una elección particular está dada por
donde es una solución única para la ecuación funcional
Se puede demostrar que la última ecuación funcional define una función de contracción si el espacio de estados está acotado, por lo que habrá una solución única para cualquier , y además se cumple el teorema de la función implícita , por lo que también es una función suave de para cada .
Estimación con algoritmo de punto fijo anidado
La función de contracción anterior se puede resolver numéricamente para el punto fijo que arroja probabilidades de elección para cualquier valor dado de . La función de verosimilitud logarítmica se puede formular entonces como
donde y representan datos sobre variables de estado (lecturas del odómetro) y decisiones (mantener o reemplazar) para autobuses individuales, cada uno en períodos.
El algoritmo conjunto para resolver el problema del punto fijo dado un valor particular de parámetro y maximizar la verosimilitud con respecto a fue denominado por John Rust algoritmo de punto fijo anidado (NFXP).
La implementación de Rust del algoritmo de punto fijo anidado está altamente optimizada para este problema, utilizando iteraciones de Newton-Kantorovich para calcular y métodos cuasi-Newton , como el algoritmo de Berndt-Hall-Hall-Hausman , para maximizar la verosimilitud. [5]
Estimación con MPEC
En el algoritmo de punto fijo anidado, se recalcula para cada aproximación de los parámetros θ . El método MPEC, en cambio, resuelve el problema de optimización restringida : [4]
Este método es más rápido de calcular que las implementaciones no optimizadas del algoritmo de punto fijo anidado y lleva aproximadamente el mismo tiempo que las implementaciones altamente optimizadas. [5]
Estimación con métodos sin solución
El método de probabilidades de elección condicional de Hotz y Miller se puede aplicar en este contexto. Hotz, Miller, Sanders y Smith propusieron una versión computacionalmente más simple del método y la probaron en un estudio del problema de reemplazo de motores de autobús. El método funciona estimando probabilidades de elección condicional utilizando simulación y luego eliminando las diferencias implícitas en las funciones de valor . [7] [8]
Véase también
Referencias
- ^ Keane y Wolpin 2009.
- ^ Óxido 1987.
- ^ Rust, John (2008). "Manual de documentación del algoritmo de punto fijo anidado". Inédito .
- ^ abc Su, Che-Lin; Judd, Kenneth L. (2012). "Enfoques de optimización restringida para la estimación de modelos estructurales". Econometrica . 80 (5): 2213–2230. doi :10.3982/ECTA7925. hdl : 10419/59626 . ISSN 1468-0262.
- ^ abcd Iskhakov, Fedor; Lee, Jinhyuk; Rust, John; Schjerning, Bertel; Seo, Kyoungwon (2016). "Comentario sobre "enfoques de optimización restringida para la estimación de modelos estructurales"". Econometrica . 84 (1): 365–370. doi :10.3982/ECTA12605. ISSN 0012-9682.
- ^ Hotz, V. Joseph; Miller, Robert A. (1993). "Probabilidades de elección condicional y estimación de modelos dinámicos". Review of Economic Studies . 60 (3): 497–529. doi :10.2307/2298122. JSTOR 2298122.
- ^ Aguirregabiria y Mira 2010.
- ^ Hotz, VJ; Miller, RA; Sanders, S.; Smith, J. (1 de abril de 1994). "Un estimador de simulación para modelos dinámicos de elección discreta". The Review of Economic Studies . 61 (2). Oxford University Press (OUP): 265–289. doi :10.2307/2297981. ISSN 0034-6527. JSTOR 2297981. S2CID 55199895.
Lectura adicional
- Aguirregabiria, Victor; Mira, Pedro (2010). "Modelos estructurales de elección discreta dinámica: una encuesta" (PDF) . Journal of Econometrics . 156 (1). Elsevier BV: 38–67. doi :10.1016/j.jeconom.2009.09.007. ISSN 0304-4076.
- Keane, Michael P. ; Wolpin, Kenneth I. (2009). "Aplicaciones empíricas de modelos de programación dinámica de elección discreta". Revista de Dinámica Económica . 12 (1): 1–22. doi :10.1016/j.red.2008.07.001.
- Rust, John (1987). "Reemplazo óptimo de motores de autobuses GMC: un modelo empírico de Harold Zurcher". Econometrica . 55 (5): 999–1033. doi :10.2307/1911259. ISSN 0012-9682. JSTOR 1911259.
- Rust, John (1994). "Capítulo 51 Estimación estructural de procesos de decisión de Markov". Handbook of Econometrics . Vol. 4. Elsevier. págs. 3081–3143. doi :10.1016/s1573-4412(05)80020-0. ISBN 978-0-444-88766-5. ISSN 1573-4412.