El principio del máximo de Pontryagin se utiliza en la teoría del control óptimo para encontrar el mejor control posible para llevar un sistema dinámico de un estado a otro, especialmente en presencia de restricciones para los controles de estado o de entrada. Este principio establece que es necesario que cualquier control óptimo, junto con la trayectoria de estado óptima, resuelva el llamado sistema hamiltoniano, que es un problema de valores en la frontera de dos puntos , más una condición de máximo del hamiltoniano de control . [ a ] Estas condiciones necesarias se vuelven suficientes bajo ciertas condiciones de convexidad en las funciones objetivo y de restricción. [ 1 ] [ 2 ]
El principio del máximo fue formulado en 1956 por el matemático ruso Lev Pontryagin y sus estudiantes, [ 3 ] [ 4 ] y su aplicación inicial fue a la maximización de la velocidad terminal de un cohete. [ 5 ] El resultado se derivó utilizando ideas del cálculo de variaciones clásico . [ 6 ] Después de una ligera perturbación del control óptimo, se considera el término de primer orden de una expansión de Taylor con respecto a la perturbación; al hacer que la perturbación sea cero, se obtiene una desigualdad variacional de la cual se deduce el principio del máximo. [ 7 ]
Considerado un hito en la teoría del control óptimo , la importancia del principio del máximo radica en que maximizar el hamiltoniano es mucho más sencillo que el problema de control original de dimensión infinita; en lugar de maximizar sobre un espacio de funciones , el problema se transforma en una optimización puntual . [ 8 ] Una lógica similar conduce al principio de optimalidad de Bellman , un enfoque relacionado con los problemas de control óptimo que establece que la trayectoria óptima permanece óptima en puntos intermedios en el tiempo. [ 9 ] La ecuación de Hamilton-Jacobi-Bellman resultante proporciona una condición necesaria y suficiente para un óptimo, y admite una extensión directa a problemas de control óptimo estocástico, mientras que el principio del máximo no. [ 7 ] Sin embargo, a diferencia de la ecuación de Hamilton-Jacobi-Bellman, que debe cumplirse sobre todo el espacio de estados para ser válida, el principio del máximo de Pontryagin es potencialmente más eficiente computacionalmente, ya que las condiciones que especifica solo necesitan cumplirse sobre una trayectoria particular.
Notación
Para el conjuntoy funciones
- :\mathbb {R} ^{n}\to \mathbb {R} } ,
- ,
- ,
- ,
Utilizamos la siguiente notación:
- ,
- ,
- ,
- ,
- .
Enunciado formal de las condiciones necesarias para los problemas de minimización.
Aquí se muestran las condiciones necesarias para la minimización de un funcional.
Consideremos un sistema dinámico n-dimensional , con variable de estadoy variable de control, dóndees el conjunto de controles admisibles. La evolución del sistema está determinada por el estado y el control, según la ecuación diferencial.. Sea el estado inicial del sistemay que la evolución del sistema sea controlada durante el período de tiempo con valoresEsto último se determina mediante la siguiente ecuación diferencial :
La trayectoria de controldebe elegirse de acuerdo con un objetivo. El objetivo es funcional.definido por
- ,
dóndepuede interpretarse como la tasa de costo para ejercer controlen el estado, ypuede interpretarse como el costo de terminar en el estado. La elección específica deDepende de la aplicación.
Las restricciones sobre la dinámica del sistema pueden adjuntarse al lagrangiano.mediante la introducción de un vector multiplicador de Lagrange variable en el tiempo, cuyos elementos se denominan coestados del sistema. Esto motiva la construcción del hamiltonianodefinido para todospor:
dóndees la transpuesta de.
El principio mínimo de Pontryagin establece que la trayectoria de estado óptimacontrol óptimoy el vector multiplicador de Lagrange correspondientedebe minimizar el hamiltonianode modo que
para siemprey para todas las entradas de control permitidasAquí, la trayectoria del vector multiplicador de Lagrange.es la solución a la ecuación coestado :
Las condiciones de contorno dependen de si el estado finaly tiempo finalestán fijas. Estas condiciones se encuentran observando cómo funciona(diferencialmente) varía cuandoyson (diferencialmente) variados. Suponiendo que el estado final y el tiempo son independientes entre sí,El hecho de que no se haya solucionado da como resultado la condición
yEl hecho de que no se haya solucionado da como resultado la condición
Estas cuatro condiciones en (1)-(4) son las condiciones necesarias para un control óptimo.
Véase también
- Multiplicadores de Lagrange en espacios de Banach , método lagrangiano en cálculo de variaciones
Notas
- ↑ Que el valor extremo sea máximo o mínimo depende de la convención de signos utilizada para definir el hamiltoniano. La convención histórica conduce a un máximo, de ahí el principio del máximo. En los últimos años, se le conoce más comúnmente como el Principio de Pontryagin, sin utilizar los adjetivos máximo o mínimo.
Referencias
- ↑ Mangasarian, OL (1966). "Condiciones suficientes para el control óptimo de sistemas no lineales". SIAM Journal on Control . 4 (1): 139– 152. doi : 10.1137/0304013 .
- ↑ Kamien, Morton I. ; Schwartz, Nancy L. (1971). "Condiciones suficientes en la teoría del control óptimo". Journal of Economic Theory . 3 (2): 207– 214. doi : 10.1016/0022-0531(71)90018-4 .
- ↑ Boltyanski, V.; Martini, H.; Soltan, V. (1998). «El principio del máximo: ¿cómo surgió?» . Métodos geométricos y problemas de optimización . Nueva York: Springer. pp. 204–227 . ISBN 0-7923-5454-0.
- ↑ Gamkrelidze, RV (1999). "Descubrimiento del principio del máximo". Journal of Dynamical and Control Systems . 5 (4): 437– 451. doi : 10.1023/A:1021783020548 . S2CID 122690986 . Reimpreso en Bolibruch, AA ; et al., eds. (2006). Mathematical Events of the Twentieth Century . Berlín: Springer. pp. 85–99 . ISBN 3-540-23235-4.
- ↑ Para las primeras obras publicadas, véanse las referencias en Fuller, AT (1963). "Bibliografía del principio máximo de Pontryagin". J. Electronics & Control . 15 (5): 513– 517. doi : 10.1080/00207216308937602 .
- ↑ McShane, EJ (1989). "El cálculo de variaciones desde el principio hasta la teoría del control óptimo". SIAM J. Control Optim . 27 (5): 916– 939. doi : 10.1137/0327049 .
- 1 2 Yong, J.; Zhou, XY (1999). "Principio del máximo y sistemas hamiltonianos estocásticos". Controles estocásticos: sistemas hamiltonianos y ecuaciones HJB . Nueva York: Springer. págs. 101–156 . ISBN 0-387-98723-1.
- ↑ Sastry, Shankar (29 de marzo de 2009). "Apuntes de clase 8. Control óptimo y juegos dinámicos" (PDF) .
- ↑ Zhou, XY (1990). "Principio del máximo, programación dinámica y su conexión en el control determinista". Journal of Optimization Theory and Applications . 65 (2): 363– 373. doi : 10.1007/BF01102352 . S2CID 122333807 .
Lecturas adicionales
- Geering, HP (2007). Control óptimo con aplicaciones de ingeniería . Springer. ISBN 978-3-540-69437-3.
- Kirk, DE (1970). Teoría del control óptimo: una introducción . Prentice Hall. ISBN 0-486-43484-2.
- Lee, EB; Markus, L. (1967). Fundamentos de la teoría del control óptimo . Nueva York: Wiley.
- Seierstad, Atle; Sydsæter, Knut (1987). Teoría del control óptimo con aplicaciones económicas . Ámsterdam: North-Holland. ISBN 0-444-87923-4.
Enlaces externos
- "Principio máximo de Pontryagin" , Enciclopedia de Matemáticas , EMS Press , 2001 [1994]
- Control óptimo
- Principios