Referencias

Bertsekas, Dimitri P. 2019. Reinforcement Learning and Optimal Control. Athena Scientific.
Castelletti, A., S. Galelli, M. Restelli, and R. Soncini-Sessa. 2010. “Tree-Based Reinforcement Learning for Optimal Water Reservoir Operation.” Water Resources Research 46: W09507. https://doi.org/10.1029/2009WR008898.
Díaz, Arallely Alegría. 2010. “Política de Operación Óptima Del Sistema de Presas Del Río Grijalva. Efectos de La Curva Guía.” Tesis de Maestría en Ingeniería Civil -- Hidráulica, Universidad Nacional Autónoma de México, Facultad de Ingeniería.
Ernst, Damien, Pierre Geurts, and Louis Wehenkel. 2005. “Tree-Based Batch Mode Reinforcement Learning.” Journal of Machine Learning Research 6: 503–56. http://www.jmlr.org/papers/volume6/ernst05a/ernst05a.pdf.
IBM. 2025. “¿Qué es el aprendizaje por refuerzo?” IBM. https://www.ibm.com/mx-es/think/topics/reinforcement-learning?mhsrc=ibmsearch_a&mhq=aprendizaje%20por%20refuerzo.
Puterman, Martin L. 1994. Markov Decision Processes: Discrete Stochastic Dynamic Programming. Wiley Series in Probability and Statistics. John Wiley & Sons. https://doi.org/10.1002/9780470316887.