Referencias
Bertsekas, Dimitri P. 2019. Reinforcement Learning and Optimal
Control. Athena Scientific.
Castelletti, A., S. Galelli, M. Restelli, and R. Soncini-Sessa. 2010.
“Tree-Based Reinforcement Learning for Optimal Water Reservoir
Operation.” Water Resources Research 46: W09507. https://doi.org/10.1029/2009WR008898.
Díaz, Arallely Alegría. 2010. “Política de Operación Óptima Del
Sistema de Presas Del Río Grijalva. Efectos de La Curva Guía.”
Tesis de Maestría en Ingeniería Civil -- Hidráulica, Universidad
Nacional Autónoma de México, Facultad de Ingeniería.
Ernst, Damien, Pierre Geurts, and Louis Wehenkel. 2005.
“Tree-Based Batch Mode Reinforcement Learning.” Journal
of Machine Learning Research 6: 503–56. http://www.jmlr.org/papers/volume6/ernst05a/ernst05a.pdf.
IBM. 2025. “¿Qué es el aprendizaje por refuerzo?” IBM. https://www.ibm.com/mx-es/think/topics/reinforcement-learning?mhsrc=ibmsearch_a&mhq=aprendizaje%20por%20refuerzo.
Puterman, Martin L. 1994. Markov Decision Processes: Discrete
Stochastic Dynamic Programming. Wiley Series in Probability and
Statistics. John Wiley & Sons. https://doi.org/10.1002/9780470316887.