Adaptive linear quadratic control using policy iteration

Steven J. Bradtke(University of Massachusetts Amherst), Andrew G. Barto(University of Massachusetts Amherst), B. Erik Ydstie(Carnegie Mellon University)
Unknown
August 24, 2005
Cited by 417


Related Papers

Introduction to Reinforcement Learning
|MIT Press eBooks|1998|6.9k
Reinforcement Learning
|IFAC Proceedings Volumes|1998|3k
Learning to act using real-time dynamic programming
|Artificial Intelligence|1995|1.1k
Recent Advances in Hierarchical Reinforcement Learning
|Discrete Event Dynamic Systems|2003|1k