PreprintJournal of Artificial Intelligence Research2000
Hierarchical Reinforcement Learning with the MAXQ Value Function Decomposition
Tom Dietterich
Introduces the MAXQ decomposition for hierarchical reinforcement learning, enabling faster convergence via state abstractions and recursively optimal policies.
1.9kNov 1, 2000Reinforcement Learning
arXiv