Sequential decision making — Markov decision processes, dynamic programming, temporal-difference learning, and policy gradient methods.