Fall 2024
Reinforcement Learning
, 3 pts, E4529Reinforcement Learning
Markov Decision Processes (MDP) and Reinforcement Learning (RL) problems. Reinforcement Learning algorithms including Q-learning, policy gradient methods, actor-critic method. Reinforcement learning while doing exploration-exploitation dilemma, multi-armed bandit problem. Monte Carlo Tree Search methods, Distributional, Multi-agent, and Causal Reinforcement Learning.
- Section Number
- 001
- Call Number
- 14542
- Day, Time & Location
- MW 1:10PM-2:25PM 330 Uris Hall
- Instructor
- Shipra Agrawal
