Courses

Fall 2024

Reinforcement Learning

, 3 pts, E4529

Reinforcement Learning

Markov Decision Processes (MDP) and Reinforcement Learning (RL) problems. Reinforcement Learning algorithms including Q-learning, policy gradient methods, actor-critic method. Reinforcement learning while doing exploration-exploitation dilemma, multi-armed bandit problem. Monte Carlo Tree Search methods, Distributional, Multi-agent, and Causal Reinforcement Learning. 

Section Number
001
Call Number
14542
Day, Time & Location
MW 1:10PM-2:25PM 330 Uris Hall
Instructor
Shipra Agrawal