ORCS E4529
Reinforcement Learning
Columbia University in the City of New York · UGRD · Fall 2026
1 section
Catalog description
g., familiarity with linear and convex optimization, gradient descent, basic algorithm design constructs, familiarity with programming in python. Markov Decision Processes (MDP) and Reinforcement Learning (RL) problems. Reinforcement Learning algorithms including Q-learning, policy gradient methods, actor-critic method. Reinforcement learning while doing exploration-exploitation dilemma, multi-armed bandit problem. Monte Carlo Tree Search methods, Distributional, Multi-agent, and Causal Reinforcement Learning
Sections
Current meeting, instructor, credit, and enrollment details
001
Availability not recently verifiedClass #columbia_in_city_new_york-ORCSE4529Fall 2026UGRD3.00 credits
- Days & times
- No scheduled meeting time
- Meeting dates
- —
- Location
- —
- Instructor
- Staff
Class numbers and section codes come from the registrar.
Spot missing or incorrect course data?