Name | Date modified | File size |
|
|---|---|---|---|
1_ Introduction.pdf Shared | Aug 22, 2022 | 303 KB | |
2_ Main concepts and example.pdf Shared | Aug 24, 2022 | 200 KB | |
3_ Multi-armed bandits (I).pdf Shared | Nov 2, 2022 | 223 KB | |
4_ Multi-armed bandits (II).pdf Shared | Aug 30, 2022 | 233 KB | |
5_ Markov Decision Processes (I).pdf Shared | Sep 6, 2022 | 272 KB | |
6_ Markov Decision Processes (II).pdf Shared | Sep 7, 2022 | 186 KB | |
7_ Markov Decision Processes (III).pdf Shared | Sep 12, 2022 | 194 KB | |
8_ Dynamic Programming (I).pdf Shared | Sep 14, 2022 | 165 KB | |
9_ Dynamic Programming (II).pdf Shared | Sep 16, 2022 | 194 KB | |
10_ Dynamic Programming (III).pdf Shared | Sep 20, 2022 | 192 KB | |
11_ Dynamic Programming (IV).pdf Shared | Sep 27, 2022 | 263 KB | |
12_ Monte Carlo methods.pdf Shared | Sep 28, 2022 | 276 KB | |
13_ MC, continued, Intro to TD.pdf Shared | Oct 3, 2022 | 233 KB | |
14_ TD continued.pdf Shared | Oct 5, 2022 | 268 KB | |
15_ n-step TD, Dyna.pdf Shared | Oct 7, 2022 | 290 KB | |
16_ RL with function approximation (I).pdf Shared | Oct 18, 2022 | 263 KB | |
17_ RL with function approximation (II).pdf Shared | Oct 24, 2022 | 266 KB | |
18_ TD(lambda).pdf Shared | Oct 26, 2022 | 251 KB | |
19_ TD(lambda)_ continued.pdf Shared | Oct 31, 2022 | 235 KB | |
20_ Policy gradient methods (I).pdf Shared | Nov 2, 2022 | 264 KB | |
21_ Policy gradient methods (II).pdf Shared | Nov 7, 2022 | 254 KB | |
22_ Policy gradient wrap up, intro to actor-critic methods.pdf Shared | Nov 9, 2022 | 287 KB | |
23_ Additional (deep) RL methods.pdf Shared | Nov 14, 2022 | 1.1 MB | |
24_ Additional (deep) RL methods, continued.pdf Shared | Nov 16, 2022 | 746 KB | |
25_ Multi agent RL.pdf Shared | Nov 21, 2022 | 193 KB | |
26_ Multi agent RL, continued.pdf Shared | Nov 27, 2022 | 985 KB | |
27_ Course summary.pdf Shared | Dec 1, 2022 | 219 KB |
