深度强化学习(DRL)-李宏毅1-8课(全)

9.7万
830
2019-08-13 21:41:26
943
800
4612
362
台湾大学李宏毅教授深度强化学习8课,review->PPO->Q-learning(baseic advance continuous actions)->Imitation Learning
视频选集
(2/11)
DRL Lecture 1_ Policy Gradient (Review)
45:49
DRL Lecture 2_ Proximal Policy Optimization (PPO)
41:34
DRL Lecture 3_ Q-learning (Basic Idea)
49:44
DRL Lecture 4_ Q-learning (Advanced Tips)
38:31
DRL Lecture 5_ Q-learning (Continuous Action)
14:58
DRL Lecture 6_ Actor-Critic
34:16
DRL Lecture 7_ Sparse Reward
30:16
DRL Lecture 8_ Imitation Learning
34:02
ML Lecture 23-1_ Deep Reinforcement Learning
01:06:22
ML Lecture 23-2_ Policy Gradient (Supplementary Explanation)
13:20
ML Lecture 23-3_ Reinforcement Learning (including Q-learning)
01:05:34
客服
顶部
赛事库 课堂 2021拜年纪