游客
登录
我的空间
使用说明下载
leixy
3
课程
|
444
资源
资源
课程
全部
视频
音频
图片
文档
PPT
其它
第七章_01_策略梯度方法的缺点
172
第六章_05_REINFORCE算法
155
第六章_04_蒙特卡罗方法
154
第六章_03_策略梯度定理的推导(下)
155
第六章_03_策略梯度定理的推导(上)
155
第六章_02_随机性策略梯度方法
154
第六章_01_基于策略的思想
152
第五章_02_Gym的使用方法
152
第五章_01_Gym简介和环境加载
153
第四章_05_DQN
148
第四章_04_Q-learning和Sarsa的对比
148
第四章_03_Q-learning
149
第四章_02_Sarsa
148
第四章_01_状态-动作价值函数
148
第三章_05_值迭代法
148
第三章_04_策略迭代法
148
首页
<
15
16
17
18
19
20
21
22
23
24
>
尾页