主页
/
7.【Deepseek】视频文档学习教程
/
2025AI人工智能课程精选
/
AI算法工程师就业班
/
31、【加课】强化学习【新增】
/
章节2:DeepQ-LearningNetwork
/
14:DQN算法思想.mp4
15:DQN算法具体流程.mp4
16:ε-greedy_ReplayBuffer_FixedQ-targets.mp4
17:代码实战DQN_Agent和Env整体交互.mp4
18:代码实战DQN_构建Q网络.mp4
19:代码实战DQN_定义损失函数_构建Target网络更新逻辑.mp4
20:代码实战DQN_训练阶段得到Q网络的预测值和真实值.mp4
21:代码实战DQN_训练阶段最小化损失_记录loss方便展示_随着learn的越多选择action随机性减小.mp4
22:DQN会over-estimate的本质原因.mp4
23:DoubleDQN缓解over-estimate.mp4
24:DoubleDQN代码实战.mp4
25:DuelingDQN.mp4
26:困难样本挖掘_Multi-step_NoiseyNet系统的探索.mp4
27:计算Action的方差避免风险.mp4
28:Rainbow_DQN如何计算连续型的Actions.mp4
© 2026
⚠
信息加载中,请等待...