文档详情 ID: cmrcpizh80kkgdduw8f15guf0 后台管理 5_3-5-深度学习库PyTorch的安装.mp4 5_8-5-近端策略优化(PPO)代码实现.mp4 2_5-2-策略迭代.mp4 8_4-8-马尔可夫过程代码实现.mp4 1_11-1模仿学习.mp4 3_1-3-课程使用的技术栈.mp4 1_5-1-动态回归核心思想和原理.mp4 6_4-6-模型分类与选择.mp4 5_11-5-AlphaStar系统.mp4 6_11-6-基于人类反馈大强化学习.mp4 4_10-4-基于模型的策略优化.mp4 5_4-5-贝尔曼方程:迭代求解价值函数.mp4 7_4-7-常见问题解析.mp4 强化学习必修课:引领人工智能新时代 分享时间 0001-01-01 入库时间 2026-08-05 资源类型 夸克网盘 分享用户 奔跑*河马 扫码获取资源 问题反馈 链接失效、内容异常、密码错误等问题都可以快速提交。 选择举报类型 复制链接 进入网盘 分享资源