文档详情 ID: cmr2aevfp1plbdh63ngdb5zag 后台管理 7_6-7-Q-Learning&SARSA代码实现.mp4 8_4-8-马尔可夫过程代码实现.mp4 3_12-3-强化学习最新发展趋势.mp4 5_10-5-MBPO的代码实现.mp4 2_10-2-Dyna-Q算法.mp4 4_12-4-下一步的学习建议.mp4 4_8-4-近端策略优化算法.mp4 5_3-5-深度学习库PyTorch的安装.mp4 1_10-1-基于模型的强化学习核心思想和原理.mp4 3_6-3-蒙特卡洛方法和时序差分代码实现.mp4 1_3-1-CUDA+Anaconda深度学习环境配置.mp4 1_1-1-课程内容和理念.mp4 6_11-6-基于人类反馈大强化学习.mp4 2_8-2-蒙特卡洛策略梯度.mp4 3_5-3-价值迭代.mp4 4_3-4-仿真环境Gym安装.mp4 6_4-6-模型分类与选择.mp4 3_7-3-常见问题改进和扩展.mp4 强化学习必修课:引领人工智能新时代 分享时间 0001-01-01 入库时间 2026-08-05 资源类型 夸克网盘 分享用户 乐不*支的苹果 扫码获取资源 问题反馈 链接失效、内容异常、密码错误等问题都可以快速提交。 选择举报类型 复制链接 进入网盘 分享资源