文档详情 ID: cmr0tu9wc0ib5dh63agarfe4x 后台管理 5_6-5-Q-Learning算法.mp4 2_4-2-马尔可夫观测过程:学会“看”.mp4 4_7-4-DQN改进算法代码实现.mp4 4_8-4-近端策略优化算法.mp4 1_3-1-CUDA+Anaconda深度学习环境配置.mp4 2_1-2-认识强化学习.mp4 2_9-2-改进型演员评论家算法.mp4 3_7-3-常见问题改进和扩展.mp4 1_8-1-策略梯度核心思想和原理.mp4 6_4-6-模型分类与选择.mp4 5_11-5-AlphaStar系统.mp4 1_6-1-蒙特卡洛方法.mp4 5_4-5-贝尔曼方程:迭代求解价值函数.mp4 强化学习必修课:引领人工智能新时代 分享时间 0001-01-01 入库时间 2026-08-05 资源类型 夸克网盘 分享用户 东倒*歪的棕熊 扫码获取资源 问题反馈 链接失效、内容异常、密码错误等问题都可以快速提交。 选择举报类型 复制链接 进入网盘 分享资源