结构化状态空间中的递阶再励学习方法 上传者:xindyfeng 2021-02-21 21:56:52上传 PDF文件 451.41KB 热度 32次 在状态空间满足结构化条件的前提下,通过状态空间的维度划分直接将复杂的原始MDP问题递阶分解为一组简单的MDP或SMDP子问题,并在线对递阶结构进行完善.递阶结构中嵌入不同的再励学习方法可以形成不同的递阶学习.所提出的方法在具备递阶再励学习速度快,易于共享等优点的同时,降低了对先验知识的依赖程度,缓解了学习初期回报值稀少的问题. 下载地址 用户评论 更多下载 下载地址 立即下载 用户评论 发表评论