1. 首页
  2. 数据库
  3. 其它
  4. 基于状态聚类的非参数化近似广义策略迭代增强学习算法

基于状态聚类的非参数化近似广义策略迭代增强学习算法

上传者: 2021-01-16 18:58:04上传 PDF文件 682.31KB 热度 4次
为解决当前近似策略迭代增强学习算法普遍存在计算量大、基函数不能完全自动构建的问题,提出一种基于状态聚类的非参数化近似广义策略迭代增强学习算法(NPAGPI-SC).该算法利用二级随机采样过程采集样本,利用trial-and-error过程和以样本完全覆盖为目标的估计方法计算逼近器初始参数,利用delta规则和最近邻思想在学习过程中自适应地调整逼近器,利用贪心策略选择应执行的动作.一级倒立摆平衡控制的仿真实验结果验证了所提出算法的有效性和鲁棒性.
下载地址
用户评论