期刊专题

10.3778/j.issn.1002-8331.1709-0489

基于CMAC的非参数化近似策略迭代增强学习

引用
为解决在线近似策略迭代增强学习计算复杂度高、收敛速度慢的问题,引入CMAC结构作为值函数逼近器,提出一种基于CMAC的非参数化近似策略迭代增强学习(NPAPI-CMAC)算法.算法通过构建样本采集过程确定CMAC泛化参数,利用初始划分和拓展划分确定CMAC状态划分方式,利用量化编码结构构建样本数集合定义增强学习率,实现了增强学习结构和参数的完全自动构建.此外,该算法利用delta规则和最近邻思想在学习过程中自适应调整增强学习参数,利用贪心策略对动作投票器得到的结果进行选择.一级倒立摆平衡控制的仿真实验结果验证了算法的有效性、鲁棒性和快速收敛能力.

增强学习、小脑关节模型控制器、非参数化、倒立摆

55

TP181(自动化基础理论)

国家高技术研究发展计划863SS2013AA041003

2019-10-22(万方平台首次上网日期,不代表论文的发表时间)

共9页

128-136

暂无封面信息
查看本期封面目录

计算机工程与应用

1002-8331

11-2127/TP

55

2019,55(2)

专业内容知识聚合服务平台

国家重点研发计划“现代服务业共性关键技术研发及应用示范”重点专项“4.8专业内容知识聚合服务技术研发与创新服务示范”

国家重点研发计划资助 课题编号:2019YFB1406304
National Key R&D Program of China Grant No. 2019YFB1406304

©天津万方数据有限公司 津ICP备20003920号-1

信息网络传播视听节目许可证 许可证号:0108284

网络出版服务许可证:(总)网出证(京)字096号

违法和不良信息举报电话:4000115888    举报邮箱:problem@wanfangdata.com.cn

举报专区:https://www.12377.cn/

客服邮箱:op@wanfangdata.com.cn