期刊专题

10.3778/j.issn.1002-8331.2008.34.013

基于最小二乘的Q(λ)强化学习算法

引用
通过分析经典的Q(λ)学习算法所存在的经验利用率低、收敛速度慢的问题,根据当前和多步的经验知识样本建立了状态-动作对值函数的最小二乘逼近模型,推导了该逼近函数在一组基底上的权向量所满足的一组线性方程,从而提出了快速而实用的最小二乘Q(λ)算法及改进的递推算法.倒立摆实验表明,该算法可以提高经验利用率,有效加快收敛速度.

强化学习、Q(λ)学习、函数逼近、最小二乘、倒立摆

44

TP181(自动化基础理论)

江苏省高校自然科学基础研究项目the Natural Science Fundamental Research Program of Higher Education of Jiangsu Province,China under Grant 07KJD520092

2009-02-16(万方平台首次上网日期,不代表论文的发表时间)

共4页

47-50

暂无封面信息
查看本期封面目录

计算机工程与应用

1002-8331

11-2127/TP

44

2008,44(34)

专业内容知识聚合服务平台

国家重点研发计划“现代服务业共性关键技术研发及应用示范”重点专项“4.8专业内容知识聚合服务技术研发与创新服务示范”

国家重点研发计划资助 课题编号:2019YFB1406304
National Key R&D Program of China Grant No. 2019YFB1406304

©天津万方数据有限公司 津ICP备20003920号-1

信息网络传播视听节目许可证 许可证号:0108284

网络出版服务许可证:(总)网出证(京)字096号

违法和不良信息举报电话:4000115888    举报邮箱:problem@wanfangdata.com.cn

举报专区:https://www.12377.cn/

客服邮箱:op@wanfangdata.com.cn