期刊界 All Journals 搜尽天下杂志传播学术成果专业期刊搜索期刊信息化学术搜索

全文获取类型

收费全文	1篇
免费	0篇

专业分类

自动化技术

1篇

出版年

2011年

1篇

排序方式： 共有1条查询结果，搜索用时 15 毫秒

一种基于启发式奖赏函数的分层强化学习方法 总被引：4，自引：0，他引：4

刘全闫其粹伏玉琛胡道京龚声蓉《计算机研究与发展》2011,48(12)

针对强化学习在应用中经常出现的维数灾问题,即状态空间的大小随着特征数量的增加而发生指数级的增长,以及收敛速度过慢的问题,提出了一种基于启发式奖赏函数的分层强化学习方法.该方法不仅能够大幅度减少环境状态空间,还能加快学习的收敛速度.将此算法应用到俄罗斯方块的仿真平台中,通过对实验中的参数进行设置及对算法性能进行分析,结果表明:采用启发式奖赏函数的分层强化学习方法能在一定程度上解决维数灾问题,并具有很好的收敛速度. 相似文献