深度强化学习研究综述期刊界 All Journals 搜尽天下杂志传播学术成果专业期刊搜索期刊信息化学术搜索

深度强化学习研究综述

作者姓名：	杨思明单征丁煜李刚伟

作者单位：	数学工程与先进计算国家重点实验室,郑州 450001;中国人民解放军94162部队,西安 710600;中国人民解放军78100部队,成都 610031

基金项目：	国家自然科学基金（61971092,61701503）。

摘要：	深度强化学习是指利用深度神经网络的特征表示能力对强化学习的状态、动作、价值等函数进行拟合,以提升强化学习模型性能,广泛应用于电子游戏、机械控制、推荐系统、金融投资等领域。回顾深度强化学习方法的主要发展历程,根据当前研究目标对深度强化学习方法进行分类,分析与讨论高维状态动作空间任务上的算法收敛、复杂应用场景下的算法样本效率提高、奖励函数稀疏或无明确定义情况下的算法探索以及多任务场景下的算法泛化性能增强问题,总结与归纳4类深度强化学习方法的研究现状,同时针对深度强化学习技术的未来发展方向进行展望。
关键词：	深度学习强化学习深度强化学习逆向强化学习基于模型的元学习
收稿时间：	2021-03-12
修稿时间：	2021-05-15
本文献已被万方数据等数据库收录！
	点击此处可从《计算机工程》浏览原始摘要信息
	点击此处可从《计算机工程》下载全文