基于遗传交叉算子的深度Q网络样本扩充

杨彤; 秦进; 谢仲涛; 袁琳琳

首页> 中文期刊> 《计算机系统应用》 >基于遗传交叉算子的深度Q网络样本扩充

基于遗传交叉算子的深度Q网络样本扩充

开具论文收录证明 >>

期刊封面封底目录下载 >>

文献代查 >>

页面导航

摘要
著录项
相似文献
相关主题

摘要

区别于传统深度强化学习中通过从经验回放单元逐个选择的状态转移样本进行训练的方式,针对采用整个序列轨迹作为训练样本的深度Q网络(Deep Q Network,DQN),提出基于遗传算法的交叉操作扩充序列样本的方法.序列轨迹是由智能体与环境交互的试错决策过程中产生,其中会存在相似的关键状态.以两条序列轨迹中的相似状态作为交叉点,能产生出当前未出现过的序列轨迹,从而达到扩充序列样本数量、增大序列样本的多样性的目的,进而增加智能体的探索能力,提高样本效率.与深度Q网络随机采样训练样本和采用序列样本向后更新的算法(Episodic Backward Update,EBU)进行对比,所提出的方法在Playing Atari 2600视频游戏中能取得更高的奖赏值.

著录项

来源
《计算机系统应用》 |2021年第12期|155-162|共8页
作者
杨彤; 秦进; 谢仲涛; 袁琳琳;
展开▼
作者单位

贵州大学计算机科学与技术学院贵阳 550025;

贵州大学计算机科学与技术学院贵阳 550025;

贵州大学计算机科学与技术学院贵阳 550025;

贵州开放大学信息工程学院贵阳 550025;

展开▼
原文格式 PDF
正文语种 chi
中图分类
关键词
深度强化学习; 经验回放; 样本效率; 遗传算法;

相似文献

中文文献
外文文献
专利

1. 基于多样本扩充的卷积神经网络人脸识别算法 [J] . 张汶汶 ,周先春 . 计算机与数字工程 . 2020,第004期
2. 基于样本倍增、深度神经网络与SVM的少样本图像识别技术 [J] . 秦俊举 ,曹选平 ,夏校朋 . 智能计算机与应用 . 2020,第009期
3. 基于样本倍增、深度神经网络与SVM的少样本图像识别技术 [J] . 秦俊举 ,曹选平 ,夏校朋 . 智能计算机与应用 . 2020,第009期
4. 基于样本划分与均匀遗传操作的遗传神经网络 [J] . 沈济南 ,郑明辉 . 武汉理工大学学报（信息与管理工程版） . 2011,第006期
5. 基于样本扩充的小样本车牌识别 [J] . 尤鸣宇 ,韩煊 . 南京师大学报（自然科学版） . 2019,第003期
6. 基于边缘重组交叉算子的改进遗传算法在TSP问题中的应用 [C] . 高威斯 . 第十六届全国青年通信学术会议 . 2011
7. 基于样本扩充与深度学习的高光谱图像分类方法研究 [A] . 邢珍杰 . 2020

基于遗传交叉算子的深度Q网络样本扩充

摘要

著录项

相似文献

相关主题

期刊订阅