浏览全部资源
扫码关注微信
1. 国防科技大学电子对抗学院
2. 安徽省电子制约技术重点实验室
纸质出版:2018
移动端阅览
颛孙少帅, 杨俊安, 刘辉, 等. 采用双层强化学习的干扰决策算法[J]. 西安交通大学学报, 2018,(2):63-69.
颛孙少帅, 杨俊安, 刘辉, 等. 采用双层强化学习的干扰决策算法[J]. 西安交通大学学报, 2018,(2):63-69. DOI:
DOI:
为解决强化学习算法在干扰决策过程中收敛速度慢的问题
提出了一种采用双层强化学习的干扰决策算法(DRLJD)。首先对等效通信参数进行建模
模型减少了待学习参数的个数
降低了搜索空间的维度;然后利用降维后的搜索空间指导干扰参数选择
避免随机选择导致干扰性能差的缺点;最后利用选择的干扰参数施加干扰
并根据环境反馈进一步降低搜索空间的维度
通过不断交互的方式加快算法的收敛速度。此外
将以往的干扰经验以先验信息的形式加入到系统的学习进程中
进一步缩短了系统的学习时间。针对构造的干扰问题实验表明
DRLJD算法经过200次交互便学习到优异的干扰策略
小于现有算法所需600次交互
且先验信息的利用进一步降低了对交互次数的要求。以提出的新的奖赏标准作为奖赏依据
算法能够在未知通信协议情况下以牺牲交互时间为代价学习到最佳干扰策略。
{"db_type":"CJFDREF","db_name":"期刊","reference_articles":[{"patent_date":"2017-06-15","unit":"通信对抗","flag":"[J]","issue":"02","year":2017,"author":"黄科举;杨俊安;周继航;刘辉","index":1,"title":"基于多臂赌博机模型的IEEE 802.11 MAC协议认知干扰技术"},{"unit":"装备学院学报","flag":"[J]","issue":"04","year":2015,"author":"贾鑫;朱卫纲;曲卫;陈维高","index":2,"title":"认知电子战概念及关键技术"},{"unit":"中国电子科学研究院学报","flag":"[J]","issue":"06","year":2014,"author":"张春磊;杨小牛","index":3,"title":"认知电子战与认知电子战系统研究"}],"articles_count":3}
0
浏览量
3
下载量
6
CSCD
关联资源
相关文章
相关作者
相关机构