基于Q-network强化学习的超视距空战机动决策
张强
杨任农
俞利新
张涛
左家亮
1.空军工程大学空管领航学院,西安,7100512.空军工程大学空管领航学院,西安,7100513.空军工程大学空管领航学院,西安,7100514.空军工程大学空管领航学院,西安,7100515.空军工程大学空管领航学院,西安,710051
摘要:考虑到空空导弹对空战胜负的重要影响,针对空战态势状态特征连续、多维的情况以及传统方法缺乏对空战对抗中敌方策略的考虑,将强化学习应用到1vs1超视距空战机动决策.首先,建立了同时为对抗双方进行机动决策的强化学习框架,提出ε-纳什均衡策略来选取机动动作,并通过导弹攻击区优势函数来修正奖赏函数;其次,基于记忆库和目标网络训练Q-network,形成超视距空战机动决策的“价值网络”;最后,设计了Q-network强化学习决策模型,并将机动决策过程分为了学习阶段与实战阶段.仿真结果表明:智能体可以感知空战的态势并作出合理的超视距空战机动决策.
关键词:超视距空战机动决策强化学习纳什均衡
分类号:V325(航空飞行术)
论文发表日期:2018-01-01
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:7( 8-14 )
英文信息展开
空军工程大学学报(自然科学版)

空军工程大学学报(自然科学版)

北大核心CSTPCD
ISSN:1009-3516
年,卷(期):2018,19(6)
所属栏目:航空·航天