国内刊号:11-2422/TN
国际刊号:1001-506X
发布日期:
作者:杨清清, 高盈盈, 郭玙, 夏博远, 杨克巍
单位:国防科技大学系统工程学院, 湖南 长沙 410073
关键词:海战场,目标搜寻,路径规划,动态规划,深度强化学习
基金:国家自然科学基金(72071206);国家自然科学基金(71690233);湖南省科技创新计划(2020RC4046);中国博士后基金(2019M653923)
海战场是未来大国冲突的主阵地之一, 强大的海战场目标搜寻能力是执行海上训练和作战的最后一道屏障, 同时也因其复杂多变的环境和重要战略地位成为战场联合搜救中最艰难最核心的部分。面向海战场目标搜寻的存活时间短、实时性要求高等特点, 提出一种基于深度强化学习的海战场目标搜寻规划方法。首先, 构建了海战场目标搜寻场景数学规划模型, 并将其映射为一种强化学习模型; 然后, 基于Rainbow深度强化学习算法, 设计了海战场目标搜寻规划的状态向量、神经网络结构以及算法框架与流程。最后, 用一个案例, 验证了所提方法的可行性与有效性, 与常规应用的平行搜寻模式相比大大提高了搜寻成功率。
来源:2022年第11期
《系统工程与电子技术》期刊编辑部