国内刊号:11-2422/TN
国际刊号:1001-506X
发布日期:
作者:夏雨奇, 黄炎焱, 陈恰
单位:南京理工大学自动化学院, 江苏 南京 210094
关键词:深度强化学习,无人侦察车,路径规划,深度Q网络
基金:国家自然科学基金(61374186)
在城市战场环境下, 无人侦察车有助于指挥部更好地了解目标地区情况, 提升决策准确性, 降低军事行动的威胁。目前, 无人侦察车多采用阿克曼转向结构, 传统算法规划的路径不符合无人侦察车的运动学模型。对此, 将自行车运动模型和深度Q网络相结合, 通过端到端的方式生成无人侦察车的运动轨迹。针对深度Q网络学习速度慢、泛化能力差的问题, 根据神经网络的训练特点提出基于经验分类的深度Q网络, 并提出具有一定泛化能力的状态空间。仿真实验结果表明, 相较于传统路径规划算法, 所提算法规划出的路径更符合无人侦察车的运动轨迹并提升无人侦察车的学习效率和泛化能力。
来源:2024年第9期
《系统工程与电子技术》期刊编辑部