国内刊号:11-2422/TN
国际刊号:1001-506X
发布日期:
作者:任智, 张栋, 唐硕
单位:1. 西北工业大学航天学院, 陕西 西安 710072;2. 陕西省空天飞行器设计重点实验室, 陕西 西安 710072
关键词:改进A*算法,收缩因子,强化学习,深度确定性策略梯度,在线航迹规划
基金:国家自然科学基金重点项目(61933010);国家自然科学基金(61903301)
针对飞行器在线航迹规划对算法实时性与结果最优性要求高的问题,基于强化学习方法改进三维A*算法。首先,引入收缩因子改进代价函数的启发信息加权方法提升算法时间性能;其次,建立算法实时性与结果最优性的性能变化度量模型,结合深度确定性策略梯度方法设计动作-状态与奖励函数,对收缩因子进行优化训练;最后,在多场景下对改进后的三维A*算法进行仿真验证。仿真结果表明,改进算法能够在保证航迹结果最优性的同时有效提升算法时间性能。
来源:2023年第1期
《系统工程与电子技术》期刊编辑部