声明
严正声明:本站非期刊官网,非中介代理。
本站仅提供学术规范服务:快速预审、润色编辑服务、中英文查重、降重、去重服务、推荐合适的期刊投稿等学术规范服务。 如需提供学术规范服务请联系在线编辑。
国内刊号:11-2422/TN
国际刊号:1001-506X
发布日期:
作者:任智, 张栋, 唐硕
单位:1. 西北工业大学航天学院, 陕西 西安 710072;2. 陕西省空天飞行器设计重点实验室, 陕西 西安 710072
关键词:改进A*算法,收缩因子,强化学习,深度确定性策略梯度,在线航迹规划
基金:国家自然科学基金重点项目(61933010);国家自然科学基金(61903301)
针对飞行器在线航迹规划对算法实时性与结果最优性要求高的问题,基于强化学习方法改进三维A*算法。首先,引入收缩因子改进代价函数的启发信息加权方法提升算法时间性能;其次,建立算法实时性与结果最优性的性能变化度量模型,结合深度确定性策略梯度方法设计动作-状态与奖励函数,对收缩因子进行优化训练;最后,在多场景下对改进后的三维A*算法进行仿真验证。仿真结果表明,改进算法能够在保证航迹结果最优性的同时有效提升算法时间性能。
来源:2023年第1期
《系统工程与电子技术》期刊编辑部
严正声明:本站非期刊官网,非中介代理。
本站仅提供学术规范服务:快速预审、润色编辑服务、中英文查重、降重、去重服务、推荐合适的期刊投稿等学术规范服务。 如需提供学术规范服务请联系在线编辑。