系统工程与电子技术

北大核心,INSPEC,JST,EI,CSCD

国内刊号:11-2422/TN

国际刊号:1001-506X

系统工程与电子技术杂志2024年第7期:融合三支多属性决策与SAC的兵棋推演智能决策技术

发布日期:

作者:彭莉莎, 孙宇祥, 薛宇凡, 周献中

单位:1. 南京大学工程管理学院, 江苏 南京 210008;2. 浙江财经大学信息技术与人工智能学院, 浙江 杭州 310018;3. 南京大学智能装备新技术研究中心, 江苏 南京 210008

关键词:兵棋推演,三支多属性决策,软表演者-批评家,强化学习,智能决策

基金:国家自然科学青年基金(62306135);教育部青年基金(23YJC630156);江苏省青年基金(BK20230783);南京大学技术创新基金(SC-2023-039)

近年来, 将深度强化学习技术用于兵棋推演的智能对抗策略生成受到广泛关注。针对强化学习决策模型采样率低、训练收敛慢以及智能体博弈胜率低的问题, 提出一种融合三支多属性决策(three-way multiple attribute decision making, TWMADM)与强化学习的智能决策技术。基于经典软表演者-批评家(soft actor-critic, SAC)算法开发兵棋智能体, 利用TWMADM方法评估对方算子的威胁情况, 并将该威胁评估结果以先验知识的形式引入到SAC算法中规划战术决策。在典型兵棋推演系统中开展博弈对抗实验, 结果显示所提算法可有效加快训练收敛速度, 提升智能体的对抗策略生成效率和博弈胜率。

来源:2024年第7期

《系统工程与电子技术》期刊编辑部

查看系统工程与电子技术杂志2024年第7期

联系我们

  • 地址:北京市142信箱32分箱
  • 电话:(010)68388406/68386014
  • E-mail:E-mail:xtgcydzjs@126.com

咨询工作人员