来源:期刊VIP网 时间:
作者:付泽建;魏洁英;罗浩;魏国强;王杰;张华;
单位:北方自动控制技术研究所;
摘要:基于强化学习的多智能体算法在作战仿真领域具有重要意义,针对传统算法在模拟蜂甲一体作战等高扩展性、高灵活性的复杂场景中的问题,引入集中计算的评论家注意力共享机制和多智能体优势函数,提出了一种基于改进型SAC的蜂甲一体协同作战仿真算法。结合作战场景与改进后的算法,设计两种蜂甲一体仿真作战环境进行对比研究。结果表明,相较于MADDPG算法和SAC算法,改进型SAC算法进一步提高了算法的回报率和收敛速度。
关键词:蜂甲一体;;作战仿真;;强化学习;;注意力机制;;优势函数;;软演员-评论家算法