我们的服务符合学术规范和道德
专业 高端让您使用时没有后顾之忧

战术导弹技术2025年第03期:基于改进TD3算法的机动目标三维拦截制导方法

来源:期刊VIP网 时间:


作者:李晨晔;佟佳慧;姜吉祥;梁海朝;

单位:中山大学航空航天学院;复杂系统控制与智能协同技术重点实验室;

摘要:针对高速主动机动目标的拦截问题,研究了三维空间中拦截弹应对高速主动机动目标的制导拦截方法,提出一种基于改进双延迟深度确定性策略梯度(Twin Delayed Deep Deterministic Policy Gradient,TD3)算法的深度强化学习制导律。通过引入指数加权移动平均值,动态调整TD3算法中Actor网络的延迟更新步长,相比于固定步长的传统方法,可以有效减小误差累积。基于零控脱靶量构建递进式奖励函数,进一步促进了三维空间智能末制导算法的快速稳定收敛。通过数值仿真对所提出方法进行有效性分析和效能分析。仿真结果表明,所提方法不仅提升了模型的训练效率与泛化能力,相较于传统末制导方法有效提升了视线平稳性,拦截成功率提升了53%。

关键词:深度强化学习;;机动目标;;三维制导;;智能制导;;攻防对抗;;零控脱靶量;;马尔可夫过程

基金资助:国家自然科学基金(62103452,62388101)