我们的服务符合学术规范和道德
专业 高端让您使用时没有后顾之忧

战术导弹技术2024年第02期:基于强化学习的无人机安全避障与围捕制导

来源:期刊VIP网 时间:


作者:梅泽伟;邵星灵;刘俊;

单位:中北大学;

摘要:针对无人机在受约束环境下面临绕飞障碍物与跟踪目标相互掣肘的问题,提出了一种基于强化学习的无人机安全避障与围捕制导方法。根据极坐标原理设计环绕跟踪控制器,驱使无人机在GPS拒止的情况下到达预设的圆形轨道。将环绕约束和障碍物约束转化为马尔可夫过程,以速度、径向误差、角速度误差和碰撞函数为状态空间,以控制器的补偿量为动作空间,设计考虑跟踪误差和碰撞概率的奖励函数,利用深度确定性策略梯度(Deep Deterministic Policy Gradient,DDPG)算法对智能体进行训练,增强跟踪效果并获得避碰能力,实现无人机对静止/运动目标的环绕跟踪;此外,在训练过程中引入课程学习,将过去的学习策略转移到当前事件,与经典的随机参数设置相比,具有更快的收敛速度。最后仿真表明,所提算法可以引导无人机圆形环绕控制的同时高效规避障碍物。

关键词:强化学习;;避障;;无人机;;目标跟踪;;环绕;;GPS拒止

基金资助:国家自然科学基金项目(61803348)