来源:期刊VIP网 时间:
作者:及鹏飞;王帅;晁涛;
单位:四川腾盾科技有限公司;哈尔滨工业大学控制与仿真中心,复杂系统建模与仿真全国重点实验室;
摘要:针对高超声速飞行器再入飞行过程的姿态控制问题,考虑到飞行过程气动环境的复杂性与强耦合性,提出一种基于双延迟深度确定性策略梯度(TD3)参数整定的非线性自抗扰控制(ADRC)算法。引用反馈线性化方法对高超声速飞行器的非线性控制模型进行解耦,进而得到飞行器的三通道线性控制模型并设计非线性自抗扰控制器。针对非线性自抗扰控制器复杂的参数整定问题,配置了强化学习过程的训练参数以及设计要素,利用双延迟深度确定性策略梯度算法进行控制器的参数优化。对高超声速飞行器的再入过程进行数学仿真,仿真结果表明,基于强化学习进行参数整定的非线性自抗扰控制算法具有良好的指令跟踪效果,验证了所提算法的有效性。
关键词:高超声速飞行器;;再入飞行;;强化学习;;双延迟深度确定性策略梯度算法;;非线性自抗扰;;参数整定;;姿态控制
基金资助:国家自然科学基金(62273119)