控制理论与应用

北大核心,CA,INSPEC,JST,Pж(AJ)

国内刊号:44-1240/TP

国际刊号:1000-8152

控制理论与应用杂志2020年第7期:基于增量式策略强化学习算法的飞行控制系统的容错跟踪控制

发布日期:

作者:任坚,刘剑慰,杨蒲

单位:南京航空航天大学,南京航空航天大学,南京航空航天大学

关键词:飞行控制系统; 故障诊断; 故障容错; 强化学习; Q-learning算法; 增量式策略; 状态转移预测网络

基金:民航飞机健康监测与智能维护重点实验室基金项目(NJ2018012), 先进飞行器导航、控制与健康管理工业和信息化部重点实验室(南京航空航天大 学)项目, 中央高校基本科研业务费项目(NS2017017), 国家自然科学基金项目(61533008, 61490703)资助.

针对发生故障的飞行控制系统, 在强化学习算法的基础上, 提出了一种基于增量式策略的强化学习容错方法. 本方法利用传感器获取的系统状态值, 根据系统预先设定的奖励函数对当前控制系统状况做出最优的决策并不断更新价值网络, 将系统的容错控制过程转换为强化学习Agent的贯序决策过程, 并使用一种改进型的增量式策略实现对当前故障的正确补偿策略的逐渐逼近. 同时, 针对连续控制系统, 提出一种状态转移预测网络来得到下一步状态值. 最后, 通过南京航空航天大学“先进飞行器导航、控制与健康管理”工信部重点实验室的飞行器故障诊断实验平台验证了该方法的有效性.

来源:2020年第7期

《控制理论与应用》期刊编辑部

查看控制理论与应用杂志2020年第7期

联系我们

  • 地址:广州市天河区五山路381号 华南理工大学3号楼516室
  • 电话:020-87111464
  • E-mail:aukzllyy@scut.edu.cn

咨询工作人员