国内刊号:44-1240/TP
国际刊号:1000-8152
发布日期:
作者:朱志斌,王付永,尹艳辉,刘忠信,陈增强
单位:南开大学人工智能学院,南开大学人工智能学院,南开大学人工智能学院,南开大学人工智能学院,南开大学人工智能学院
关键词:多智能体系统; 一致性; 离散时间; Q-learning
基金:天津市自然科学基金项目(20JCYBJC01060, 20JCQNJC01450), 国家自然科学基金项目(61973175), 南开大学中央高校基本科研业务费专项资金 项目(63201196)资助.
针对模型未知的一类离散时间多智能体系统, 本文提出了一种Q-learning方法实现多智能体系统的一致性控制. 该方法不依赖于系统模型, 能够利用系统数据迭代求解出可使给定目标函数最小的控制律, 使所有智能体的状态实现一致. 通过各个智能体所产生的系统数据, 采用策略迭代的方法实时更新求解得到多智能体系统的控制律, 并对所提Q-learning方法进行了收敛性和稳定性分析. 最后, 论文给出了计算机仿真验证了所提方法的有效性.
来源:2021年第7期
《控制理论与应用》期刊编辑部