基于Q-learning的离散时间多智能体系统一致性
朱志斌1
王付永2
尹艳辉
刘忠信
陈增强
1.南开大学人工智能学院,天津3003502.天津市智能机器人技术重点实验室, 天津300350
摘要:针对模型未知的一类离散时间多智能体系统,本文提出了一种Q-learning方法实现多智能体系统的一致性控制.该方法不依赖于系统模型,能够利用系统数据迭代求解出可使给定目标函数最小的控制律,使所有智能体的状态实现一致.通过各个智能体所产生的系统数据,采用策略迭代的方法实时更新求解得到多智能体系统的控制律,并对所提Q-learning方法进行了收敛性和稳定性分析.最后,论文给出了计算机仿真验证了所提方法的有效性.
关键词:多智能体系统一致性离散时间Q-learning
资助基金:天津市自然科学基金(20JCYBJC01060)天津市自然科学基金(20JCQNJC01450)国家自然科学基金(61973175)中央高校基本科研业务费专项南开大学项目(63201196)
论文发表日期:2021-07-28
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:9( 997-1005 )
英文信息展开
控制理论与应用

控制理论与应用

EICSTPCD北大核心
ISSN:1000-8152
年,卷(期):2021,38(7)
所属栏目:“集群智能与协同控制”专刊