基于强化学习的异构多智能体系统最优输出调节
熊春萍
马倩
南京理工大学自动化学院,江苏南京 210094
摘要:本文研究了异构多智能体系统的最优输出调节问题.通信网络拓扑含有向生成树.首先,设计了外部系统状态补偿器和状态反馈控制器,应用图论和Lyapunov稳定性理论证明了所设计的补偿器和控制器可以解决一般输出调节问题.然后,通过最小化预定义的成本方程,解决最优输出调节问题.结合最优控制理论和强化学习技术,提出了两种求解最优控制器的算法,即基于模型的策略迭代算法和无模型off-policy算法.利用无模型算法获取最优控制器的过程既不需要求解输出调节方程也不需要使用系统动态信息.最后,通过数值仿真验证了本文所提出的算法的有效性.
关键词:异构多智能体系统最优输出调节策略迭代无模型算法强化学习
论文发表日期:2025-03-31
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:8( 491-498 )
英文信息展开
控制理论与应用

控制理论与应用

CSTPCD北大核心EICSCD
ISSN:1000-8152
年,卷(期):2025,42(3)
所属栏目:论文与报告