基于策略迭代算法的连续时间线性Markov跳变系统
非零和微分反馈Nash控制
朱国政1
张茂光2
何舒平
1.安徽大学 电气工程与自动化学院, 安徽 合肥 2306012.安徽大学 计算智能与信号处理教育部重点实验室, 安徽 合肥 230601
摘要:针对一类连续时间线性Markov跳变系统,本文提出了一种新的策略迭代算法用于求解系统的非零和微分反馈Nash控制问题.通过求解耦合的数值迭代解,以获得具有线性动力学特性和无限时域二次成本的双层非零和微分策略的Nash均衡解.在每一个策略层,采用策略迭代算法来计算与每一组给定的反馈控制策略相关联的最小无限时域值函数.然后,通过子系统分解将Markov跳变系统分解为N个并行的子系统,并将该算法应用于跳变系统.本文提出的策略迭代算法可以很容易求解非零和微分策略所对应的耦合代数Riccati方程,且对高维系统有效.最后通过仿真示例证明了本文设计方法的有效性和可行性.
关键词:策略迭代Markov跳变线性系统非零和微分反馈Nash策略
资助基金:国家自然科学基金(61673001)安徽省杰出青年科学基金(1608085J05)安徽省高等学校优秀青年项目(gxydZD2017001)
论文发表日期:2020-08-28
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:8( 1749-1756 )
英文信息
