基于深度强化学习的交通信号控制
乔志敏1
柯良军2
1.太原工业学院自动化系,山西太原 0300082.西安交通大学自动化科学与工程学院,机械制造系统工程国家重点实验室,陕西西安 710049
摘要:当前广泛应用的基于车流动力学建模的交通信号优化模型精确度较高,但迁移能力稍弱,针对该问题,本文提出了一种基于深度强化学习的单智能体交通信号控制方法.该方法首次在考虑交叉口有行人穿越干扰的情况下定义了动作空间,从3个不同的角度定义了 3种奖励函数,并提出了一种累积延迟近似方法.在算法方面,提出了一种基于动态权重的Soft Actor-Critic算法,该算法可以动态调整Actor网络和Critic网络的更新幅度,显著地提高了传统Soft Actor-Critic算法的收敛效率和收敛性能.仿真结果表明,本文提出的模型和算法在降低车辆延迟时间、减少车辆停车次数以及减少车辆队列长度等交通性能指标方面是有效的.
关键词:交通信号强化学习动态权重延迟时间
论文发表日期:2025-01-27
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:11( 76-86 )
英文信息展开
控制理论与应用

控制理论与应用

CSTPCD北大核心EICSCD
ISSN:1000-8152
年,卷(期):2025,42(1)
所属栏目:论文与报告