基于Q-learning的高速铁路列车动态调度方法
韩忻辰1
俞胜平1
袁志明2
程丽娟1
1.东北大学流程工业综合自动化国家重点实验室,辽宁沈阳1108192.中国铁道科学研究院集团有限公司通信信号研究所,北京100081
摘要:高速铁路作为国家综合交通运输体系的骨干核心,近十年来取得了飞速蓬勃的发展.其飞速发展的同时也引发了路网复杂化、分布区域广等现象,这些现象对高铁动态调度提出了更高的要求.突发事件的不确定性会对列车造成时间延误影响,甚者时间延误会沿路网传播,造成大面积列车到发晚点.而目前对于此问题的人工调度方式,前瞻性及针对性较差,难以对受影响列车进行迅速调整.针对上述问题,本文建立了以各列车在各车站延误时间总和最小为目标函数的高速铁路列车动态调度模型,在此基础上设计了用于与智能体交互的仿真环境,采用了强化学习中的Q-learning算法对模型进行求解.最后通过仿真实例验证了仿真环境的合理性以及Q-learning算法用于高铁动态调度的有效性,为高铁调度员做出优化决策提供了良好的依据.
关键词:高速铁路列车动态调度强化学习Q-learning
资助基金:国家自然科学基金(U1834211)国家自然科学基金(61790574)国家自然科学基金(61603262)国家自然科学基金(61773269)辽宁省自然科学基金(2020–MS–093)
论文发表日期:2021-10-28
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:11( 1511-1521 )
英文信息展开
控制理论与应用

控制理论与应用

CSTPCD北大核心EICSCD
ISSN:1000-8152
年,卷(期):2021,38(10)
所属栏目:论文与报告