智能车辆深度强化学习的模型迁移轨迹规划方法
余伶俐1
邵玄雅1
龙子威1
魏亚东1
周开军2
1.中南大学自动化学院,湖南长沙,4100832.湖南商学院计算机与信息工程学院,湖南长沙,410205
摘要:针对智能驾驶车辆传统路径规划中出现车辆模型跟踪误差和过度依赖问题,提出一种基于深度强化学习的模型迁移的智能驾驶车辆轨迹规划方法.首先,提取真实环境的抽象模型,该模型利用深度确定性策略梯度(DDPG)和车辆动力学模型,共同训练逼近最优智能驾驶的强化学习模型;其次,通过模型迁移策略将实际场景问题迁移至虚拟抽象模型中,根据该环境中训练好的深度强化学习模型计算控制与轨迹序列;而后,根据真实环境中评价函数选择最优轨迹序列.实验结果表明,所提方法能够处理连续输入状态,并生成连续控制的转角控制序列,减少横向跟踪误差;同时通过模型迁移能够提高模型的泛化性能,减小过度依赖问题.
关键词:路径规划智能车辆强化学习深度学习车辆模型
资助基金:国家重点研发计划(2018YFB1201602)湖南省科技重大专项(2017GK1010)湖南省自然科学基金(2018JJ2531)湖南省自然科学基金(2018JJ2197)国家自然科学基金(61403426)国家重点实验室开放基金(SKLRS-2017-KF-13)国家重点实验室开放基金(SKLMT-KFKT-201602)
论文发表日期:2019-01-01
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:14( 1409-1422 )
英文信息展开
控制理论与应用

控制理论与应用

CSTPCD北大核心EICSCD
ISSN:1000-8152
年,卷(期):2019,36(9)
所属栏目:论文与报告