一种基于强化学习的自适应变步长路径规划算法
王维1
禹建丽2
1.河南科技大学,电子信息工程学院,河南,洛阳,4710032.河南科技大学,数理系,河南,洛阳,471003
摘要:在基于神经网络结构的机器人全局路径规划算法中,利用强化学习的思想,引进评价预测学习的自适应变步长算法,实现了步长的在线自动调节,加快了路径规划的计算速度.仿真试验表明,该算法能有效实现步长参数的在线自动调节,并使路径规划收敛速度平均提高了10倍以上.
关键词:强化试验全局域路自适应控制机器人
分类号:TP18(自动化基础理论)TP242.6(自动化技术及设备)
资助基金:河南省教育厅自然科学研究项目(20011200001)
论文发表日期:2004-01-01
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:3( 50-52 )
英文信息
