基于双延迟深度确定性策略梯度的路由优化算法
郑艺
韩永国
成都东软学院计算机与软件学院 成都 611844
摘要:随着人工智能、网络通信、网络应用的飞速发展,传统的路由算法如RIP、OSPF在面对网络流量的指数级增长以及不同服务需求的情况下存在收敛慢、平均时延高等一系列问题.而近年来深度强化学习在复杂控制领域取得巨大发展.路由优化算法本质上讲就是一个控制优化问题.所以为了克服现有路由算法在某些场合下的弊端,将深度强化学习与计算机路由优化相结合.论文提出一种利用改进的DDPG算法,并命名为TD3OR算法去解决传统路由在某些场合下的弊端.实验表明,采用TD3OR算法的路由对比单纯DDPG算法以及传统OSPF算法的路由具有更低的延时,证明其是有效的.
关键词:深度强化学习DDPGTD3OR路由优化
分类号:TP393.01(计算技术、计算机技术)
论文发表日期:2025-08-20
在线出版日期:2025-12-12(本平台首次上网日期,不代表文献的发表时间)
页数:5( 2117-2121 )
英文信息
