基于强化学习的装箱问题研究
纪乃华
李祥栋
祝凯
青岛理工大学信息与控制工程学院 青岛 266520
摘要:论文提出了一种基于改进规则和强化学习的混合启发式算法来求解二维带装箱问题(2D Strip Packing Prob?lem,2DSPP).首先,对基于skyline算法的评分规则进行了改进.其次使用Deep Q-Network(DQN)来获得初始的矩形物品序列,它可以提高空间利用率,防止算法陷入局部最优.将改进的评分规则与DQN相结合,提出了基于简单随机算法(SRA)的启发式算法,称为基于强化学习的简单随机算法(RSRA).用五种算法对8个数据集进行了实验比较.结果表明,RSRA在8个数据集(C,N,CX,NT,2sp,NP,ZDF,BWMV)上的性能最好,Ave.Gap%分别比GRASP、SRA、IA、ISH算法分别提高45.86%、45.16%、30.89%和20.56%.
关键词:二维带装箱问题DQN强化学习启发式算法改进的规则
分类号:TP242.2(自动化技术及设备)
论文发表日期:2022-12-20
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:6( 2633-2638 )
英文信息
