异构群智感知PPO多目标任务指派方法
杨潇1
郭一楠2
吉建娇3
刘旭1
1.中国矿业大学信息与控制工程学院,江苏徐州 2211162.中国矿业大学信息与控制工程学院,江苏徐州 221116;中国矿业大学(北京)机械与电气工程学院,北京 1000833.中国矿业大学人工智能研究院,江苏 徐州 221008
摘要:现有移动群智感知系统的任务指派主要面向单一类型移动用户展开,对于存在多种类型移动用户的异构群智感知任务指派研究相对缺乏.为此,本文针对异质移动用户,定义其区域可达性,并给出感知子区域类型划分.进而,兼顾感知任务数量和移动用户规模的时变性,构建了动态异构群智感知系统任务指派的多目标约束优化模型.模型以最大化感知质量和最小化感知成本为目标,综合考虑用户的最大任务执行数量、无人机的受限工作时间等约束.为解决该优化问题,本文提出一种基于近端策略优化的多目标进化优化算法.采用近端策略优化,根据种群的当前进化状态,选取具有最高奖励值的进化算子,生成子代种群.面向不同异构群智感知实例,与多种算法的对比实验结果表明,所提算法获得的Pareto最优解集具有最佳的收敛性和分布性,进化算子选择策略可以有效提升对时变因素的适应能力,改善算法性能.
关键词:异构群智感知多目标优化强化学习近端策略优化
论文发表日期:2024-06-28
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:11( 1056-1066 )
英文信息
