以类重叠度为优化目标的不平衡数据学习方法
孙博1
周倩1
陈海燕2
1.山东农业大学计算机科学与技术系,山东泰安 2710182.南京航空航天大学人工智能学院,江苏南京 211106
摘要:分类是机器学习中的一项重要学习任务,基本思想是使用在训练样例集上生成的分类器对测试样例的类别进行预测.然而,很多实际应用中的训练集具有不平衡的类分布,这通常会制约学习算法的分类性能.为此,本文提出以类重叠度为优化目标的不平衡数据学习方法(COA-RBU).将相对类间势作为多数类样例效用的评价标准,并根据训练集的类重叠度自适应地确定合适欠采样比例,以降低不平衡训练集的数据复杂性.实验结果表明,类重叠度能较好地反映数据集的学习难度,并且COA-RBU具有良好的性能和较高的效率.因此,本文工作从类重叠数据复杂性角度为合适欠采样比例的确定提供了一种新的思路.
关键词:分类类不平衡欠采样类重叠度数据复杂性机器学习
论文发表日期:2024-11-28
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:8( 2139-2146 )
英文信息展开
控制理论与应用

控制理论与应用

CSTPCD北大核心EICSCD
ISSN:1000-8152
年,卷(期):2024,41(11)
所属栏目:论文与报告