一种基于闭项集的无冗余关联规则挖掘方法
宋威
高磊
李晋宏
1.北方工业大学,信息工程学院,北京,1001442.北方工业大学,信息工程学院,北京,1001443.北方工业大学,信息工程学院,北京,100144
摘要:针对关联规则挖掘中存在的规则数量过多,难于理解和应用的问题,提出了一种基于闭项集的无冗余关联规则挖掘算法.首先,给出了无冗余关联规则的定义,并基于规则信任度的概念说明了该定义的合理性;其次,在生成子、闭项集和无冗余关联规则的基础上,给出了无冗余最小-最大精确规则基和无冗余最小-最大近似规则基的定义,并讨论了它们的剪枝策略.最后,讨论了生成子的性质及连接策略,并在包含索引的基础上,给出了一种宽度优先的无冗余关联规则挖掘算法.实验结果表明,本文提出的算法不仅可以发现规模较小的无冗余关联规则,提高了挖掘结果的可理解性,而且具有较高的挖掘效率.
关键词:数据挖掘无冗余关联规则生成子闭项集包含索引
分类号:TP311(计算技术、计算机技术)
论文发表日期:2009-01-01
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:6( 91-96 )
英文信息展开
北京交通大学学报

北京交通大学学报

北大核心CSTPCD
ISSN:1673-0291
年,卷(期):2009,33(6)
所属栏目:机器学习与数据挖掘