K-最邻近算法在文本自动分类中的应用
刘卓
苏州科技学院,电子与信息工程学院,江苏,苏州,215011
摘要:对文本的自动分类进行了研究,介绍文本分类的基本过程和文本特征选取的方法,重点介绍了一种常用的基于内容的分类算法--K-最邻近算法.利用K-最邻近算法(KNN)并结合改进的词特征权值计算方法和文本相似度的计算方法完成了文本的自动分类.通过KNN方法分类之后的结果的查准率、查全率得以明显提高.
关键词:数据挖掘文本自动分类K-最邻近算法
分类号:TP18(自动化基础理论)
论文发表日期:2010-01-01
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:3( 58-60 )
英文信息展开
苏州市职业大学学报

苏州市职业大学学报

ISSN:1008-5475
年,卷(期):2010,21(2)