基于属性关联相似度的中文简称匹配算法研究
郭晖1
董源2
周钢1
1.海军工程大学电子工程学院计算机工程系 武汉 4300332.海军水文气象中心 北京 100000
摘要:字符匹配是数据清洗中提高数据质量的重要途径.针对中文名词简称的匹配问题,在分析现有中文匹配算法的基础上,提出一种基于数据库中各属性关联度的匹配算法,通过对匹配名词所处属性的关联属性的数据对比相似度,按照中文简称和全称数据量设置置信度,从而得到简称匹配度.实例实验表明,该算法具有较好的适用性和准确性.
关键词:数据清洗数据挖掘关联度中文简称匹配
分类号:TP393(计算技术、计算机技术)
论文发表日期:2018-01-01
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:5( 1726-1730 )
英文信息展开
计算机与数字工程

计算机与数字工程

CSTPCD
ISSN:1672-9722
年,卷(期):2018,46(9)
所属栏目:算法与分析