基于大规模语料库的汉语词相似计算
买志玉1
金澎2
曾赛2
1.中原工学院,郑州,4500072.乐山师范学院,四川,乐山,614004
摘要:针对词语相似度这一问题,在大规模语料库上,通过分布相似对汉语词相似进行了研究. 实现了一个词相似计算平台,可灵活组合各种计算词相似算法,新增加语料库可以被增量式用于计算;对比研究了基于距离的度量和基于概率的度量2类算法的性能,通过和人工创建的黄金标准进行比较,基于概率的度量算法要优于基于距离的度量算法.
关键词:自然语言处理词相似分布相似度
分类号:TP301.6(计算技术、计算机技术)
论文发表日期:2010-01-01
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:6( 45-50 )
英文信息展开
中原工学院学报

中原工学院学报

ISSN:1671-6906
年,卷(期):2010,21(3)