基于相似度融合的中文文本相似性度量方法研究
温雨1
王琦2
严武军1
1.太原师范学院 山西晋中 0306002.运城学院 山西运城 044000
摘要:中文文本之间可能具有复杂的上下文关系,比较容易出现语义混淆、语序混乱等问题,而使用传统的度量文本相似性的方法很难捕捉到这些关系,所以对于中文文本的结构特点等造成度量中文文本相似性存在的不足,采用了一种基于相似度融合的方式计算两个文本的相似度.首先通过提取文本字面特征构建结构相似度模型;然后通过语义特征构建语义相似度模型,根据相应判断文本相似性的逻辑,采用层次分析法确定权重,从而提高中文文本的相似度.经过对比实验结果表明,所提出的模型在短文本方面的准确率达到了 81.9665%.
关键词:相似度融合文本相似性字面特征语义特征对比实验层次分析法
资助基金:山西省高等学校教学改革创新项目(JG20220980)
论文发表日期:2023-10-28
在线出版日期:2026-05-22(本平台首次上网日期,不代表文献的发表时间)
页数:4( 36-39 )
