基于DTW和改进匈牙利算法的句子语义相似度研究
钮焱
李星
李军
刘宇强
Jepkemei Judith
1.湖北工业大学 武汉 4300682.湖北工业大学 武汉 4300683.湖北工业大学 武汉 4300684.湖北工业大学 武汉 4300685.湖北工业大学 武汉 430068
摘要:句子语义相似度的研究在自然语言处理等领域发挥着重要的作用.针对现有汉语句子相似度研究中存在的语义特征难以分析以及语序影响的问题,提出了一种基于DTW和匈牙利算法相结合的语义句子相似度处理模型.模型首先使用Word2vec深度学习模型训练百度新闻语料,得到200维的包含语义特征的词向量词典,并建立词向量空间,根据词向量组成的多维空间曲线,通过计算句子曲线之间相互转换的距离和复杂度来表示句子语义相似度,模型采用了DTW矩阵和改进的匈牙利算法,并对DTW矩阵做最短路径规划.实验结果表明,与现有的夹角余弦相似度等句子相似度计算方法相比,该方法在语序较乱但语义相近的情况下也能得到较为准确的相似度结果值.
关键词:词向量DTW匈牙利算法语义相似度语义特征
分类号:TP301.6(计算技术、计算机技术)
论文发表日期:2021-02-20
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:6( 242-247 )
英文信息
