文档级分类记忆的中文命名实体识别
王宝祥1
陈渝2
孙界平1
琚生根1
1.四川大学计算机学院 成都 6100652.四川民族学院理工学院 康定 626001
摘要:命名实体识别是将自然语句中的姓名,地点,组织等实体抽取出来,是自然语言处理的一个上游任务.基于文档级记忆的命名实体识别是将所有识别过的语句信息融入当前待识别的语句中,从而加强当前句子的语义表达,以获得更好的识别效果.鉴于当前文档级记忆的命名实体识别都是将所有记忆信息混合融入当前语句中,忽略了不同标签类别的记忆信息对当前语句的影响不同,论文提出了一种融入分类记忆信息的中文命名实体识别方法,将当前输入语句与记忆模块中已按类别分成B、M、E、S四份的记忆信息利用注意力机制相匹配,找到每个字语义最相近的不同类别的若干个记忆字信息,将得到的记忆信息分别融入当前语句经过LSTM输出后得到的输出向量信息中,得到融入记忆信息的输出向量表示.这样可以更全面地表示当前字向量属于不同标签的可能.论文方法在中文命名实体识别经典数据集Resume简历数据集中得到了很好的实验效果.
关键词:命名实体识别文档级记忆分类记忆
分类号:TP391(计算技术、计算机技术)
论文发表日期:2021-12-20
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:8( 2501-2508 )
英文信息
