基于N元的候选词库的建立
李群
鞍山师范学院,计算中心,辽宁,鞍山,114005
摘要:随着internet的发展,网上各种新词语的创建和发展也超过以往任何时候,新词语的自动识别一直是中文信息处理中的一个热点研究课题,研究了网上新词语的自动识别技术,主要研究内容是利用初加工语料,采用分解策略将N元组候选词库的形成分为预处理、二元候选字段,三元候选字段、四元候选字段几个过程,降低了整体处理难度,提出了一种以规则剔除噪声词串和构词相结合的新词语的识别技术.
关键词:网络词语N元组新词语自动识别
分类号:TP39(计算技术、计算机技术)
论文发表日期:2005-01-01
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:3( 134-136 )
英文信息展开
渤海大学学报(自然科学版)

渤海大学学报(自然科学版)

CSTPCD
ISSN:1673-0569
年,卷(期):2005,26(2)