基于词典的中文分词算法研究
周程远
朱敏
杨云
1.华东师范大学计算中心,上海,2000622.华东师范大学计算中心,上海,2000623.华东师范大学计算中心,上海,200062
摘要:中文分词是计算机自动处理文本的基础.通过比较常用的机械分词算法的优缺点,提出了分层逐字二分算法,综合了TRIE树和逐字二分分词的特点,以求通过较小的开销来实现较快的匹配速度.实验结果表明,该算法在综合性能上有显著提高.
关键词:中文分词计算机应用中文信息处理
分类号:TP391.1(计算技术、计算机技术)
论文发表日期:2009-01-01
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:5( 68-71,87 )
英文信息展开
计算机与数字工程

计算机与数字工程

CSTPCD
ISSN:1672-9722
年,卷(期):2009,37(3)
所属栏目:算法与分析