基于最大熵的中文组织机构名识别模型
冯丽萍
焦莉娟
1.忻州师范学院计算机系,忻州,0340002.忻州师范学院计算机系,忻州,034000
摘要:中文组织机构名识别的精确率一直是影响自然语言处理的因素之一.根据中文组织机构名的特点,提出采用最大熵的识别方法.实验系统在较大规模的数据集上对比了不同特征选择方法对模型的影响,同时考查了词面、词性、语法等信息对模型的贡献.实验结果表明,不同的特征选择算法,开放测试的平均值只相差0.2~0.5个百分点.
关键词:最大熵中文组织机构名识别自然语言处理
分类号:TP311(计算技术、计算机技术)
论文发表日期:2010-01-01
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:5( 36-40 )
英文信息展开
计算机与数字工程

计算机与数字工程

CSTPCD
ISSN:1672-9722
年,卷(期):2010,38(12)