基于语言模型的缺失数据追踪方法与应用分析
林睿1
陈鲁雁2
王嘉梅1
范菁2
袁长森1
1.云南民族大学云南省高校少数民族语言文字信息化处理工程研究中心 昆明 650500;云南民族大学电气信息工程学院 昆明 6505002.云南民族大学电气信息工程学院 昆明 650500
摘要:在大多数情况下,语言信息系统是不完备的,或者说存在某种程度的不完备,在各种实用的数据库中,属性值语言数据缺失的情况经常发全甚至是不可避免的.在语言调查与语言收集中,数据的缺失会带来很大的失误率,数据的缺失比例过大会导致数据不具有代表性和真实性,具有较大的估计偏差,甚至导致数据完全失去利用价值,因此对随机缺失的数据处理十分必要,首先,在对缺失语言数据进行处理前,了解语言数据缺失的机制和形式.其次,针对缺失的数据机制,确定追踪数据的方法,使得语言数据得到最大化的完善.
关键词:语言模型追踪研究缺失数据数据处理方法
分类号:TN912(通信)
资助基金:国家自然科学基金(61363085)云南省教育厅科研项目(ZD2013013)云南民族大学高水平民族大学建设科研项目(ZZZC1501-JF12002)国家语委重大科研项目(WT125-61)国家自然科学基金(2016YJCXS05,2015/6-2016/9)
论文发表日期:2018-01-01
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:5( 2034-2038 )
英文信息展开
计算机与数字工程

计算机与数字工程

CSTPCD
ISSN:1672-9722
年,卷(期):2018,46(10)
所属栏目:信息处理与网络安全