基于自适应心理声学模型的智能语音识别系统
熊笑颜
陈栩
黄灿英
陈艳
1.南昌大学 科学技术学院,南昌,3300292.南昌大学 科学技术学院,南昌,3300293.南昌大学 科学技术学院,南昌,3300294.南昌大学 科学技术学院,南昌,330029
摘要:针对包含环境噪声和信道失真等噪声的语音处理问题,提出了一种基于自适应心理声学模型的智能语音识别系统,并建立了听觉模型.该模型将心理声学和耳声发射(OAE)合并到了自动语音识别(ASR)系统中,利用AURORA2数据库分别在清洁训练条件和多训练条件下进行试验.结果表明,所提出的特征提取方法可以显著提高词识别率,优于梅尔频率倒谱系数(MFCC)、前向掩蔽(FM)、侧向抑制(LI)和倒谱平均值及方差归一化(CMVN)算法,能够有效地提高智能语音识别系统的性能.
关键词:梅尔频率倒谱系数耳声发射自适应心理声学滤波器自动语音识别AURORA2数据库前向掩蔽侧向抑制
分类号:TP511(自动化技术、计算机技术)
资助基金:江西省教育厅科学技术研究项目(GJJ151504)江西省教育厅科学技术研究项目(GJJ151505)江西省教育改革课题资助项目(JXJG-14-28-3)江西省教育改革课题资助项目(JXJG-14-28-1)江西省教育改革课题资助项目(JXJG-14-28-6)江西省教育改革课题资助项目(JXJG-14-28-8)
论文发表日期:2017-11-01
在线出版日期:2025-08-15(本平台首次上网日期,不代表文献的发表时间)
页数:5( 675-679 )
英文信息展开
沈阳工业大学学报

沈阳工业大学学报

CSTPCD北大核心
ISSN:1000-1646
年,卷(期):2017,39(6)
所属栏目:信息科学与工程