节点文献

噪声环境下语音能量的MMSE估计及其在语音识别中的应用

A MMSE Estimation of Speech Energy for ASR in Noisy Environment

  • 推荐 CAJ下载
  • PDF下载
  • 不支持迅雷等下载工具,请取消加速工具后下载。

【作者】 王兴斌徐望王炳锡马治飞

【Author】 Wang xingbin Xu wang Wang bingxi Ma zhifei Department of.Information Science,PLA Information and Engineering University, Zhengzhou 450002,Henan,P.R.China

【机构】 解放军信息工程大学信息科学系

【摘要】 语音识别中,语音信号能量是一个重要的识别特征参数。在噪声环境下,语音信号能量产生的畸变是导致识别率下降的原因之一。本文依据RASTA-PLP分析的增益参数和最小均方误差估计准则,给出了带噪语音能量和干净语音信号能量的线性映射关系。在中文连续语音识别中的应用表明,利用该映射关系得到的干净语音能量估计,可使信噪比为5dB的白噪声环境下的识别正确率提高21.36%。

【Abstract】 Energy is an important feature parameter in speech recognition.However,in noisy environment,it degrades severely.In this paper,we deduce a linear mapping between noisy speech energy and its corresponding clean energy,according to the RASTA-PLP analysis and MMSE rule.This mapping is used to estimate the energy of clean speech from noisy speech.Continuous speech recognition experiments shows it works well and even improves the WER 21.36%when of 5db noisy.

【关键词】 语音识别语音能量RASTA-PLP最小均方误差估计
【Key words】 speech recognitionenergyRASTA-PLPMMSE
【基金】 国家自然科学基金项目资助项目号:60372038
  • 【会议录名称】 第十二届全国信号处理学术年会(CCSP-2005)论文集
  • 【会议名称】第十二届全国信号处理学术年会(CCSP-2005)
  • 【会议时间】2005-08-30
  • 【会议地点】中国江苏苏州
  • 【分类号】TN912.34
  • 【主办单位】中国电子学会信号处理分会、中国仪器仪表学会信号处理分会
节点文献中: 

本文链接的文献网络图示:

本文的引文网络