节点文献

扩展DTW用于连续语音识别的实验

  • 推荐 CAJ下载
  • PDF下载
  • 不支持迅雷等下载工具,请取消加速工具后下载。

【作者】 罗万伯; 费向东; 林道发; 杨家沅;

【机构】 四川大学模式识别研究室;

【摘要】 本文报告了将扩展DTW(Dynamic Time Warppin g)用于连续语音识别时的设计及处理过程和实验情况。本实验是八六三计划“声音自然语音翻译系统”中的部分识别实验,实现了对主题受限、句型有限、词汇有限的连续英语语音的识别。用多种参数进行了切分对比试验,结果表明,用能量和音调周期,按一定规则,切分语音流比较简单,效果较好。语音的预处理及特征抽取用高速通用数字信号处理芯片TMS320实时完成。为保证建立正确的初始参考模板,采用两次语音登记,即分别按孤立词方式和连续语音方式进行。优化模板时利用动态规划时间伸缩(DTW)处理过程中的时间记录信息,并采用加权平均。识别时,采用两次DTW进行Jevel- building处理:第一次用能量和音调周期两个参数,进行初选,并适当放宽门限,以免漏识;第二次用LPC参数,在试选出的对象中进行精选, 并适当提高门限,以免误识。进一步提高了识别性能和速度。

  • 【会议录名称】 第一届全国人机语音通讯学术会议(NCMMSC1990)论文集
  • 【会议名称】第一届全国人机语音通讯学术会议
  • 【会议时间】1990-06
  • 【会议地点】中国北京
  • 【分类号】TP391.42
  • 【主办单位】中国计算机学会人工智能与模式识别专业委员会、中国软件行业协会人工智能协会
节点文献中: 

本文链接的文献网络图示:

本文的引文网络