节点文献
扩展DTW用于连续语音识别的实验
【机构】 四川大学模式识别研究室;
【摘要】 本文报告了将扩展DTW(Dynamic Time Warppin g)用于连续语音识别时的设计及处理过程和实验情况。本实验是八六三计划“声音自然语音翻译系统”中的部分识别实验,实现了对主题受限、句型有限、词汇有限的连续英语语音的识别。用多种参数进行了切分对比试验,结果表明,用能量和音调周期,按一定规则,切分语音流比较简单,效果较好。语音的预处理及特征抽取用高速通用数字信号处理芯片TMS320实时完成。为保证建立正确的初始参考模板,采用两次语音登记,即分别按孤立词方式和连续语音方式进行。优化模板时利用动态规划时间伸缩(DTW)处理过程中的时间记录信息,并采用加权平均。识别时,采用两次DTW进行Jevel- building处理:第一次用能量和音调周期两个参数,进行初选,并适当放宽门限,以免漏识;第二次用LPC参数,在试选出的对象中进行精选, 并适当提高门限,以免误识。进一步提高了识别性能和速度。
【关键词】 语音识别;
动态规划时间伸缩(DTW);
线性预测编码(LPC);
- 【会议录名称】 第一届全国人机语音通讯学术会议(NCMMSC1990)论文集
- 【会议名称】第一届全国人机语音通讯学术会议
- 【会议时间】1990-06
- 【会议地点】中国北京
- 【分类号】TP391.42
- 【主办单位】中国计算机学会人工智能与模式识别专业委员会、中国软件行业协会人工智能协会