节点文献

汉语连续语音识别中声学模型基元比较:音节、音素、声韵母

  • 推荐 CAJ下载
  • PDF下载
  • 不支持迅雷等下载工具,请取消加速工具后下载。

【作者】 李净徐明星张继勇郑方吴文虎方棣棠

【机构】 清华大学计算机科学与技术系语音技术中心智能技术与系统国家重点实验室

【摘要】 本文研究的是汉语连续语音识别中声学模型基元的选择问题.根据汉语语音的特点,本文分别采用音节、音素和声韵母等三种语音识别基元进行声学建模.为了描述连续语音中的协同发音现象,本文针对音素和声韵基元,设计了相应的问题集,利用基于决策树的状态共享策略建立了上下文相关音素模型(Triphone)和上下文相关声韵模型(TriIF),并对几种声学基元进行了对比、实验结果表明,对于上下文无关模型,音素和声韵模型都要劣于音节模型,而对于上下文相关模型,Triphone和TriIF模型与音节模型相比,识别性能有了很大提高,其音节误识率分别降低了8.5%和23.6%.

  • 【会议录名称】 第六届全国人机语音通讯学术会议论文集
  • 【会议名称】第六届全国人机语音通讯学术会议
  • 【会议时间】2001-11
  • 【会议地点】中国深圳
  • 【分类号】TN912.3
  • 【主办单位】中国计算机学会人工智能与模式识别专业委员会、中国中文信息学会基础理论专业委员会、中国自动化学会模式识别与机器智能专业委员会、中国电子学会信号处理学会语音图象通讯专业委员会、中国声学学会语音听觉和音乐声学分科学会、中国通信学会通信理论专业委员会、国家863计划计算机软硬件技术主题专家组
节点文献中: 

本文链接的文献网络图示:

本文的引文网络