节点文献
基于共振峰和高斯混合模型的声音转换系统
【机构】 中科院自动化所模式识别国家重点实验室;
【摘要】 现有的声音转换系统大多用源一滤波器语音模型,采用LPC,LPC倒谱系数,线性频谱频率LSF为特征。本文提出用共振峰作为声音转换系统的特征,共振峰是决定说话人特征的主要因素,并且在声音产生理论中具有明确的物理意义, 所以引入共振峰特征相比其它特征有其优越性。转换函数的训练采用高斯混合模型(GMM),并采用一系列的改进措施(静\清\浊音判定,动态时间弯折的后处理)来精确地建立这个映射规则。实验表明转换语音音质和目标的倾向性获得有效的改善。
- 【会议录名称】 第八届全国人机语音通讯学术会议论文集
- 【会议名称】第八届全国人机语音通讯学术会议
- 【会议时间】2005-10
- 【会议地点】中国北京
- 【分类号】TN912.3
- 【主办单位】中国电子学会信号处理学会语音图象通讯专业委员会、中国计算机学会人工智能与模式识别专业委员会、中国声学学会语音听觉和音乐声学专业委员会、中国通信学会通信理论专业委员会、中国语言学会语音学专业委员会、中国中文信息学会语音信息专业委员会、中国自动化学会模式识别与机器智能专业委员会、国家863计划计算机软硬件技术主题专家组