[00272314]一种非平行文本条件下的语音转换方法
交易价格:
面议
所属行业:
乐器
类型:
发明专利
技术成熟度:
正在研发
专利所属地:中国
专利号:CN201010520107.0
交易方式:
技术转让
技术转让
技术入股
联系人:
南京邮电大学
进入空间
所在地:江苏南京市
- 服务承诺
- 产权明晰
-
资料保密
对所交付的所有资料进行保密
- 如实描述
技术详细介绍
本发明提供一种非平行文本条件下的语音转换方法,属于语音信号处理技术领域。该方法首先对语音音素分类,其次对分类后的语音帧基于谐波加噪声模型进行分解,提取特征矢量;接着在每类音素集合中建立特征参数的转换函数,通过对每一类音素的频谱特征矢量,基于主成分语音分析建立非平行文本条件下的频谱转换模型;最后在转换阶段,形成目标说话人的估计特征,得到转换后的语音。本发明不仅能够有效分离语音信号中的语义信息和话者身份信息,增强转换语音中的话者信息,而且克服了训练阶段要求平行语料的限制,实现了非平行文本条件下的语音转换,同时降低了对语料数据量的依赖。
本发明提供一种非平行文本条件下的语音转换方法,属于语音信号处理技术领域。该方法首先对语音音素分类,其次对分类后的语音帧基于谐波加噪声模型进行分解,提取特征矢量;接着在每类音素集合中建立特征参数的转换函数,通过对每一类音素的频谱特征矢量,基于主成分语音分析建立非平行文本条件下的频谱转换模型;最后在转换阶段,形成目标说话人的估计特征,得到转换后的语音。本发明不仅能够有效分离语音信号中的语义信息和话者身份信息,增强转换语音中的话者信息,而且克服了训练阶段要求平行语料的限制,实现了非平行文本条件下的语音转换,同时降低了对语料数据量的依赖。