X为了获得更好的用户体验,请使用火狐、谷歌、360浏览器极速模式或IE8及以上版本的浏览器
平台简介 | 帮助中心
欢迎来到科易厦门城市创新综合服务平台,请 登录 | 注册
尊敬的 , 欢迎光临!  [会员中心]  [退出登录]
当前位置: 首页 >  科技成果  > 详细页

[00901849]一种基于语谱图合成的语音转换方法

交易价格: 面议

所属行业: 乐器

类型: 发明专利

技术成熟度: 正在研发

专利所属地:中国

专利号:CN202011102941.8

交易方式: 其他

联系人:

所在地:浙江杭州市

服务承诺
产权明晰
资料保密
对所交付的所有资料进行保密
如实描述
|
收藏
|

技术详细介绍

本发明公开了一种基于语谱图合成的语音转换方法,包括:S1.将源语音和目标语音的语谱图分解为内容语谱图和说话人语谱图,并将内容语谱图和说话人语谱图分别输入超深度卷积神经网络中进行处理,分别得到语义内容信息和说话人身份信息;S2.将得到的语义内容信息和说话人身份信息映射到特征空间,分别得到语义内容信息和说话人身份信息的特征矩阵直方图;S3.将得到的语义内容信息和说话人身份信息的特征矩阵直方图输入直方图匹配HdaIN层中进行匹配,得到目标特征矩阵;S4.基于生成框架将得到的目标特征矩阵转换为目标语谱图;S5.将转换得到的目标语谱图通过生成对抗网络转换为语音波形输出。
本发明公开了一种基于语谱图合成的语音转换方法,包括:S1.将源语音和目标语音的语谱图分解为内容语谱图和说话人语谱图,并将内容语谱图和说话人语谱图分别输入超深度卷积神经网络中进行处理,分别得到语义内容信息和说话人身份信息;S2.将得到的语义内容信息和说话人身份信息映射到特征空间,分别得到语义内容信息和说话人身份信息的特征矩阵直方图;S3.将得到的语义内容信息和说话人身份信息的特征矩阵直方图输入直方图匹配HdaIN层中进行匹配,得到目标特征矩阵;S4.基于生成框架将得到的目标特征矩阵转换为目标语谱图;S5.将转换得到的目标语谱图通过生成对抗网络转换为语音波形输出。

推荐服务:

智能制造服务热线:0592-5380947

运营商:厦门科易帮信息技术有限公司     

增值电信业务许可证:闽B2-20100023      闽ICP备07063032号-5