X为了获得更好的用户体验,请使用火狐、谷歌、360浏览器极速模式或IE8及以上版本的浏览器
平台简介 | 帮助中心
欢迎来到科易厦门城市创新综合服务平台,请 登录 | 注册
尊敬的 , 欢迎光临!  [会员中心]  [退出登录]
当前位置: 首页 >  科技成果  > 详细页

[00272304]一种超矢量的说话人辨认方法

交易价格: 面议

所属行业: 乐器

类型: 发明专利

技术成熟度: 正在研发

专利所属地:中国

专利号:CN201610817892.3

交易方式: 技术转让 技术转让 技术入股

联系人: 南京邮电大学

进入空间

所在地:江苏南京市

服务承诺
产权明晰
资料保密
对所交付的所有资料进行保密
如实描述
|
收藏
|

技术详细介绍

本发明公开了一种超矢量的说话人辨认方法,包括训练阶段和实测阶段。前者包括利用说话人语音信号的特征参数为每一个说话人训练一个GMM,从GMM提取超矢量,然后对该超矢量进行重组得到重组超矢量,再利用重组超矢量训练一个SVM模型。后者包括用相同的方法对测试语音提取测试的重组超矢量,然后利用训练阶段得到的SVM模型对测试的重组超矢量进行判别,从而判定测试语音所代表的说话人的身份。本发明利用原始超矢量的相邻均值矢量间的高相关性,实现了平滑数据的过渡,降低计算复杂度,对GMM组成超矢量的各个均值向量进行重新组合,使其更加契合SVM对数据处理的机制。通过选择适当的超矢量重组方式,有效提升系统的识别性能,减少了运算时间。
本发明公开了一种超矢量的说话人辨认方法,包括训练阶段和实测阶段。前者包括利用说话人语音信号的特征参数为每一个说话人训练一个GMM,从GMM提取超矢量,然后对该超矢量进行重组得到重组超矢量,再利用重组超矢量训练一个SVM模型。后者包括用相同的方法对测试语音提取测试的重组超矢量,然后利用训练阶段得到的SVM模型对测试的重组超矢量进行判别,从而判定测试语音所代表的说话人的身份。本发明利用原始超矢量的相邻均值矢量间的高相关性,实现了平滑数据的过渡,降低计算复杂度,对GMM组成超矢量的各个均值向量进行重新组合,使其更加契合SVM对数据处理的机制。通过选择适当的超矢量重组方式,有效提升系统的识别性能,减少了运算时间。

推荐服务:

智能制造服务热线:0592-5380947

运营商:厦门科易帮信息技术有限公司     

增值电信业务许可证:闽B2-20100023      闽ICP备07063032号-5