基于计算听觉场景分析和语者模型信息的语音识别鲁棒前端研究

关勇; 李鹏; 刘文举; 徐波

首页> 中文期刊> 《自动化学报》 >基于计算听觉场景分析和语者模型信息的语音识别鲁棒前端研究

基于计算听觉场景分析和语者模型信息的语音识别鲁棒前端研究

开具论文收录证明 >>

期刊封面封底目录下载 >>

文献代查 >>

页面导航

摘要
著录项
相似文献
相关主题

摘要

传统抗噪算法无法解决人声背景下语音识别(Automatic speech recognition,ASR)系统的鲁棒性问题.本文提出了一种基于计算听觉场景分析(Computational auditory scene analysis,CASA)和语者模型信息的混合语音分离系统.该系统在CASA框架下,利用语者模型信息和因子最大矢量量化(Factorial-max vector quantization,MAXVQ)方法进行实值掩码估计,实现了两语者混合语音中有效地分离出目标说话人语音的目标,从而为ASR系统提供了鲁棒的识别前端.在语音分离挑战(Speech separation challenge,SSC)数据集上的评估表明,相比基线系统,本文所提出的系统的语音识别正确率提高了15.68%.相关的实验结果也验证了本文提出的多语者识别和实值掩码估计的有效性.

著录项

来源
《自动化学报》 |2009年第4期|410-416|共7页
作者
关勇; 李鹏; 刘文举; 徐波;
展开▼
作者单位

中国科学院自动化研究所模式识别围家重点实验室,北京,100190;

诺基亚中国研究中心,北京,100176;

中国科学院自动化研究所数字内容技术研究中心,北京,100190;

中国科学院自动化研究所模式识别围家重点实验室,北京,100190;

中国科学院自动化研究所模式识别围家重点实验室,北京,100190;

中国科学院自动化研究所数字内容技术研究中心,北京,100190;

展开▼
原文格式 PDF
正文语种 chi
中图分类信息处理（信息加工）;
关键词
计算听觉场景分析; 语音分离; 鲁棒语音识别; 因子最大矢量量化; 语者识别;

相似文献

中文文献
外文文献
专利

1. 基于小波分析和鲁棒最小二乘的信息融合估计算法 [J] . 朱培逸 ,孙顺远 ,刘柱 . 微电子学与计算机 . 2012,第3期
2. 基于计算听觉场景分析的单声道语音分离研究 [J] . 钱政 . 北京印刷学院学报 . 2020,第0z2期
3. 基于计算听觉场景分析的混合语音信号分离算法研究 [J] . 屈俊玲 ,李鸿燕 . 计算机应用研究 . 2014,第012期
4. 基于可逆信息隐藏的的无损鲁棒数字水印模型的研究 [J] . 赵彦涛 ,吴希军 ,马云飞 . 燕山大学学报 . 2010,第003期
5. 建筑材料供应中断对承包商成本的冲击研究——基于鲁棒模型分析 [J] . 员慧慧 ,温修春 ,陆建飞 . 工业工程 . 2019,第001期
6. 基于小波分析和鲁棒最小二乘的信息融合估计算法 [C] . 朱培逸 ,孙顺远 ,刘柱 . 2011年江苏省人工智能学术会议 . 2011
7. 听觉特性与鲁棒语音识别算法研究 [A] . 孙暐 . 2005

基于计算听觉场景分析和语者模型信息的语音识别鲁棒前端研究

摘要

著录项

相似文献

相关主题

期刊订阅