学位论文 > 优秀研究生学位论文题录展示

基于耳蜗滤波及谐波特性的语音增强方法研究

作 者: 杨海波
导 师: 杨凌
学 校: 兰州大学
专 业: 通信与信息系统
关键词: 语音增强 谐波相关 gammatone滤波 谐波固定带宽
分类号: TN912.35
类 型: 硕士论文
年 份: 2010年
下 载: 70次
引 用: 0次
阅 读: 论文下载
 

内容摘要


语音增强主要是指提高被噪声污染的语音信号的可理解度或是语音的质量,被广泛应用于手机通信、语音识别、汽车电话、人机对话机等领域,是高质量语音通信的保证。目前已有的语音增强算法要么除噪效果不好,要么计算复杂度高,要么不具有噪声环境可移植性等,很难满足实际应用的需求,所以有必要研究满足实际语音通信需要的语音增强算法。本文对目前已有的语音增强算法进行了较为系统的分类与总结,并比较详细地介绍了基音估计方法和耳蜗仿真模型。在此基础之上,源于对耳蜗滤波仿真模型的深入思考,通过大量实验分析,研究了语音信号频谱中各谐波的特点,发现不同元音,不同人之间的谐波具有一定的相关性和谐波带宽近似为常数的特性,根据这两个特性,提出了一种新的语音增强算法—谐波相关去噪法。在该方法中,我们首先从纯净语音中提取出典型谐波分量,然后利用该谐波对带噪语音作谐波相关,构造了一个谐波相关域,进而联合谐波相关域与频域构造了一个大谱域,并联合大谱域和谐波相关域采用了平均阈值法提取出频域中较高分量谐波的峰值点,接着以这些峰值点为中心频率,构造了一个gammatone滤波器组对带噪信号进行滤波,从而简单而有效的将较高分量谐波从噪声中分离开来。本文在3种不同的噪声环境下设计了两大类共6组实验验证本文方法的去噪性能,分别针对不同人发同一元音以及同一人发不同元音的语音进行了去噪实验,实验结果表明本文方法的优点如下:(1)计算简洁;(2)具有较好的主谐波提取效果:(3)具有良好的噪声环境可移植性;(4)对不同人的不同元音具有通用性。文章最后指出,本文提出的方法在具体细节上还有待改进,例如,纯净谐波的提取,平均阈值,高频小分量谐波的提取等等。

全文目录


摘要  4-5
Abstract  5-7
目录  7-8
1 引言  8-20
  1.1 语音增强及其应用背景  8-9
  1.2 目前的主流算法  9-20
    1.2.1 噪声和语音的特性  9-10
    1.2.2 语音增强算法分类及其概述  10-20
2 基音估计综述  20-28
  2.1 基音的定义及应用背景  20
  2.2 基音提取算法分类  20-22
    2.2.1 时域法  21
    2.2.2 频域法  21
    2.2.3 统计法  21-22
    2.2.4 时频域法  22
  2.3 YIN算法原理  22-28
3 耳蜗仿真模型  28-35
  3.1 谱分析和gammatone听觉滤波器组  28-30
  3.2 特征增强和二维调整  30-35
4 谐波相关语音增强算法  35-53
  4.1 声门波模型  35-37
  4.2 谐波的带宽  37-39
  4.3 谐波相关原理  39-40
  4.4 算法描述  40-42
  4.5 实验结果及其分析  42-53
    4.5.1 算法对不同人的实验效果  43-47
    4.5.2 算法对不同元音的实验效果  47-51
    4.5.3 实验结果分析  51-53
5 结论  53-55
  5.1 谐波相关法的优点  53-54
  5.2 谐波相关法的缺点  54
  5.3 谐波相关法的前瞻  54-55
参考文献  55-59
攻读学位期间发表的学术论文  59-60
致谢  60

相似论文

  1. 基于听觉掩蔽效应的数字助听器关键技术的研究,TN912.3
  2. 数字助听器中语音增强技术的研究,TN912.35
  3. 多管阵列定向语音增强系统的研制,TN912.35
  4. 嘈杂环境下的麦克风阵列语音增强技术研究,TN912.35
  5. 复杂环境下语音增强方法研究,TN912.35
  6. 基于听觉掩蔽效应的小波包语音增强方法研究,TN912.35
  7. 基于噪声估计和先验信噪比估计的语音增强算法研究,TN912.35
  8. 后置感知滤波的多带语音增强方法研究,TN912.3
  9. 基于TMS320C55x DSP的语音增强算法研究,TN912.3
  10. 语音信号增强与分离算法研究,TN912.3
  11. 军用通信电台前置语音增强系统的研究与实现,TN912.3
  12. 参考独立分量分析算法及应用研究,TP301.6
  13. 船载航行数据记录仪中的驾驶台语音通信增强和压缩处理,U675.7
  14. 基于自适应滤波器的语音增强算法研究及DSP实现,TN912.3
  15. 多媒体语言学习系统中的关键技术研究,TN912.3
  16. 说话人识别相关技术的研究,TN912.3
  17. 无线语音通信降噪技术的研究与实现,TN912.3
  18. 噪音环境下的说话人识别,TN912.3
  19. 基于GSC结构的自适应波束形成语音增强算法研究,TN912.3
  20. 多通道语音增强与语音盲分离算法的研究,TN912.3

中图分类: > 工业技术 > 无线电电子学、电信技术 > 通信 > 电声技术和语音信号处理 > 语音信号处理 > 语音增强
© 2012 www.xueweilunwen.com