学位论文 > 优秀研究生学位论文题录展示
说话人识别中语音参数提取方法的研究
作 者: 胡政权
导 师: 曾毓敏
学 校: 南京师范大学
专 业: 电路与系统
关键词: 说话人识别 GMM模型 特征参数 基音同步 频谱重建
分类号: TN912.34
类 型: 硕士论文
年 份: 2013年
下 载: 135次
引 用: 0次
阅 读: 论文下载
内容摘要
|
说话人识别属于生物特征识别的一种,也称为声纹识别。说话人识别在人的身份识别领域具有广泛的研究价值和应用前景。说话人识别中反映人的个性的特征参数的提取是影响识别结果的一个关键问题。本文主要研究各种语音特征参数以及其改进的参数应用于说话人识别。文中对于说话人识别中的三种基本特征参数,MFCC、LPCC和PLPCC分别研究了其提取过程,将这三种参数分别应用于已经搭建好的说话人识别平台。本文说话人识别模型用的是在与文本无关的语音识别中常用的GMM模型。文中完成了三种参数分别用于说话人识别的实验,分析了其实验结果。并且将基音周期这种反映说话人声带的固有特征的参数分别与三种参数组合,完成实验结果的分析。针对以上实验结果中噪声情况下,特别低信噪比下识别率明显下降,如Odb高斯白噪声下都低于10%。文中提出了两种改进的参数提取方法:基于基音同步预处理的参数提取与基于浊音谱重建的参数提取。基音同步主要是根据基音周期的长度实现对语音信号的可变窗长的加窗,可以补偿浊音在非周期长度被截断导致的频谱泄露,提取的参数会使高频段的参数更加的具有鲁棒性。浊音谱重建根据浊音谱的短时谱具有明显的谐波特性,且在噪声环境下谐波特性不会发生明显的改变,基于此可以对含噪浊音谱进行重建,使重建后的频谱接近真实的纯净语音谱,再将经过谱重建后提取的参数应用于说话人识别。实验结果都表明以上两种改进可以明显提高说话人识别系统的识别率,尤特别是在低信噪比环境下的识别率会有明显的提高,如Odb的高斯白噪声下识别率提高都在15%到20%左右。
|
全文目录
摘要 3-4 Abstract 4-6 目录 6-8 第1章 绪论 8-12 1.1 选题背景及意义 8-9 1.2 说话人识别参数及模型研究的现状和难点 9-12 第2章 语音信号预处理及说话人识别原理 12-24 2.1 语音信号产生模型 12-14 2.1.1 激励模型 13 2.1.2 声道模型 13 2.1.3 辐射模型 13-14 2.2 语音信号前端处理 14-17 2.2.1 语音信号采集及数字化 14 2.2.2 预加重 14-16 2.2.4 分喊及加窗 16-17 2.3 说话人识别原理 17-18 2.3.1 说话人识别的分类 17 2.3.2 说话人识别的实现过程 17-18 2.4 说话人识别的模型 18-23 2.4.1 矢量量化VQ模型 18-19 2.4.2 隐马尔可夫模型(HMM)模型 19 2.4.3 高斯混合模型(GMM)模型 19-23 2.5 本章小结 23-24 第3章 说话人识别中特征参数的提取方法 24-37 3.1 说话人识别常用特征概述 24-25 3.2 基音周期 25 3.3 线性预测系数 25-29 3.3.1 线性预测中LPC分析 26-27 3.3.2 线性预测倒谱系数的提取 27-29 3.4 梅尔倒谱系数 29-30 3.5 感知线性预测倒谱系数 30-31 3.6 说话人识别实验分析 31-36 3.6.1 单特征说话人识别实验及对比 31-35 3.6.2 组合基音周期的实验 35-36 3.7 本章总结 36-37 第4章 改进的基于基音同步的特征参数 37-45 4.1 基音同步原理 37-38 4.1.1 传统加窗的缺陷 37-38 4.1.2 基于基音同步可变窗长加窗 38 4.2 基于基音同步的特征参数提取 38-40 4.2.1 基于基音同步的MFCC参数 38-39 4.2.2 基于基音同步的LPCC参数 39 4.2.3 基于基音同步的PLPCC参数 39-40 4.3 实验结果与分析 40-44 4.4 本章总结 44-45 第5章 基于浊音谱重建的特征参数提取方法 45-58 5.1 清浊音频谱分析 45-47 5.2 频谱的重建的及特征参数提取 47-54 5.2.1 基函数为sinc函数的重建 48-54 5.3 混合特征参数 54-56 5.4 本章总结 56-58 第6章 总结与展望 58-59 科研及获奖情况 59-60 致谢 60-61 参考文献 61-64
|
相似论文
- 基于特征的油浸式变压器参数化设计系统的研究,TM411
- 关于GMM模型常规渐近性的一种新的检验统计量的讨论,O212.1
- 基于特征选择及其融合方法的说话人识别,TN912.34
- 数字波导网格模型及语音网格参数估计,TN912.3
- 底片扫描仪小型化及焊缝故障识别技术研究,TP391.41
- 基于保局部核多元RVM的说话人识别方法研究,TN912.34
- 基于SOPC的说话人识别控制器,TN912.34
- 滴灌灌水器实验室堵塞强化试验的水力性能研究,S277.95
- 认知无线电网络中的基于信道特征的主用户仿真攻击防御技术,TN925
- 咳嗽音特征提取及在身份识别中的应用研究,TN912.34
- 听觉系统中语音信号处理相关性质研究,TN912.3
- 在役RC桥梁结构补强加固前后的可靠度分析,U445.72
- 宽幅矮塔斜拉桥结构参数分析及宽幅箱梁剪力滞效应研究,U448.27
- 复杂信道下的说话人识别技术,TN912.34
- 基于VC++6.0的说话人识别系统的研究,TN912.34
- 基于特征参数的歌唱评分方法研究,TN912.3
- 竹子地上部分形态特征及生长建模研究,S795
- 基于混合特征和高斯混合模型的说话人识别研究,TN912.34
- 国有银行发展与经济增长的实证研究,F124;F224
- 孤立词语音识别算法优化的研究和实现,TN912.34
- 薄壁箱梁畸变效应研究,U448.213
中图分类: > 工业技术 > 无线电电子学、电信技术 > 通信 > 电声技术和语音信号处理 > 语音信号处理 > 语音识别与设备
© 2012 www.xueweilunwen.com
|