语音特征提取与研究

来源 :中国地质大学(武汉) | 被引量 : 0次 | 上传用户:tyzhaoxiqing
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
随着语音识别技术的发展,语音识别系统的系统性能有了很大的提高。   目前,建立起来的语音识别系统已经在某种程度上获得广泛认同,这是基于概率统计的一种系统结构。按照不同的功能可以将语音识别系统划分成不同的模块,这样的系统结构是基于整个语音识别的,即无论是说话内容识别还是说话人识别。一个完整的语音识别系统包括对信号的预处理、特征信号的提取、训练语音,模式匹配、判决等多个部分。每个部分在功能上可以是独立的,不同模块相互配合完成语音识别系统整体功能。因此每个部分都相当重要。按照识别的对象不同分类,语音识别可分为说话内容识别和说话人识别两类。这一技术在通信,安全,人工智能等多领域都有着广泛的应用前景。本课题研究的只要就是说话人身份识别系统中的特征信号的提取及处理这一部分。   语音信号特征提取主要是通过对语音信号的处理分析得到其中一些能够体现共性或特性的信息。这些信息的表现为一系列的数组或矩阵,而相关的语音信息则暗藏在数字元素的数值及相互关系之中。研究语音就是研究如何将语音信号转换成数值,以及如何理解数值之间的关系。   本文在系统介绍语音识别中说话人识别系统的基础上,着重阐明不同语音特征提取方法的实现。文章分析了能体现语音特性的一些基本语音处理方法(包括分帧加窗处理,短时能量和短时平均幅度,短时平均过零率,短时自相关函数及短时傅立叶变换);介绍了目前主流的特征提取方法的原理及实现(线性预测分析(LPC)及预测倒谱系数(LPCC),及美尔倒谱系数算法(MFCC));比较不同方法,不同参数,不同阶数对语音识别的识别率的影响。最后提出了MFCC算法一些改进意见。   本课题对语音信号的基音信号做了进一步分析,在基音分析的基础上提出了利用基音特征来区分说话人性别的的一种方式。并通过贝叶斯网络将基音与MFCC结合,通过概率统计的方法判别语音的性别,进而达到减小匹配样本个数,提高语音识别的效率的目的。
其他文献
杂散电容是影响电容式电压互感器(CVT)谐波测量取值的不确定因素,通过分析CVT内部结构和杂散电容计算公式,发现杂散电容是具有随机性特点的区间型参数.为提高CVT谐波传递特性
遥感技术是目前能够提供全球范围的动态观测数据的唯一手段。利用遥感技术,可以在同一地区获得大量不同尺度、不同光谱、不同时相的影像数据,这些数据构成了同一地区的多源影
学位
噪声源在诸如数据加密、密钥产生与管理、数字签名、身份鉴定等密码学应用中,都有着很广泛的应用。常见的噪声源有两种:数学乱源和物理乱源,前者可以用数学算法实现,不能生成真正
学位
多普勒计程仪是一种优良的水声导航设备,利用它可以测得舰船的航速、偏航角、航程等参数。以海底作为参照对象的多普勒计程仪可以测出对海底的相对速度,从而精确地确定舰船所在
学位
本文通过对荣华二采区10
期刊
随着互联网和计算机技术的迅猛发展,网络安全问题日益严峻,病毒、蠕虫、木马等恶意代码充斥着整个网络,入侵、恶意破坏、账号盗取等屡见不鲜。传统的、采取集中式的、基于特
本论文以某国防基础课题为背景。目前在靶场测试中,尚不能将实际测试或虚拟测试的弹道数据用于驱动虚拟场景模型,导致在测试过程中不能实时监测导弹的飞行状态,这使导弹的测试安
随着互联网技术的不断发展,网上交易以其方便性和快捷性得到了广泛的应用,但同时网上欺诈行为也屡见不鲜。“网络钓鱼”就是其中最典型的一种,其主要方式是利用欺骗性的电子
嵌入式操作系统具有结构小巧、实时性强、稳定性高等特点。其中源代码开放的嵌入式μC/OS-Ⅱ实时操作系统在工业测控领域得到普遍应用。TCP/IP协议是发展至今最成功的通信协
针对电力系统固有的效率与安全之间的矛盾,以及传统安全稳定控制存在失配风险等问题,文章开展电力系统广域协调运行控制关键技术的研究,构建了电力系统广域协调运行控制系统