基于Fujisaki模型的情感语音信号分析与合成

来源 :北京交通大学 | 被引量 : 0次 | 上传用户:cpts
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
语音信号处理作为一个研究领域,已经有几十年的历史,其中的语音合成技术在可懂度和自然度上已达到了相当的水平。随着语音合成技术的推广和应用,对语音合成的质量提出了更高的要求。如果在语音合成过程中结合情感计算领域的研究,赋予语音感情色彩,使得合成的语音能够表情达意,那么语音合成的质量必将大大提高。本文的研究目的是实现语音信号的情感表达,依据从信号提取情感特征→归纳情感与特征参数之间的关联规律→将特征参数作用于语音信号以进行情感转换的思路进行研究。论文首先概述了课题的研究背景及情感语音技术的发展历史,介绍了情感空间的界定,提出了本文的情感分类方法,在情感分析用语音资料的标准和分析条件还没有被提出的条件下,针对语音语调受众多因素影响的特点,为了突出语音中的情感特征,设计、建立了实验用情感语音库;通过分析库中携带已知情感状态的语音,提取了表达语音特征的韵律类和音质类参数,用仿真实验对比了这两类参数在情感表达上的效果,选定基频曲线作为工作的切入点;之后利用一种改进的适合于汉语的Fujisaki模型给基频曲线以定量的描述,总结出在不同情感状态下特征参数的表现规律,将Fujisaki模型的应用推广到了情感表达的方向;在语音合成阶段,采用了一种基音同步的声韵母拼接方法,用很少的无调的基元合成了带有声调的语音;最后把体现语音情感的规则应用到合成的语音中去,用PSOLA算法实现语音的情感转换。工作的创新之处有以下三点:1、通过修改Fujisaki模型中的声调表达分量,使模型更适合汉语的表达特点,并将该模型与表达情感的特征参数结合,从而将该模型的应用于情感表达方向;2、利用归一化的声调调型模型,涵盖汉语普通话中的基本调型和常见变调现象,并通过仿真实验证明了该方法的有效性;3、提出了一种从韵母中提取基音同步模板、基于基音同步的声韵母拼接合成的方法,实现了由语音库中的无调的声韵母合成带有四种声调的语句,并实现其情感转换的过程。
其他文献
认知无线电网络中主用户的随机出现会随时中断授权频带中认知用户通信服务,因此,频谱切换技术是保证认知无线电网络中认知用户通信连续性的关键技术。本论文的主要研究工作如
期刊
随着互联网技术的迅速发展,社交网络逐渐成为一种快速便捷的信息分享和交互平台。作为当前国内社交网络巨头之一,新浪微博热门话题的讨论提升了微博用户的参与感和活跃程度,形成
期刊
无线通信网络与IP网络的互通与融合已成为未来通信发展的一个主要方向。其中,由第三代合作组织(3GPP)标准化的自适应多速率窄带(AMR-NB)语音编码算法已应用于第三代移动通信系
超分辨率复原技术是指通过信号处理的方法,将退化降质的低分辨率图像重建为高质的高分辨率图像,这可弥补实际成像系统由于硬件实现条件和成本限制导致的分辨率不高的局限,并
合成孔径雷达(SAR)是一种主动式成像雷达,它具有全天时监测特点,且不受天气影响,能提供详细的地面测绘数据和图像。此外,SAR在一定波段对植被、浅层土壤具有良好的穿透能力,
期刊
本文瞄准异构无线Mesh网络的发展前景,根据异构wMN的应用需求,设计并实现了无线传感器网络模块软件实现方案。为构建新型Mesh网络实验平台打下了重要基础。   无线传感器网
随着无线通信需求的日益增长和实现技术的日新月异,无线通信技术向更高数据传输速率、更大系统容量、更高频谱利用率和更适合各种信道条件的方向发展。多径传播等引起的信道衰