论文部分内容阅读
语音信号处理作为一个研究领域,已经有几十年的历史,其中的语音合成技术在可懂度和自然度上已达到了相当的水平。随着语音合成技术的推广和应用,对语音合成的质量提出了更高的要求。如果在语音合成过程中结合情感计算领域的研究,赋予语音感情色彩,使得合成的语音能够表情达意,那么语音合成的质量必将大大提高。本文的研究目的是实现语音信号的情感表达,依据从信号提取情感特征→归纳情感与特征参数之间的关联规律→将特征参数作用于语音信号以进行情感转换的思路进行研究。论文首先概述了课题的研究背景及情感语音技术的发展历史,介绍了情感空间的界定,提出了本文的情感分类方法,在情感分析用语音资料的标准和分析条件还没有被提出的条件下,针对语音语调受众多因素影响的特点,为了突出语音中的情感特征,设计、建立了实验用情感语音库;通过分析库中携带已知情感状态的语音,提取了表达语音特征的韵律类和音质类参数,用仿真实验对比了这两类参数在情感表达上的效果,选定基频曲线作为工作的切入点;之后利用一种改进的适合于汉语的Fujisaki模型给基频曲线以定量的描述,总结出在不同情感状态下特征参数的表现规律,将Fujisaki模型的应用推广到了情感表达的方向;在语音合成阶段,采用了一种基音同步的声韵母拼接方法,用很少的无调的基元合成了带有声调的语音;最后把体现语音情感的规则应用到合成的语音中去,用PSOLA算法实现语音的情感转换。工作的创新之处有以下三点:1、通过修改Fujisaki模型中的声调表达分量,使模型更适合汉语的表达特点,并将该模型与表达情感的特征参数结合,从而将该模型的应用于情感表达方向;2、利用归一化的声调调型模型,涵盖汉语普通话中的基本调型和常见变调现象,并通过仿真实验证明了该方法的有效性;3、提出了一种从韵母中提取基音同步模板、基于基音同步的声韵母拼接合成的方法,实现了由语音库中的无调的声韵母合成带有四种声调的语句,并实现其情感转换的过程。