线性预测残差偏度最大化多通道语音去混响算法

来源 :中国声学学会2017年全国声学学术会议 | 被引量 : 0次 | 上传用户:lurnay
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
本文提出一种基于高阶统计量的多通道语音去混响方法,该方法首次用多通道语音信号线性预测残差的偏度构造代价函数,以语音去混响重建信号线性预测残差的偏度最大化为目标自适应地更新逆滤波器。结果表明该方法相较于多通道线性预测残差峰度的方法具有更好的去混响效果。
其他文献
本文根据ANSYS FLUENT中的标准k-ε湍流模型,对0.5Ma、0.7Ma 和0.9Ma三种马赫数的冷的轴对称喷流进行流场计算,并将得到的流场结果分别代入MGBK和TA声场计算模型中。结果表明,TA
本文主要探讨了低频音量对主观混响感的影响,实验结果表明低频音量对主观混响感有着显著影响,为虚拟混响效果的后期使用提供了一定的参考依据与基础。但实验选用曲目有限,需进行
本文利用声场传声器进行空间采样获得四个声压信号,根据平面波声场的声压与质点振动速度的关系,采用最小二乘法进行线性拟合,获得一个4×4的数字滤波器矩阵,来测量声场标定的声压
本文以清华大学建筑馆报告厅的建筑声学改造为例,分析研究报告厅在改造设计过程中的建筑声学设计、声学材料应用、施工工艺细节等,清华大学建筑馆报告厅建设完工后,经过近一年
会议
本文通过可压缩性评估噪声信号的稀疏度,对NoiseX92噪声库中的八种噪声在DCT域下的稀疏性进行了分析,讨论了三类基于压缩感知的去噪方法对-5DB带噪信号的去噪效果。后续工作将
为了降低基于BLSTM的语音识别系统的实时率。本文在CSC-Chunk算法的基础上,使用上一个Chunk结束帧的BLSTM-Cell状态来初始化下一个Chunk起始帧的BLSTM-Cell,从而节省了CSC-Chun
本文利用频域相干函数即包括了声源的方位信号,又可以用来区别相干和非相干信号,为此借助深度神经网络去利用相干函数构造一个基于回归分析的语音增强系统,实验结果表明,该方法显
会议
本文对鼾声的基频提取做了分析,并与和语音的基频轨迹进行了对比,提出了区分鼾声与语音的有效特征,检测两者的正确率分别达到91.11%和91.02%,对于居家医疗有着重要的应用价值。
本文将“语音质量感知评价”客观评价标准应用于水声语音通信,利用该评价标准对语音通信解码恢复后的语音进行评价,以此为依据,对低速率语音编码器输出的每帧参数的每一比特进行
本文采用谱偏离的方法分析了远、近场高频谱特征,并得到了不同距离情况下的最相似角度。结果表明:不同距离HRTF的高频谱特征存在相似性;然而在近场情况下,随着声源距离的逐渐减小