论文部分内容阅读
本文介绍了一个主要基于语音识别的音频检索系统的架构和基本实现.目前,越来越多的信息以视频、音频等多媒体方式出现,传统的检索方法不能直接适用于这些信息格式,急待新的检索方法出现.文章介绍的系统主要利用语音识别技术,把语音数据转化为文本,然后通过传统的文本检索方式实现对语音数据的全文检索.文中侧重阐述了对音频数据的处理过程,系统实现中遇到的一些问题和解决方法.