图像视频序列中的人脸检测与识别

来源 :中国科学院自动化研究所 | 被引量 : 0次 | 上传用户:kaida111
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
与静态图像相比,图像视频序列由动态场景下的多帧时间序列图像组成,序列中包含了丰富的时间和空间信息,这些因素使得人们普遍认为基于图像视频序列的人脸检测与识别方法比基于静态图像的方法具有更为广泛的应用前景。然而,视频序列中存在着各种不利于人脸检测与识别的因素,仍有很多理论与技术问题需待解决。在本论文中,通过分析如何充分利用视频序列中包含的时间和空间信息,对序列中的活体人脸判别、人脸检测和人脸识别等问题进行了初步的探讨。论文的主要工作及贡献如下:   (1)研究了在序列中判别活体人脸的可能途径,并提出了基于眼睛眨动分析的活体判别方法。通过分析序列眼睛图像边缘能量在多方向上的变化趋势,建立眼睛眨动判别模型。模型采用多判据融合机制,保证了活体判别的可靠性;   (2)按照静态人脸识别的思路,提出了一种基于关键帧选取的序列人脸识别框架,并详细推导了2DBayes算法。实验表明,尽管算法没有利用视频中包含的时间信息,但通过融合方法融合2DBayes对关键帧的识别结果,算法仍能取得较好的识别结果;   (3)详细讨论了目前video-to-video的序列识别算法的主要思想,并提出将现有的video-to-video算法分成贯序识别方法(Sequential Approach)和批量识别方法(Batch Approach)两大类。在充分考虑序列数据空间流形分布的基础上,将序列建模为聚类中心与聚类权重的集合,并提出了基于Earth Movers Distance的序列模型匹配方法;   (4)提出了一种基于GMM增量学习和模型更新的在线训练方法。我们认为在基于视频的应用中,算法应该具有自学习的功能。在设计初始人脸检测模型和人脸识别模型的基础上,通过增量学习,实现初始模型参数的自动更新,以得到新的人脸检测模型和人脸类别模型。在识别过程中,采用贝叶斯推理过程累积序列识别信息。实验显示了这种方法的有效性。
其他文献
随着人类对化石燃料消费的不断增加及其储量有限之间矛盾的加剧正使能源危机日趋逼近,探测和开发海洋资源,具有可持续发展的深远战略意义。海洋可控源电磁探测法是目前进行海洋
目前,道路交通拥挤问题日益严重,其中由交通事件引起的偶发性交通拥挤对路段通行能力和交通安全的影响尤为突出。采用先进信息技术手段对交通流特性参数进行主动提取和分析,及时
扩散张量成像(Diffusion Tensor Imaging)是一种新型的MR成像方式,它的发展使得对大脑白质纤维的无创伤性研究成为可能。基于扩散张量图像的脑白质研究已是现阶段脑影像研究领
混凝剂投加是自来水生产过程中净水处理的重要环节,混凝剂投加自动化是实现自来水生产自动化的重要一环。准确地投加混凝剂可以有效地减轻过滤、消毒设备的负担,在保证满足出厂
随着社会经济的高速发展和人口的急剧增长,交通问题已经成为现代社会发展所必须解决的难题之一。智能交通系统(Intelligent Transportation System,简称ITS)的研究与建设将是
提高系统的可靠性与安全性已成为航空、航天、工业过程领域的迫切需求,故障诊断和容错控制技术是提高动态系统可靠性、安全性的一种重要途径。因此深入研究故障诊断与容错控制
过程安全对于现代化工过程十分重要,一个微小的故障可能导致巨大的经济损失,甚至人员伤亡。过程监测是保障过程安全、提高产品质量的一项有效手段。过程监测方法可以分为三类:
近年来,全球老龄化日趋严重,老年人又是脑卒中的高发人群。脑卒中造成的肢体运动功能障碍给患者带来极大不便和精神压力,同时也给家庭和社会带来了沉重的负担。如何帮助患者
汉语语音转换研究内容是通过语音处理手段改变汉语语音中的说话人个性信息,使得改变后的语音听起来像是由另外一个说话人发出的。本文分析了语音特征中蕴藏的说话人个性信息,针
声学建模是语音识别系统中的核心技术,声学建模能力的增强对语音识别系统性能的提高具有重要意义。隐马尔柯夫模型(Hidden markov model,HMM)解码效率高,是现在使用最广,也是最成