基于FPGA的光度立体3D人脸重建研究

来源 :东南大学 | 被引量 : 0次 | 上传用户:stage7
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
近年来,机器视觉中的生物识别这一研究方向越来越受到人们的关注,其中的人脸识别更是当前的研究热点。二维人脸识别受人脸表情、环境背景和人脸姿态等诸多因素的影响,很难保证人脸识别的准确性,如何快速准确地重建出三维人脸模型就显得尤为重要。光度立体视觉技术是机器视觉领域一种经典的三维重建技术,具有非接触性和精度高等优点,但是也存在设备复杂、重建实时性差等缺点。为此,本文基于FPGA硬件平台,对光度立体视觉算法的基础理论进行深入研究,分析出算法中可用硬件加速的部分,并结合三维人脸重建系统的设计要求,利用软、硬件协同开发的优势,提出一套适合于FPGA平台的系统设计的总体方案。研究内容如下:
  1. 搭建一套人脸图像采集系统,系统包括OV7670图像传感器和四个不同位置的点光源,用来获取四张在四种不同光源条件下的人脸灰度图像,用于后续算法计算。同时,建立光源和相机三维坐标系,实现光源方向的标定和二维图像坐标系到三维坐标系的映射。通过 Matlab 离线标定相机和光源位置等参数,并将光源信息生成查找表固化在ROM中,以此来简化灰度方程的求解。
  2. 基于 FPGA 光度立体视觉算法的优化与改进。针对 FPGA 的硬件特性,优化了最耗时也最耗资源的梯度场积分模块。基于二维 FFT 对梯度场积分模块梯度值进行积分,主要通过乘法和累加计算实现,其算法复杂度低,计算量大,非常适合利用FPGA逻辑电路进行硬件加速。改进后的光度立体视觉算法均通过Matlab的仿真验证,验证结果表明算法功能可正常实现。
  3. 光度立体视觉硬件平台设计与实现。平台以Xilinx Artix-7系列FPGA为核心计算平台,利用SRAM、RAM、ROM以及FIFO等存储控制器来实现原始图像的存储和中间数据的缓存,UART输出三维重建结果。为了提高实时性,采用了乒乓操作、数据缓存等硬件加速方法来优化设计,并充分利用FPGA并行结构,优化了资源利用率并提高了运算速度。采用Verilog HDL语言进行硬件编程,并在vivado平台上对算法中的各个模块进行功能仿真验证。最后系统测试表明,在系统工作时钟为100MHz的FPGA平台上,实现了分辨率为 128×128人脸重建系统,重建速度可达60fps的三维人脸重建系统。
  该三维人脸重建系统,针对算法的复杂度进行优化,结合FPGA逻辑并行的特点提高了算法的运行速度,可以满足实时重建的要求,在智能家居人脸识别以及芯片原型设计分析等应用领域有很好的应用价值与前景。
其他文献
目前高清视频在娱乐、医疗、视频监控等领域的应用越来越广泛,促进了视频超分辨技术的研究。其中,基于深度学习的视频超分辨算法快速发展,但它们在视觉感知、精度、时序一致性的指标方面各有侧重,且模型参数量大。因此需要进一步研究如何更好地综合上述三方面指标,并提升模型推理速度,为视频超分辨技术在嵌入式终端的应用打好基础。  由此,本文设计了基于生成式对抗网络的视频超分辨算法( High Optical Fl
近些年来,二维材料由于其原子级别的厚度、表面无悬挂键等特性逐渐成为研究人员的热点,此外,二维材料之间依靠范德瓦尔斯力结合,所以能够将不同种类的材料组合成异质结结构,更加拓宽了其研究方向。不同于其对应的体材料,石墨烯等二维材料展现出了一系列优异的光电性质,因此广泛应用于高性能场效应管、光电传感器等电子器件,但目前此类器件仍具有些许不足,例如栅氧化层的存在阻碍了载流子的扩散运动,导致了较低的迁移率;使
学位
语音唤醒作为一种关键词识别(Keyword Spotting, KWS)技术,通常用作复杂语音交互设备的接口,是一种小型的关键词检索系统。随着物联网技术的发展,语音唤醒电路被广泛地应用在电池受限的移动、可穿戴设备中,并且保持常开(Always on)的状态,因此该类芯片对语音唤醒电路的功耗要求非常严格。  本文设计了一种极低功耗的语音唤醒电路,主要包括特征提取电路、神经网络电路和后处理电路。特征提
学位
随着物联网技术的飞速发展以及嵌入式芯片处理能力的增强,人体行为检测在智能视频监控、家居安全等领域的需求日益增加。目前基于深度学习的行为检测技术虽然取得了突破性进展,但是依然存在着视频特征提取不够高效、多任务优化不充分、模型复杂难以部署到嵌入式平台等问题,需要进一步的发展和完善。  本文着重于高效的视频时空特征提取方法以及准确的多尺度检测方法的研究,并探索在嵌入式设备上的优化方案,提出了基于2D和3
学位
近些年来,基于无监督学习的图像深度估计算法成为计算机视觉领域的热门研究方向,广泛应用在三维重建、语义分割、SLAM等场景。考虑到算法的应用,FPGA作为一种高度并行化的可编程器件,经过针对性的硬件设计,能够兼顾计算性能与功耗,实现算法在硬件平台的加速设计。在此背景下,本文以基于无监督学习的图像深度估计算法为切入点,实现该算法的硬件加速设计。  本文首先选用对硬件友好的Goard算法方案作为基准方案
基于单目相机的视觉里程计是室内移动定位领域的关键技术。该技术通过追踪视频流图像中的点-线-面特征,建立了相机在现实世界中运动轨迹的数学模型。考虑到室内网格型天花板上存在大量有利于定位的结构化线特征与平面特征,本文设计了一种基于单目顶视相机追踪天花板特征的室内定位系统,并在嵌入式平台上实现。该系统以PL-SVO为基础框架,改进线特征的初始化、坐标优化、匹配以及位姿优化等模块,并增加天花板平面特征优化
学位
面对自然界中人体动作的多样性和丰富性,基于监督学习的动作识别算法已经难以满足各种应用中的需求。近年来,基于零样本学习的动作识别方法使得算法模型能够在不使用新动作类别样本进行额外训练的情况下完成对应样本的识别工作,大大提升了动作识别技术的泛化能力和通用性。  本文深入研究了基于关系图谱的零样本学习方法,并针对动作识别领域的关键问题和难点提出了一套基于图卷积神经网络和动作关系图谱的零样本动作识别算法(
学位
人防警报平台是国家人防工程的重要组成,关系到国家安危和人民生命财产安全。人防警报终端作为现有人防警报平台中的关键部分,对整个平台的正常运转具有底层支撑作用。本文针对人防警报终端在维护检测中存在的实际问题,设计基于物联网的人防警报终端监测系统。该系统可对人防警报终端进行有效监测,确保人防警报终端处于正常工作状态,对提升人防警报终端维护检测的效率和水平具有重要意义  首先,论文分析了现有人防警报平台架
学位
物联网技术正在加速对现代生活方式产生深刻影响。在物联网技术的大潮下,WiFi、蓝牙和Zigbee等基于工业、科学、医疗(Industrial Scientific Medical, ISM)频段的短距通信技术在终端应用场景中发挥着重要作用。相应地,对低压、低功耗、高质量射频收发机的需求也快速增长,同时促进了高性能锁相环(Phase Locked Loop, PLL)和频率综合器的发展。作为PLL的
学位
视频图像是当今社会信息交互的主要媒介。人类依靠视觉获取视频图像并影响大脑判断,智能设备依赖视觉传感器获取环境信息。雾霾天气下大气粒子对光路的散射使得清晰图像的获取变得困难,进而产生一系列安全隐患。随着 5G、物联网和自动驾驶等新兴技术发展,更多智能设备将在视觉系统的辅助下执行任务,而清晰图像的获取将增强设备工作的可靠性和稳定性,图像去雾技术应运而生。本文提出了一种基于FPGA的自适应图像去雾算法,