复杂条件下的皮肤病理图像分割方法的研究

来源 :黑龙江大学 | 被引量 : 0次 | 上传用户:cocksun
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
据统计,皮肤癌作为一种比较棘手的疾病,它的致死率正在呈逐年升高的趋势。其中致命性最高的当属黑色素瘤,它严重地威胁着我们的身体健康。不过只要我们能够在早期通过科技手段及时地诊断并加以临床干预和治疗,那么治愈几率就会提高很多。由于当下皮肤癌数量的快速增长,对于皮肤伤口病变部位诊断的计算机需求也随之日益增长。目前皮肤病变图像分割是临床诊断的重要手段之一,然而皮肤病变的最新公共可用数据集却仅有极其有限的真实专家标签。除此之外,可用的分割数据集由许多专家共同进行标注,代表着对皮肤伤口边界进行精确的标注是一件既费力又费时又昂贵的工作。但是一个出色的计算机辅助诊断系统(CAD)不仅可以帮助医生诊断、提高效率,而且在一定程度上节约了人力资源。准确的皮肤分割算法能够在皮肤镜图像中实现高灵敏度地定位,迅速找出病变位置,从而对后续诊断不同皮肤疾病类型起到了至关重要的作用。于是,针对目前皮肤镜图像中存在的伤口区域与健康皮肤区域高度相似、皮肤病灶区域边缘较模糊以及皮肤镜图像中存在伪影信息干扰这三个难题,本文进行了重点研究。主要包括以下三个方面:
  首先,为了有效地提高皮肤皮损区域的分割准确率,本文提出了一种可以过滤掉毛发等噪声的分割模型,通过对特征提取过程中的干扰信息进行筛选、过滤,可以有效地解决由U形网络的跳跃连接操作所带来的噪声传递等问题。本文所提出的特征提纯模块,在模型训练过程中,可以对多种低级特征进行预测,并以权重的方式对预测后的特征进行配比,以获取更加有效的特征信息。同时根据相似性原理,动态地反馈调节权重大小,削弱干扰信息的占比,增强有效信息的占比,以此配比出最佳的有效特征。实验结果表明,该模型在基准的ISIC2017挑战赛数据集上取得了较好的分割效果,达到了在特征学习的同时过滤掉毛发、设备伪影等干扰信息的目的。
  其次,考虑到在皮肤镜图像中由医疗设备装置伪影所占据的区域的比例较大,而随着医学图像分割网络中层数的加深,将存在混合有效特征信息和无效特征信息的问题。于是本文通过结合位置注意力机制和通道注意力机制,捕获远距离像素之间的关系,来区分伪影特征和病灶特征。我们将其融入到一般的编码-解码分割网络中,命名为AF-Unet。该网络通过以上两种机制强调具有相似性的局部特征,在应对皮肤伪影问题时可以获得全局视野。无论距离多远,AF-Unet根据伪影特征与皮肤病灶特征之间的相似性有选择性地强调那些相互依赖的通道存在。添加这两个注意力模块的输出从而进一步改善特征信息的表示,这对于准确的分割效果将有很大的帮助。
  最后,针对ISIC2017中存在的低对比度的数据图像,本文设计了低对比度分割模块。我们通过嵌套残差连接操作来代替传统的U形网络中的跳跃连接操作,使其更容易处理不明显的特征信息。这样可以在不用加深网络层数的情况下也不引入太多网络参数的情况下,有效地提高网络的表达能力。随着表示能力的提升,网络能够进一步拟合此类棘手的病灶,从而对其处理地更加地充分和细致。与此同时,我们引入focalloss来减少易分类样本像素的权重,使模型专注于学习难分类的样本像素特征。形成的新模型我们命名为LCSA网络,它可以改善ISIC2017数据集中低对比度条件下较难分割的图像,从而进一步提高整体的分割准确率。
其他文献
目标检测是计算机视觉领域的重要方向,随着深度学习方法及相关硬件设备的发展,它在自动驾驶、智能监控、智能手机等方面都有着广泛的应用,具有重要的研究意义。  基于无锚框深度学习的目标检测是一种主流的单阶段目标检测算法。融合多层监督信息的沙漏网络结构能够显著提升无锚框目标检测算法的精度,然而其速度却远低于同层次的普通网络的速度,并且不同尺度目标间的特征会互相干扰。针对上述问题,本文提出了一种非对称沙漏网
学位
测量胎儿头围可估计胎龄和监测胎儿的生长。医学超声影像技术由于其廉价性、无辐射和实时性,成为测量胎儿头围的首选方式。然而,目前的主要测量方式是通过有经验的医师手动测量,测量精度依赖于医师临床经验。这种方式易导致超声图像测量耗时,增大医师工作量。现有有经验的医师资源并不充足,一些落后地区更为明显,影响孕妇产前检查的准确性。为了提高超声测量的工作效率以及准确性,本文提出一种测量方案帮助解决自动测量胎儿头
行人重识别是指在跨摄像头的场景下进行行人的匹配。它是计算机视觉中的热门研究领域之一。在实际应用场景中,摄像机拍摄角度的变化、身体部件被拍摄场景中物体遮挡以及行人姿态存在多变性等问题使得行人在检测框内的空间上不对齐,这给行人重识别的特征提取阶段带来了极大的挑战性。因此,如何在跨视角场景下获取具有高判别力的特征是行人重识别的研究重点。针对以上问题,本文提出了基于密集3D部件对齐的行人重识别方法研究。具
在大量实际问题中,往往存在不止一个全局最优解和多个局部极值解,如何构造一种优化算法,使之能够求出所有全局最优解和尽可能多的局部最优解,这类问题就称作多模态优化问题或多峰函数优化问题。而多模态优化问题又可以分为多模态单目标优化问题和多模态多目标优化问题。烟花算法是最近才提出一种群体智能算法,可以用来求解很多实际的优化问题,具有很好的局部搜索能力。但是近年来烟花算法还没有被应用到求解多模态优化问题上。
传统机器学习方法只有在训练数据和测试数据满足相同分布时表现出良好的效果。在现实场景中,训练数据往往与测试数据分布不同,从而导致分类准确率降低。  在领域自适应问题中,将训练数据作为源域;而将测试数据作为目标域。其目的是减少源域和目标域之间的分布差异。本文提出两种基于流形子空间学习的领域自适应方法,用流形学习的方法将源域和目标域映射到同一子空间中去。在这个子空间中,源域数据和且标域数据有着相似的分布
手势识别技术作为人机交互领域内的关键技术之一,因其便捷、自然的交互方式有着广阔的应用前景,也因此成为各国学者的研究热点。传统手势识别技术通常借助外部穿戴设备,限制了用户活动自由,逐渐被基于计算机视觉的手势识别技术取代。而基于计算机视觉的手势识别方法易受光照变化、环境背景的影响,有一定的局限性。深度采集设备Kinect的出现为这一缺陷提供了解决方案。因此,本文基于Kinect设备采集的深度图像与彩色
学位
网络技术的发展以及信息的快速流动导致多媒体数据急剧增长,呈现出规模变大、类型增多的特点。在这种情况下,传统的单模态数据检索再难满足用户对多种类型数据的检索需求,同时大规模的多媒体数据对检索提出了新的挑战。利用哈希码低存储、高效率检索的特点,跨模态哈希检索在众多的检索方法中得到了研究者们越来越多的关注。  跨模态哈希检索的关键问题是如何利用异构数据中的潜在关联缩短语义鸿沟。大多数的方法忽略了以交互方
有些发生概率较小的人群行为(例如踩踏,骚乱等)可能会造成巨大的财产和生命损失。现有群体视频数据集的平衡性较差,一般包括大量普通群体视频的样本,而某些发生概率较小的人群行为样本却很少。  人群行为识别是一种多标签分类任务,具有场景复杂,样本不均衡等特点。在现实场景中,即使是同一种人群的行为也可能具有不同的场景,外观噪声往往较大;同时,人群行为通常伴随着各种运动信息,从而导致相对较大的动态噪声。为了有
知识库中包含大量的知识,如何从特定结构的知识库中挖掘自然语言问题的答案成为了近年的研究热点。知识库问答主要研究如何将问题转化为结构化查询从而对知识库中的知识进行检索。随着深度学习的发展,知识库问答的查询方式演变为在同一个语义空间下将问题与候选答案信息进行语义相似度比较后得到语义相似度最高的候选答案信息对应的候选答案作为问题的答案。  在知识库问答研究中,通常选取知识库中的实体作为候选答案,选取知识
夜间有雾场景下的航运货物状态识别涉及到图像去雾和视频识别两个领域,这也是计算机视觉中比较热门的研究方向。在图像去雾方面,图像的成像极易受到江面上雾气的影响,进而产生大量低质量的图像。而在视频识别方面,增强模型的特征提取能力是有必要的,同时,为了便于部署,模型的尺寸不宜过大。经典的循环生成对抗网络用于图像去雾时容易出现图像失真的问题,而经典的三维残差网络用于视频识别时则会出现特征提取能力不高或模型参
学位