基于重采样技术在医学不平衡数据分类中的应用研究

来源 :中国卫生统计 | 被引量 : 0次 | 上传用户:zhangdeting
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
目的 以代谢综合征为例,探讨不平衡数据对分类算法的影响,并运用重采样技术对数据进行平衡化处理,比较神经网络、决策树的分类性能.方法 采用随机过采样、随机欠采样、混合采样和人工合成数据四种重采样技术,比较数据重采样前后及四种数据重采样间使用神经网络、决策树分类的性能,以F-Measure,G-mean和AUC作为模型评价指标.结果 (1)分类算法性能随不平衡数据集不平衡比例的加剧而降低;(2)四种重采样技术中随机过采样后作用于BP神经网络、C4.5决策树分类性能最大.结论 分类性能随数据集中患病率的降低而下降.采用随机过采样提高了算法的分类性能.建议在应用分类算法对医学不平衡数据分类前,采用随机过采样技术以提高分类性能.
其他文献
为了满足医疗系统中RFID的低成本、可扩展、高效率和强隐私的要求,研究者进行了安全分析,并对协议的复杂度和各种攻击策略进行阐述,揭示现有协议的缺陷和不足。该研究提出一种适用于移动医疗的基于Hash运算的RFID双向认证协议,并证明了新协议具有强大的抗追踪能力。
目的探究全方位健康指导护理干预在高血压患者中的运用效果。方法 100例高血压患者,随机分对照组和实验组,各50例。对照组患者采用常规护理,实验组患者采用全方位健康指导护
目的:总结休门氏病伴脊柱后凸畸形围术期的护理方法与经验。方法21例休门氏病伴脊柱后凸畸形矫形植骨融合内固定术患者,术前加强心理护理及呼吸锻炼;术后做好观察及功能锻炼,预防
目的:分析北京市卫生筹资存在的风险以及未来卫生筹资的趋势.方法:对比分析北京市卫生筹资各来源的增速与社会经济各指标的增速.结果:2006年以来,北京市卫生总费用中政府支出
馒头不属于 GB 2 76 0 1 996《食品添加剂使用卫生标准》中着色剂柠檬黄的使用范围 ,在馒头中添加柠檬黄违反了《中华人民共和国食品卫生法》第九条第十二项的规定 ,2 0 0 1
文章系统梳理了芬兰15D量表的发展历程、内容及其在卫生经济学评价领域的应用状况,为国内开展经济学评价研究,尤其是效用值测量与成本-效用分析研究提供参考与借鉴.
文章简要梳理了AQoL系列量表,包括AQoL-4D量表、AQoL-6D量表、AQoL-7D量表和AQoL-8D量表的发展历程、量表特征、效用积分体系以及应用状况,为国内开展经济学评价研究,尤其是
目的分析康复治疗在脊髓损伤患者功能恢复中的干预价值。方法 80例脊髓损伤患者,随机分为对照组与观察组,各40例。对照组采取常规治疗措施,观察组在对照组基础上采取康复治疗
目的探讨稳定型慢性心力衰竭患者实施康复运动的安全性及疗效。方法 106稳定型慢性心力衰竭患者,随机分成对照组(52例,常规治疗)和运动康复组(54例,在常规治疗基础上接受运动
期刊