论文部分内容阅读
多指标综合评价概指对以多属性体系结构描述的对象系统做出全局性、整体性的评价,是利用数学及统计方法,将反映评价对象不同属性的多个统计指标的信息转化成无量纲的相对评价值,并综合这些评价值以求得评价对象的优劣等级的一种评价方法。综合评价方法的研究一直是评价研究领域中的热点问题。论文对多指标综合评价方法进行了概述,重点介绍了属于运筹学和其它数学方法范畴的几种常用的综合评价方法,包括层次分析法(Analytic Hierarchy Process, AHP)、模糊综合评判法(Fuzzy Comprehensive Evaluation,FCE)、数据包络分析法(Data Envelopment Analysis,DEA)、灰色综合评价法(Grey Comprehensive Evaluation)、 TOPSIS评价法(Technique for order preference by similarity to ideal solution)等,从综合评价方法的概念和原理、模型和步骤、优缺点评析等方面作了较为详细的阐述。最后讨论了评价方法的集成、存在的问题及研究趋势。聚类分析是研究分类问题的一种多元统计分析方法,是一种重要的数据分析手段。它把一个没有类别标记的数据集按照某种相似性准则划分成若干个子集(类)。聚类的主要依据是类内对象的相似性尽可能大,而类间对象的相似性尽可能小。通过聚类分析,能有效地发现隐含在数据集中的数据分布特性和典型模式,从而为进一步充分、有效地利用数据奠定良好的基础。聚类分析现已成为数据挖掘中的一项重要技术和主要方法之一。多年来,众多学者对聚类算法进行了广泛而深入的研究。论文对基于划分的(partitioning method)、基于层次的(hierarchical method)、基于密度的(density-based method)、基于网格的(grid-based method)和基于模型的(model-based method)五大类聚类算法进行了综述,并在每一类中,介绍了一些经典的聚类算法。在此基础上,论文针对多指标综合评价结果的差异显著性测验以及缺失数据聚类的统计分析两个问题开展了初步研究,主要结果如下:(1)发展了一种多性状综合评价的统计假设测验方法(非参数的秩和与秩和差测验)目前国内外关于多性状综合评价的方法很多,但它们都只是提供了各不相同的优劣判别方法,其评价结论表现为一定的综合评价值以及相应的优劣排序,而无法提供各评价对象与其平均水平的差异显著性。论文给出了一种多性状综合评价的统计假设测验方法(非参数的秩和测验),在“H0:各评价对象在各性状上的秩次随机分布”假设下,导出多性状秩和的理论分布,并据之提出获得秩和测验显著性临界值的一般化方法及计算程序。通过定义任意长度整数C++运算律,解决了当评价对象和性状数较多时,因常用软件内置数据类型有效位数不足所导致的计算误差问题。最后,以糯玉米12个品种5个淀粉粘度性状为例演示了分析程序。以上多性状综合评价的秩和测验方法,虽可测验各评价对象与其平均水平的差异显著性,但无法实现各评价对象两两之间的差异显著性测验。论文以秩和理论分布为基础,利用组合数学方法,进一步导出了多性状秩和差的理论分布,并据之给出了多性状综合评价秩和差测验的显著性临界值。通过秩和差测验,确定评价对象两两之间的差异显著性,从而实现评价对象间的多重比较。(2)给出了一种带有缺失数据的基于模型的动态聚类方法聚类分析是把数据集中的对象按某种相似性准则聚集成多个类的多元统计分析方法。通常情况下,聚类过程需要基于完全数据集,但在许多实际问题的研究中,其数据是不完全的,这给聚类分析带来一定的困难。论文研究了带有缺失数据的基于模型的动态聚类方法,利用相关变量的辅助信息,对缺失数据进行推估,确定其合理的替代值,从而构造出一个“完全”数据集。在此基础上以EM算法循环迭代,参数的估计值和缺失数据的替代值都将逐渐收敛,以相应的贝叶斯后验概率判别个体的归类,进而实现动态聚类。模拟研究表明,缺值替代法具有较好的收敛性,对有缺失的数据基本都可正确地聚类。