【摘 要】
:
维度规约不但可以提高模式识别及机器学习的效率和准确性,同时作为一种有效的数据预处理技术也得到了众多研究者的密切关注,基于分形的特征选择技术是目前维度规约研究领域的
【机 构】
:
西北工业大学计算机学院,西安,710072
【出 处】
:
第二十三届中国数据库学术会议(NDBC2006)
论文部分内容阅读
维度规约不但可以提高模式识别及机器学习的效率和准确性,同时作为一种有效的数据预处理技术也得到了众多研究者的密切关注,基于分形的特征选择技术是目前维度规约研究领域的新动态.借鉴Z-ordering索引技术的思想,设计并实现了一种改进的分形属性选择方法ZBFDR(Z-ordering based FDR),该方法仅需要扫描数据集一遍建立底层网格结构,基于该底层网格结构计算数据集的分形维数及实现属性选择操作.ZBFDR避免了FDR(fractal dimensionality reduction)算法多次扫描数据集问题,空间需求也低于OptFDR(optimized FDR),在合成数据集及实际数据集上的实验结果表明ZBFDR具有较为优良的整体,性能.
其他文献
目前电力系统发展的趋势是向用户提供高质量的电能,而机械开关技术是进一步提高电能质量的瓶颈,为此需要设计新型的开关技术.本文在介绍了混合式转换开关的工作原理及其动作
蓄电池生产规格,是有限的单体蓄电池组合;如果蓄电池厂不依靠几何体的组合的传统方法,而是创新应用本文模块,能够得到预置电压,且可以稳压,这对蓄电池产业而言,有巨大的产业
在热循环条件下,对电镀纯Sn覆层的器件引脚的锡须生长进行了评估.当器件经历500与1 000次温度循环后,纯Sn镀层表面会产生致密的热疲劳裂纹,伴随生长出许多锡须.由于镀层表面
基于密度的聚类算法是一类重要的聚类算法,能发现任意形状的簇,但由于它的时间复杂度较高,因此设计有效的增量更新算法是一个重要研究方向.本文在SNN算法的基础上,提出一种基
聚类是数据挖掘中的一项重要课题.在大型数据集中有效地发现具有任意形状、密度和尺度的簇结构是目前聚类算法研究中的一个开放性的问题.基于图形轮廓的思想,本文提出了一种
本文选择合适的聚类数和准确划分类间重叠的数据是聚类分析领域2个被广泛研究的问题.提出了一个基于高斯混合模型的层次聚类算法(HCGMM),该算法基于重叠度的衡量,而且不需要
本文介绍了河南省科技文献资源的现状,并对科技文献资源建设存在的问题进行了分析,总结了国内文献资源共建共享的成功经验,提出了建立河南省科技文献信息共享服务系统的建议
本文结合实践阐述了网络环境下信息服务模式及方法。一、"撒网捞鱼"扩大信息服务范围;二、开展信息跟踪服务,为企业技术攻关提供自始至终的信息服务;三、利用各种业务技术洽谈会
本文对信息生态问题进行了探讨。文章从信息生态的含义入手,指出信息失衡的表现,并对如何调节信息生态平衡提出了建设性的建议。
一、存在的问题1.营林生产成本偏低,职工收入低,作业条件差,职工无积极性,影响生产进度和质量。一是营林生产成本给的不足,生产单位去掉苗木费、包装、运输等必要费用,剩下的