BW-RAID系统中数据版本管理研究

来源 :中国科学院研究生院 中国科学院大学 | 被引量 : 0次 | 上传用户:homejang
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
随着数据的爆炸式增长,分布式网络存储系统以高性能、高可靠性和大容量的优势成为当今研究的热点。为了在提高系统可靠性的同时降低容量开销,将传统集中式RAID技术引入分布式网络存储系统成为当前分布式存储系统研究中的一个重要方向。   BW-RAID集群存储系统采用双层混合式RAID架构,前端使用RAID1镜像避免集中控制的冗余计算带来的性能问题,后端进行异步冗余计算,通过数据版本管理保证冗余计算和业务访问的数据一致性,同时实现RAID1容量到RAID4容量的转换。数据版本管理是保证系统数据正确性和降低容量开销的关键组成部分,其设计的合理性和性能开销也直接影响整个BW-RAID系统的性能和可扩展能力。   本文研究BW-RAID系统中高效数据版本管理的相关技术,将主要功能切分为基于标准快照语义的数据版本控制和依赖于快照语义的镜像冗余消减两部分。   本文的研究主要取得了如下成果:   1)分层协同的数据版本控制的设计与实现   以标准快照方式实现数据版本控制,对快照实现模型做了深入分析,并通过与虚拟存储子系统的配合,实现了快照元数据消减,避免了元数据更新带来的性能问题,也避免了元数据内存开销和磁盘开销;通过与缓存子系统的配合,提升了缓存合并的效果,优化小写更新问题。以分层协同的方法实现的快照系统CMSD,系统性能较同类快照系统有明显提升,同时实现复杂度远低于同类快照系统。与LVSS相比,针对元数据的优化,源卷首次写性能提升198%-14%;针对小写更新问题的优化,源卷首次写性能提升233%-2.6%。同时,分层协同方式使得BW-RAID系统整体性能得到优化。   2)镜像冗余消减过程分步处理及在线镜像冗余消减算法设计   深入分析镜像冗余消减过程,将冗余消减过程分为冗余检测和冗余执行两个部分,通过缓存子系统、数据版本控制层及虚拟存储子系统的配合完成。提出在缓存子系统中实现冗余消减的方案以提高在线冗余消减方式的可控性。结合.Buddy缓存策略提出一种流水批处理式冗余消减算法,以批处理方式减小磁盘I/O开销,以流水方式使系统I/O资源与计算资源充分并行化,性能比在快照系统中实现的单粒度版本提升8.2-9.3倍。最后从缓存、版本控制及虚拟存储多个层次分别保证冗余消减过程中的数据一致性。
其他文献
符号计算是数学、计算机和人工智能相结合的一门交叉学科。随着计算机硬件性能的提高和软件功能的增强,人们通过计算机程序化地处理一些数学推理和代数计算问题逐渐成为可能。
随着互联网与信息技术的发展,电子商务的运营模式逐渐被人们所接受,但是传统的电子商务模式因其系统功能单一、交易成本高、自动化程度低等原因不能适应用户们的需求,因此人
大气电学是研究电离层以下的大气中所发生的各种电学现象及其生成和相互作用的物理过程的学科,是大气物理学的一个重要分支。大气电学的研究是当前世界各航天大国所面临的共
作为云计算的核心技术之一,虚拟化是计算机系统技术领域当前的研究热点。虚拟化技术的资源共享、对异构平台的抽象性、隔离性和在线迁移等特性,使之广泛应用于各个数据中心。然
数字家庭是当前世界各国正在努力探索的新型产业,发达国家已经在基础通信、智能家居和养老服务等方面取得显著进展。中国数字家庭虽处于起步阶段,但发展速度非常快。现阶段数
海量数据处理是云计算的核心技术之一。在互联网、商业和科学计算等领域,数据量已经达到TB甚至PB量级,并且数据在爆炸性地增长。分析海量数据能够给我们带来新的知识和深刻的洞
目前,XML已经在互联网环境中扮演着越来越重要的角色,逐渐成为各种各样数据的存储、交换和表示标准。为了满足查询和处理XML数据的需求,W3C发布了XQuery语言正式推荐标准,作
随着网络信息的迅速增长,如何提高信息检索系统对自然语言的处理能力,成为了研究热点。文本关联性计算作为信息检索处理中一项基础性技术,直接影响着检索结果的好坏。而传统的基
随着互联网的普及和电子商务的飞速发展,网络上的商品信息严重“过载”,用户很难在大量的商品信息中找到真正需要的商品。电子商务推荐系统根据用户个人的习惯和偏好向用户推荐
进入21世纪以后,教育信息化程度将是衡量一个国家教育现代化程度的重要标志。经过多年建设,我国在教育信息化方面已经取得巨大成就。但是,由于我国幅员辽阔,人口众多,区域之