嵌入式系统中低功耗Cache的研究与设计

来源 :湖南大学 | 被引量 : 0次 | 上传用户:phenix519
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
能耗问题是近年来人们在嵌入式系统设计中普遍关注的热点,它严重影响着嵌入式系统的应用与发展。Cache即高速缓冲存储器,作为处理器与主存之间的关键桥梁,在优化计算机系统的性能中发挥着重要作用,但同时它也是主要的功耗部件之一。因此,有效地降低Cache的功耗对嵌入式系统的低功耗设计有着重要的意义。本文主要研究体系结构级的低功耗Cache设计技术。在详细分析了低功耗Cache技术的研究现状的基础上,提出了两种新的低功耗Cache模型,分别为基于有效位预判和分类访问的低功耗混合Cache模型(CAVPU Cache)和基于容量联合分配算法的低功耗分离Cache模型(CCAS Cache)。CAVPU Cache具有低功耗和动态平衡指令负载和数据负载的优点;而CCAS Cache则兼备低功耗、动态调节负载和高处理带宽的优点。通过仿真实验证明了上述两种低功耗模型的有效性。本文的主要创新工作如下:1.提出基于有效位预判和分类访问的低功耗混合Cache模型(CAVPU Cache)。在访问传统的组相联混合Cache时,要同时访问一个组中的所有路,这样极大地增加了访问功耗,因为对于一个n路的组相联Cache,就有n-1路的访问是无谓的。本文通过在分类访问的混合Cache模型中增加有效位的预判,提出一种基于有效位预判和分类访问的路暂停Cache模型。该低功耗模型既能暂停对类型不匹配的存储体的访问,又能暂停对无效存储体的访问,从而降低了访问能耗,同时子块搁置技术的引入,又减少了Cache的失效开销。实验表明,新提出的路暂停Cache模型在保证高性能的同时,又能有效降低Cache的功耗。2.提出基于容量联合分配算法的低功耗分离Cache模型(CCAS Cache)。可重构Cache具有参数可重新配置的特性,建立在可重构Cache之上的自适应算法,能够动态地统计Cache的行为和性能信息,并根据这些信息在程序运行时动态地改变Cache的配置,从而在保证高性能的前提下,有效地降低Cache的功耗。考虑到不同程序甚至同一程序的不同运行阶段对指令Cache和数据Cache的容量的实时需求往往不同且不均衡,本文针对可重构分离Cache,提出了一种新的容量联合分配算法,该算法可以综合考虑程序运行时对两类Cache资源的实时需求,动态地联合调整一级Cache的容量和配置,从而更有效地利用Cache资源。实验表明,与先前的自适应算法相比,新提出的算法不仅有效地降低了Cache的功耗,而且降低了程序运行中由于两类Cache容量的分配不均衡带来的性能损失。
其他文献
分片式处理器体系结构(TPA)能够很好地应对纳米工艺代的功耗、线延迟、设计和验证复杂度等一系列问题,是一种具有良好的性能扩展潜力的众核处理器体系结构设计方案。作为一种
与文本无关的说话人识别是指通过说话人的语音来自动识别说话人的身份,它在许多领域有着良好的应用前景。 本文介绍了说话人识别系统中需要用到的理论和方法例如高斯混合模
随着信息社会的快速发展和网络的广泛应用,每天从社交网络、业务交易以及传感器等应用中产生的数据难以计数。尽管传统的哈希技术能够很大程度上压缩数据并提高数据管理性能,但
集传感器技术、嵌入式计算技术、分布式信息处理技术和通信技术于一体的无线集成传感器网络以其低廉的价格、便利的部署方式正得到越来越广泛的使用,对传感器网络各个方面的
随着计算机科学技术的发展,其应用的领域也越来越广泛。在图像处理领域中,处理的数据量巨大,提高图像处理的速度就是一个巨大的挑战,这是由图像数据的特点和图像处理算法的复
独立分量分析(Independent Component Analysis, ICA)作为一种变换方法,在神经网络、盲源分离、统计分析等领域的有着广泛的应用,它在过去二十年尤其是近十年内得到了长足的
本文在假定深度的基础上提出一种几何物体位姿计算的方法,并且初步研究位姿计算中基本几何物体的三维感知经验。文章首先概述了位姿计算的基本研究背景综述了一些基本的研究
P2P(Peer-to-Peer)技术作为Internet的重要技术之一,近些年来受到了计算机业界越来越多的关注。P2P技术直接将人们联系起来,让人们通过互联网可以直接交流。P2P使得网络上的
数字图像和视频修复是填充图像或视频内指定的破损区域的处理过程,是当前计算机图形学、计算机视觉和图像处理的研究热点领域之一。目前,图像修复的基本方法主要有两大类:基
近年来,随着生物测序技术的突飞猛进,现代生物技术的研究取得了突破性的进展,生物序列数据以前所未有的速度增长。人工分析和处理生物序列数据已无法满足需要,如何分析和处理