一种高带宽向量地址产生器的设计与实现

来源 :第18届全国信息存储技术学术会议 | 被引量 : 0次 | 上传用户:yangwenping666
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
  YHFT-XDSP是一款自主设计的面向无线基站应用的32位高性能数字信号处理器,根据通信算法的访存行为及其高带宽的存储结构特点,提出了一种高带宽的向量地址产生器( Vector Address Generation Unit,VAGU),可并行执行两条向量访存指令,支持YHFT-XDSP中基于单指令多数据(Single Instruction Multiple Data,SIMD)结构的向量处理部件(Vector Processing Unit,VPU)对向量存储器(Vector Memory,VM)的非对齐访问和有限共享.VAGU除了完成向量访存指令译码和地址计算功能外,还实现了一种向量访问重整理单元(Vector Accessing Reorder Unit,VARU),根据计算出的地址信息对VPU访问VM的地址进行带宽扩展和对齐整理,将各套访问VM的请求、数据、地址等访存信息进行整理和移位操作,使其与VM各访存接口带宽匹配、对齐,实现了对VM的地址非对齐访问;当以字节和半字粒度向量数据访问VM时,还将其带宽分别压缩成字访问带宽的1/4和1/2,减少了访存冲突几率,实现了字节、半字、字粒度地址连续的向量数据访存.实验结果表明,该VAGU不仅为向量处理部件提供了充足的数据访问带宽,还减少了向量处理部件内部数据的混洗等操作,压缩了代码密度,提高了算法的访存效率,降低了功耗.
其他文献
为解决数值模拟并行轨迹数据的输出与访问共性问题,本文实现了端到端的存储解决方案。提出了扩展的轨迹数据模型,支持复杂并行轨迹数据的表示与组织;提供直接易用的轨迹数据读写接口,屏蔽底层复杂的数据处理过程;重叠数据并行通信与合并,提供可扩展的并行数据采集技术;提供可扩展文件数组存储技术,满足多种文件访问模式需求;直接耦合可视化系统,方便用户进行轨迹数据的浏览与可视化分析。目前,研究成果已在模拟激光聚变过
服务资源提取是影响系统效率的重要因素。针对目前监控系统可控性、扩展性不足的问题,设计了一种能够进行大规模接入的分布式视频监控系统架构,提出了服务资源按类别先请求后提取、集中控制,监控终端集中管理的策略,介绍了数据资源、媒体资源的提取过程和接入容量扩展实现方案,最后给出了子系统的测试结果。
“流量本地化”技术是一种缓解传输压力的有效途径,其核心即在于解耦应用与数据存储。本文在缓解骨干网压力的“流量本地化思想”的基础之上,分析研究在网络边缘引入“通用网络存储协议”的解决方案。文章分析了嵌入式环境和通用计算机环境下HTTP、NFS、iSCSI三种存储协的基本原理和实现方式,并重点针对三种协议在不同应用场合中的性能表现进行对比测试,为“通用网络存储协议”的设计实现提供参考建议。
Web服务组合验证对增强服务安全、保证系统质量具有重要意义。为保障Web服务组合的正确运行,提出了一种形式化和在线检测结合的Web服务组合验证方法。在动态检测的实时数据的基础上,通过语义Web服务组合到Petri网的映射和基于可达图的服务组合一致性检测方法,实现语义Web服务组合动态交互的形式化验证,最后通过实例进一步说明该方法的可行性。
现有的大多数序列模式挖掘算法或者没有把项出现的时间作为一个因素来考虑,或者只考虑序列项作为点时刻而出现,而没有考虑到有的序列项是存在于一个时间范围,因而挖掘结果可能会遗漏一些有趣的模式。提出一种混合时态序列模式挖掘算法,对同时包含点时刻的项和时间区间的项的序列进行挖掘,利用有效的剪枝策略和时间区间合并,分区间精确显示混合时态序列模式挖掘结果,实验证明,算法是有效的,并且具有较好的可扩展性。
网页的内容信息对于提高聚类质量来说并不完全够用,针对网络社区网页之间存在的天然链接关系,本文提出了一种挖掘用户标签的增强型社区网页聚类算法。本文采用多种距离度量方法,并将网页之间的链接关系挖掘出来,包括相同用户链接,相同标签链接和相同用户相同标签链接信息,然后将社区网页的内容信息相似度和社区网页的链接关系结合起来判断社区网页所属的类别。实验表明,提出的算法是有效的。
随着海量数据的快速膨胀,机群文件系统的存储方式正在逐步从复本向Erasure Code过渡.Erasure Code存储能够以更低的存储空开销提供更高的可靠性.然而,由于Erasure Code存储需要通过编码生成编码数据,在存储原始数据和编码数据过程中更容易产生磁盘争用和不均衡负载,从而影响整个存储系统的I/O性能;同时,Erasure Code存储在写回编码数据时,数据一致性和数据缓存之间存在
对某并行文件系统的I/O性能进行分析和测试。从软件结构和硬件部署结构等方面对某并行文件系统进行简要介绍,分析并总结影响其I/O性能的因素(I/O性能因子),设计测试用例,重点对前端文件系统(FFS)的性能因子进行测试,并分析测试结果,给出优化建议。分析和测试表明,合理的I/O策略和文件系统配置能够极大提升并行文件系统I/O性能。
协同过滤是到目前为止最成功和应用最广泛的推荐技术,然而,由于用户-项目矩阵极端稀疏导致推荐不精确.针对该问题,本文提出了三种数据填充方法和两种推荐策略.对评分矩阵中未评分数据的三种数据填充方法是:(1)采用行和列数据的加权平均值填充;(2)采用行和列数据的众数的平均值填充;(3)采用行和列数据的中位数的平均值填充.一种推荐策略是直接用填充数据作为预测评分进行推荐;另一种推荐策略是将填充数据后的评分
在torus网络中气泡流控是一种有效、实用的死锁避免技术。关键气泡机制使用虚跨步技术,只需要使用一个报文缓冲区就可以避免torus网络中的环内死锁,但是却存在阻塞的可能。在本文中,我们首先提出了伪报文协议,然后结合伪报文协议设计了移动气泡流控策略。采用该机制,路由器只需要最少两条虚通道,每条虚通道最少一个报文空间就可以实现无死锁完全自适应路由。我们采用模拟器比较了各种气泡流控的性能,结果表明,移动