使用GPU加速分子动力学模拟中的非绑定力计算

来源 :计算机工程与科学 | 被引量 : 0次 | 上传用户:xiangcool2
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
在分子动力学模拟(MD)中,对非绑定力的计算需要花费大量的时间。本文提出了基于CUDA和Brook+的两种双精度算法,分别在NVIDIA和AMD两款主流GPU上实现了非绑定力的计算,借助GPU的计算能力加速了整个MD程序。算法对MD进行了任务分割,采用区域分解的方法将非绑定力的计算映射到GPU的计算核心上,同时针对两款GPU的各自特点提出了线程块内共享存储、最小化数据集两种优化方法。性能测试结果表明,与Intel Xeon2.6GHzCPU的单核相比,43.2万粒子的高速粒子碰撞模拟,在配置NVIDIA
其他文献
如何快速开发和部署NGN新业务已成为当务之急。在使用ParlayXAPI规范的基础上,结合软件工程方法,本文提出了一种基于有限状态机模型的NGN业务系统开发方法,并在Appium-GBox^TN+JB
为了顺应教育“大数据”时代,设计了学员课程学习大数据体系架构,给出了基于该架构的学员课程学习成败预测模型,并进行了基于大数据的课程学习成败因素分析。通过挖掘学员大数据
本文研究了非高斯噪声情况下主用户的频谱检测问题,采用混合高斯模型拟合了非高斯噪声背景,并采用矩估计方法对混合高斯模型的混合系数等参数进行了估计。在此基础上,将混合高斯
目前的信息共享系统普遍存在着对内网终端的防火墙穿透问题。针对这个问题.本文在现有的UDP穿透和TCP穿透两种方案基础上对实际应用中的各种可能传输情景进行分析,提出了一种UD
知识经济对建立在工业经济基础上的传统会计模式提出了严峻的挑战,为了充分发挥会计对知识经济的反映和监督作用,就必须对会计的核算内容、方法、管理机制等方面进行适当创新。
零中频接收系统以其高集成、低功耗和易于单片集成等优点,正成为射频接收机中极具竞争力的一种结构。针对零中频接收机存在IQ不平衡和直流漂移等固有问题,对两种接收机形式由于
针对分水岭变换算法对噪声敏感和易于产生过分割的问题,提出了一种基于分水岭变换和模糊C均值聚类(FCM)的图像分割算法。该算法不仅解决了分水岭变换算法的过分割问题,而且同时解决了FCM算法初始值难以确定的不足。实验结果显示,该算法可以快速准确地分割出目标,是一种有效的方法。
MOD问题是指在进行过程调用时哪些信息可能在被调用的过程中被修改。针对C语言,本文提出了一种基于流敏感、上下文敏感指针分析结果的MOD分析算法。该算法通过计算表达式在指
实证研究显示两岸贸易与投资呈互补关系,两岸经贸政策,特别是台湾对大陆的经贸政策影响着"互补关系"的形成,影响的机制有4个:投资带动机制、投资返销机制、投资衍生机制、诱
在长期的社会演变和历史进程中,中西方思想史上积累了丰富的关于“和谐”的思想素材。在特定历史环境和生活条件下,不同的文化背景、民族风格和思维方式形成了特色鲜明、志趣各