Current Location:home > Detailed Browse

Article Detail

CPU/ATI GPU 混合体系结构上DGEMM 的性能研究

Submit Time: 2016-06-08
Author: 李佳佳 1 ; 李兴建 1 ; 谭光明 1 ;
Institute: 1.中国科学院计算技术研究所;

Abstracts

本文报道了我们在CPU/ATI GPU 混合体系结构上优化双精度矩阵乘法(DGEMM)的工作。在真实应用中, CPU 与图形处理器(GPU)之间的数据传输是影响性能的关键因素。由于软件流水可以降低数据传输开销,我们提出了三种软件流水算法,分别是双缓存(Double Buffering)、数据重用(Data Reuse)和数据存储优化(Data Placement)。在AMD 公司的图形处理器(GPU)ATI HD5970 上,优化后DGEMM性能达到758 GFLOP/s,对应效率为82%,是ACML-GPU v1.1 性能的两倍。在Intel Westmere EP 和ATIHD5970 组成的异构系统上,性能达到844 GFLOP/s,效率为80%。我们进一步考察了多个CPU 和多个GPU上DGEMM 的扩展性,详细分析了体系结构方面的影响因素。分析表明,PCIe 总线和内存总线的竞争是异构系统上程序性能降低的重要影响因素。
Download Comment Hits:2470 Downloads:1752
Journal:信息技术快报
Recommended references: 李佳佳,李兴建,谭光明.(2016).CPU/ATI GPU 混合体系结构上DGEMM 的性能研究.信息技术快报.[ChinaXiv:201606.00051] (Click&Copy)
Version History
[V1] 2016-06-08 16:48:35 chinaXiv:201606.00051V1 Download
Related Paper

Download

Current Browse

Change Subject Browse

Cross Subject Browse

  • - NO