一类Stencil应用在众核NUMA架构的性能研究 |
| |
作者姓名: | 高凌云 勾文进 刘夏真 袁武 张鉴 陆忠华 |
| |
作者单位: | 1. 中国科学院计算机网络信息中心;2. 中国科学院大学;3. 华为技术有限公司 |
| |
基金项目: | 国家重点研发计划“面向复杂装备的CAE云服务平台研发”项目(2020YFB1709500); |
| |
摘 要: | 【应用背景】模板计算是CFD(计算流体动力学,Computational Fluid Dynamics)等科学计算的典型算法,其访存性能受到关注。NUMA架构因扩展性好,在以鲲鹏920处理器为代表的ARM架构上普遍被应用。【方法】使用性能分析工具和benchmark程序,对鲲鹏平台的访存和通信子系统进行性能测试。针对典型stencil应用软件CCFD V3.0开展热点分析和性能测试,并建立Roofline模型。【结果】鲲鹏920处理器依托其众核NUMA架构,单节点浮点性能、内存带宽峰值,以及通信时延均优于Intel Xeon E5-2680v2与一款国产处理器。单节点时,CCFD V3.0在鲲鹏平台的运行速度约是Intel平台的2~3倍,是国产处理器的1.5~2倍。【结论】基于ARM架构的鲲鹏平台应用移植简单,其NUMA架构对模板计算一类访存密集性应用具有优势。
|
关 键 词: | Stencil 鲲鹏920 性能评估 CFD |
|