首页 | 本学科首页   官方微博 | 高级检索  
     

一类Stencil应用在众核NUMA架构的性能研究
作者姓名:高凌云  勾文进  刘夏真  袁武  张鉴  陆忠华
作者单位:1. 中国科学院计算机网络信息中心;2. 中国科学院大学;3. 华为技术有限公司
基金项目:国家重点研发计划“面向复杂装备的CAE云服务平台研发”项目(2020YFB1709500);
摘    要:【应用背景】模板计算是CFD(计算流体动力学,Computational Fluid Dynamics)等科学计算的典型算法,其访存性能受到关注。NUMA架构因扩展性好,在以鲲鹏920处理器为代表的ARM架构上普遍被应用。【方法】使用性能分析工具和benchmark程序,对鲲鹏平台的访存和通信子系统进行性能测试。针对典型stencil应用软件CCFD V3.0开展热点分析和性能测试,并建立Roofline模型。【结果】鲲鹏920处理器依托其众核NUMA架构,单节点浮点性能、内存带宽峰值,以及通信时延均优于Intel Xeon E5-2680v2与一款国产处理器。单节点时,CCFD V3.0在鲲鹏平台的运行速度约是Intel平台的2~3倍,是国产处理器的1.5~2倍。【结论】基于ARM架构的鲲鹏平台应用移植简单,其NUMA架构对模板计算一类访存密集性应用具有优势。

关 键 词:Stencil  鲲鹏920  性能评估  CFD
设为首页 | 免责声明 | 关于勤云 | 加入收藏

Copyright©北京勤云科技发展有限公司  京ICP备09084417号