一种GPU资源感知的矩阵乘法并行性能分析模型构建方法
申请号:CN202510939915
申请日期:2025-07-09
公开号:CN120429216B
公开日期:2025-11-21
类型:发明专利
摘要
本发明公开了一种GPU资源感知的矩阵乘法并行性能分析模型构建方法,涉及高性能计算的技术领域,其依托于Roofline原理,结合带宽模型、资源负载模型、指令依赖模型构建性能分析模型,并成功应用于矩阵乘法场景中,实现资源感知的矩阵乘法应用下的并行性能量化。本发明不受平台限制能够实现资源感知,并在矩阵乘法场景下能够通过性能分析模型分辨最大化资源使用、最优化性能的参数设置,为后续的并行程序优化工作打下基础;本发明使用的硬件参数是完全基于可公开获取的GPU硬件参数,使得非GPU专业人员也可以使用该模型对程序进行性能评估。
技术关键词
分析模型构建方法
全局内存访问
强度计算方法
矩阵
资源
访存指令
指令发射方法
理论
参数
地址映射
因子
综合性
规模
效应
媒介
冗余度
场景