尧图网络科技YAOTU DIGITAL 获取报价
获取报价
首页 / 资讯中心 / 文章详情

164、MLIR的HBM(高带宽内存)与GDDR优化

发布时间:2026/9/25 12:01:07

资讯中心
01
ARTICLE

164、MLIR的HBM(高带宽内存)与GDDR优化

164、MLIR的HBM(高带宽内存)与GDDR优化
MLIR的HBM与GDDR优化:一次带宽踩坑实录去年在调一个AI推理引擎的MLIR后端时,遇到一个诡异的性能问题:同样的计算图,在A100上跑出理论带宽的85%,换到H100上反而掉到60%。当时盯着nvidia-smi的带宽利用率,百思不得其解。后来扒开MLIR的affine loop tiling和memory space映射,才发现问题出在HBM的bank conflict和GDDR的page burst上。今天就把这些坑掰开揉碎,聊聊MLIR里怎么针对高带宽内存做优化。从一次bank conflict说起先看一个典型的MLIR片段,这是某个卷积算子的tiling后代码:#map = affine_map(d0, d1) - (d0 * 64 + d1) func.func @conv_tiled(%input: memref1024x1024xf16, 3, %output: memref1024x1024xf16, 3) { affine.for %i = 0 to 1024 step 64 { affine.for %j = 0 to 1024 step 64 { // 这里踩过坑:直接按行连续访问,HBM bank冲突爆炸 affine.for %ii = 0 to 64 { affine.for %jj = 0 to 64 { %val = affine.load %in
02
RELATED NEWS

相关资讯

更多网站建设与数字化升级内容

03
WHY YAOTU

想打造同款高转化官网?

懂行业、懂生意,从建站到增长一站式陪跑

◈

场景化定制

不做模板站,围绕你的业务场景量身设计,小众不撞款。

◐

营销型架构

以转化目标组织内容与路径,让官网真正带来询盘。

▲

全周期服务

设计、开发、运营、运维一体,上线只是开始。

免费获取你的建站方案

留下需求,专属顾问 24 小时内为你输出方案建议。