tilelang.cuda.op.gemm.gemm_mma_sm120¶
Attributes¶
Classes¶
SM120 warp-level block-scaled MMA lowering. |
Module Contents¶
- tilelang.cuda.op.gemm.gemm_mma_sm120.GEMM_INST_MMA_BLOCK_SCALED = 'cuda.mma.blockscaled'¶
- class tilelang.cuda.op.gemm.gemm_mma_sm120.GemmMMASm120BlockScaled¶
Bases:
tilelang.cuda.op.gemm.gemm_mma.GemmMMASM120 warp-level block-scaled MMA lowering.
- intrin_emitter_cls¶
- infer_layout(target, thread_nums)¶
- Parameters:
target (tvm.target.Target)
thread_nums (int)
- lower(layout_map, target, thread_bounds, thread_index, mbar_phase_expr=None)¶
- Parameters:
layout_map (dict)
target (tvm.target.Target)
thread_bounds (tvm.ir.Range)
thread_index (tvm.tirx.PrimExpr)
mbar_phase_expr (tvm.tirx.PrimExpr | None)