tilelang.cuda.op.gemm.gemm_mma_sm120¶

Attributes¶

Classes¶

GemmMMASm120BlockScaled

SM120 warp-level block-scaled MMA lowering.

Module Contents¶

tilelang.cuda.op.gemm.gemm_mma_sm120.GEMM_INST_MMA_BLOCK_SCALED = 'cuda.mma.blockscaled'¶
class tilelang.cuda.op.gemm.gemm_mma_sm120.GemmMMASm120BlockScaled¶

Bases: tilelang.cuda.op.gemm.gemm_mma.GemmMMA

SM120 warp-level block-scaled MMA lowering.

intrin_emitter_cls¶
infer_layout(target, thread_nums)¶
Parameters:
  • target (tvm.target.Target)

  • thread_nums (int)

lower(layout_map, target, thread_bounds, thread_index, mbar_phase_expr=None)¶
Parameters:
  • layout_map (dict)

  • target (tvm.target.Target)

  • thread_bounds (tvm.ir.Range)

  • thread_index (tvm.tirx.PrimExpr)

  • mbar_phase_expr (tvm.tirx.PrimExpr | None)