triton.experimental.gluon.language.nvidia.rubin.fma4

triton.experimental.gluon.language.nvidia.rubin.fma4(lhs, rhs, acc, dtype=None, _semantic=None)

Perform a Rubin four-lane packed FP8 or FP4 fused multiply-add.