triton.experimental.gluon.language.nvidia.rubin.add4

triton.experimental.gluon.language.nvidia.rubin.add4(lhs, rhs, dtype=None, _semantic=None)

Add four-lane FP8 or FP4 operands with a Rubin packed instruction.