Stable FP4 Training via Transposition-Invariant Block Quantization
DGX agentarXiv:2607.24953v1 Announce Type: cross Abstract: Reducing training precision is a key lever for improving the e ciency of large language model (LLM) training, but pushing beyond FP8 to 4-bit oating p