FPTQuant: Function-Preserving Transforms for LLM Quantization
DGX agentarXiv:2506.04985v2 Announce Type: replace Abstract: Large language models (LLMs) require substantial compute, and thus energy, at inference time. While quantizing weights and activations is effective