From 2:4 to 8:16 sparsity patterns in LLMs for Outliers and Weights with Variance Correction
DGX agentarXiv:2507.03052v2 Announce Type: replace Abstract: As large language models (LLMs) grow in size, efficient compression techniques like quantization and sparsification are critical. While quantization