Invariant Gradient Alignment for Robust Reasoning Distillation
DGX agentarXiv:2606.05025v1 Announce Type: cross Abstract: Large language models (LLMs) suffer from shortcut learning: they systematically fail on out-of-distribution (OOD) inputs whose semantic surface differ