Learning to Adapt SFT Data for Better Reasoning Generalization
DGX agentarXiv:2605.26924v1 Announce Type: new Abstract: Large language models (LLMs) have achieved remarkable progress, with post-training playing a crucial role in enhancing their reasoning capabilities. Amo