On the Generalization Gap in Self-Evolving Language Model Reasoning
DGX agentarXiv:2606.01075v1 Announce Type: new Abstract: Recent work suggests that large language models (LLMs) can improve through self-evolution (SE), using supervision signals generated by the model itself.