Internalizing Curriculum Judgment for LLM Reinforcement Fine-Tuning
DGX agentarXiv:2605.11235v1 Announce Type: new Abstract: In LLM Reinforcement Fine-Tuning (RFT), curriculum learning drives both efficiency and performance. Yet, current methods externalize curriculum judgment