Beyond Solvability: Task Learnability as a Static Prior for LLM RL Post-Training
DGX agentarXiv:2608.09217v1 Announce Type: cross Abstract: Reinforcement learning (RL) has become a central post-training paradigm for eliciting reasoning capabilities in large language models, yet uniform tas