TideRL: Boosting Agentic RL Goodput with Readiness-Aware Scheduling
DGX agentarXiv:2608.10402v1 Announce Type: new Abstract: Reinforcement learning (RL) for large language models is moving toward multi-turn agentic workloads, where rollout tasks repeatedly pause for external e