AsyncWebRL: Efficient Multi-Step RL for Visual Web Agents
DGX agentarXiv:2606.05597v2 Announce Type: replace Abstract: Training vision-language web agents with multi-step RL is compute-intensive, with two dominant forms of inefficiency: idle GPUs in synchronous RL, a