Resolving Action Bottleneck: Agentic Reinforcement Learning Informed by Token-Level Energy
DGX agentarXiv:2605.14558v1 Announce Type: cross Abstract: Agentic reinforcement learning trains large language models using multi-turn trajectories that interleave long reasoning traces with short environment