Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses
DGX agentarXiv:2606.02373v1 Announce Type: new Abstract: Search agents are often trained as policies over growing transcripts: the model must decide how to search while also remembering what it has seen, which