Reward-free Pretraining for Reinforcement Learning via Occupancy Coverage Maximization
DGX agentarXiv:2606.21271v1 Announce Type: new Abstract: Sparse rewards pose a central challenge in reinforcement learning, since agents receive no informative signal until they reach their goal. Intrinsic-rew