Unsupervised Partner Design Enables Robust Ad-hoc Teamwork
DGX agentarXiv:2508.06336v2 Announce Type: replace-cross Abstract: We introduce Unsupervised Partner Design (UPD), a population-free multi-agent reinforcement learning method for robust ad-hoc teamwork. UPD ge