CODA: Coordination via On-Policy Diffusion for Multi-Agent Offline Reinforcement Learning
DGX agentarXiv:2604.23308v1 Announce Type: new Abstract: Offline multi-agent reinforcement learning (MARL) enables policy learning from fixed datasets, but is prone to coordination failure: agents trained on s