Hierarchical Message-Passing Policies for Multi-Agent Reinforcement Learning
DGX agentarXiv:2507.23604v2 Announce Type: replace Abstract: Decentralized Multi-Agent Reinforcement Learning (MARL) methods allow for learning scalable multi-agent policies, but suffer from partial observabil