Target-Aligned Bellman Backup for Cross-domain Offline Reinforcement Learning
DGX agentarXiv:2605.22376v1 Announce Type: new Abstract: Cross-domain offline reinforcement learning (CDRL) aims to improve policy learning in a target domain by leveraging data collected from a source domain.