Provably Efficient Off-Policy Adversarial Imitation Learning with Convergence Guarantees
arXiv:2405.16668v2 Announce Type: replace Abstract: Adversarial Imitation Learning (AIL) faces challenges with sample inefficiency because of its reliance on sufficient on-policy data to evaluate the