Well-Posed KL-Regularized Control via Wasserstein and Kalman-Wasserstein KL Divergences
DGX agentarXiv:2602.02250v2 Announce Type: replace-cross Abstract: Kullback-Leibler (KL) divergence regularization is widely used in reinforcement learning, but it becomes infinite under support mismatch and c