Revisiting Regularized Policy Optimization for Stable and Efficient Reinforcement Learning in Two-Player Games
arXiv:2602.10894v2 Announce Type: replace Abstract: Two-player games such as board games have long been used as traditional benchmarks for reinforcement learning. This work revisits a policy optimizat