CoRe-Code: Collaborative Reinforcement Learning for Code Generation
arXiv:2605.24812v1 Announce Type: new Abstract: Large language models (LLMs) have achieved strong performance in code generation, but most methods rely on autoregressive decoding without global planni