Native Parallel Reasoner: Reasoning in Parallelism via Self-Distilled Reinforcement Learning
DGX agentarXiv:2512.07461v3 Announce Type: replace Abstract: We introduce Native Parallel Reasoner (NPR), a teacher-free framework that enables Large Language Models (LLMs) to self-evolve genuine parallel reas