Beyond Accuracy: Decomposing the Reasoning Efficiency of LLMs
arXiv:2602.09805v2 Announce Type: replace-cross Abstract: As reasoning LLMs increasingly trade tokens for accuracy through deliberation, search, and self-correction, a single accuracy score can no lon