UPAIR: Diagnosing Reasoning States via Uncertainty-Progress Alignment for Selective Intervention
DGX agentarXiv:2607.17188v2 Announce Type: replace Abstract: While test-time scaling improves the problem-solving ability of large reasoning models (LRMs) through additional inference-time computation, it can