Asymptotic Risk Calibration for Selective Question Answering
DGX agentarXiv:2608.12008v1 Announce Type: new Abstract: Large language models (LLMs) may generate fluent but incorrect answers, making uncertainty quantification important for reliable question answering. How