REHEARSE: Experiential Rehearsal for Verbal Confidence Calibration in Large Language Models
DGX agentarXiv:2508.14390v2 Announce Type: replace-cross Abstract: Large language models (LLMs) often express verbal confidence that is poorly aligned with actual correctness, limiting their reliability in saf