LLM Judges Can Be Too Generous When There Is No Reference Answer
DGX agentarXiv:2607.12885v1 Announce Type: new Abstract: LLM judges are increasingly being used to evaluate open-ended model responses, often in no-reference settings where a ground-truth answer is unavailable