Surfacing Variations to Calibrate Perceived Reliability of MLLM-generated Image Descriptions
DGX agentarXiv:2507.15692v1 Announce Type: cross Abstract: Multimodal large language models (MLLMs) provide new opportunities for blind and low vision (BLV) people to access visual information in their daily l