MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models
DGX agentarXiv:2605.01520v1 Announce Type: cross Abstract: Vision-Language Models (VLMs) frequently suffer from visual perception errors and hallucinations that compromise answer accuracy in complex reasoning