Multimodal Continuous Reasoning via Asymmetric Mutual Variational Learning
DGX agentarXiv:2607.00461v1 Announce Type: new Abstract: Multimodal Large Language Models (MLLMs) are often constrained by a language-space bottleneck, forcing complex visual reasoning into discrete tokens whi