Spatial-IQ: Deconstructing Spatial Intelligence via Hierarchical Capability Tests
DGX agentarXiv:2607.22864v1 Announce Type: cross Abstract: Multimodal large language models (MLLMs) excel at visual interpretation but fail on spatial reasoning tasks that humans solve reliably. Existing bench