Does Visual Information Play a Decisive Role in Vision-Language-Action Model Driving Behavior?
DGX agentarXiv:2605.31041v1 Announce Type: cross Abstract: Vision-Language-Action (VLA) models have demonstrated promising capability in autonomous driving, highlighting the potential of unified multimodal arc