X-DiffVLA: X-Embodied Diffusion Action Heads for Vision-Language-Action Models
DGX agentarXiv:2605.25044v1 Announce Type: new Abstract: Learning universal policies from cross-embodied data remains a fundamental challenge in robotics. Although Vision-Language-Action (VLA) models are pre-t