FOCA: Future-Oriented Conditioning for Data-Efficient Vision-Language-Action Adaptation
DGX agentarXiv:2606.20867v1 Announce Type: new Abstract: Vision-Language-Action (VLA) models enable general-purpose robotic control via large-scale multimodal pretraining, yet their effectiveness under few-sho