VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction
arXiv:2608.09448v1 Announce Type: cross Abstract: Test-time training (TTT) offers a lightweight way to adapt vision--language--action (VLA) policies from unlabeled deployment streams, but it remains d