UniFS: Unified Fast-to-Slow Hierarchical Architecture for Vision-Language-Action Models
arXiv:2606.22794v1 Announce Type: new Abstract: Mainstream Fast-Slow dual system vision-language-action models decouple a high-frequency action expert from a low-frequency vision-language model for ef