Leveraging Text-to-Image Diffusion Models for Unsupervised Visual Object Tracking
DGX agentarXiv:2605.26933v1 Announce Type: new Abstract: Unsupervised visual object tracking is a challenging task that requires following arbitrary targets in videos without training on ground-truth annotatio