Geometry-Preserving Unsupervised Alignment for Heterogeneous Foundation Models
DGX agentarXiv:2606.04385v1 Announce Type: new Abstract: Foundation models have driven rapid progress in computer vision, yet the two dominant paradigms, vision-language foundation models (VLMs) and vision-onl