One Layer Is Enough: Adapting Pretrained Visual Encoders for Image Generation
DGX agentVisual generative models (e.g., diffusion models) typically operate in compressed latent spaces to balance training efficiency and sample quality. In parallel, there has been growing interest in lever