Guiding Diffusion-based Reconstruction with Contrastive Signals for Balanced Visual Representation
Cet article propose la Reconstruction Contrastive par Diffusion (DCR), une méthode qui intègre des signaux contrastifs dérivés des images reconstruites dans le processus de diffusion pour surmonter les limites des encodeurs visuels CLIP et équilibrer simultanément les capacités de discrimination et de perception des détails.