Cross-Domain Generalization Limits of Vision Foundation Models in Facial Deepfake Detection
Questo articolo valuta sistematicamente i limiti di generalizzazione cross-dominio dei Modelli Fondamentali per la Visione nella rilevazione di deepfake facciali, rivelando che, sebbene questi modelli eccellano nell'identificare la sintesi dell'intero volto, faticano con le tecniche di editing localizzato a causa di compromessi intrinseci tra i paradigmi di pre-addestramento e le strutture di valutazione tramite sonda lineare.