To See is Not to Learn: Protecting Multimodal Data from Unauthorized Fine-Tuning of Large Vision-Language Model
यह शोध पत्र MMGuard का प्रस्ताव करता है, जो एक सक्रिय रक्षा तंत्र है जो बड़े विजन-लैंग्वेज मॉडल्स (Large Vision-Language Models) के अनधिकृत फाइन-ट्यूनिंग को रोकने के लिए मानव-अदृश्य विक्षोभों (human-imperceptible perturbations) को इंजेक्ट करके और क्रॉस-मोडल बाइंडिंग्स को बाधित करके अनलर्नेबल मल्टीमॉडल उदाहरण उत्पन्न करता है, जिससे डेटा मालिकों के कॉपीराइट और गोपनीयता की रक्षा होती है।