Towards Robustness against Typographic Attack with Training-free Concept Localization
यह शोध पत्र एक नवीन, प्रशिक्षण-मुक्त मैकेनिस्टिक इंटरप्रिटेबिलिटी विधि प्रस्तावित करता है जो लेक्सिकल (शब्दकोशीय) जानकारी को एनकोड करने के लिए जिम्मेदार विशिष्ट विजन ट्रांसफॉर्मर सर्किटों की पहचान करती है और उनमें हस्तक्षेप करती है, जिससे बिना किसी अतिरिक्त प्रशिक्षण के टाइपोग्राफिक हमलों के विरुद्ध CLIP-आधारित लार्ज विजन लैंग्वेज मॉडल्स की मजबूती को महत्वपूर्ण रूप से बढ़ाया जा सकता है।