Activation-Deactivation: A General Framework for Robust Post-hoc Explainable AI
यह शोध पत्र एक्टिवेशन-डीएक्टिवेशन (AD) को प्रस्तुत करता है, जो एक नवीन पोस्ट-हॉक व्याख्यात्मकता ढांचा (explainability framework) है जो अधिक सुदृढ़ और हस्तांतरणीय स्पष्टीकरण उत्पन्न करने के लिए इनपुट गड़बड़ी (input perturbations) के स्थान पर आंतरिक मॉडल निष्क्रियता (internal model deactivation) का उपयोग करता है, जिसमें अतिरिक्त प्रशिक्षण की आवश्यकता नहीं होती है।