Actionable Interpretability Must Be Defined in Terms of Symmetries
यह शोध पत्र तर्क देता है कि क्रियाशील (actionable) AI व्याख्यात्मकता को चार विशिष्ट समरूपताओं (symmetries) के माध्यम से औपचारिक रूप से परिभाषित किया जाना चाहिए, जो व्याख्यात्मक मॉडलों के कठोर परीक्षण, डिजाइन और सत्यापन को सक्षम बनाती हैं, जो कि अनुमान (inference), संरेखण (alignment) और सुरक्षा अनुपालन को एकीकृत करने में सक्षम संभाव्य प्रणालियों के एक उपवर्ग के रूप में कार्य करते हैं।