Escaping the Agreement Trap: Defensibility Signals for Evaluating Rule-Governed AI
यह शोध पत्र नियम-शासित एआई (AI) के लिए एक नए मूल्यांकन ढांचे का प्रस्ताव करता है जो दोषपूर्ण सहमति-आधारित मेट्रिक्स को नीति-आधारित शुद्धता मापों, जैसे कि डिफेन्सिबिलिटी इंडेक्स (Defensibility Index) और प्रोबेबिलिस्टिक डिफेन्सिबिलिटी सिग्नल (Probabilistic Defensibility Signal) से बदल देता है, ताकि कंटेंट मॉडरेशन में वैध निर्णयों और वास्तविक त्रुटियों के बीच सटीक रूप से अंतर किया जा सके।