Who and What? Using Linguistic Features and Annotator Characteristics to Analyze Annotation Variation
यह शोध पत्र हानिकारक भाषा का पता लगाने वाले चार डेटासेट के पहले बड़े पैमाने के विश्लेषण को प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि एनोटेटर (अंशों) की विशेषताओं और भाषाई गुणों के बीच की अंतःक्रियाएं एनोटेशन भिन्नता को समझने के लिए महत्वपूर्ण हैं, जबकि यह भी प्रकट करता है कि प्रभाव के पैटर्न विभिन्न डेटासेट में काफी भिन्न होते हैं, जो व्यापक सामान्यीकरण के विरुद्ध चेतावनी देता है।