Evaluating Agreement Between Human Consensus and Large Language Model Ratings of Suicide Reporting
यह अध्ययन प्रदर्शित करता है कि बड़े भाषा मॉडल (लार्ज लैंग्वेज मॉडल्स) TEMPOS फ्रेमवर्क का उपयोग करके आत्महत्या संबंधी समाचार लेखों को प्रभावी ढंग से रेट कर सकते हैं, जिसमें मानव रेटर्स के समान सहमति देखी गई है, जो यह सुझाव देता है कि मानवीय देखरेख के साथ मिलकर एआई जिम्मेदार आत्महत्या रिपोर्टिंग की निगरानी को बढ़ाने के लिए एक व्यवहार्य उपकरण है।