Are Language Models Sensitive to Morally Irrelevant Distractors?
यह शोध पत्र इस बात की जांच करता है कि क्या बड़े भाषा मॉडल (लार्ज लैंग्वेज मॉडल्स) मानवीय नैतिक अस्थिरता प्रदर्शित करते हैं, यह दर्शाते हुए कि नैतिक रूप से अप्रासंगिक परिस्थितिजन्य व्याकुलता (डिस्ट्रैक्टर्स) को डालने से उनके नैतिक निर्णयों में 30% से अधिक का बदलाव आ सकता है, यहाँ तक कि कम अस्पष्टता वाले परिदृश्यों में भी।