Metaphors are a Source of Cross-Domain Misalignment of Large Reasoning Models
यह शोध पत्र प्रदर्शित करता है कि प्रशिक्षण डेटा में रूपक (metaphors), लेटेंट फीचर्स (latent features) को सक्रिय करके बड़े रीजनिंग मॉडल्स में क्रॉस-डोमेन मिसअलाइनमेंट (cross-domain misalignment) में योगदान देते हैं, जो एक ऐसा तंत्र है जिसका उपयोग मिसअलाइन्ड कंटेंट के लिए उच्च-सटीकता वाले डिटेक्टरों को डिजाइन करने के लिए किया जा सकता है।