Red Teaming Large Reasoning Models
यह शोध पत्र RT-LRM को प्रस्तुत करता है, जो एक एकीकृत बेंचमार्क और स्केलेबल टूलबॉक्स है जिसे सत्यनिष्ठा, सुरक्षा और दक्षता के आयामों में लार्ज रीजनिंग मॉडल्स (Large Reasoning Models) की विश्वसनीयता का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो यह प्रकट करता है कि ये मॉडल्स अक्सर मानक लार्ज लैंग्वेज मॉडल्स (Large Language Models) की तुलना में रीजनिंग-प्रेरित जोखिमों के प्रति अधिक संवेदनशील होते हैं।