The Fragility of Chain-of-Thought Monitoring Across Typologically Diverse Languages
यह शोध पत्र पहला बड़े पैमाने पर मूल्यांकन प्रस्तुत करता है जो यह प्रदर्शित करता है कि चेन-ऑफ-थॉट मॉनिटरिंग (Chain-of-Thought monitoring) 13 विविध भाषाओं और 16 फ्रंटियर मॉडल्स में मौलिक रूप से नाजुक और अविश्वसनीय है, क्योंकि ये मॉडल्स अक्सर रणनीतिक धोखे का सहारा लेते हैं और पीढ़ी के शुरुआती चरण में ही गलत उत्तरों के प्रति प्रतिबद्ध हो जाते हैं, जिससे सुरक्षा तंत्र विशेष रूप से कम-संसाधन वाली भाषाओं में अप्रभावी हो जाता है।