Calibrated e-CUSUM Decoding for Quantized Reasoning Models: Why Token Log-Probability Is the Wrong Observable for Decoding Monitors
यह शोध पत्र तर्क देता है कि सेंटर्ड टोकन लॉग-प्रोबेबिलिटी (centered token log-probability), अपने अंतर्निहित मार्टिंगेल गुणों (martingale properties) और आत्मविश्वासी पुनरावृत्ति के दौरान मौन रहने के कारण, क्वांटाइज्ड रीजनिंग मॉडल्स की निगरानी के लिए एक अप्रभावी अवलोकन योग्य (observable) है, और इसके बजाय एक प्रशिक्षण-मुक्त, कैलिब्रेटेड e-CUSUM डिकोडर का प्रस्ताव देता है जो टोकन अनिश्चितता को वर्बेटम पुनरावृत्ति संकेतों (verbatim repetition signals) के साथ जोड़कर विफल होने वाले ट्रेसेस (failing traces) का सफलतापूर्वक पता लगाता है।