How do LLMs Compute Verbal Confidence
यह शोध पत्र यह प्रदर्शित करता है कि जेम्मा 3 (Gemma 3) और क्वेन 2.5 (Qwen 2.5) जैसे बड़े भाषा मॉडल जनरेशन के दौरान आत्मविश्वास के जटिल, उत्तर-गुणवत्ता-आधारित निरूपणों की गणना करने के बजाय उन्हें स्वतः ही कंप्यूट और कैश करते हैं, जो यह प्रकट करता है कि मौखिक आत्मविश्वास टोकन संभावनाओं के सरल पश्चात-निर्माण (post-hoc reconstruction) के बजाय वास्तविक मेटाकॉग्निटिव आत्म-मूल्यांकन को दर्शाता है।