On Verbalized Confidence Scores for LLMs
यह शोध पत्र कॉन्फिडेंस स्कोर के माध्यम से अपनी अनिश्चितता को व्यक्त करने में लार्ज लैंग्वेज मॉडल्स की विश्वसनीयता की जांच करता है, यह प्रदर्शित करते हुए कि हालांकि प्रभावशीलता प्रॉम्प्टिंग रणनीति के अनुसार भिन्न होती है, विशिष्ट विधियाँ कम ओवरहेड के साथ अच्छी तरह से कैलिब्रेटेड, मॉडल-अज्ञेय अनिश्चितता परिमाणीकरण प्रदान कर सकती हैं।