A Positive Case for Faithfulness: LLM Self-Explanations Help Predict Model Behavior
Dieses Paper führt den Normalized Simulatability Gain (NSG) ein, eine neue Metrik, die zeigt, dass Selbsterklärungen von LLMs trotz einiger irreführender Instanzen die Fähigkeit, das Modellverhalten über verschiedene Aufgaben hinweg vorherzusagen, signifikant verbessern und Erklärungen von externen Modellen übertreffen.
Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.