← Neueste Arbeiten
🤖 AI

A Positive Case for Faithfulness: LLM Self-Explanations Help Predict Model Behavior

Dieses Paper führt den Normalized Simulatability Gain (NSG) ein, eine neue Metrik, die zeigt, dass Selbsterklärungen von LLMs trotz einiger irreführender Instanzen die Fähigkeit, das Modellverhalten über verschiedene Aufgaben hinweg vorherzusagen, signifikant verbessern und Erklärungen von externen Modellen übertreffen.

Ursprüngliche Autoren: Harry Mayne, Justin Singh Kang, Dewi Gould, Kannan Ramchandran, Adam Mahdi, Noah Y. Siegel

Veröffentlicht 2026-10-08
📖 1 Min. Lesezeit☕ Kaffeepausen-Lektüre

Ursprüngliche Autoren: Harry Mayne, Justin Singh Kang, Dewi Gould, Kannan Ramchandran, Adam Mahdi, Noah Y. Siegel

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). ✨ Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →