← أحدث الأبحاث
🤖 AI

A Positive Case for Faithfulness: LLM Self-Explanations Help Predict Model Behavior

تقدم هذه الورقة "مكسب القابلية للمحاكاة المعياري" (NSG)، وهو مقياس جديد يثبت أن التفسيرات الذاتية للنماذج اللغوية الكبيرة، على الرغم من وجود بعض الحالات المضللة، تعزز بشكل كبير القدرة على التنبؤ بسلوك النموذج عبر مهام متنوعة وتتفوق على التفسيرات المقدمة من النماذج الخارجية.

المؤلفون الأصليون: Harry Mayne, Justin Singh Kang, Dewi Gould, Kannan Ramchandran, Adam Mahdi, Noah Y. Siegel

نُشر 2026-10-08
📖 1 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Harry Mayne, Justin Singh Kang, Dewi Gould, Kannan Ramchandran, Adam Mahdi, Noah Y. Siegel

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). ✨ هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →