Architecture, Not Scale: Circuit Localization in Large Language Models
تتحدى هذه الورقة الافتراض القائل بأن التفسير الآلي يزداد سوءاً بطبيعته مع حجم النموذج، مبرهنةً بدلاً من ذلك على أن الخيارات المعمارية مثل انتباه الاستعلام المجموع وعتبات القياس المحددة تؤدي إلى تحديد أكثر تركيزاً واستقراراً للدوائر في النماذج اللغوية الكبيرة.