← أحدث الأبحاث
💬 NLP

Can Large Language Models Still Explain Themselves? Investigating the Impact of Quantization on Self-Explanations

تبحث هذه الورقة في كيفية تأثير التكميم على التفسيرات الذاتية للنماذج اللغوية الكبيرة، وتجد أنه بينما يتسبب ذلك عمومًا في انخفاضات متوسطة في جودة التفسير، والأمانة، وثقة المستخدم، فإن التأثير يتباين باختلاف السياق وحجم النموذج، مما يستلزم التحقق من الحالة الخاصة قبل النشر.

المؤلفون الأصليون: Qianli Wang, Nils Feldhus, Pepa Atanasova, Fedor Splitt, Simon Ostermann, Sebastian Möller, Vera Schmitt

نُشر 2026-08-26
📖 3 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Qianli Wang, Nils Feldhus, Pepa Atanasova, Fedor Splitt, Simon Ostermann, Sebastian Möller, Vera Schmitt

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تُعد النماذج اللغوية الكبيرة أدوات قوية يمكنها الكتابة، والتفكير، وشرح طريقة تفكيرها. وعندما تتخذ هذه الأنظمة قراراً ما، يمكنها غالباً توليد جملة أو جملتين تصفان سبب اختيارها لهذا المسار، وهي ميزة تُعرف باسم "التفسير الذاتي". وتكتسب هذه القدرة أهمية متزايدة في المواقف عالية المخاطر، مثل التشخيص الطبي أو التحليل القانوني، حيث يحتاج المستخدمون إلى الثقة في أن الآلة تفكر بشكل صحيح ولا تخمن فحسب. ولجعل هذه الأنظمة الضخمة أسرع وأرخص في التشغيل على الأجهزة اليومية، يستخدم المهندسون غالباً تقنية تُسمى "الكمية" (quantization). تشبه هذه العملية ضغط صورة عالية الدقة إلى حجم ملف أصغر؛ فهي تقلل من دقة الأرقام داخل النموذج لتوفير المساحة وتسريع الحسابات، لكنها تخاطر بفقدان بعض التفاصيل الدقيقة التي تجعل الصورة واضحة. والسؤال الجوهري الذي يواجه الباحثين هو ما إذا كان هذا الضغط يؤدي أيضاً إلى طمس قدرة النموذج على شرح نفسه بصدق.

لقد وضع فريق من العلماء نصب أعينهم استقصاء هذه المشكلة تحديداً. حيث أخذوا عدة نماذج لغوية كبيرة بأحجام مختلفة وطبقوا عليها ثلاث تقنيات ضغط شائعة، مما أدى إلى إنشاء نسخ تستخدم بتات أقل من المعلومات لتخزين معرفتها. ثم طلبوا من هذه النماذج توليد نوعين من التفسيرات لمهام متنوعة: المبررات باللغة الطبيعية، وهي جمل مكتوبة تشرح قراراً ما، والأمثلة "الواقعية المضادة" (counterfactual examples)، وهي نسخ معدلة قليلاً من المدخلات التي من شأنها أن تجعل النموذج يغير رأيه. ومن خلال مقارنة النماذج المضغوطة بنسخها الأصلية غير المضغوطة، استطاع الباحثون معرفة ما إذا كان فعل تقليص حجم النموذج يؤدي أيضاً إلى تقليص قدرته على التفكير الصادق.

أظهرت النتائج أنه بينما يكون للضغط تأثير، إلا أنه ليس كارثياً كما يُخشى، وإن كان لا يخلو من التكلفة. فقد وجدت الدراسة أن "الكمية" تؤدي عادةً إلى انخفاض متوسط في جودة التفسيرات، حيث تنخفض الدرجات بنسبة تصل إلى 4.4 بالمئة، وانخفاض مماثل في "الأمانة" (faithfulness)، بمعنى أن التفسيرات أصبحت أقل توافقاً مع المنطق الداخلي الفعلي للنموذج بنسبة تصل إلى 3.9 بالمئة. ومع ذلك، كانت تجربة البشر لهذه التغييرات أكثر وضوحاً. ففي دراسة شملت ثمانية وأربعين شخصاً قرأوا التفسيرات وقيموها، وُجد أن النماذج المضغوطة كانت تُعتبر أقل موثوقية وأقل تماسكاً بشكل ملحوظ، حيث انخفضت درجات الموثوقية بنسبة تصل إلى 8.5 بالمئة. ويشير هذا إلى أنه بينما قد تظل النماذج وظيفية من الناحية التقنية، إلا أن التفسيرات التي تنتجها تبدو أقل موثوقية للقارئ البشري.

ومن المثير للاهتمام أن الباحثين اكتشفوا أن الحجم لا يضمن دائماً الصمود. فبينما كانت النماذج الأكبر حجماً أفضل عموماً في الحفاظ على صدق تفسيراتها عند ضغطها، إلا أنها لم تنتج بالضرورة نصوصاً ذات جودة أعلى من النماذج الأصغر غير المضغلة. علاوة على ذلك، لم تثبت أي طريقة ضغط واحدة أنها الأفضل في جميع المجالات؛ فبعض التقنيات حافظت على دقة المهام بشكل أفضل، بينما كانت تقنيات أخرى أفضل قليلاً في الحفاظ على تماسك التفسيرات. كما سلطت الدراسة الضوء على قصور في كيفية تقييمنا لهذه الأنظمة حالياً؛ حيث وجد الباحثون أن استخدام ذكاء اصطناعي آخر للحكم على جودة هذه التفسيرات فشل في مطابقة الحكم البشري. فقد أغفل الحكام الآليون الطرق الدقيقة التي أدى بها الضغط إلى تدهور موثوقية النص، وهي فجوة لا يمكن إلا للتقييم البشري كشفها.

وفي الختام، تخلص الورقة البحثية إلى أن "الكمية" تظل استراتيجية قابلة للتطبيق لنشر هذه النماذج، بشرط أن يختبر المطورون التفسيرات المحددة التي ستولدها نماذجهم قبل وضعها قيد التشغيل. إن التدهور في الأداء غالباً ما يكون صغيراً بما يكفي ليكون مقبولاً، ولكن في المواقف التي تكون فيها الشفافية أمراً حاسماً، مثل الرعاية الصحية أو العدالة، فإن الخسارة الطفيفة في التماسك والموثوقية تكتسي أهمية بالغة. وتشير النتائج إلى عدم وجود حل واحد يناسب الجميع؛ وبدلاً من ذلك، يجب على الممارسين التحقق بعناً من كيفية تأثير الضغط على النوع المحدد من التفسيرات الذي سيقدمه نظامهم، لضمان بقاء النموذج شريكاً موثوقاً في اتخاذ القرار حتى بعد ضغطه.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →