← أحدث الأبحاث
🤖 AI

HalluTracer: Hallucination Detection via Depth-Averaging Truth Signals

يعتبر HalluTracer إطار عمل للكشف عن الهلوسة بنظام الصندوق الأبيض، وهو يعمل على تحسين الدقة من خلال تجميع إشارات الصدق عبر جميع طبقات المحولات (transformer layers) عبر عملية متوسط عمق بسيطة، مما يتغلب بذلك على فقدان المعلومات في الأساليب الحالية التي تعتمد على طبقات أو مكونات معزولة.

المؤلفون الأصليون: Zhihao Guo, Zonghan Wu, Huan Huo, DaYong Ye, Junwei Zhang, Weiran Yao, Zhiwei Liu, Qingsong Wen, Yilei Shao

نُشر 2026-08-18
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Zhihao Guo, Zonghan Wu, Huan Huo, DaYong Ye, Junwei Zhang, Weiran Yao, Zhiwei Liu, Qingsong Wen, Yilei Shao

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تُعد النماذج اللغوية الكبيرة هي المحركات التي تقف وراء العديد من أدوات الذكاء الاصطناعي الحديثة، وهي قادرة على كتابة نصوص بليغة، والإجابة على أسئلة معقدة، وحل المشكلات بسلاسة تشبه السلاسة البشرية. ومع ذلك، تعاني هذه الأنظمة من خلل مستمر: فهي أحياناً تولد عبارات واثقة ولكنها غير صحيحة واقعياً، وهو فشل يُعرف باسم "الهلوسة". هذا ليس مجرد خلل في المخرجات؛ بل هو خطر جوهري يمس الموثوقية، خاصة عندما تُستخدم هذه النماذج في مجالات عالية الخطورة مثل الرعاية الصحية أو القانون. لسنوات، اشتبه الباحثون في أنه حتى عندما يكذب النموذج، فإن آلياته الداخلية تحتفظ بالحقيقة. فدماغ النموذج، إن جاز التعبير، يشفر إشارة تميز بين الحقيقة والتلفيق قبل وقت طويل من ظهور الكلمات النهائية على الشاشة. وكان التحدي يكمن في تعلم كيفية قراءة تلك الإشارة دون الضياع في ضجيج بنية النموذج الضخمة والمعقدة.

لقد طور فريق من الباحثين الآن طريقة جديدة تسمى "HalluTracer" لحل هذه المشكلة. فبدلاً من محاولة البحث عن "مفتاح حقيقة" واحد داخل النموذج أو النظر إلى جزء واحد فقط من معالجته، قرروا الاستماع إلى المحادثة بأكملها التي يجريها النموذج مع نفسه. فبينما يعالج النموذج اللغوي الكبير أمراً ما، فإنه يمرر المعلومات عبر سلسلة من الطبقات المتراكمة، مما يصقل فهمه خطوة بخطوة. وقد اكتشف الباحثون أنه عند كل طبقة من هذه الطبقات، ينتج النموذج إشارة خافتة وضئيلة تشير إلى ما إذا كانت الإجابة القادمة من المرجح أن تكون صحيحة أم خاطئة. وبشكل فردي، تكون هذه الإشارات ضعيفة ومليئة بالضجيج، مثل محاولة سماع همس في غرفة مزدحمة. لكن الباحثين وجدوا أن هذه الهمسات ليست عشوائية؛ فهي متسقة بما يكفي بحيث إذا استمعت إليها جميعاً معاً، تصبح الرسالة واضحة.

يكمن جوهر اكتشافهم في رؤية هندسية حول كيفية عمل هذه الطبقات. فقد وجدوا أن الطريقة التي تتحقق بها كل طبقة من الحقيقة تختلف قليلاً عن الطبقة التي تسبقها، كما لو أن كل طبقة تنظر إلى المشكلة من زاوية مختلفة قليلاً. ولأن هذه الزوايا مختلفة جداً، فإن الأخطاء أو الضجيج في طبقة ما لا يتطابق مع الأخطاء في الطبقة التالية. وهذا أمر بالغ الأهمية؛ فعندما قام الباحثون بمتوسط الإشارات من كل طبقة، تلاشت الضوضاء العشوائية، بينما نمت إشارة الحقيقة المتسقة. الأمر يشبه التقاط صورة بيد مرتجفة: قد تكون لقطة واحدة ضبابية، ولكن إذا التقطت لقطات عديدة من مواقع مختلفة قليلاً ودمجتها معاً، تصبح الصورة النهائية حادة وواضحة. ومن خلال مجرد حساب متوسط إشارات الحقيقة عبر جميع الطبقات، استطاع نظامهم اكتشاف الهلوسة بدقة مذهلة، متفوقاً في كثير من الأحيان على الطرق التي حاولت اختيار الطبقة "الأفضل" للنظر إليها.

ولاختبار هذه الفكرة، طبق الفريق "HalluTracer" على ستة نماذج لغوية كبيرة وخمسة معايير مرجعية مصمسة لكشف الأخطاء الواقعية. وكانت النتائج متسقة وقوية؛ حيث اكتشفت الطريقة الجديدة الهلوسة بشكل أفضل من التقنيات السابقة في جميع المجالات، مع تحسينات تتراوح بين واحد وأربعة عشر نقطة مئوية اعتماداً على صعوبة المهمة. وفي المهام المعقدة بشكل خاص والتي تتضمن استدلالاً متعدد الخطوات، كان التحسن أكثر دراماتيكية، حيث حقق النظام الجديد درجات كشف تقترب من الكمال في الحالات التي تعثرت فيها الطرق القديمة. كما أثبت الباحثون أن هذا النجاح لم يكن ناتجاً عن اختيار محظوظ للجزء الذي يجب النظر إليه في النموذج؛ فقد أظهروا أن الإشارة موزعة بالتساوي لدرجة أنه لا يهم أي مكون داخلي محدد فحصوه؛ إذ جاءت القوة بالكامل من عملية دمج المعلومات من كامل عمق النموذج.

يغير هذا العمل طريقة تفكيرنا في اكتشاف الأكاذيب في الذكاء الاصطناعي. ففي السابق، كان التركيز ينصب على إيجاد اللحظة المثالية أو الطبقة المثالية لقراءة عقل النموذج. لكن "HalluTracer" يظهر أن الحقيقة ليست مخبأة في بقعة واحدة، بل هي منسوجة طوال العملية بأكملها. ومن خلال معاملة الحالة الداخلية للنموذج كرحلة وليس كلقطة ثابتة، حوّل الباحثون مشكلة الاختيار الصعبة إلى مشكلة بسيطة من حساب المتوسطات. وتتميز هذه الطة بأنها خفيفة وسريعة، وقادرة على رصد الهلوسة المحتملة قبل أن ينهي النموذج توليد إجابته حتى. وهذا يعني أنه في المستقبل، يمكن تجهيز أنظمة الذكاء الاصطناعي بمراقب سلامة في الوقت الفعلي يستمع إلى الاستدلال الداخلي للنموذذ ويوقف البيان الخاطئ قبل أن يصل إلى المستخدم، مما يجعل هذه الأدوات القوية أكثر موثوقية للاستخدام في العالم الحقيقي.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →