Listen to the Layers: Mitigating Hallucinations with Inter-Layer Disagreement
تقترح الورقة البحثية خوارزمية CoCoA، وهي خوارزمية فك تشفير لا تتطلب تدريباً تعمل على الحد من هلوسة النماذج اللغوية الكبيرة من خلال اكتشاف المخرجات غير الصحيحة واقعياً ومعاقبتها عبر تحليل عدم الاستقرار التمثيلي والتباين الداخلي عبر الطبقات الوسطى للنموذج.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
تخيل أن لديك صديقاً موهوباً جداً، واسع الاطلاع، يحب سرد القصص. هذا الصديق فصيح للغاية ويتحدث بقواعد لغوية مثالية، لكنه أحياناً، عندما يشعر ببعض عدم اليقين بشأن حقيقة ما، يقوم باختلاق شيء ما لمجرد استمرار تدفق المحادثة. قد يقول مثلاً: "عاصمة أستراليا هي سيدني"، بكل ثقة، رغم أنها في الواقع كانبيرا. في عالم الذكاء الاصطناعي، نسمي هذا الهلوسة (Hallucination).
تقدم الورقة البحثية التي شاركتها طريقة ذكية لمنع هذا الصديق من اختلاق الأمور، دون الحاجة إلى إعادة تعليمه كل شيء من الصفر. لقد أطلقوا على حلهم اسم CoCoA (المدرك للارتباك والاتساق - Confusion and Consistency Aware).
إليك كيف يعمل، مقسماً ببعض التشبيهات من الحياة اليومية:
1. المشكلة: "المتحدث اللبق" مقابل "الحقيقة"
نماذج الذكاء الاصطناعي الحالية (مثل تلك التي تشغل روبوتات الدردشة) تشبه المتحدثين اللبقين. إنهم بارعون في التنبؤ بالكلمة التالية في الجملة. إذا سألت: "من فاز بكأس العالم 2024؟" ولم يكن النموذج متأكداً بنسبة 100%، فقد يخمن ببساطة فريقاً يبدو منطقياً ليحافظ على مثالية الجملة من الناحية النحوية. هو لا يحاول الكذب؛ هو فقط يحاول أن يكون فصيحاً.
2. الرؤية: الاستماع إلى "المونولوج الداخلي"
أدرك الباحثون أنه قبل أن يعطيك الذكاء الاصطناعي إجابة، فإنه يعالج تلك الإجابة عبر طبقات عديدة من "التفكير" (مثل تفكير الإنسان في مسألة ما خطوة بخ بخطوة).
- التشبيه: تخيل لجنة مكونة من 30 خبيراً (طبقات الذكاء الاصطناعي) يناقشون سؤالاً.
- إذا كانوا يعرفون الإجابة: يوافق جميع الخمسة والثلاثين خبيراً في الإيماء برؤوسهم. الإشارة تكون مستقرة.
- إذا كانوا يختلقون الإجابة: قد يخمن الخبراء الأوائل، ثم يبدأ الخبراء في المنتصف بالجدال، ثم يشعر الخبراء الأواخر بالارتباك. هناك خلاف وعدم استقرار في منتصف الغرفة.
تفترض الورقة البحثية أن الهلوسة تحدث عندما تكون الطبقات الداخلية للذكاء الاصطناعي مرتبكة ومتنازعة فيما بينها.
3. الحل: "كاشف الخلاف" (CoCoA)
بدلاً من مجرد ترك الذكاء الاصطناعي يختار الإجابة الأكثر فصاحة (وهو ما يشبه ترك المتحدث اللبق ينتصر)، يعمل CoCoA كـ مفتش جودة.
إليك العملية خطوة بخطوة:
- توليد الخيارات: يفكر الذكاء الاصطناعي في بضعة إجابات محتملة (مثل "كاليفورنيا"، أو "جورجيا"، أو "ساوث كارولينا" للسؤال: أي ولاية تنتج أكبر قدر من الخوخ؟).
- الاستماع إلى الطبقات: لكل خيار، يتحقق النظام من "المونولوج الداخلي" للذكاء الاصطناعي. إنه ينظر إلى الطبقات الوسطى من "الدماغ" ليرى ما إذا كان الخبراء متفقين.
- الخيار أ (كاليفورنيا): الخبراء مرتبكون. الطبقة 10 تقول "ربما"، الطبقة 15 تقول "لا"، الطبقة 20 تقول "انتظر". خلاف عالٍ = ارتباك عالٍ.
- الخيار ب (جورجيا): الخبراء جميعاً على نفس الصفحة. الطبقة 10، 15، و20 تقول "نعم، بالتأكيد". خلاف منخفض = اتساق عالٍ.
- العقوبة: يطبق النظام "عقوبة" على الخيارات المرتبكة. الأمر يشبه قولك للمتحدث اللبق: "أعلم أنك تبدو واثقاً، لكن فريقك الداخلي يتجادل، لذا سأقوم بخفض درجتك."
- الاختيار: يختار النظام الإجابة التي كان فيها الفريق الداخلي أكثر اتساقاً، حتى لو لم تكن هي التخمين الأول الأكثر وضوحاً.
4. "بوابة المعلومات الذاتية" (الفلتر الذكي)
تقدم الورقة أيضاً نسخة متطورة تسمى CoCoA-SIG. فكر في هذا كفلتر ذكي يعرف متى يكون صارماً.
- التشبيه: تخيل حارساً عند مدخل ملهى ليلي.
- إذا كان الضيف مرجحاً جداً لأن يكون من كبار الشخصيات (احتمالية عالية)، فإن الحارس يسمح له بالدخول بسرعة دون التدقيق كثيراً.
- إذا كان الضيف شخصاً غير متوقع (احتمالية منخفضة، "مفاجأة" عالية)، فإن الحارس يفحص هويته بدقة شديدة.
- كيف يعمل: من المرجح أن يهلوس الذكاء الاصطناعي عندما يخمن شيئاً مفاجئاً أو غير مرجح. يركز CoCoA-SIG جهوده في "كاشف الخلاف" بقوة أكبر على تلك التخمينات المحفوفة بالمخاطر والمفاجئة، بينما يسمح للإجابات الآمنة والواضحة بالمرور بسهولة.
5. لماذا يعد هذا أمراً هاماً؟
- لا حاجة لإعادة التدريب: لا تحتاج إلى تغذية الذكاء الاصطناعي بملايين الكتب الجديدة لإصلاح هذه المشكلة. فهو يعمل "جاهزاً للاستخدام" بمجرد تغيير كيفية اختيار الذكاء الاصطناعي لكلماته أثناء المحادثة.
- يعمل في كل مكان: لقد اختبروه في الرياضيات، والبرمجة، وتلخيص الأخبار، والإجابة على الأسئلة العامة. لقد جعله أكثر صدقاً في جميع المجالات.
- سريع: لا يضيف إلا وقتاً ضئيلاً جداً للإجابة (أبطأ بحوالي 1.3 مرة من الطبيعي)، وهو ثمن بسيط مقابل عدم التعرض للكذب.
الملخص
فكر في CoCoA كـ مترجم صادق. عندما يحاول الذكاء الاصطناعي التحدث، يستمع CoCoA إلى "اجتماع اللجنة" الداخلي للذكاء الاصطناعي. إذا كانت اللجنة تتجادل وتشعر بالارتباك، يقول CoCoA: "توقف، هذه الإجابة مهتزة"، ويوجه الذكاء الاصطناعي نحو الإجابة التي يتفق فيها الجميع في اللجنة.
إنها طريقة لتعليم الذكاء الاصطناعي الثقة في اتساقه الداخلي بدلاً من مجرد قدرته على التحدث ببراعة وفصاحة.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.