Auditing Pay-Per-Token in Large Language Models
تقترح هذه الورقة إطار عمل للتدقيق قائماً على المارتينجال (martingale) يُمكّن طرفاً ثالثاً موثوقاً من اكتشاف وإثبات سوء إبلاغ الرموز (token misreporting) من قبل مزودي النماذج اللغوية الكبيرة بموثوقية عالية وثقة إحصائية كبيرة، مع تقليل الاتهامات الزائفة ضد المزودين الأمناء إلى أدنى حد.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
تخيل أنك تطلب بيتزا من تطبيق توصيل. أنت تدفع بناءً على عدد القطع التي تتلقاها. يقوم محل البيتزا (مزود نموذج اللغة الكبير - LLM Provider) بخبز البيتزا، وتقطيعها إلى قطع، ثم يسلمك الصندوق. ويقول لك: "هذه 8 قطع، ثمنها 8 دولارات".
لكن هنا تكمن الخدعة: لا يمكنك رؤية ما بداخل الصندوق حتى تفتحه. المحل يعرف تماماً كيف قام بتقطيع البيتزا. يمكنهم سراً تقسيم قطعة واحدة إلى شريحتين صغيرتين لا فائدة منهما، ثم يخبرونك: "أصبحت الآن 9 قطع، ادفع لي 9 دولارات!"
في عالم نماذج اللغة الكبيرة (LLLLMs)، هذا هو بالضبط ما يحدث. الشركات تتقاضى منك رسوماً بناءً على "الرمز" (token) (وهو جزء من كلمة أو جزء من كلمة). ولأن طريقة تقطيع النص إلى رموز ليست فريدة من نوعها، يمكن لمزود غير أمين تقسيم رمز واحد إلى اثنين لتقاضي المزيد منك، رغم أن النص الذي تقرأه يبدو متطابقاً تماماً.
تقدم هذه الورقة البحثية نظام "شرطة الرموز" (Token Police) — وهي طريقة لمدقق موثوق لكشف هؤلاء المخادعين دون الحاجة للتواجد داخل مطبخ المزود.
المشكلة: "الخطر الأخلاقي" في الصندوق الأسود
في الاقتصاد، يُسمى هذا "الخطر الأخلاقي" (Moral Hazard). المزود يرى كل شيء (عملية تقطيع البيتزا بالكامل)، بينما أنت لا ترى سوى النتيجة النهائية. وبما أن المزود يرغب في كسب المزيد من المال، فلديه حافز مالي لـ "الإفراط في تقطيع" النص الخاص بك.
الحل: المحقق "المارتينجال" (Martingale)
ابتكر المؤلفون إطاراً رياضياً لكشف هؤلاء المخادعين. إنهم يستخدمون مفهوماً من نظرية الاحتمالات يسمى "المارتينجال" (Martingale).
فكر في المارتينجال كأنه "مقياس للعدالة" أو "درجة اشتباه".
- إذا كان المزود أميناً: يظل مقياس الاشتباه مستقراً، ويحوم حول الصفر. يشبه الأمر بحراً هادئاً؛ الأمواج ترتفع وتنخفض قليلاً، لكن مستوى سطح الماء لا يرتفع.
- إذا كان المزود غاشاً: يبدأ مقياس الاشتباه في التصاعد. في كل مرة يحاول فيها المزود المبالغة في التكلفة، يرتفع المقياس. وفي النهاية، يصل المقر إلى "حالة الإنذار الأحمر"، ويقول المدقق: "أمسكت بك! أنت تغش!"
كيف يعمل المحقق (الخدعة السحرية)
يحتاج المدقق إلى معرفة السعر "العادل" الذي يجب أن يكون، لكي يتمكن من رصد الفرق. لكن المدلق لا يملك الوصفة السرية للمزود. لذا، يستخدمون خدعة ذكية:
- محاكاة "ماذا لو": يأخذ المدقق النص الذي قدمه المزود (مثلاً: "The cat sat on the mat") ويسأل نموذج الذكاء الاصطناعي: "إذا كان عليك توليد هذه الجملة بدقة، فكم رمزاً ستستخدم في المتوسط عادةً؟"
- المُقدِّر (The Estimator): تقدم الورقة طريقة جديدة وعالية الكفاءة لحساب هذا المتوسط. الأمر يشبه قيام المدقق بإجراء آلاف عمليات المحاكاة الصغيرة في ذهنه لمعرفة عدد الرموز "العادل" لتلك الجملة المحددة.
- المقارنة: يقارن المدقق بين عدد الرموز الذي أبلغ عنه المزود (مثلاً: "10 رموز") مع عدد الرموز العادل الذي حسبه (مثلاً: "7 رموز").
- إذا قال المزود 10، بينما تقول الرياضيات 7، فإن "درجة الاشتباه" ترتفع.
- إذا كان المزود أميناً، يظل المقياس منخفضاً.
النتائج: كشف المخادعين بسرعة
اختبر الباحثون هذا النظام باستخدام نماذج ذكاء اصطناٍعي حقيقية (مثل Llama و Gemma) ومزودين "مخادعين" وهميين.
- الأخبار الجيدة: النظام سريع للغاية. لم يحتج إلا لفحص حوالي 70 مثالاً فقط لكشف المخادع بثقة عالية.
- شبكة الأمان: النظام أيضاً حذر جداً من اتهام المزودين الأمناء. تم الحفاظ على فرصة اتهام شخص نزيه بالخطأ عند أقل من 5% (وفي الواقع، كانت أقل من ذلك بككثير).
لماذا هذا مهم؟
حالياً، سوق الذكاء الاصطناعي يشبه "الغرب المتوحش". يمكن للمزودين التلاعب بالقواعد لجني المزيد من المال، ولا يملك المستخدمون وسيلة لمعرفة ذلك. توفر هذه الورقة البحثية المخطط الأساسي لأداة رقابية.
تخيل مستقبلاً حيث تستخدم وكالة حكومية أو جهة رقابية مستقلة "محقق المارتينجال" هذا للتدقيق في شركات الذكاء الاصطناعي. إذا حاولت شركة المبالغة في التكلفة عبر تقسيم الرموز، سيقوم النظام بتمييزهم فوراً. هذا يجبر الشركات على الأمانة، مما يضمن أنك تدفع فقط مقابل ما تحصل عليه بالفعل.
باختدصار
- الشرير: مزودو الذكاء الاصطناٍعي الذين يقسمون الكلمات إلى قطع صغيرة جداً لزيادة التكلفة عليك.
- البطل: "درجة اشتباه" رياضية ترتفع عند حدوث الغش.
- السلاح: محاكاة ذكية تحسب عدد الرموز "العادل" لأي جملة.
- النتيجة: نظام يكشف المخادعين في أقل من 70 محاولة دون معاقبة الأمناء.
هذا العمل هو خطوة عملاقة نحو جعل اقتصاد الذكاء الاصطناعي عادلاً، شفافاً، وموثوقاً للجميع.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.