← أحدث الأبحاث
💬 NLP

How to Train Your Advisor: Steering Black-Box LLMs with Advisor Models

تقدم هذه الورقة "نماذج المستشار" (Advisor Models)، وهي طريقة لتدريب نماذج صغيرة مفتوحة الأوزان لتوليد نصائح لغوية طبيعية ديناميكية لكل حالة على حدة، مما يعمل بفعالية على توجيه وتعزيز أداء النماذج اللغوية الكبيرة الأمامية غير القابلة للوصول (black-box) من خلال التحسين البارامتري دون تعديل أوزانها.

المؤلفون الأصليون: Parth Asawa, Alan Zhu, Abigail O'Neill, Matei Zaharia, Alexandros G. Dimakis, Joseph E. Gonzalez

نُشر 2026-05-18
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Parth Asawa, Alan Zhu, Abigail O'Neill, Matei Zaharia, Alexandros G. Dimakis, Joseph E. Gonzalez

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أن لديك طباخاً عبقرياً عالمياً (النموذج الصندوق الأسود - Black-Box Model، مثل GPT-5 أو Gemini) يعمل في مطبخ مغلق وعالي التأمين. لا يمكنك لمس المكونات، ولا يمكنك تغيير وصفاتهم، ولا يمكنك حتى رؤية كيف يقطعون الخضروات. يمكنك فقط إرسال ملاحظة إليه بطلبك (المطالبة - Prompt).

عادةً، إذا كنت تريد طبقاً معيناً، فعليك كتابة ملاحظة طويلة ومثالية. ولكن إذا ارتكبت خطأً في الملاحظة، فقد يصنع الطباخ طبقاً رائعاً، أو قد يرتبك. وإذا أردت من الطباخ أن يتكيف مع ذوقك الخاص في كل مرة، فإن كتابة ملاحظة مثالية جديدة لكل طلب أمر مرهق وغالباً ما يفشل.

نماذج المستشار (ADVISOR MODELS) هي بمثابة توظيف مساعد طباخ صغير وذكي (المستشار - Advisor) يقف تماماً خارج باب ذلك المطبخ المغلق.

إليك كيف يعمل الأمر، خطوة بخميل:

1. الإعداد: مهمة مساعد الطباخ

بدلاً من محاولتك كتابة الملاحظة المثالية للطباخ الرئيسي، تطلب من مساعد الطباخ أن ينظر إلى طلبك ويكتب نصيحة مخصصة للطباخ الرئيسي.

  • الطباخ الرئيسي (الصندوق الأسود): لا يزال يعمل بنفس الطريقة تماماً. لا يمكنك تغيير عقله أو تدريبه. هو فقط يتبع الملاحظة التي يتلقاها.
  • مساعد الطخاب (المستشار): هذا نموذج أصغر وأرخص، مفتوح المصدر. مهمته الوحيدة هي النظر في الطلب المحدد وقول: "مهلاً، بالنسبة لهذا الطلب تحديداً، يجب على الطباخ الرئيسي تجربة القيام بـ س، ص، و ز".

2. التدريب: التعلم من خلال الممارسة

كيف يتعلم مساعد الطخاب تقديم نصائح جيدة؟

  • الحلقة: تعطي مساعد الطخاب مهمة. يكتب مساعد الطخاب نصيحة. يقرأ الطباخ الرئيسي النصيحة ويطبخ الوجبة.
  • التقييم: إذا كانت الوجبة لذيذة (تم حل المهمة بشكل صحيح)، يمنح النظام مساعد الطخاب "إبهاماً للأعلى". إذا احترقت الوجبة، يحصل على "إبهام للأسفل".
  • الدرس: يتعلم مساعد الطخاب من هذه التقييمات. مع مرور الوقت، يتوقف عن تقديم نصائح غامضة مثل "اطبخ جيداً" ويبدأ في تقديم نصائح محددة وقابلة للتنفيذ مثل "تحقق من درجة حرارة الموقد" أو "استخدم 10 كلمات بالضبط لهذه المراجعة".

3. الخدعة السحرية: "مساعد الطباخ الرخيص" يساعد "الطباخ الغالي"

هذا هو الادعاء الأكبر للورقة البحثية. أنت لا تحتاج لتدريب مساعد الطخاب باستخدام الطباخ الرئيسي الغالي والعالمي.

  • يمكنك تدريب مساعد الطخاب باستخدام طباخ أرخص وأصغر (مثل GPT-4o mini).
  • بمجرد أن يتعلم مساعد الطخاب كيفية تقديم نصائح رائعة للطباخ الرخيص، يمكنك أخذ نفس مساعد الطخاب المدرب ووضعه أمام الطخاب الرئيسي الغالي والعالمي (مثل GPT-5).
  • النتيجة: فجأة يصبح الطباخ الغالي أفضل في مهام محددة، رغم أنه لم يتم تدريبه أبداً! النصائح واضحة ومفيدة جداً لدرجة أن الطباخ الكبير يفهمها تماماً.

أمثلة من الواقع من الورقة البحثية

اختبر المؤلفون نظام "مساعد الطخاب" هذا في ثلاثة مطابخ مختلفة:

  • مطبخ الضرائب (RuleArena Taxes):

    • المشكلة: الطباخ الرئيسي بارع في الطبخ العام ولكنه يرتبك بسبب قواعد الضرائب المعقدة.
    • الحل: تعلم مساعد الطخاب المدرب تقديم تعليمات محددة حول كيفية حساب الضرائب.
    • النتيجة: قفزت دقة الطباخ الرئيسي من 67% إلى 85%.
  • مطبخ إصلاح البرمجيات (SWE Agent):

    • المشكلة: كان الطباخ يستغرق خطوات كثيرة لإصلاح كود برمجي مكسور (مثل فحص كل درج في المطبخ).
    • الحل: تعلم مساعد الطخاب أن يقول: "لا تفحص الأدراج؛ فقط استخدم أمر البحث للعثور على الجزء المكسور".
    • النتيجة: أصلح الطباخ الكود أسرع بنسبة 24% دون ارتكاب المزيد من الأخطاء.
  • مطبخ الذوق الشخصي (التخصيص):

    • المشكلة: لديك 5 أصدقاء مختلفين. أحدهم يحب المراجعات القصيرة، والآخر يحب الطويلة، وآخر يكره المسائل الرياضية. الطباخ الرئيسي لا يعرف هذا.
    • الحل: تعلم مساعد الطخاب قراءة التفضيلات "الخفية" لكل صديق وإخبار الطباخ بما يجب فعله بالضبط.
    • النتيجة: تعلم النظام هذه التفضيلات الخفية بدقة شبه مثالية (94-99%)، بينما فشلت الطرق القياسية تماماً.

لماذا هذا مهم (وفقاً للورقة البحثية)

  • لا حاجة للجراحة: لا تحتاج لفتح دماغ الطباخ الرئيسي (تعديل أوزانه) لتحسينه. أنت فقط تعطيه تعليمات أفضل.
  • لا نسيان: نظرًا لأن دماغ الطباخ الرئيسي لا يتغير، فإنه لا ينسى كيفية القيام بالأشياء الأخرى. يظل جيداً في كل ما كان جيداً فيه أصلاً.
  • فعالية التكلفة: من الأرخص بكثير تدريب مساعد الطخاب الصغير على نموذج رخيص ثم "نقل" تلك المهارات إلى النموذج الغالي، بدلاً من محاولة تدريب النموذج الغالي مباشرة.

باختصار: نماذج المستشار (ADVISOR MODELS) هي طريقة لتدريب مساعد صغير وذكي لكتابة تعليمات أفضل لذكاء اصطناعي ضخم ومغلق، مما يجعل ذلك الذكاء الاصطماعي الضخم أكثر ذكاءً، وسرعة، وتخصيصاً دون المساس بشفرته الداخلية أبداً.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →