Is Agentic RAG worth it? An experimental comparison of RAG approaches
تقيم هذه الورقة تجريبيًا وتقارن بين نماذج استرجاع المعلومات المعزز (Enhanced RAG) والنماذج الوكيلة (Agentic RAG) عبر سيناريوهات متعددة لتقديم إرشادات عملية حول اختيار التصميم الأكثر فعالية بناءً على مقايضات الأداء والتكلفة.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
تخيل أنك تحاول الإجابة على سؤال صعب، لكن ليس لديك كل الحقائق في رأسك. أنت بحاجة للذهاب إلى مكتبة ضخمة (قاعدة المعرفة) لتجد الكتب المناسبة، تقرأها، ثم تكتب إجابتك.
في عالم الذكاء الاصطناعي، تسمى هذه العملية RAG (التوليد المعزز بالاسترجاع). ولكن هناك طريقتان مختلفتان لتشغيل نظام المكتبة هذا: الطريقة "المُحسّنة" والطريقة "الوكيلة".
هذه الورقة البحثية تشبه سباقاً بين اثنين من أمناء المكتبات لمعرفة من سيؤدي وظيفة أفضل، أسرع، وأرخص.
الأمينان
1. أمين المكتبة "المُحسَّن" (الفريق المتخصص)
تخيله كفريق عمل منظم للغاية يعمل بنظام خط الإنتاج. لديهم كتاب قواعد صارم وأدوات محددة لكل مهمة.
- الموجّه (The Router): حارس عند الباب يتحقق من هويتك. إذا سألت سؤالاً عن "الطبخ" بينما المكتبة تحتوي فقط على كتب "التمويل"، فسيوقفك الحارس فوراً.
- إعادة الصياغة (The Rewriter): مترجم يعيد صياغة سؤالك لجعله يبدو أكثر تشابهاً مع الكتب الموجودة في المكتبة، حتى يجد محرك البحث تطابقات أفضل.
- إعادة الترتيب (The Reranker): آلة فرز تأخذ الـ 20 كتاباً التي وجدها محرك البحث وتضع أفضل 5 منها في مقدمة المجموعة.
- الكاتب (The Writer): الشخص الذي يقرأ تلك الكتب الخمسة ويكتب الإجابة النهائية.
الانطباع العام: كفء، متوقع، وسريع. يتبعون مساراً ثابتاً. إذا تعطل المسار، فقد يعلقون، لكنهم نادراً ما يضيعون الوقت.
2. أمين المكتبة "الوكيل" (المحقق الذكي المنفرد)
تخيله كمحقق ذكي جداً يقوم بكل شيء بنفسه. ليس لديه كتاب قواعد؛ بل لديه عقل يمكنه التفكير، والتأمل، وتغيير الخطط أثناء العمل.
- المحقق (The Detective): عندما تسأل سؤالاً، يتوقف ويفكر: "هل أحتاج حقاً للبحث في المكتبة؟ أم أنني أعرف الإجابة بالفعل؟"
- المتحول (The Shapeshifter): إذا بحث ووجد كتباً سيئة، فهو لا يستسلم فحسب. بل يفكر: "همم، مصطلحات البحث الخاصة بي كانت خاطئة. دعني أعيد صياغة السؤال وأبحث مرة أخرى." يمكنه القيام بهذه الحلقة من العمل لعدد المرات التي يحتاجها.
- صانع القرار (The Decision Maker): يقرر متى يتوقف عن البحث ومتى يبدأ في كتابة الإجابة.
الانطباع العام: مرن، متكيف، وذكي جداً. ولكن لأنه يفكر بعمق ويراجع عمله عدة مرات، فقد يستغرق وقتاً أطول ويصاب بالتعب (يكلف مالاً أكثر) بسرعة.
السباق: ماذا حدث؟
وضع الباحثون هذين الأمينين للعمل على أربعة أنواع مختلفة من المهام (مثل أسئلة التمويل، والمساعدة في القواعد، والتحقق من الحقائق). إليكم ما وجدوه:
1. معرفة متى يتوقف (نية المستخدم)
- السيناريو: تسأل سؤالاً ليس له علاقة بالمكتبة (مثل "ما هي حالة الطقس في طوكيو؟" بينما المكتبة تحتوي فقط على كتب التمويل).
- الفائز: يعتمد ذلك على المكتبة.
- في المكتبات الصارمة والمحددة جيداً (مثل التمويل)، فإن المحقق الوكيل رائع. فهو يفهم السياق ويقول: "لا أحتاج للبحث عن هذا".
led في المكتبات الفوضوية والواسعة (مثل الحقائق العامة)، فإن حارس الفريق المُحسَّن هو الأكثر موثوقية في الواقع. فالمحقق قد يرتبك أحياناً ويبحث عن أشياء لا ينبغي له البحث عنها.
- في المكتبات الصارمة والمحددة جيداً (مثل التمويل)، فإن المحقق الوكيل رائع. فهو يفهم السياق ويقول: "لا أحتاج للبحث عن هذا".
2. طرح السؤال الصحيح (إعادة صياغة الاستعلام)
- السيناريو: تسأل سؤالاً قصيراً وغامضاً. كتب المكتبة طويلة ومعقدة.
- الفائز: الوكيل.
- الفريق المُحسَّن يعيد صياغة السؤال في كل مرة، حتى لو لم يكن ذلك ضرورياً.
- أما المحقق الوكيل فهو أذكى. فهو ينظر إلى السؤال ويفكر: "هذا يحتاج لإعادة صياغة،" أو "هذا جيد كما هو." هذه المرونة تساعده في العث على كتب أفضل، خاصة عندما تكون الأسئلة غريبة أو معقدة.
3. اختيار أفضل الكتب (تحسين المستندات)
- السيناريو: محرك البحث يجد 20 كتاباً. أي 5 منها يجب أن نقرأ؟
- الفائز: المُحسَّن.
- الفريق المُحسَّن لديه آلة متخصصة (إعادة الترتيب) بارعة جداً في فرز الكتب.
- أما المحقق الوكيل فيحاول القيام بذلك بنفسه عبر البحث مجدداً. ولكن غالباً، يجد نفس الكتب مرة أخرى! فهم ليسوا ببراعة الآلة المتخصصة في الفرز.
4. تكلفة التفكير (الوقت والمال)
- السيناريو: كم يكلف تشغيل المكتبة؟
- الفائز: المُحسَّن.
- المحقق الوكيل مكلف. لأنه يفكر، ويعيد القراءة، ويبحث عدة مرات، فإنه يستخدم 3.3 ضعف "قوة الدماغ" (الرموز/Tokens) ويستغرق وقتاً أطول بمقدار 1.5 مرة من الفريق المُحسَّن.
- الفريق المُحسَّن مثل العداء السريع: سريع ورخيص. أما المحقق الوكيل فهو مثل عداء الماراثون الذي يتوقف لفحص الخريطة باستمرار: ذكي، لكنه بطيء ومكلف.
الحكم النهائي: أي منهما يجب أن توظف؟
تخلص الورقة البحثية إلى أن لا أحد منهما مثالي لكل شيء. الأمر لا يتعلق باختيار فائز، بل باختيار الأداة المناسبة للمهمة.
اختر المحقق "الوكيل" إذا كنت:
- تحتاج للتعامل مع أسئلة صعبة جداً حيث لست متأكداً مما إذا كنت بحاجة للبحث عن الإجابة أم لا.
- كانت أسئلتك غريبة أو يصعب فهمها، وتحتاج لمن يعيد صياغتها في اللحظة ذاتها.
- تملك الميزانية اللازمة لذلك.
اختر الفريق "المُحسَّن" إذا كنت:
- تحتاج إلى السرعة والتكلفة المنخفضة.
- تحتاج لفرز قائمة ضخمة من النتائج للعثور على أفضلها على الإطلاق (الآلة المتخصصة أفضل في ذلك).
- كانت أسئلتك مباشرة وواضحة.
الحل "الهجين"
يقترح المؤلفون أن أفضل نهج هو "وحش فرانكنشتاين" (بالمعنى الجيد!):
خذ المحقق الوكيل ليتولى بداية العملية (اتخاذ القرار بشأن ما إذا كنت بحاجة للبحث وإعادة صياغة السؤال)، ولكن بعد ذلك سلم الجزء الأوسط للفريق المُحسَّن لاستخدام آلتهم المتخصصة لفرز الكتب بشكل مثالي.
باخت-طصار: لا تكتفِ باختيار الذكاء الاصطناዊ الأكثر "ذكاءً". اختر الذي يوازن بين الذكاء والسرعة والتكلفة لمشكلتك المحددة. فأحياناً، يتفوق فريق من المتخصصين على عبقري منفرد، وأحياناً يتفوق العبقري المنفرد على فريق من الروبوتات.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.