VIDEE: Visual and Interactive Decomposition, Execution, and Evaluation of Text Analytics with Intelligent Agents
تقدم هذه الورقة نظام VIDEE، وهو نظام تعاوني بين الإنسان والوكيل يُمكّن المحللين المبتدئين من إجراء تحليلات نصية متقدمة من خلال سير عمل يتكون من ثلاث مراحل هي التفكيك، والتنفيذ، والتقييم، مما يثبت فعاليته وسهولة استخدامه عبر مستويات متفاوتة من الخبرة.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
تخيل أن لديك كومة ضخمة من الرسائل الفوضوية، أو المقالات الإخبارية، أو مراجعات العملاء، وتريد العث_ور على القصص الخفية بداخلها. في الماضي، كان القيام بذلك يتطلب منك أن تكون ساحراً حاسوبياً يعرف لغات برمجة معقدة (مثل بايثون) ورياضيات متقدمة. كان الأمر يشبه محاولة إصلاح محرك سيارة دون أن تفتح غطاء المحرك من قبل.
مؤخراً، أصبحت "الوكلاء الذكيون" (برامج حاسوبية ذكية) أفضل في أداء هذه المهام تلقائياً. لكن مؤلفي هذه الورقة البحثية وجدوا مشكلة: إذا قلت للذكاء الاصطناعي ببساطة "حلل هذا النص"، فإنه غالباً ما يصبح كسولاً، أو يختلق أشياءً (هلوسات)، أو ينشئ خطة فوضوية ومكسورة. الأمر يشبه توظيف متدرب واثق جداً من نفسه ولكنه يفتقر للخبرة، يحاول القيام بكل شيء في خطوة واحدة ضخمة وفوضوية، وينتهي به الأمر بتقرير مليء بالحقائق المزيفة.
لحل هذه المشكلة، صمم الباحثون نظاماً يسمى VIDEE. فكر في VIDEE ليس كروبوت يقوم بالعمل نيابة عنك، بل كـ موقع بناء ذكي حيث أنت مدير الموقع والذكاء الاصطناعي هو طاقم عملك.
إليك كيف يعمل VIDEE، مقسماً إلى ثلاث مراحل بسيطة:
1. مرحلة المخطط (التفكيك - Decomposition)
المشكلة: إذا طلبت من الذكاء الاصطناعي "استخراج المواضيع الرئيسية من هذه الرسائل الـ 2000"، فقد يخمن طريقة واحدة بسيطة للقيام بذلك ويتمسك بها، حتى لو كانت فكرة سيئة.
حل VIDEE: يستخدم VIDEE أداة بحث خاصة (تسمى بحث شجرة مونت كارلو - Monte-Carlo Tree Search) تعمل مثل خريطة متفرعة.
- تخيل أنك تخطط لرحلة برية. بدلاً من اختيار مسار واحد فقط، يرسم الذكاء الاصطناعي شجرة تضم عشرات المسارات الممكنة.
- بينما يستكشف الذكاء الاصطناعي هذه المسارات، يتوقف ليسألك أنت (الإنسان): "هل هذه الخطوة معقدة للغاية؟ هل هذه الخطوة منطقية بعد الخطوة السابقة؟ هل هذه الخطوة مهمة حقاً؟"
- يمكنك تعديل الخريطة، أو حذف الفروع السيئة، أو إخبار الذكاء الاصطناعي باستكشاف اتجاه مختلف. أنت من يقود السفينة، وتضمن أن الخطة متينة قبل بدء أي عمل.
2. مرحلة البناء (التنفيذ - Execution)
المشكلة: بمجرد وضع الخطة، غالباً ما يحاول الذكاء الاصطناعي كتابة كود برمجي لتنفيذها. ولكن إذا كانت الخطة معقدة، فقد يكتب الذكاء الاصطناعي كوداً يتسبب في تعطل النظام، أو قد يدعي أنه أنهى المهمة بينما لم يفعل ذلك في الواقع.
حل VIDEE: يحول VIDEE "مخططك" إلى خط تجميع خطوة بخطوة.
- يقوم الذكاء الاصطناعي بتفكيك الهدف الكبير إلى مهام صغيرة وملموسة (مثل "قراءة الرسالة"، "إيجاد الأسماء"، "تجميع الأسماء").
- يبني خط إنتاج حيث يمكنك رؤية كل خطوة على حدة.
- يمكنك الضغط على "تنفيذ" لخطوة واحدة فقط لترى ما إذا كانت تعمل. إذا حاول الذكاء الاصطناعي القيام بشيء غريب، يمكنك ملاحظة ذلك فوراً. الأمر يشبه فحص أساسات المنزل قبل صب الخرسانة.
3. مرحلة التفتيش (التقييم - Evaluation)
المشكلة: كيف تعرف أن الذكاء الاصطناعي لم يختلق النتائج فحسب؟
حل VIDEE: يعمل VIDEE مثل مفتش مراقبة الجودة.
- بعد أن ينهي الذك_اء الاصطناعي خطوة ما، يقوم تلقائياً بإنشاء "تقرير درجات" لهذه الخطوة.
- يستخدم "قضاة" من الذكاء الاصطناعي الآخرين لتقييم العمل بناءً على قواعد تضعها أنت (على سبيل المثال: "هل لخص هذا الملخص الفكرة الرئيسية؟").
- تُعرض هذه النتائج لك بشكل مرئي. على سبيل المثال، إذا كنت تحلل شكاوى العملاء، فقد يعرض لك VIDEE مخططاً ملوناً حيث يمكنك رؤية أي الشكاوى "سعيدة" وأيها "غاضبة"، ومعرفة أي رسالة تنتمي بالضبط إلى كل مجموعة. يمكنك النقر على نقطة في المخطط لقراءة الرسالة الفعلية.
ماذا حدث عندما اختبروه؟
أجرى الباحثون نوعين من الاختبارات:
اختبار "الروبوت وحده": تركوا ذكاءً اصطناعياً قياسياً يحاول تحليل النصوص بمفرده.
- النتيجة: فشل الروبوت كثيراً. لقد اختلق بيانات، وارتبك أمام الوثائق الطويلة، وأنشأ خططاً فوضوية وغير منطقية. كان الأمر كأنه سائق يحاول باستمرار القيادة عبر جدار لأنه يعتقد أنه باب.
اختبار "الإنسان + الروبوت" (VIDEE): تركوا الناس يستخدمون نظام VIDEE.
- النتيجة: عمل النظام بشكل أفضل بكثير. حتى الأشخاص الذين لم يسبق لهم البرمجة قط استطاعوا استخدامه لاستخراج رؤى من البيانات النصية.
- اكتشاف رئيسي: وثق الناس في النتائج أكثر لأنهم استطاعوا رؤية العملية خطوة بخوة. عندما يعطيك الذكاء الاصطناعي إجابة فقط (صندوق أسود)، فأنت لا تعرف ما إذا كان يكذب. ولكن عندما ترى الذكاء الاصطناعي يبني الإجابة خطوة بخطوة وتستطيع التحقق من العمل، تشعر بالثقة.
الخلاصة الكبرى
يثبت VIDEE أننا لسنا بحاجة للاختيار بين "الذكاء الاصطناعي يفعل كل شيء" وبين "البشر يفعلون كل شيء". النهج الأفضل هو الشراكة.
- الذكاء الاصطناعي بارع في توليد الأفكار، وكتابة الكود، والقيام بالأعمال الشاقة.
- الإنسان ضروري للتحقق من المنطق، ورصد الأشياء المزيفة، والتأكد من أن الخطة منطقية.
من خلال منح البشر خريطة مرئية للتحكم في الذكاء الاصطناعي، يجعل VIDEE تحليل النصوص القوي متاحاً للأشخاص العاديين (مثل الصحفيين أو الباحثين) دون الحاجة لأن يكونوا علماء حاسوب، مع الحفاظ في الوقت نفسه على موثوقية وصدق النتائج.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.