Agentproof: Static Verification of Agent Workflow Graphs
يُعد Agentproof نظام تحقق استاتيكي يقوم تلقائياً باستخراج نماذج رسوم بيانية موحدة من أطر عمل الوكلاء الرئيسية للكشف عن العيوب الهيكلية وفرض سياسات السلامة الزمنية عبر لغة وصفية متخصصة وتحليل قائم على الأوتوماتات المحدودة الحتمية (DFA)، مما يكمل حواجز الحماية أثناء التشغيل من خلال تحديد المشكلات على مستوى الطوبولوجيا قبل النشر.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
تخيل أنك تقوم ببناء خادم آلي (روبوت) معقد. أنت لا تكتفي بقول "نظف المنزل" فحسب، بل تكتب مخططاً انسيابياً مفصلاً: التقط المكنسة ← اذهب إلى المطبخ ← إذا كانت الأرضية متسخة، اكنس ← إذا كانت الأرضية نظيفة، اذهب إلى غرفة المعيشة ← أعد المكنسة إلى مكانها.
في عالم الذكاء الاصطناعي، تُسمى هذه "الروبوتات" وكلاء (Agents). وهي تستخدم أدوات (مثل البحث في الويب أو إرسال رسائل البريد الإلكتروني) بناءً على هذه المخططات الانسيابية، والتي تُسمى مخططات سير العمل (Workflow Graphs).
المشكلة هي أنه عندما يبني المطورون هذه المخططات، غالباً ما يرتكبون أخطاءً سخيفة. قد يرسمون مساراً يؤدي إلى طريق مسدود (حيث يعلق الروبوت)، أو قد ينسون وضع خطوة "موافقة بشرية" قبل أن يقوم الروبوت بحذف قاعدة بيانات.
حالياً، نحن نتحقق من هذه الأخطاء أثناء تشغيل الروبوت فقط. إذا علق الروبوت، لا نعرف ذلك إلا عندما يحاول فعلياً سلوك ذلك المسار المحدد. الأمر يشبه انتظار وقوع حادث سيارة قبل أن تدرك أن المكابح لم تكن موصلة أصلاً.
Agentproof هي أداة جديدة تعمل مثل مهندس معماري فائق الذكاء، يقوم بفحص المخططات قبل أن تبدأ حتى في بناء المنزل.
إليك كيف يعمل، باستخدام تشبيهات بسيطة:
1. المترجم العالمي (المستخرج - The Extractor)
يستخدم بناة الروبوتات لغات مختلفة. البعض يستخدم "LangGraph"، والبعض الآخر يستخدم "CrewAI" أو "AutoGen". الأمر يشبه وجود باني يتحدث الفرنسية، وآخر يتحدث اليابانية، وثالث يتحدث الألمانية.
- مهمة Agentproof: لديه مترجم لكل هذه اللغات. فهو يقرأ المخطط بأي من هذه اللغات ويحوله فوراً إلى "مخطط عالمي موحد" يمكنه فهمه. ليس عليك إعادة كتابة الكود الخاص بك؛ Agentproof يقرأه فحسب.
2. مفتش "اكتشاف الخلل" (الفحوصات الهيكلية)
بمجرد حصوله على المخطط العالمي الموحد، يقوم Agentproof بإجراء ست فحوصات سريعة للعثور على الأخطاء المنطقية. فكر في الأمر كأنه لعبة "أين والدو؟" (Where's Waldo) للبحث عن الأخطاء المنطقية:
- الطريق المسدود: "مهلاً، هذا المسار يؤدي إلى حائط. سيعلق الروبوت هنا للأبد."
- المخرج الشبح: "لديك زر 'النهاية'، ولكن لا يوجد مسار يؤدي إليه. لن يعرف الروبوت متى يتوقف أبداً."
- البوابة المفقودة: "أنت على وشك السماح للروبوت بحذف ملف، لكنك نسيت وضع نقطة تفتيش 'موافقة بشرية' أمامها!"
- الخدعة السحرية: إذا وجد خطأ ما، فهو لا يكتفي بقول "خطأ". بل يعطيك أثر شاهد (Witness Trace). هذا يشبه مسار نظام تحديد المواقع (GPS) الذي يوضح لك بالضبط: ابدأ ← اتجه يساراً ← اذهب مستقيماً ← اصطدام! إنه يظهر لك المسار الدقيق الذي سيسلكه الروبوت ليقع في الفخ.
3. مُنفذ كتاب القواعد (السياسات الزمنية)
أحياناً لا تكون المشكلة في الطريق المسدود، بل في ترتيب الأشياء.
- القاعدة: "يجب ألا تحذف جدولاً أبداً دون عمل نسخة احتياطية منه أولاً."
- القاعدة: "إذا أرسلت بريداً إلكترونياً، يجب على البشر مراجعته أولاً."
يقوم Agentproof بترجمة هذه القواعد إلى نظام "إشارات مرور" بسيط (يُسمى DFA). وهو يفحص المخطط ليرى ما إذا كان أي مسار محتمل قد يسلكه الروبوت يكسر هذه القواعد.
- الفحص الساكن (Static Check): يقوم بمحاكاة كل رحلة ممكنة يمكن للروبوت القيام بها في المخطط. إذا كسر أي مسار القواعد، فإنه يوقفك قبل أن تبدأ التشغيل.
- الفحص أثناء التشغيل (Runtime Check): يمكنه أيضاً مراقبة الروبوت أثناء عمله، ليعمل كحارس أمن يصرخ "توقف!" إذا حاول الروبوت القيام بشيء سيء في الوقت الفعلي.
لماذا يعد هذا أمراً مهماً؟
- لا عمل يدوي: تتطلب الأدوات القديمة منك إعادة كتابة كود الروبوت الخاص بك إلى "لغة تحقق" خاصة (مثل ترجمة رواية إلى معادلة رياضية). يقوم Agentproof بذلك تلقائياً.
- السرعة: يمكنه فحص مخططات ضخمة (تصل إلى 5,000 خطوة) في أقل من ثانية.
- الأمان: في اختبار لـ 18 مخططاً مختلفاً للروبوتات، وجد Agentproof أن 27% منها تحتوي على خلل هيكلي (طرق مسدودة) و 55% تفتقر إلى بوابات السلامة البشرية. هذه أخطاء كان من الصعب جداً اكتشافها بمجرد اختبار الروبوت بضع مرات.
الخلاصة
فكر في Agentproof كـ مفتش سلامة للروبوتات الذكية.
- حواجز الحماية أثناء التشغيل (Runtime Guardrails) (الطريقة القديمة) تشبه حزام الأمان: فهي تمسك بك إذا وقعت في حادث، لكنها لا تمنع وقوع الحادث من الأساس.
- Agentproof يشبه فحص محرك السيارة والمكابح قبل أن تقودها. إنه يضمن أن الخريطة التي أعطيتها للروبوت تؤدي بالفعل إلى وجهة ولا توجد بها ثقوب في الطريق.
هو لا يتحقق مما إذا كان الروبوت "ذكياً" أو يقول الحقيقة (فهذه مشكلة أخرى)؛ هو فقط يتأكد من أن خطة الروبوت سليمة منطقياً وآمنة للتنفيذ.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.