← أحدث الأبحاث
🤖 AI

Cochise: A Reference Harness for Autonomous Penetration Testing

تقدم هذه الورقة Cochise، وهو إطار مرجعي بلغة بايثون يتكون من 597 سطرًا فقط، يطبق بنية "المخطط-المنفذ" (Planner-Executor) المنفصلة لاختبار الاختراق المستقل، مما يمكّن الباحثين من تقييم الوكلاء الموجهين بالنماذج اللغوية الكبيرة (LLMs) ضد بيئة اختبار "لعبة النشاط في الدليل النشط" (GOAD)، مع توفير أدوات مفتوحة المصدر لإعادة التشغيل، والتحليل، ومشاركة بيانات المسار.

المؤلفون الأصليون: Andreas Happe, Jürgen Cito

نُشر 2026-05-13
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Andreas Happe, Jürgen Cito

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أنك تحاول تعليم روبوت كيفية اختراق حصن رقمي (شبكة كمبيوتر) للعثور على نقاط ضعفه. يُسمى هذا "اختبار الاختراق". مؤخراً، بدأ الباحثون في استخدام عقول ذكاء اصطناعي فائقة الذكاء (نماذج اللغات الكبيرة) للقيام بهذه المهمة تلقائياً.

ومع ذلك، كانت هناك مشكلة: في كل مرة يبني فيها فريق جديد مخترقاً يعمل بالذكاء الاصطناعي، كانوا يبنون ورشتهم الخاصة، وأدواتهم، وكتيب القواعد الخاص بهم. كان الأمر يشبه مقارنة سيارة تم بناؤها في مرآب بمركبة فضائية بُنيت في مصنع؛ لا يمكنك معرفة ما إذا كانت المركبة الفضائية أسرع بسبب محركها أم لمجرد أنها تمتلك عجلات أفضل.

إليك "كوتشيس" (Cochise).

فكر في "كوتشيس" ليس كجاسوس خارق، بل كـ صالة ألعاب رياضية تدريبية معيارية وشفافة لمخترقي الذكاء الاصطناعي. إنه "حزام" بسيط وصغير (مجموعة من الأدوات والقواعد) يسمح للباحثين باختبار عقول ذكاء اصطناعي مختلفة تحت نفس الظروف تماماً.

إليك كيف يعمل، باستخدام بعض التشبيهات من الحياة اليومية:

1. الإعداد: "مضيف القفز" (The Jump Host)

تخيل أن الذكاء الاصطناعي يحتاج إلى اختراق قلعة (الشبكة المستهدفة)، لكن من الخطر جداً ترك الذكاء الاصطناعي يقف عند بوابة القلعة مباشرة.

  • الحل: يقوم "كوتشيس" بإعداد منصة "قفز" آمنة (كمبيوتر منفصل) خارج القلعة.
  • التشبيه: يجلس الذكاء الاصطناعي في غرفة تحكم ويستخدم جهاز لاسلكي طويل وآمن (SSH) ليخبر روبوتاً على منصة القفز بما يجب فعله. ثم يقوم الروبوت بعد ذلك بالمشي داخل القلعة.
  • لماذا؟ إذا ارتكب الذكاء الاصطناعي خطأً وتسبب بالخطأ في تفجير القلعة، فإنه سيدمر فقط تعليمات الروبوت، وليس عقل الذكاء الاصطناعي نفسه أو غرفة التحكم. هذا يبقي التجربة آمنة ومحتواة.

2. الفريق: "المخطط" و"المنفذ"

يقسم "كوتشيس" عقل الذكاء الاصطناعي إلى دورين متميزين للحفاظ على التنظيم:

  • المخطط (الجنرال): هذا الجزء من الذكاء الاصطناعي يجلس في الخلف وينظر إلى الصورة الكبيرة. يحتفظ بقائمة مهام طويلة الأمد (مثل خريطة القلعة) ويقرر ما الذي يجب القيام به تالياً. إنه يتذكر المهمة بأكملها.
  • المنفذ (الجندي): هذا الجزء قصير المدى ومركز. يتلقى أمراً محدداً من الجنرال (مثلاً: "حاول فتح هذا الباب")، وينفذ الأوامر، ويرى ما حدث، ثم ينسى كل شيء بمجرد انتهاء المهمة.
  • التشبيه: فكر في مخرج أفلام (المخطط) ودوبلير/بديل مشاهد خطرة (المنفذ). المخرج يخطط للمشهد، والدوبلير يقوم بالقفزة الخطيرة، ويحصل على النتيجة، ثم يقوم المخرج بمسح السجل تماماً للمشهد التالي. هذا يمنع الذكاء الاصطناعي من الارتباك بسبب ذكريات قديمة لساعات مضت.

3. مسجل "الصندوق الأسود"

كل شيء يفعله الذكاء الاصطناعي يتم تدوينه في مذكرات دقيقة ومفصلة (سجلات JSON).

  • التشبيه: يشبه الأمر مسجل الرحلة في الطائرة. يسجل كل زر تم ضغطه، وكل فكرة خطرت للذكاء الاصطعي، وكم استهلك من "الوقود" (المال/الرموز - tokens)، وما إذا كان قد نجح أم لا.
  • لماذا هذا رائع؟ عادةً، لدراسة هؤلاء المخترقين من الذكاء الاصطناعي، تحتاج إلى مختبر حاسوبي ضخم ومكلف للغاية (بيئة الاختبار GOAD) يكلف ثروة لتشغيله. يوفر لك "كوتشيس" مجموعة أدوات لإعادة التشغيل مجاناً. لست بحاجة إلى المختبر المكلف؛ يمكنك فقط مشاهدة بيانات "مسجل الرحلة" لترى بالضبط كيف تصرف الذكاء الاصطناعي، وكم كلف، وأين فشل.

4. لماذا يهم الأمر (الـ "حزام المرجعي")

المؤلفون واضحون جداً: "كوتشيس" ليس أفضل مخترق في العالم. إنه لا يحاول أن يكون الجاسوس الأقصى.

  • التشبيه: فكر فيه كـ مسطرة معيارية. أنت لا تستخدم المسطرة لبناء منزل؛ بل تستخدمها لقياس مدى جودة الأدوات الأخرى في بناء المنازل.
  • لأن "كوتشيس" صغير جداً (597 سطراً من الكود فقط، مقارنة بآلاف الأسطر في المشاريع الأخرى)، فمن السهل على الباحثين الآخرين قراءته وفهمه وتغييره. وهذا يسمح لهم بمقارنة نماذج الذكاء الاصطنا المختلفة بشكل عادل لمعرفة أي منها هو الأذكى حقاً، بدلاً من مجرد رؤية أي منها يمتلك إعدادات أكثر فخامة.

الملخص

"كوتشيس" هو مجموعة أدوات بسيطة ومفتوحة المصدر تسمح للباحثين باختبار مخترقي الذكاء الاصطناعي بشكل عادل. إنه يفصل بين "التفكير" و"التنفيذ"، ويبقي التجارب آمنة، ويسجل كل التفاصيل بحيث يمكن لأي شخص دراسة النتائج دون الحاجة إلى كمبيوتر خارق. إنه يحول العالم الفوضوي لأبحاث أمن الذكاء الاصطناعي إلى علم عادل وقابل للقياس.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →