GRID: Graph Representation of Intelligence Data for Security Text Knowledge Graph Construction
تقدم الورقة البحثية إطار عمل GRID، وهو إطار عمل متكامل (end-to-end) يقوم ببناء رسوم بيانية للمعرفة الأمنية من استخبارات التهديدات السيبرانية عبر الاستفيادة من محاذاة المقالات والرسوم البيانية القابلة للتتبع ونظام مكافآت قائم على بنك مهام مبرمج لتدريب مستخرجات ذات كفاءة بحجم 4 مليارات معلمة تحقق دقة واستدعاء وتكلفة فعالة تتفوق على طرق التقييم التقليدية القائمة على النماذج اللغوية الكبيرة.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
تخيل أنك محقق في الأمن السيبراني تحاول حل جريمة ضخمة ومعقدة. لديك كومة من آلاف التقارير الشرطية الفوضوية والطويلة والمملة ("النص الأمني"). هدفك هو تحويل هذه التقارير الفوضوية إلى خريطة منظمة ونظيفة (رسم بياسي للمعرفة - Knowledge Graph) توضح بالضبط من فعل ماذا، ولمن، وكيف.
المشكلة هي أن المحققين الذين تستعين بهم عادةً (نماذج الذكاء الاصطناعي القياسية) بارعون في المحادثات العامة ولكنهم سيئون للغاية في فهم المصطلحات الأمنية المحددة؛ فهم غالباً ما يغفلون عن التفاصيل الحاسمة أو يختلقون معلومات من خيالهم. علاوة على ذلك، فإن تعليمهم القيام بهذه المهمة أمر مكلف وصعب للغاية لأن تقييم عملهم يتطلب استئجار خبير بشري لكل محاولة.
إليك GRID (تمثيل البيانات الاستخباراتية في رسوم بيانية). فكر في GRID ليس فقط كمحقق جديد، بل كأكاديمية تدريب ونظام تقييم كامل مصمم خصره لتحويل ذكاء اصطناعي صغير ومنخفض التكلفة إلى خبير أمني.
إليك كيف يعمل GRID، مقسماً إلى خطوات بسيطة:
1. "الكتاب المدرسي ذاتي التصحيح" (التعليق التوضيحي التلقائي)
عادةً، لتعليم طالب ما، تحتاج إلى معلم يكتب نموذج إجابة مثالياً. ولكن بالنسبة للتقارير الأمنية، لم يكتب أحد نماذج الإجابة هذه بعد.
- حل GRID: يعمل GRID كمعلم ذكي يكتب كتابه المدرسي الخاص. يقرأ تقريراً أمنياً فوضوياً، ويستخرج الحقائق لإنشاء خريطة أولية، ثم يعيد كتابة التقرير الأصلي.
- التشبيه: تخيل طالباً يحدد النصوص في كتاب مدرسي. إذا حدد القلم النص لشيء ليس موجوداً فعلياً في النص، يقوم المعلم (GRID) بمسح ذلك التحديد وإعادة كتابة الجملة لتتطابق مع الحقائق. هذا يخلق "زوجاً" مثالياً من قصة وخريطتها دون الحاجة إلى بشر لكتابتها من الصفر.
2. "اختصار الاختيار من متعدد" (مكافآت بنك المهام)
تعليم الذكاء الاصطناعي رسم خريطة كاملة من الصفر يشبه مطالبة طالب بكتابة مقال من 50 صفحة ثم تقييمه؛ فهذا يستغرق وقتاً طويلاً ويكلف ثروة إذا استخدمت مقيّماً بشرياً (أو مقيّماً من الذكاء الاصطناعي باهظ الثمن) في كل مرة.
- حل GRID: بدلاً من تقييم المقال بالكامل، يقوم GRID بتفكيك الدرس إلى اختبارات قصيرة صغيرة وسهلة التحقق.
- التشبيه: بدلاً من سؤال الطالب: "ارسم مسرح الجريمة بالكامل"، يسأله GRID: "هل استخدم المخترق الأداة (أ) أم الأداة (ب)؟" أو "هل هذه العلاقة المحددة بين شخصين صحيحة أم خاطئة؟".
- لماذا يساعد ذلك: هذه تشبه أسئلة الاختيار من متعدد ذات "قائمة مراجعة" للإجابة. إنها رخيصة ويمكن تقييمها فورياً. من خلال التدرب على آلاف من هذه الاختبارات القصيرة، يتعلم الذكاء الاصطناي قواعد اللعبة بشكل أسرع وأرخص مما لو كان عليه كتابة مقالات كاملة في كل مرة.
3. "كتاب القواعد" (الاستخراج الموجه بالأنطولوجيا)
المصطلحات الأمنية مخادعة. فقد يُطلق على "الفيروس" أسماء مثل "برمجية خبيثة"، أو "تهديد"، أو "ثغرة" في تقارير مختلفة.
- حل GRID: يمنح GRID الذكاء الاصطناعي كتاب قواعد صارم (أنطولوجيا). يخبر الذكاء الاصطناعي: "إذا رأيت 'فيروساً' أو 'حصان طروادة'، فكلاهما ينتمي إلى مجلد 'البرمجيات الخبيثة'".
- التشبيه: الأمر يشبه إعطاء المحقق خزانة ملفات معيارية. بدلاً من التخمين أين يضع الملف، يعرف الذكاء الاصطناعي تماماً أي درج يستخدم بناءً على نوع التهديد المحدد، مما يضمن أن تكون الخريطة النهائية منظمة ومتسقة.
4. نتائج "التقييم"
اختبر الباحثون هذا النظام على 249 تقريراً أمنياً حقيقياً من خمسة مصادر مختلفة. وقارنوا ذكاءهم الاصطناعي "المدرب" بأنظمة رائدة أخرى.
- النتيجة: كان الذكاء الاصطناعي المدرب بواسطة GRID هو الأفضل في العثور على جميع الأدلة المفقودة (الاستدعاء/Recall). لقد وجد المزيد من التهديدات الفعلية من أي نظام آخر تم اختباره.
- الكفاءة: بينما كانت الأنظمة الأخرى مثل الشاحنات الثقيلة والبطيئة والمكلفة، كان GRID مثل سيارة رشيقة وسريعة. لقد حقق درجات عالية مماثلة تقريباً ولكنه استخدم أقل من نصف قوة الحوسبة (الرموز/tokens) للوصول إلى هناك.
الملخص
فكر في GRID كنظام يأخذ ذكاءً اصطناعياً صغيراً ميسور التكلفة ويمنحه:
- أدلة دراسية ذاتية الصنع (مقالات أعيدت كتابتها).
- اختبارات تدريبية دقيقة (اختبارات اختيار من متعدد) بدلاً من الامتحانات النهائية المكلفة.
- نظام أرشفة صارم (كتاب القواعد) للحفاظ على التنظيم.
النتيجة هي خبير أمني من الذكاء الاصطناعي، أقل تكلفة في التشغيل، أسرع في التدريب، وأفضل في العثور على التفاصيل المخفية في التقارير الأمنية من الجيل السابق من الأدوات.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.