Right-to-Act: A Pre-Execution Non-Compensatory Decision Protocol for AI Systems
تقدم هذه الورقة بروتوكول "الحق في التنفيذ"، وهو إطار عمل حتمي وغير تعويضي لما قبل التنفيذ يعمل على إيقاف إجراءات الذكاء الاصطناعي إذا لم يتم استيفاء أي شرط من شروط السلامة، مما ينقل التركيز من تحسين جودة القرار إلى الحوكمة الصارمة لمقبولية التنفيذ.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
تخيل أن لديك مساعداً آلياً (روبوت) ذكياً وسريعاً للغاية. يمكن لهذا الروبوت القيام بأشياء مثل إرسال الأموال، أو قفل حسابات الأشخاص، أو تغيير الإعدادات في آلة مصنع. في الوقت الحالي، لدينا الكثير من القواعد لضمان سلامة هذا الروبوت:
- التفويض (Authorization): "هل يُسمح لهذا الروبوت بلمس الآلة؟"
- السلامة (Safety): "هل سيؤدي هذا الإجراء إلى إيذاء أي شخص؟"
- تقييم المخاطر (Risk Scoring): "على مقي scale من 1 إلى 100، ما مدى خطورة هذا الأمر؟"
تجادل الورقة البحثية بأنه حتى لو اجتاز الروبوت كل هذه الاختبارات، فلا تزال هناك خطوة مفقودة. قد يكون الروبوت مسموحاً له، وآمناً، ومنخفض المخاطر، لكن قد يظل من الخطأ القيام بهذا الإجراء في الوقت الحالي لأنه يفتقر إلى قطعة حاسمة من اللغز.
تطلق المؤلفة على هذه الخطوة المفقودة اسم "فجوة شرعية ما قبل الإجراء" (Pre-Action Legitimacy Gap).
المشكلة الجوهرية: "الدرجة" مقابل "قائمة التحقق"
لفهم هذه الفجوة، تخيل طريقتين قد يستخدمهما المعلم لتقييم مشروع طالب:
1. النظام التعويضي (Compensatory System) - (كيف نفعل ذلك الآن):
هذا يشبه لعبة النقاط.
- يحصل الطالب على 10 نقاط لتصميم رائع.
- ويحصل على 10 نقاط للبحث الجيد.
- ويحصل على 10 نقاط لعرض تقديمي لطيف.
- ولكن، لقد نسي تضمين صفحة العنوان (متطلب مفقود).
- النتيجة: بما أن لديه 30 نقطة إجمالية، ودرجة النجاح هي 20، فإن المعلم يعطيه درجة (A). لقد تم "التعويض" عن صفحة العنوان المفقودة بالأجزاء الجيدة الأخرى.
2. النظام غير التعويضي (Non-Compensatory System) - ("الحق في التصرف" المقترح في الورقة):
هذا يشبه نقطة تفتيش أمنية مع قائمة تحقق صارمة.
- هل لديك تذكرة؟ نعم.
- هل لديك جواز سفر؟ نعم.
- هل لديك تأشيرة؟ لا.
- النتيجة: لا يهم إذا كنت تملك تذكرة ذهبية، وجواز سفر رائع، وابتسامة ودودة. إذا كنت تفتقر إلى التأشيرة، فلا يمكنك الدخول. لا يوجد مقدار من "النقاط الجيدة" يمكنه إصلاح نقص التأشيرة.
تجادل الورقة بأنه بالنسبة للذكاء الاصطناعي الذي يتخذ قرارات في العالم الحقيقي (مثل قفل حساب أو تحويل أموال)، فإننا بحاجة إلى نهج "قائمة التحقق" وليس "نظام النقاط".
بروتوكول "الحق في التصرف" (Right-to-Act)
يقترح المؤلف "قاعدة" جديدة تسمى "الحق في التصرف".
فكر في الأمر كحارس أمن في ملهى ليلي لا يهتم بمقدار المال الذي تملكه (درجتك) أو مدى أناقتك (تقييم سلامتك). الحارس يسأل فقط: "هل تملك المفتاح المحدد المطلوب لفتح هذا الباب تحديداً؟"
- إذا قال الذكاء الاصطناعي: "أريد قفل حساب هذا المستخدم"، يتحقق النظام: "هل لدينا دليل على أن هذا المستخدم خرق القواعد فعلاً، أم أنه مجرد تخمين؟"
- إذا كان الدليل مفقوداً، يقول النظام: "لا".
- إنه لا يقول: "حسناً، نسبة الثقة في التخمين هي 95%، فلنفعل ذلك على أي حال".
- بدلاً من ذلك، يقول: "توقف. ليس لدينا المفتاح. اذهب واحصل على مزيد من المعلومات أو اطلب مساعدة بشرية".
لماذا هذا مهم (مثال تعليق الحساب)
تستخدم الورقة مثالاً من الواقع: ذكاء اصطناعي يقرر حظر مستخدم من موقع إلكتروني.
- الطريقة القديمة: يرى الذكاء الاصطناعي أن المستخدم قام بنشاط مشبوه 5 مرات، ويبدو كأنه هكر معروف، والذكاء الاصطناعي متأكد بنسبة 95% أنه هكر. "درجة المخاطر" عالية. النتيجة: يتم حظر المستخدم فوراً.
- المشكلة: ماذا لو كان المستخدم يستخدم مجرد جهاز كمبيوتر مشترك تم اختراقه؟ كان الذكاء الاصطناعي "محقاً" بشأن النشاط المشبوه، لكنه كان "مخطئاً" بشأن هوية الفاعل. لقد أغفل الذكاء الاصطناعي شرطاً مطلوباً وهو: "التحقق من هوية المستخدم".
- الطريقة الجديدة (الحق في التصرف): يتحقق النظام من قائمة التحقق.
- نشاط مشبوه؟ نعم.
- ثقة عالية؟ نعم.
- هل تم التحقق من الهوية؟ لا.
- النتيجة: النظام يتوقف. لا يقوم بحظر المستخدم. بدلاً من ذلك، يقول: "لا يمكنني القيام بهذا بعد. أحتاج إلى طلب المزيد من المعلومات من المستخدم".
الخلاصة الكبرى
تثبت الورقة رياضياً أنه لا يمكنك حل هذه المشكلة بمجرد رفع "درجة المخاطر" أو تحسين "السلامة". إذا كنت تستخدم نظام درجات، فإن الدرجة العالية ستتمكن دائماً من تغطية المتطلبات المفقودة.
الشرعية ليست درجة؛ الشرعية هي حدود.
تشير الورقة إلى أنه قبل السماح للذكاء الاصطناعي بـ "الضغط على الزناد" لأي إجراء في العالم الحقيقي، يجب أن يجتاز قائمة تحقق صارمة وغير قابلة للتفاوض. إذا كان هناك شرط واحد مطلوب مفقود، يتم حظر الإجراء، بغض النظر عن مدى "ذكاء" أو "ثقة" الذكاء الاصطناعي. هذا يحول "عدم فعل شيء" (الانتظار، أو طلب المساعدة، أو التصعيد إلى إنسان) إلى نتيجة صالحة وضرورية، بدلاً من اعتباره فشلاً في النظام.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.