Governed Metaprogramming for Intelligent Systems: Reclassifying Eval as a Governed Effect
تقترح هذه الورقة "البرمجة الميتافيزيقية المحكومة"، وهي تصميم لغوي يعيد تصنيف أداة `eval` غير المقيدة إلى تأثير محكوم يتطلب فحصاً هيكلياً وامتثالاً للسياسات قبل تجسيد الأشكال الرمزية إلى كود قابل للتنفيذ، مما يضمن السلامة والتحكم في السلطة في أنظمة الذكاء الاصطناعي ذاتية التعديل.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
تخيل أن لديك مساعداً آلياً ذكياً جداً يمكنه كتابة تعليماته الخاصة. يمكنه النظر إلى مشكلة ما، والتفكير فيها، ثم كتابة مجموعة جديدة من القواعد لنفسه ليتبعها.
في عالم البرمجة القديم، إذا كتب هذا الروبوت مجموعة جديدة من القواعد، فإن الكمبيوتر سيقول ببساطة: "حسناً، سأقوم بتشغيلها الآن". لن يتساءل: "مهلاً، هل هذه القواعد آمنة؟ هل تحاول سرقة كلمة مرور حسابك البنكي؟ هل تحاول حذف ملفاتك؟". لقد تعامل الكمبيوتر مع عملية تحويل الكلمات المكتوبة إلى أفعال كأنها زر سحري يعمل دائماً.
تجادل هذه الورقة بأن الأنظمة التي يمكنها إعادة كتابة نفسها، يكون هذا "الزر السحري" خطيراً. يقترح المؤلف، آلان إل. مكين (Alan L. McCann)، طريقة جديدة للتعامل مع هذا الأمر تسمى البرمجة الفوقية المحكومة (Governed Metaprogramming).
إليك الفكرة الجوريّة، مقسمة عبر تشبيهات بسيية:
1. المشكلة: "الزر السحري" معطل
فكر في برنامج الكمبيوتر مثل الوصفة.
- الكود (Code): الوصفة المكتوبة (المكونات والخطوات).
- التنفيذ (Execution): عملية طهي الوجبة.
في الأنظمة التقليدية، إذا كتبت وصفة جديدة على ورقة، يمكنك تسليمها فوراً للطاهي، ويبدأ الطاهي بالطهي. الانتقال من الورقة إلى الطهي هو انتقال فوري وغير مقيد.
لكن في الذكاء الاصطناعي الحديث، "الطاهي" (الذكاء الاصطناعي) يمكنه كتابة وصفات جديدة أثناء الطهي. إذا كتب الذكاء الاصطناعي وصفة تقول "كل المطبخ بالكامل"، وقام النظام بالسماح له بالطهي فوراً، فستحدث كارثة. تسمي الورقة هذا الانتقال "تضخم السلطة" (Authority Amplification). إنه اللحظة التي تتحول فيها ورقة (بيانات) فجأة إلى قوة قادرة على تغيير العالم الحقيقي (تنفيذ).
2. الحل: "حارس الأمن" للوصفات
تقترح الورقة أن نتوقف عن معاملة عملية تحويل الوصفة إلى وجبة كدالة حاسوبية بسيطة. بدلاً من ذلك، نعاملها كـ أثر محكوم (governed effect) — وهو إجراء خاص يتطلب موافقة حارس أمن.
يقدم النظام مفهوماً جديداً يسمى الأشكال الآلية (Machine Forms).
- الأشكال الآلية هي مثل المخططات الهندسية أو الرسوم التخطيطية للوصفة. إنها مجرد بيانات. لا يمكنها طهي أي شيء. لا يمكنها الاتصال برقم هاتف. إنها مجرد صور للتعليمات.
- التلاعب بالمخططات (الرسم عليها، مسح الخطوط، دمج مخططين معاً) هو أمر آمن. إنه يشبه لعب طفل بقطع الليغو. لا يمكن أن يحدث ضرر حقيقي للعالم بمجرد تحريك قطع البلاستيك حول بعضها البعض.
3. الخطوة الحاسمة: "التجسيد" (Materialization)
اللحظة الخطيرة تسمى التجسيد. هذه هي اللحظة التي تأخذ فيها المخطط وتقول: "حسناً، ابنِ هذا".
في هذا النظام الجديد، لا يمكنك مجرد قول "ابنِ هذا". بل يجب عليك تسليم المخطط إلى نظام الحوكمة (حارس الأمن). يقوم الحارس بثلاثة أشياء قبل السماح للطاهي بالطهي:
- يفحص المخطط: هل تحاول هذه الوصفة استخدام مكون محظور (مثل نموذج ذكاء اصطناعي خطير)؟
- يتحقق من القواعد: هل تقع هذه الوصفة ضمن الميزانية؟ هل تحاول الوصول إلى ملفات لا ينبغي لها الوصول إليها؟
- يقرر: إذا اجتازت الاختبار، يعطي الحارس إشارة "الانطلاق". وإذا فشلت، يتم إلقاء المخطط في السلة.
4. لماذا يهم هذا بالنسبة للذكاء الاصطناعي ذاتي التحسين
تخيل ذكاءً اصطناعياً يريد أن يصبح أكثر ذكاءً. ينظر إلى الكود الخاص به، ويدرك أنه سيء في الرياضيات، ويكتب نسخة جديدة من نفسه تكون أفضل في الرياضيات.
- بدون هذا النظام: يكتب الذكاء الاصطناعي الكود الجديد، يضغط على "تشغيل"، وفجأة يمتلك الكود الجديد كامل السلطة. إذا ارتكب الذكاء الاصطناعي خطأ أو تم خداعه، فقد يمنح نفسه بالخطأ القدرة على حذف كل شيء.
- مع هذا النظام: يكتب الذكاء الاصطناعي الكود الجديد (المخطط). ثم يتعين عليه أن يسأل حارس الأمن: "هل يمكنني أن أصبح هذه النسخة الجديدة؟". يفحص الحارس الكود الجديد. إذا كان الكود الجديد يحاول القيام بشيء غير مسموح للذكاء الاصطناعي القيام به (مثل الوصول إلى قاعدة بيانات سرية)، فإن الحارس يقول "لا". لا يمكن للذكاء الاصطناعي تجاوز الحارس، حتى لو كتب الكود بنفسه.
الخلاصة الكبرى
تزعم الورقة أن الأمر eval (الأمر الذي يحول الكود إلى فعل) ليس مجرد أداة؛ بل هو منح سلطة.
من خلال إعادة تصنيفه كـ "أثر محكوم"، يضمن النظام ما يلي:
- كتابة الكود (التلاعب بالمخططات) آمن ونقي.
- تشغيل الكود (تحويل المخططات إلى فعل) يمر دائماً عبر نقطة تفتيش.
- لا توجد طرق مختصرة. لا يمكنك تمرير برنامج خطير بجانب الحارس عبر إخفائه داخل عملية حسابية عادية.
قام المؤلف بتنفيذ هذا في نظام يسمى MashinTalk وأثبت رياضياً (باستخدام 454 نظرية رسمية) أنه من المستحيل تجاوز حارس الأمن هذا. إنه يخلق عالماً يمكن للذكاء الاصطناعي فيه بناء نسخ جديدة من نفسه، ولكن فقط إذا اجتازت تلك النسخ الجديدة فحص سلامة صارم أولاً.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.