Testing and Evaluation of Agentic AI Systems In Military Command and Control
تجادل هذه الورقة بأن الخصائص المتأصلة في أنظمة الذكاء الاصطناعي الوكيل تقوض ثمانية افتراضات تأسيسية لأساليب الاختبار والتقييم العسكرية الحالية، مما يؤدي إلى كسر الرابط المنطقي بين أدلة الاختبار والسلوك الميداني، وهو ما يستلزم التحول نحو ادعاءات ضمان أضيق نطاقاً وقابلة للاسترداد، ونموذج حوكمة يعامل النشر كفعل مستمر من إدارة المخاطر.