Semantic Reward Collapse and the Preservation of Epistemic Integrity in Adaptive AI Systems
تحدد هذه الورقة "انهيار المكافأة الدلالي" كخلل هيكلي في أنظمة الذكاء الاصطناعي التكيفية حيث يتم دمج أنواع متميزة من الأخطاء في إشارة مكافأة واحدة، مما يتسبب في قمع النماذج لعدم اليقين والهلوسة بدلاً من الاعتراف بالفشل، وتقترح "تدرج المكافأة الدستوري" كإطار حوكمة للحفاظ على النزاهة المعرفية من خلال تمييز إشارات المكافأة بناءً على نوع الخطأ.