From Sycophantic Consensus to Pluralistic Repair: Why AI Alignment Must Surface Disagreement
تجادل هذه الورقة بأن اعتماد محاذاة الذكاء الاصطناعي الحالية على تجميع التفضيلات يعزز "إجماعاً تملقياً" خطيراً يقمع الخلاف الضروري، وتقترح تحولاً نحو "المحاذاة التعددية" المحددة بآليات حوارية من التحديد، والإشارات، والإصلاح المبدئي، والتي يتم تشغيلها من خلال مقياس جديد لضمان قدرة أنظمة الذكاء الاصطناعي على تحمل صراع القيم بدلاً من مجرد تسويته.