Can Revealed Preferences Clarify LLM Alignment and Steering?
تقدم هذه الورقة مساراً تجريبياً يستخدم التفضيلات المعلنة لتقييم وتوجيه اتخاذ القرار في النماذج اللغوية الكبيرة في المجالات الطبية عالية المخاطر، حيث وجدت أنه بينما تُظهر النماذج تماسكاً داخلياً، إلا أنها تواجه صعوبة في التعبير لفظياً بدقة أو التبني الموثوق للأهداف المحددة من قبل المستخدم.