Reliable Reasoning with Large Language Models via Preference-Based Maximum Satisfiability
تقترح هذه الورقة إطار عمل استدلالي هجين حيث تقوم النماذج اللغوية الكبيرة بتوليد كود بايثون لترميز مهام الاستدلال القائمة على التفضيلات كمسائل MaxSAT، والتي يتم حلها والتحقق منها بواسطة أدوات حل دقيقة لتحقيق معدلات أعلى بكثير من حيث الجدوى والصحة مقارنة بالنماذج المرجعية التي تعتمد على الإجابة المباشرة أو سلسلة الأفكوت.