The Counterexample Game: Iterated Conceptual Analysis and Repair in Language Models
यह शोध पत्र इस बात की जांच करता है कि क्या भाषा मॉडल पुनरावृत्त प्रति-उदाहरण (counterexample) और सुधार चक्रों के माध्यम से दार्शनिक अवधारणात्मक विश्लेषण को बनाए रख सकते हैं, जिसमें यह पाया गया है कि यद्यपि वे इस प्रक्रिया में संलग्न हो सकते हैं, लेकिन यह लूप शीघ्र ही घटते प्रतिफल (diminishing returns) की ओर ले जाता है जो बढ़ती हुई वाचालता (verbosity) के रूप में प्रकट होता है जिसमें सटीकता में सुधार नहीं होता है और मानव न्यायाधीशों की तुलना में अमान्य प्रति-उदाहरणों को अत्यधिक स्वीकार करने की प्रवृत्ति देखी जाती है।