Where Not to Learn: Prior-Aligned Training with Subset-based Attribution Constraints for Reliable Decision-Making
यह शोध पत्र एक ऐसी प्रशिक्षण पद्धति प्रस्तावित करता है जो उपसमूह-आधारित एट्रिब्यूशन बाधाओं (subset-based attribution constraints) के माध्यम से ऑफ-प्रायर साक्ष्य पर निर्भरता को दंडित करके मॉडलों को मानवीय पूर्वाग्रहों (human priors) के साथ संरेखित करती है, जिससे इमेज क्लासिफिकेशन और GUI एजेंट कार्यों में कार्य सटीकता और निर्णय तर्कसंगतता दोनों में सुधार होता है।