Value-Guided Iterative Refinement and the DIQ-H Benchmark for Evaluating VLM Robustness
यह शोध पत्र DIQ-H बेंचमार्क प्रस्तुत करता है, जो त्रुटि प्रसार (error propagation) और मूल्य विसंगति (value misalignment) का आकलन करने के लिए निरंतर प्रतिकूल दृश्य स्थितियों के तहत विजन-लैंग्वेज मॉडल्स का मूल्यांकन करने वाला पहला बेंचमार्क है, साथ ही वैल्यू-गाइडेड इटरेटिव रिफाइनमेंट (VIR) फ्रेमवर्क भी प्रस्तुत करता है जो सुरक्षा-महत्वपूर्ण अनुप्रयोगों के लिए एनोटेशन सटीकता में उल्लेखनीय सुधार करने हेतु नैतिक रूप से संरेखित ग्राउंड ट्रुथ जनरेशन को स्वचालित करता है।