Self-Ensembling Vision-Language Models for Chart Data Extraction
تقترح هذه الورقة طريقة لنموذج رؤية ولغة ذات تجميع ذاتي تعمل على تجميع مخرجات جدولية متعددة العينات لتحسين دقة وموثوقية استخراج البيانات من المخططات إلى جداول، وهو ما تم التحقق منه عبر معيار مرجعي جديد ومعقد (WB-ChartExtract) يُظهر مكاسب كبيرة في الأداء مقارنة بالنهج أحادي المرور.