Separating perception from reasoning in vision-language models: a model-free render ceiling for crystal structures
यह शोध पत्र "रेंडर सीलिंग" (render ceiling) को प्रस्तुत करता है, जो ज्ञात क्रिस्टल संरचनाओं के इनवर्टेड कैमरा रेंडरिंग का उपयोग करने वाला एक मॉडल-मुक्त बेंचमार्किंग तरीका है, जो विजन-लैंग्वेज मॉडल्स में दृश्य धारणा की त्रुटियों को तर्क संबंधी विफलताओं से निश्चित रूप से अलग करता है, जिससे यह पता चलता है कि कई मॉडल तार्किक निष्कर्ष निकालने के बजाय ज्यामितीय निष्कर्षण (geometric extraction) में संघर्ष करते हैं।