Do 3D Large Language Models Really Understand 3D Spatial Relationships?
यह शोध पत्र प्रकट करता है कि वर्तमान 3D लार्ज लैंग्वेज मॉडल्स अक्सर वास्तविक 3D स्थानिक तर्क के बजाय पाठ्य शॉर्टकट (textual shortcuts) पर निर्भर करते हैं, जो लेखकों को वास्तविक 3D समझ का कड़ाई से मूल्यांकन करने और उसे सुधारने के लिए Real-3DQA बेंचमार्क और 3D-रीवेटेड (3D-reweighted) प्रशिक्षण उद्देश्य पेश करने के लिए प्रेरित करता है।