A Scene Language Model for Open-Vocabulary Scene Mapping
यह शोध पत्र SceneLM को प्रस्तुत करता है, जो एक विजन-लैंग्वेज मॉडल है जो एक संक्षिप्त संरचित टेक्स्ट सूची के रूप में एक निरंतर, ओपन-वोकैबुलरी 3D सीन मैप बनाए रखता है, और पारंपरिक मैपिंग सिस्टम की तुलना में काफी कम मेमोरी उपयोग के साथ प्रतिस्पर्धी लोकलाइजेशन और रिट्रीवल प्रदर्शन प्राप्त करता है।