VEGA: Learning Navigation VLAs from In-the-Wild Egocentric Video with Geometric Trajectory Supervision
VEGA बिना लेबल वाले एगोसेंट्रिक (egocentric) वीडियो से स्थानीय दृश्य ज्यामिति (local scene geometry) को पुनर्गठित करके बाधा-सचेत प्रक्षेपवक्र (obstacle-aware trajectories) उत्पन्न करने के लिए पर्यवेक्षण (supervision) हेतु नेविगेशन विजन-लैंग्वेज-एक्शन मॉडलों को प्रशिक्षित करने की एक विधि प्रस्तुत करता है, जिससे मौजूदा बेसलाइन की तुलना में टकराव बचाव और सफलता दरों में महत्वपूर्ण सुधार प्राप्त होता है।