DAM-VLA: Decoupled Asynchronous Multimodal Vision Language Action model
यह शोध पत्र DAM-VLA को प्रस्तुत करता है, जो एक डिकपल्ड एसिंक्रोनस विजन-लैंग्वेज-एक्शन मॉडल है जो सिंक्रोनस आर्किटेक्चर की फ्रीक्वेंसी सीमाओं को दूर करने के लिए मोडैलिटीज को उनकी नेटिव सेंसर दरों पर प्रोसेस करता है, और 100 Hz रिएक्टिव कंट्रोल बनाए रखते हुए कॉन्टैक्ट-रिच रियल-वर्ल्ड मैनिपुलेशन टास्क पर मजबूत बेसलाइन्स की तुलना में दोगुने से अधिक सफलता दर प्राप्त करता है।