💻 computer science

Dreaming Across Towns: Semantic Rollout and Town-Adversarial Regularization for Zero-Shot Held-Out-Town Fixed-Route Driving in CARLA

यह शोध पत्र CARLA में फिक्स्ड-रूट ड्राइविंग के लिए एक ज़ीरो-शॉट ट्रांसफर विधि प्रस्तावित करता है जो सिमेंटिक रोलआउट और टाउन-एडवर्सरियल रेगुलराइजेशन को जोड़ता है ताकि एजेंटों को भविष्य के विज़ुअल सिमेंटिक्स की भविष्यवाणी करने के लिए प्रशिक्षित करके और सोर्स-टाउन-विशिष्ट विशेषताओं पर निर्भरता को कम करके अनदेखे टाउन्स में सामान्यीकरण में महत्वपूर्ण सुधार किया जा सके।

Feeza Khan Khanzada, Jaerock Kwon2026-06-01
💻 computer science

Hyper-DP3: Frequency-Aware Right-Sizing of 3D Diffusion Policies for Visuomotor Control

यह शोध पत्र Hyper-DP3 प्रस्तुत करता है, जो एक हल्का (लाइटवेट) 3D डिफ्यूजन पॉलिसी है जो फ्रीक्वेंसी-डोमेन विश्लेषण का लाभ उठाकर यह प्रदर्शित करता है कि रोबोटिक एक्शन डिनोइजिंग के लिए न्यूनतम स्टेप्स और मॉडल जटिलता की आवश्यकता होती है, जिससे यह पूर्ववर्ती विधियों की तुलना में 1% से भी कम पैरामीटर्स और काफी कम लेटेंसी के साथ अत्याधुनिक प्रदर्शन प्राप्त करता है।

Jinhao Zhang, Zhexuan Zhou, Huizhe Li, Yichen Lai, Wenlong Xia, Haoming Song, Youmin Gong, Jie Mei2026-06-01
💻 computer science

Learning-Based Navigation for Indoor Mobile Robots

यह शोध पत्र इनडोर मोबाइल रोबोटों के लिए एक लर्निंग-आधारित नेविगेशन फ्रेमवर्क प्रस्तुत करता है जो A* ट्रैजेक्टरीज पर प्रशिक्षित एक सुपरवाइज्ड न्यूरल ग्लोबल प्लानर को बीहेवियर क्लोनिंग और PPO-रिफाइंड डायनेमिक विंडो अप्रोच को संयोजित करने वाले एक लोकल प्लानर के साथ एकीकृत करता है, जो सिम्युलेटेड और वास्तविक दुनिया के वातावरणों में प्रभावी और सुरक्षित लक्ष्य-निर्देशित नेविगेशन प्रदर्शित करता है।

Tri-Tin Nguyen, Tien-Dat Nguyen, Gia-Uy Le, Vinh Nguyen, Vinh-Hao Nguyen2026-06-01
⚡ electrical engineering

Physics-informed Goal-Conditioned Reinforcement Learning under Hybrid Contact Dynamics

यह शोध पत्र संपर्क-समृद्ध हेरफेर (contact-rich manipulation) कार्यों में मौजूदा भौतिकी-सूचित लक्ष्य-सशर्त सुदृढीकरण शिक्षण (physics-informed goal-conditioned reinforcement learning) विधियों की विफलता को संबोधित करने के लिए संपर्क-जागरूक और पदानुक्रमित सूत्रीकरण पेश करता है जो हाइब्रिड डायनेमिक्स और गैर-चिकनी मूल्य भू-आकृतियों (nonsmooth value landscapes) को संभालने के लिए चुनिष्ट रूप से भौतिकी-सूचित प्रेरणात्मक पूर्वाग्रहों (physics-informed inductive biases) को लागू करते हैं।

Vittorio Giammarino, Anastasios Manganaris, Ahmed H. Qureshi2026-06-01
💻 computer science

ARISTO Hand: Sensing-Driven Distal Hyperextension for Fine-Grained Manipulation

ARISTO हैंड एक टेंडन-ड्रिवन रोबोटिक हैंड है जो सक्रिय डिस्टल हाइपरएक्सटेंशन को एक हाइब्रिड सेंसिंग आर्किटेक्चर के साथ एकीकृत करके पतली वस्तुओं के सूक्ष्म हेरफेर को प्राप्त करता है, जिससे SD कार्ड निष्कर्षण जैसे कार्यों के दौरान पुल-आउट फोर्स और संपर्क विश्वसनीयता में महत्वपूर्ण सुधार होता है।

Aaron Kim, Dong Ho Kang, Mark Helwig, Mingyo Seo, Kazuto Yokoyama, Tetsuya Narita, Luis Sentis2026-06-01
🤖 AI

Memory-Bound but Not Bandwidth-Limited: The Physical AI Inference Gap in Batch-1 LLM Decode

यह शोध पत्र प्रकट करता है कि जहाँ फिजिकल एआई (Physical AI) का बैच-1 एलएलएम (LLM) इन्फरेंस मेमोरी-डॉमिनेटेड है, वहीं तेज़ जीपीयू (GPU) असंगत रूप से अधिक लॉन्च-साइड ओवरहेड्स से ग्रस्त होते हैं जो आनुपातिक लेटेंसी लाभ को रोकते हैं, और मानक क्वांटाइजेशन विधियाँ अक्सर अपेक्षित स्पीडअप प्राप्त करने में विफल रहती हैं जब तक कि उन्हें GPTQ+ExLlamaV2 जैसे अत्यधिक अनुकूलित कर्नेल्स के साथ जोड़ा न जाए।

Josef Chen2026-06-01
🤖 AI

PInVerify: An Offline Embodied Benchmark for Active Instance Verification

यह शोध पत्र PInVerify प्रस्तुत करता है, जो एक ऑफलाइन एम्बॉडीड बेंचमार्क है जिसे एक्टिव इंस्टेंस वेरिफिकेशन (AIV) कार्यों का मूल्यांकन करने के लिए डिज़ाइन किया गया है जहाँ एजेंटों को सूक्ष्म वस्तु विशेषताओं को अलग करने के लिए मल्टी-व्यू निरीक्षण करना होता है, जिससे यह पता चलता है कि जबकि LoRA-फाइन-ट्यून किए गए एजेंट मजबूत प्रदर्शन प्राप्त करते हैं, वर्तमान नेक्स्ट-बेस्ट-व्यू रणनीतियाँ अभी तक स्टैटिक बेसलाइन की तुलना में विश्वसनीय लाभ प्रदान नहीं करती हैं।

Yuhang Jiang2026-06-01
🤖 machine learning

BOKBO (Best of K Bad Options): Calibrated Abstention for VLA Policies

यह शोध पत्र BOKBO को प्रस्तुत करता है, जो K-सैंपल VLA इन्फरेंस के लिए पहला कॉन्फॉर्मल एब्स्टेंशन लेयर (conformal abstention layer) है, जो मौजूदा नॉनकॉन्फॉर्मिटी स्कोर्स में संरचनात्मक विफलताओं को संबोधित करके और फोर्स थ्रेशोल्डिंग में पद्धतिगत खामियों को सुधारकर निष्पादित-उल्लंघन दरों (executed-violation rates) पर परिमित-नमूना वितरण-मुक्त गारंटी प्रदान करता है, जिससे विविध बेंचमार्क और वितरण बदलावों (distribution shifts) में सुरक्षा अंशांकन (safety calibration) और कार्य सफलता में महत्वपूर्ण सुधार होता है।

Anya Singh, Cabrel Happi, Jai Relan, Varun Nair, Vidyut Baradwaj2026-06-01
💻 computer science

WristCompass: Kinematic Coupling as a Learnable Visual Concept for Ego-Camera Orientation

WristCompass कलाई की गति और कैमरा ओरिएंटेशन के बीच काइनेमैटिक कपलिंग डायनेमिक्स पर आधारित एक सीखने योग्य विज़ुअल कॉन्सेप्ट पेश करता है, जो उच्च दक्षता और एनाटॉमिकल ग्राउंडिंग के साथ बाधित मैनिपुलेशन वीडियो में ज़ीरो-शॉट ईगो-कैमरा ओरिएंटेशन रिकवरी को सक्षम बनाता है।

Varun Nair, Vidyut Baradwaj, Jiahang He, Anya Singh, Jai Relan, Cabrel Happi2026-06-01
💻 computer science

Primitive Subspaces Mediate Few-Shot Transfer in VLAs

यह शोध पत्र यह प्रदर्शित करता है कि प्रिमिटिव-सेगमेंटेड एपिसोड के साथ विजन-लैंग्वेज-एक्शन (VLA) पॉलिसियों को प्रशिक्षित करना उप-कौशलों की एक हस्तांतरणीय लाइब्रेरी बनाता है जो फ्लैट ट्राजेक्टरी ट्रेनिंग की तुलना में काफी अधिक सैंपल-एफिशिएंट फ्यू-शॉट टास्क एडाप्टेशन सक्षम करता है, एक कारण संबंध जिसे सबस्पेस एब्लेशन अध्ययनों के माध्यम से पुष्ट किया गया है।

Anya Singh, Cabrel Happi, Jai Relan, Varun Nair, Vidyut Baradwaj2026-06-01