💻 computer science

A Scene Language Model for Open-Vocabulary Scene Mapping

यह शोध पत्र SceneLM को प्रस्तुत करता है, जो एक विजन-लैंग्वेज मॉडल है जो एक संक्षिप्त संरचित टेक्स्ट सूची के रूप में एक निरंतर, ओपन-वोकैबुलरी 3D सीन मैप बनाए रखता है, और पारंपरिक मैपिंग सिस्टम की तुलना में काफी कम मेमोरी उपयोग के साथ प्रतिस्पर्धी लोकलाइजेशन और रिट्रीवल प्रदर्शन प्राप्त करता है।

Adam Lilja, Fabio Hübel, Siming He, Junsheng Fu, Claire Tomlin, Lars Hammarstrand, Jitendra Malik, Jonas Frey, Marco Pav (…)2026-09-21
⚡ electrical engineering

Tilt as a Certified Resource: Preserving Motor Wrench-Rate Authority on Articulated Multirotors

यह शोधपत्र पूर्णतः-सक्रिय (fully-actuated) आर्टिकुलेटेड मल्टीरोटर्स के लिए एक कंट्रोल बैरियर फंक्शन-आधारित आवंटन रणनीति प्रस्तावित करता है जो मोटर-ओनली रेडिनेस सर्टिफिकेट को लागू करने के लिए सर्वो टिल्ट को एक ज्यामितीय संसाधन के रूप में उपयोग करता है, जिससे वेंच-रेट अथॉरिटी (wrench-rate authority) को संरक्षित किया जा सके और उन गंभीर बाधाओं के तहत सुरक्षा उल्लंघनों को रोका जा सके जहाँ शास्त्रीय विधियाँ विफल हो जाती हैं।

Giuseppe Silano, Martin Saska2026-09-21
💻 computer science

A High-Payload Wall-Climbing Robot Using Passive Bistable Suction Cups

यह शोध पत्र एक नवीन उच्च-भार वहन करने वाले वॉल-क्लाइंबिंग रोबोट प्रस्तुत करता है जो निष्क्रिय बाइस्टेबल सक्शन कप्स को संलग्न करने के लिए एक ट्रैक-आधारित प्रणाली का उपयोग करता है, जो बिना बिजली के आसंजन (एडहेसन) और 7.940 किलोग्राम का भार खींचने की क्षमता के साथ विभिन्न चिकनी सतहों पर चढ़ने में सक्षम बनाता है।

Andrew Nguyen, Mingyuan Li, Daniel Bruder2026-09-21
💻 computer science

Towards Fine-Grained Object Manipulation: SAM3-Guided Visuomotor Policy with Persistent Memory Learning and Focused Visual Conditioning

यह शोध पत्र एक SAM3-निर्देशित विज़ुओमोटर फ्रेमवर्क प्रस्तुत करता है जिसमें निरंतर वस्तु स्मृति के लिए FOM-SAM3 और केंद्रित दृश्य अनुकूलन के लिए FSAE शामिल है, जो रोबोटों को विचलित करने वाले तत्वों और दृश्य समानताओं के बीच सूक्ष्म वस्तुओं को मजबूती से पहचानने और हेरफेर करने में सक्षम बनाता है।

Haolong Meng, Fangbo Qin, Mengchen Bai, Houwu Wang, Cirong Liu, Shan Yu2026-09-21
⚡ electrical engineering

RAYA: Learning Where and When to Intervene for Robot Recovery

यह शोध पत्र RAYA प्रस्तुत करता है, जो एक हाइब्रिड लर्नड-एनालिटिक फ्रेमवर्क है जो विफलताओं से ज़ीरो-शॉट रिकवरी को सक्षम करने के लिए एक रोबोट के कंट्रोलर में एक लर्नड रिकवरेबिलिटी मार्जिन और एक एडेप्टिव टास्क शेड्यूलर को सक्रिय रूप से एकीकृत करता है, जो मौजूदा बेसलाइनों की तुलना में व्यापक सिमुलेशन और वास्तविक हार्डवेयर उड़ानों दोनों में बेहतर सर्वाइवल रेट प्रदर्शित करता है।

Ishaan Mahajan, Charles Chen, Frederike Dümbgen, Brian Plancher2026-09-21
💻 computer science

Sandwich-Residuals: Parameter-Efficient Test-time Adaptation of World Models

यह शोध पत्र 'सैंडविच-रेसिडुअल्स' (Sandwich-Residuals) को प्रस्तुत करता है, जो लेटेंट वर्ल्ड मॉडल्स के लिए एक पैरामीटर-कुशल टेस्ट-टाइम एडेप्टेशन विधि है जो प्रीट्रेंड वेट्स को फ्रीज करती है और केवल छोटे रेसिडुअल करेक्शन्स को सेल्फ-सुपरवाइज्ड प्रेडिक्शन एरर्स का उपयोग करके ऑनलाइन सीखती है, जिससे वितरण बदलावों (distribution shifts) के तहत सफलता दर में उल्लेखनीय सुधार होता है और मौजूदा दृष्टिकोणों की तुलना में 97-99% कम पैरामीटर्स को एडेप्ट किया जाता है।

Krishnam Soni, Aditya Sehgal, Vedant Dave, Elmar Rueckert2026-09-21
🤖 AI

ForceTwin: Physics-informed Digital Twins for Robotic Manipulation from Instrumented Human Interaction

ForceTwin एक ऐसा सिस्टम है जो बल-संवेदी ग्रिपर्स (force-sensing grippers) के साथ इंस्ट्रूमेंटेड मानव इंटरैक्शन का विश्लेषण करके आर्टिकुलेटेड वस्तुओं के फिजिक्स-इन्फॉर्म्ड डिजिटल ट्विन्स की पहचान करता है, जो मौजूदा किनेमैटिक्स-ओनली या विजुअल-लैंग्वेज प्रायर-आधारित दृष्टिकोणों की तुलना में काफी अधिक सटीक हेरफेर और नियंत्रण सक्षम बनाता है।

Tim Engelbracht, René Zurbrügg, Mayank Mittal, Marco Hutter, Marc Pollefeys, Hermann Blum, Zuria Bauer2026-09-21
💻 computer science

SFVO: Decoupled Confidence-Guided Stereo-Flow Visual Odometry with Bidirectional PnP

SFVO एक पत्राचार-संचालित (correspondence-driven) स्टीरियो विजुअल ओडोमेट्री फ्रेमवर्क है जो छवियों से सीधे पोज़ सीखने के बजाय, रोबस्ट, मेट्रिक-स्केल 6-DoF पोज़ अनुमान के लिए प्रीट्रेन स्टीरियो मैचिंग और ऑप्टिकल फ्लो मॉडल्स का लाभ उठाकर डिकपल्ड कॉन्फिडेंस-गाइडेड ज्यामितीय बाधाएं (geometric constraints) उत्पन्न करता है।

Kai Zhang, Guoyang Zhao, Jun Ma2026-09-21
🤖 machine learning

From Pretraining to Proficiency: Real-World Subtask RL for Long-Horizon Manipulation with Minimal Human Intervention

यह शोध पत्र PARTS को प्रस्तुत करता है, जो एक वास्तविक दुनिया का सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो केवल महत्वपूर्ण उप-कार्य बाधाओं (subtask bottlenecks) पर मानवीय हस्तक्षेप पर ध्यान केंद्रित करके पूर्व-प्रशिक्षित रोबोट नीतियों को फाइन-ट्यून करता है, जिससे मौजूदा विधियों की तुलना में न्यूनतम मानवीय प्रयास के साथ दीर्घ-अवधि हेरफेर (long-horizon manipulation) की सफलता दर में उल्लेखनीय सुधार होता है।

Sichang Su, Benjamin Yang, Zhiyun Deng, Boyuan Liang, Yip Fun Yeung, Zelin Wang, Lingfeng Sun2026-09-21
💻 computer science

A Sim-to-Real Integration Pipeline for Training and Deployment of Chunk-Based VLA Manipulation Policies

यह शोध पत्र एक ओपन-सोर्स सिम-टू-रियल पाइपलाइन प्रस्तुत करता है जो विशेषज्ञ सिमुलेशन प्रक्षेप पथों (expert simulation trajectories) को वास्तविक हार्डवेयर पर पुन: चलाने के माध्यम से युग्मित डेटासेट (paired datasets) उत्पन्न करके, चंक-आधारित विजन-लैंग्वेज-एक्शन (VLA) मैनिपुलेशन पॉलिसियों के प्रशिक्षण में डेटा की कमी की बाधा को संबोधित करता है, जिससे कुशल नीति प्रशिक्षण, मूल्यांकन और सिम-टू-रियल अंतराल का प्रत्यक्ष मापन सक्षम होता है।

Mathilde Kappel, Clémence Grislain, Mohamed Chetouani, Olivier Sigaud, Louis Annabi, Fa\"ız Ben Amar, Stéphane Doncieux (…)2026-09-21