💻 computer science

MAPLE: Latent Multi-Agent Play for End-to-End Autonomous Driving

MAPLE एक स्केलेबल, सिम्युलेटर-मुक्त फ्रेमवर्क है जो विजन-लैंग्वेज-एक्शन मॉडल्स के लेटेंट स्पेस में सुपरवाइज्ड फाइन-ट्यूनिंग और डाइवर्सिटी रिवार्ड्स के साथ रिइन्फोर्समेंट लर्निंग के माध्यम से रिएक्टिव, मल्टी-एजेंट क्लोज्ड-लूप ट्रेनिंग को सक्षम करके एंड-टू-एंड ऑटोनॉमस ड्राइविंग को बढ़ाता है।

Rajeev Yasarla, Deepti Hegde, Hsin-Pai Cheng, Shizhong Han, Yunxiao Shi, Meysam Sadeghigooghari, Hanno Ackermann, Litian (…)2026-05-15
💻 computer science

Distill: Uncovering the True Intent behind Human-Robot Communication

यह शोधपत्र "डिस्टिल" (Distill) का प्रस्ताव करता है, जो मानव-रोबोट संचार इंटरफेस के लिए एक नवीन दृष्टिकोण है जो कार्य विशिष्टताओं में अनावश्यक चरणों को हटाकर, चरणों के अर्थों का सामान्यीकरण करके और क्रम संबंधी बाधाओं को शिथिल करके उपयोगकर्ता के इरादे को पकड़ने की क्षमता में सुधार करता है।

Ting Li, David Porfirio2026-05-15
⚡ electrical engineering

SeaVis: Modeling and Control of a Remotely Operated Towed Vehicle for Seabed Visualization and Mapping

यह शोध पत्र सीविस (SeaVis) रिमोटली ऑपरेटेड टोव्ड व्हीकल के लिए एक नवीन गणितीय मॉडल और एक गेन-शेड्यूल्ड लीनियर-क्वाड्रेटिक रेगुलेटर (LQR) प्रस्तुत करता है, जो उच्च-निष्ठा सिमुलेशन के माध्यम से यह प्रदर्शित करता है कि प्रस्तावित नियंत्रक उच्च-रिज़ॉल्यूशन वाले समुद्री तल मानचित्रण (seabed mapping) के लिए मजबूती, दक्षता और एक्चुएशन में कमी के मामले में पारंपरिक PID दृष्टिकोणों से बेहतर प्रदर्शन करता है।

Abdelhakim Amer, Aske Alstrup, Frederik Rasmussen, Yury Brodskiy, Andriy Sarabakha, Erdal Kayacan2026-05-15
💻 computer science

SR-Platform: An Agentic Pipeline for Natural Language-Driven Robot Simulation Environment Synthesis

SR-Platform एक प्रोडक्शन-डिप्लॉयड एजेंटिक सिस्टम है जो प्राकृतिक भाषा के प्रॉम्प्ट्स से भौतिक रूप से वैध MuJoCo रोबोट सिमुलेशन वातावरण के संश्लेषण को स्वचालित करता है, जो LLM-संचालित एसेट जनरेशन, लेआउट प्लानिंग और सीन असेंबली को ऑर्केस्ट्रेट करता है, और लगभग 50 सेकंड की मीडियन एंड-टू-एंड लेटेंसी प्राप्त करता है।

Ben Wei Lim, Minh Duc Le, Thang Truong, Thanh Nguyen Canh2026-05-15
💻 computer science

SceneFunRI: Reasoning the Invisible for Task-Driven Functional Object Localization

यह शोध पत्र SceneFunRI प्रस्तुत करता है, जो 855 इंस्टेंस वाला एक नया बेंचमार्क है जो कार्य निर्देशों और सामान्य ज्ञान (कॉमन सेंस) का उपयोग करके अदृश्य, अवरुद्ध कार्यात्मक वस्तुओं के स्थानों के बारे में तर्क करने की विजन-लैंग्वेज मॉडल्स की क्षमता का मूल्यांकन करता है, जिससे यह पता चलता है कि वर्तमान अत्याधुनिक मॉडल इस क्षमता के साथ काफी संघर्ष करते हैं।

Posheng Chen, Powen Cheng, Gueter Josmy Faure, Hung-Ting Su, Winston H. Hsu2026-05-15
💻 computer science

Learning Cross-Coupled and Regime Dependent Dynamics for Aerial Manipulation

यह शोध पत्र एक संरचित एनकोडर-डिकोडर ढांचे का प्रस्ताव करता है जो क्रॉस-कपल्ड टेम्पोरल डायनेमिक्स को कैप्चर करने के लिए एक नॉनलीनियर लेटेंट एनकोडर को एक लाइटवेट लीनियर डिकोडर के साथ जोड़ता है, जिससे जटिल, रिजीम-डिपेंडेंट ऑपरेटिंग स्थितियों के तहत सुदृढ़ और सटीक एरियल मैनिपुलेशन सक्षम होता है।

Rishabh Dev Yadav, Samaksh Ujjawal, Sihao Sun, Spandan Roy, Wei Pan2026-05-15
💻 computer science

Chrono-Gymnasium: An Open-Source, Gymnasium-Compatible Distributed Simulation Framework

Chrono-Gymnasium एक ओपन-सोर्स, Ray-आधारित वितरित फ्रेमवर्क है जो एक मानकीकृत Gymnasium इंटरफ़ेस के माध्यम से कंप्यूटिंग क्लस्टरों में हाई-फिडेलिटी प्रोजेक्ट क्रोनो (Project Chrono) सिमुलेशन को स्केल करता है, जिससे भौतिक सटीकता से समझौता किए बिना सुदृढीकरण लर्निंग (reinforcement learning) और बेयसियन ऑप्टिमाइज़ेशन (Bayesian optimization) जैसे डेटा-गहन रोबोटिक्स कार्यों के लिए वॉल-क्लॉक समय को महत्वपूर्ण रूप से कम किया जाता है।

Bocheng Zou, Harry Zhang, Khailanii Slaton, Jingquan Wang, Derrick Ruan, Huzaifa Mustafa Unjhawala, Radu Serban, Dan Neg (…)2026-05-15
💻 computer science

FU-MPC: Frontier- and Uncertainty-Aware Model Predictive Control for Efficient and Accurate UAV Exploration with Motorized LiDAR

यह शोध पत्र FU-MPC प्रस्तुत करता है, जो मोटर चालित रोटेटिंग LiDAR से लैस UAVs के लिए एक पदानुक्रमित अन्वेषण ढांचा (hierarchical exploration framework) है, जो वास्तविक समय की मॉडल प्रेडिक्टिव कंट्रोल रणनीति के माध्यम से फ्रंटियर कवरेज और लोकलाइजेशन अनिश्चितता को संयुक्त रूप से अनुकूलित करता है, जिससे जटिल वातावरण में अन्वेषण दक्षता और मैपिंग सुदृढ़ता दोनों में वृद्धि होती है।

Jianping Li, Pengfei Wan, Zhongyuan Liu, Yi Wang, Yiheng Chen, Xinhang Xu, Rui Jin, Boyu Zhou, Lihua Xie2026-05-15
⚡ electrical engineering

Behavioral Data-Driven Optimal Trajectory Generation for Rotary Cranes

यह शोध पत्र विलेम्स (Willems) के फंडामेंटल लेम्मा पर आधारित एक व्यवहारिक डेटा-संचालित ढांचे का प्रस्ताव करता है ताकि रोटरी क्रेन के लिए इष्टतम, ओपन-लूप स्लीविंग प्रक्षेपवक्र (trajectories) उत्पन्न किए जा सकें जो स्पष्ट सिस्टम मॉडलिंग या व्यापक डेटासेट की आवश्यकता के बिना प्रभावी रूप से लोड स्वय (sway) को कम करते हैं और संचालन समय एवं ऊर्जा की खपत को घटाते हैं।

Iskandar Khemakhem, Manuel Zobel, Johannes Schüle, Oliver Sawodny, Naoki Uchiyama, Abdallah Farrage2026-05-15
💻 computer science

CLOVER: Closed-Loop Value Estimation \& Ranking for End-to-End Autonomous Driving Planning

CLOVER एक क्लोज्ड-लूप वैल्यू एस्टिमेशन और रैंकिंग फ्रेमवर्क है जो सूडो-एक्सपर्ट ट्रेजेक्टरीज और कंजर्वेटिव सेल्फ-डिस्टिलेशन का उपयोग करके एंड-टू-एंड ऑटोनॉमस ड्राइविंग में ट्रेनिंग-इवैल्यूएशन मिसमैच को संबोधित करता है, जिससे NAVSIM बेंचमार्क पर स्टेट-ऑफ-द-आर्ट परफॉर्मेंस प्राप्त होती है।

Sining Ang, Yuguang Yang, Canyu Chen, Yan Wang2026-05-15