💻 computer science

Right Model, Right Time: Real-Time Cascaded-Fidelity MPC for Bipedal Walking

यह शोध पत्र द्विपाद चाल (bipedal walking) के लिए एक वास्तविक समय के कैस्केडेड-फिडेलिटी मॉडल प्रेडिक्टिव कंट्रोल फ्रेमवर्क को प्रस्तुत करता है जो गणनात्मक जटिलता को कम करने के लिए निकट क्षितिज (near horizon) के लिए एक विस्तृत होल-बॉडी मॉडल और दूरस्थ क्षितिज (distant horizon) के लिए एक सरलीकृत सिंगल-रिजिड-बॉडी मॉडल को जोड़ता है, जिससे पूर्व-निर्धारित फुटस्टेप स्थानों के बिना जॉइंट टॉर्क को अनुकूलित किया जा सकता है, जैसा कि MuJoCo सिमुलेशन में HyPer-2 रोबोट पर मान्य किया गया है।

Franek Stark, Felix Wiebe, Shubham Vyas, Dennis Mronga, Frank Kirchner2026-05-07
💻 computer science

From Pixels to Tokens: A Systematic Study of Latent Action Supervision for Vision-Language-Action Models

यह शोध पत्र विज़न-लैंग्वेज-एक्शन मॉडल्स के लिए इमेज-आधारित और एक्शन-आधारित लेटेंट एक्शन सुपरविजन रणनीतियों की व्यवस्थित रूप से तुलना करता है, जिससे यह स्पष्ट होता है कि इमेज-आधारित विधियाँ लॉन्ग-होरिज़ोन रीजनिंग को बढ़ाती हैं जबकि एक्शन-आधारित विधियाँ मोटर समन्वय में सुधार करती हैं, जिसमें डायरेक्ट टोकन सुपरविजन समग्र प्रदर्शन के लिए सर्वश्रेष्ठ परिणाम देता है।

Yihan Lin, Haoyang Li, Yang Li, Haitao Shen, Yihan Zhao, Chao Shao, Jing Zhang2026-05-07
🤖 AI

Modular Reinforcement Learning For Cooperative Swarms

यह शोध पत्र एक मॉड्यूलर सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) दृष्टिकोण प्रस्तावित करता है जो कम्प्यूटेशनल रूप से सीमित रोबोट झुंडों की स्मृति सीमाओं को दूर करने के लिए स्थानिक अंतःक्रिया अवस्थाओं को अलग-अलग शिक्षण प्रक्रियाओं में विभाजित करता है, और सहयोगात्मक खोज कार्यों में इसकी प्रभावशीलता को प्रदर्शित करता है।

Erel Shtossel, Gal A. Kaminka2026-05-07
🤖 AI

Position: Embodied AI Requires a Privacy-Utility Trade-off

यह स्थिति पत्र (position paper) तर्क देता है कि एम्बॉडीड एआई (Embodied AI) घटकों को अलग-थलग रूप से अनुकूलित करना वास्तविक दुनिया के परिनियोजन में प्रणालीगत गोपनीयता जोखिम उत्पन्न करता है, और एक SPINE ढांचे का प्रस्ताव करता है जो गोपनीयता को एक गतिशील, जीवन-चक्र-स्तर के वास्तुशिल्प प्रतिबंध के रूप में व्यवहार करता है जो क्रॉस-स्टेज संवेदनशीलता को व्यवस्थित करता है।

Xiaoliang Fan, Jiarui Chen, Zhuodong Liu, Ziqi Yang, Peixuan Xu, Ruimin Shen, Junhui Liu, Jianzhong Qi, Cheng Wang2026-05-07
💻 computer science

Reduced-order Neural Modeling with Differentiable Simulation for High-Detail Tactile Perception

यह शोध पत्र एक रिड्यूस्ड-ऑर्डर न्यूरल सिमुलेशन फ्रेमवर्क प्रस्तावित करता है जो उच्च-सटीक, डिफरेंशिएबल (differentiable), और मेमोरी-कुशल उच्च-रिज़ॉल्यूशन स्पर्श धारणा (tactile perception) प्राप्त करने के लिए कोर्स-ग्रेन्ड मटेरियल पॉइंट मेथड्स को एक इम्प्लिसिट न्यूरल डिकोडर के साथ जोड़ता है, जो गति, मेमोरी उपयोग और ज्यामितीय सटीकता में TacIPC जैसे मौजूदा तरीकों से काफी बेहतर प्रदर्शन करता है।

Yuhu Guo, Zhikai Shen, Jiasheng Qu, Chenghao Qian, Yuming Huang, Bin Chen, Guoxing Fang2026-05-07
⚡ electrical engineering

A Closed-Form Dual-Barrier CBF Safety Filter for Holonomic Robots on Incrementally Built Occupancy Grid Maps

यह शोध पत्र एक गणनात्मक रूप से कुशल, क्लोज्ड-फॉर्म ड्यूल-बैरियर कंट्रोल बैरियर फंक्शन सेफ्टी फिल्टर प्रस्तुत करता है जो क्रमिक रूप से निर्मित ऑक्यूपेंसी ग्रिड मैप्स में होलोनोमिक रोबॉट्स के लिए टकराव-मुक्त नेविगेशन सुनिश्चित करता है, जो मानचित्रित बाधाओं से बचने और अनोन्वेषित क्षेत्रों में प्रवेश को प्रतिबंधित करने के कार्य को एक साथ करता है, जैसा कि एक क्वाडरोटर पर शून्य-टकराव वाले हार्डवेयर प्रयोगों द्वारा सत्यापित किया गया है।

Himanshu Paudel, Basanta Joshi, Dhirendra Raj Madai, Alina Bartaula, Biman Rimal, Sanjay Neupane2026-05-07
🤖 AI

Large Language Models for Multi-Robot Systems: A Survey

यह सर्वेक्षण मल्टी-रोबोट सिस्टम में लार्ज लैंग्वेज मॉडल्स को एकीकृत करने की पहली समर्पित समीक्षा प्रदान करता है, जो कार्य आवंटन (टास्क एलोकेशन), मोशन प्लानिंग और मानव संपर्क के माध्यम से उनके अनुप्रयोगों को व्यवस्थित रूप से वर्गीकृत करता है और वर्तमान चुनौतियों का विश्लेषण करते हुए भविष्य की अनुसंधान दिशाओं को रेखांकित करता है।

Peihan Li, Zijian An, Shams Abrar, Lifeng Zhou2026-05-06
💻 computer science

BEVCALIB: LiDAR-Camera Calibration via Geometry-Guided Bird's-Eye View Representations

यह शोध पत्र BEVCALIB पेश करता है, जो एक नवीन डीप लर्निंग मॉडल है जो कच्चे डेटा से बर्ड्स-आई व्यू फीचर्स को फ्यूज करके और एक ज्यामितीय-निर्देशित फीचर सेलेक्टर का उपयोग करके स्टेट-ऑफ-द-आर्ट LiDAR-कैमरा कैलिब्रेशन प्राप्त करता है, जो कई डेटासेट्स में ट्रांसलेशन और रोटेशन सटीकता के मामले में मौजूदा बेसलाइन्स से काफी बेहतर प्रदर्शन करता है।

Weiduo Yuan, Jerry Li, Justin Yue, Divyank Shah, Konstantinos Karydis, Hang Qiu2026-05-06
⚡ electrical engineering

A Vision-Based Shared-Control Teleoperation Scheme for Controlling the Robotic Arm of a Four-Legged Robot

यह शोध पत्र एक विजन-आधारित साझा-नियंत्रण टेलीऑपरेशन सिस्टम प्रस्तुत करता है जो एक बाहरी कैमरे और मशीन लर्निंग का उपयोग करके एक ऑपरेटर की कलाई की गतिविधियों को क्वाड्रुपेड रोबोट के मैनिपुलेटर आर्म के साथ सहजता से मैप करता है, जबकि खतरनाक वातावरण में वास्तविक समय में टकराव से बचने के लिए एक ट्रैजेक्टरी प्लानर का उपयोग करता है।

Murilo Vinicius da Silva, Matheus Hipolito Carvalho, Juliano Negri, Thiago Segreto, Gustavo J. G. Lahr, Ricardo V. Godoy (…)2026-05-06
⚡ electrical engineering

Optimizing Grasping in Legged Robots: A Deep Learning Approach to Loco-Manipulation

यह शोध पत्र एक सिम-टू-रियल डीप लर्निंग फ्रेमवर्क प्रस्तुत करता है जो सिंथेटिक जेनेसिस डेटा पर प्रशिक्षित एक U-Net जैसे CNN का उपयोग करता है ताकि भुजाओं वाले क्वाड्रुपेड रोबोट्स को लोको-मैनिपुलेशन के माध्यम से स्वायत्त रूप से नेविगेट करने, धारणा बनाने और वस्तुओं को सटीक रूप से पकड़ने में सक्षम बनाया जा सके।

Dilermando Almeida, Guilherme Lazzarini, Juliano Negri, Thiago H. Segreto, Ricardo V. Godoy, Marcelo Becker2026-05-06