💻 computer science

CoLMIN: LLM-based Multi-Decision Path Negotiation for Cooperative Autonomous Driving

यह शोध पत्र CoLMIN का प्रस्ताव करता है, जो सहकारी स्वायत्त ड्राइविंग (cooperative autonomous driving) के लिए एक LLM-आधारित ढांचा है, जो जटिल ट्रैफ़िक परिदृश्यों में उप-इष्टतम समाधानों (suboptimal solutions) की ओर समयपूर्व अभिसरण (premature convergence) को दूर करने और स्थिर, उच्च-गुणवत्ता वाले निर्णय आम सहमति प्राप्त करने के लिए बहु-इरादा वार्ता (multi-intent negotiation) और द्वि-स्तरीय परावर्तक तर्क (dual-layer reflective reasoning) का उपयोग करता है।

Zhe Huang, Zhaoxin Fan, Shuo Wang, Wenjun Wu, Xuan Zhao, Min Liu2026-09-07
🤖 machine learning

Coupled Control and Wireless World Models for Resilient Remote Robotic Control

यह शोध पत्र एक लचीला रिमोट रोबोटिक नियंत्रण ढांचा प्रस्तावित करता है जो रोबोट की गतिशीलता और चैनल की स्थितियों का संयुक्त रूप से पूर्वानुमान लगाने के लिए कपल्ड कंट्रोल को वायरलेस जॉइंट एम्बेडिंग प्रेडिक्टिव आर्किटेक्चर (JEPA) वर्ल्ड मॉडल्स के साथ एकीकृत करता है, जिससे सीमित बैंडविड्थ और पर्यावरणीय विक्षोभों के तहत अनुकूल संचार शेड्यूलिंग और सुदृढ़ नेविगेशन सक्षम होता है।

H. P. Madushanka, Sumudu Samarakoon, Mehdi Bennis2026-09-07
🤖 machine learning

Sound-based Multi-Person 3D Pose Estimation

यह शोध पत्र SoundMHPE को प्रस्तुत करता है, जो सिग्नल सुपरपोजिशन और रिफ्लेक्शन जैसी चुनौतियों से निपटने के लिए एक नवीन एनकोडर-डिकोडर आर्किटेक्चर का उपयोग करके, केवल ध्वनिक संकेतों (acoustic signals) से मल्टी-पर्सन 3D पोज़ का अनुमान लगाने वाला पहला फ्रेमवर्क है, जिसे एक नए निर्मित 6-घंटे के सिंक्रोनाइज़्ड डेटासेट पर सत्यापित किया गया है।

Yusuke Oumi, Yuto Shibata, Go Irie, Akisato Kimura, Yoshimitsu Aoki, Mariko Isogawa2026-09-07
🤖 machine learning

One Diffusion Model, Two Roles: Guided Trajectory Planning and Safety-Critical Scenario Generation in Closed-Loop Simulation

यह शोध पत्र प्रदर्शित करता है कि एक एकल प्रीट्रेंड डिफ्यूजन ट्रैफिक मॉडल एक नवीन SSDS डिकोडर और DAPSE गाइडेंस का उपयोग करते हुए एक उच्च-प्रदर्शन मोशन प्लानर के रूप में, और क्लोज्ड-लूप सिमुलेशन में प्लानर की मजबूती को व्यवस्थित रूप से मूल्यांकन करने के लिए यथार्थवादी सुरक्षा-महत्वपूर्ण परिदृश्यों के एक नियंत्रणीय जनरेटर के रूप में, साथ ही कार्य कर सकता है।

Arka Pal, Rajesh Kumar, Hannes Eriksson, Rémi Lacombe, Arvid Laveno Ling, Ankit Gupta, Maciej Wozniak2026-09-07
🤖 AI

A Schema Bounded Language Model for Refining Robot Policies Without Destabilizing Local Learning

यह शोध पत्र विषम रोबोटों (heterogeneous robots) के लिए एक विकेंद्रीकृत नेविगेशन ढांचे को प्रस्तुत करता है जो UCB और Double DQN नियंत्रकों के साथ LLM-आधारित नीति परिशोधन (policy refinement) को एकीकृत करता है, यह प्रदर्शित करते हुए कि टिक-स्तर (tick-level) की क्रियाओं के लिए स्थानीय शिक्षण का उपयोग करते हुए राउंड-स्तर के अपडेट तक LLM अनुमान (inference) को सीमित करने से अन्य कॉन्फ़िगरेशन की तुलना में लक्ष्य पूर्णता दर में काफी सुधार होता है और पूर्णता समय में कमी आती है।

Chongwen Dong, Mithun Paul Saint-Germain, Pinjari Asif, Carlo R. daCunha2026-09-07
💻 computer science

APEX-RBD: Mixed-Precision Exploration Framework for Hardware-Efficient Robot Dynamics Accelerator Design

APEX-RBD एक स्वचालित ढांचा है जो भौतिकी-संचालित खोज स्थान छंटनी (physics-driven search space pruning) और एक डेटा-कुशल सरोगेट मॉडल का लाभ उठाकर रोबोट डायनेमिक्स एक्सेलेरेटर्स के लिए कुशल मिश्रित-परिशुद्धता अन्वेषण को सक्षम बनाता है ताकि उन हार्डवेयर कॉन्फ़िगरेशनों की पहचान की जा सके जो गति सटीकता को बनाए रखते हुए क्षेत्र और बिजली की खपत को महत्वपूर्ण रूप से कम करते हैं।

Xingyu Liu, Hanwei Fan, Chaofang Ma, Jiawei Liang, Guangyu Hu, Jiang Xu, Wei Zhang2026-09-07
💬 NLP

Same Trajectory, Contradictory Rewards (ROBORMBENCH): Paraphrase Fragility in Vision Language Reward Models

यह शोधपत्र ROBORMBENCH प्रस्तुत करता है, जो यह प्रदर्शित करता है कि वर्तमान विजन-लैंग्वेज रिवॉर्ड मॉडल्स में पैराफ्रेस इनवेरिएंस (paraphrase invariance) की कमी है—जो अक्सर केवल लक्ष्य विवरण के बदलावों के आधार पर समान रोबोटिक प्रक्षेपवक्रों (trajectories) को विरोधाभासी रिवॉर्ड प्रदान करते हैं—और यह दर्शाता है कि प्रक्षेपवक्र-आधारित पर्यवेक्षण (trajectory-grounded supervision) के साथ प्रशिक्षित समर्पित मॉडल काफी अधिक स्थिर होते हैं।

Wonje Jeung, Sangyeon Yoon, Hyesoo Hong, Yoonjun Cho, Dongjae Jeon, Bumjun Kim, Jean Oh, Youngjae Yu, Albert No2026-09-07
🤖 AI

LightEMMA: A Longitudinal Evaluation of Vision-Language Models for Autonomous Driving

यह शोधपत्र LightEMMA का परिचय देता है, जो एक अनुदैर्ध्य मूल्यांकन ढांचा (longitudinal evaluation framework) है जो यह प्रदर्शित करता है कि विज़न-लैंग्वेज मॉडल्स की क्रमिक पीढ़ियाँ nuScenes बेंचमार्क पर स्वायत्त ड्राइविंग प्रदर्शन में लगातार सुधार नहीं करती हैं, जिससे आवर्ती विफलता मोड (recurring failure modes) को संबोधित करने और सुरक्षा सुनिश्चित करने के लिए डोमेन-विशिष्ट अनुकूलन की आवश्यकता पर प्रकाश पड़ता है।

Zhijie Qiao, Haowei Li, Zhong Cao, Henry X. Liu2026-09-04
🤖 AI

Decentralized Vision-Based Autonomous Aerial Wildlife Monitoring

यह शोध पत्र एक विकेंद्रीकृत, विज़न-आधारित मल्टी-क्वाड्रोटर प्रणाली प्रस्तुत करता है जो बिना किसी केंद्रीकृत नियंत्रण पर निर्भर हुए, गतिशील और अनस्ट्रक्चर्ड वातावरण में बड़े वन्यजीवों की स्केलेबल, कम-बैंडविड्थ और न्यूनतम-सेंसर वाली स्वायत्त निगरानी और ट्रैकिंग को सक्षम बनाता है।

Makram Chahine, William Yang, Alaa Maalouf, Justin Siriska, Ninad Jadhav, Daniel Vogt, Stephanie Gil, Robert Wood, Danie (…)2026-09-04
⚡ electrical engineering

SPARC: Spine with Prismatic And Revolute Compliance for Faster Quadrupedal Bounding

यह शोध पत्र SPARC को प्रस्तुत करता है, जो एक कॉम्पैक्ट चतुष्पाद (क्वाड्रुपेड) रोबोट है जिसमें स्वतंत्र रूप से ट्यूनेबल इम्पीडेंस कंट्रोल वाला 3-DoF स्पाइन है, जो यह प्रदर्शित करता है कि सक्रिय रूप से विनियमित स्पाइनल कंप्लायंस, पोजीशन-कंट्रोल्ड या रिजिड स्पाइन कॉन्फ़िगरेशन की तुलना में बाउंडिंग गति को महत्वपूर्ण रूप से बढ़ाता है, हालांकि इसके साथ एक ऊर्जा संबंधी समझौता (एनर्जेटिक ट्रेड-ऑफ) भी जुड़ा है।

Yue Wang, Yanran Xu2026-09-04