💻 computer science

SAIN: Structure-Aware Interactive Navigation with Active Dialogue Grounding for Mobile Robot

SAIN एक ज़ीरो-शॉट फ्रेमवर्क है जो अस्पष्ट निर्देशों के तहत मोबाइल रोबोट नेविगेशन को सक्रिय संवाद को निरंतर, संरचित स्थानिक और वस्तु-केंद्रित अवस्थाओं में परिवर्तित करके बेहतर बनाता है, जिससे कार्य-विशिष्ट नीति प्रशिक्षण की आवश्यकता के बिना VL-LN IIGN बेंचमार्क पर सफलता दर में उल्लेखनीय सुधार होता है।

Yuhao Cao, Xiao Liu, Yang Xie, Lu Liu, Haoyao Chen2026-08-11
⚡ electrical engineering

Real-Time Nonlinear MPC via Sequential Quadratic Programming with Structure-Exploiting ADMM and Interior-Point Methods for Underactuated Double-Pendulum Swing-Up

यह शोध पत्र "AI Olympics with RealAIGym" प्रतियोगिता के लिए अज्ञात हार्डवेयर पर एक अंडरएक्टुएटेड डबल-पेंडुलम सिस्टम के सुदृढ़ स्विंग-अप और स्थिरीकरण को सफलतापूर्वक प्राप्त करने हेतु सीक्वेंशियल क्वाड्रेटिक प्रोग्रामिंग पर आधारित एक रियल-टाइम नॉनलीन मॉडल प्रिडिक्टिव कंट्रोल रणनीति प्रस्तुत करता है।

Nick Karydakis, Konstantinos Chatzilygeroudis2026-08-11
🤖 AI

WorldSimProbe: Diagnosing Simulator Faithfulness in Action-Conditioned World Models for Embodied Manipulation

यह शोध पत्र WorldSimProbe को प्रस्तुत करता है, जो एक क्षमता-आधारित नैदानिक ढांचा (diagnostic framework) है जो मोशन इंडक्शन (motion induction), इंटरेक्शन ग्राउंडिंग (interaction grounding) और डायनेमिक्स (dynamics) का आकलन करने वाले नियंत्रित सूट्स के माध्यम से एक "ऑब्जर्वेबल सिम्युलेटर कॉन्ट्रैक्ट" (Observable Simulator Contract) को औपचारिक रूप देता है, जिससे मौजूदा मॉडलों में उन व्यवस्थित विफलताओं का पता चलता है जिन्हें पारंपरिक दृश्य या कार्य-आधारित मेट्रिक्स अनदेखा कर देते हैं।

Peterson Co, Sicheng Hu, Chunxuan Jiao, Hongyang Cheng, Yulin Luo, Yijie Xu, Sixiang Chen, Zhongxia Zhao, Zihao Wang, Da (…)2026-08-11
🤖 machine learning

SAFE-CHEM: Uncertainty-Aware Policy Switching for Robust Robotic Chemistry

यह शोध पत्र SAFE-CHEM को प्रस्तुत करता है, जो एक अनिश्चितता-जागरूक ढांचा (uncertainty-aware framework) है जो स्वायत्त रोबोटिक रसायनशास्त्रियों की सुरक्षा और विश्वसनीयता को बढ़ाता है, क्योंकि यह एपिस्टेमिक अनिश्चितता (epistemic uncertainty) के कैलिब्रेटेड थ्रेशोल्ड से अधिक होने पर सीखे गए पॉलिसियों से नियम-आधारित बैकअप में गतिशील रूप से स्विच करता है, जिससे उच्च-जोखिम वाले रासायनिक प्रयोगों में महत्वपूर्ण विफलताओं को कम किया जा सके।

Laura Jones, Shazil Shahzad, Ayesha Sana, Gabriella Pizzuto2026-08-11
💻 computer science

DH-VLM: Dual-Horizon Cooperative Latent Reasoning for Autonomous Driving

यह शोध पत्र DH-VLM का प्रस्ताव करता है, जो एक डुअल-होरिज़न कोऑपरेटिव लेटेंट रीजनिंग फ्रेमवर्क है जो कुशल लेटेंट गाइडेंस के माध्यम से ईगो-व्हीकल निर्णय लेने को परिष्कृत करने के लिए इंफ्रास्ट्रक्चर-एग्रीगेटेड ग्लोबल रीजनिंग का लाभ उठाता है, जिससे मौजूदा विधियों की तुलना में संचार लागत और मेमोरी उपयोग को काफी कम करते हुए अत्याधुनिक प्लानिंग प्रदर्शन प्राप्त होता है।

Ziyi Song, Chen Xia, Hang Yu, Sheng Zhou, Zhisheng Niu2026-08-11
💻 computer science

JEPA-WAM: Learning Vision-Language-Action Policies with Joint-Embedding World Modeling

JEPA-WAM एक प्रीट्रेन्ड V-JEPA स्पेस पर आधारित एक लेटेंट वर्ल्ड एक्शन मॉडल पेश करता है जो एक साझा प्रेडिक्टर के माध्यम से स्थानिक रूप से संरचित भविष्य के पूर्वानुमान और निरंतर एक्शन जनरेशन को एकीकृत करता है, जिससे बड़े पैमाने पर पॉलिसी प्रीट्रेनिंग की आवश्यकता के बिना रोबोटिक मैनिपुलेशन बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Yihan Lin, Jiawei He, Shifeng Bao, Chen Zhao, Yang Li, Xiaobo Wang, Yan Wang, Cheng Chi, Jing Zhang2026-08-11
💻 computer science

VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction

VANE विजन-लैंग्वेज-एक्शन मॉडल्स के लिए एक विश्वसनीय टेस्ट-टाइम ट्रेनिंग फ्रेमवर्क है जो उम्मीदवार अपडेट्स को अलग करके और भविष्य के विजुअल रिप्रेजेंटेशन प्रेडिक्शन के माध्यम से उनकी सफलता को सत्यापित करने के बाद ही उन्हें कमिट करके पॉलिसियों को चुनिले ढंग से अनुकूलित करता है, जिससे क्लोज्ड-लूप मैनिपुलेशन प्रदर्शन में सुधार होता है।

Hongjin Ji, Guoyang Xia, Luoyang Sun, Fangxiang Feng, Lei Ren2026-08-11
💻 computer science

Rethink Before You Execute: Adaptive Execution for World Action Models

यह शोध पत्र TempoWAM को पेश करता है, जो वर्ल्ड एक्शन मॉडल्स (World Action Models) के लिए एक हल्का अनुकूलन योग्य निष्पादन ढांचा (lightweight adaptive execution framework) है, जो एक निश्चित एक्शन होराइजन के बजाय वास्तविक समय में कार्य प्रगति की निगरानी के आधार पर गतिशील रूप से यह निर्णय लेता है कि कब पुन: योजना (replan) बनानी है, जिससे सिम्युलेटेड और वास्तविक दुनिया के रोबोटिक कार्यों में दक्षता-सफलता के संतुलन में महत्वपूर्ण सुधार होता है।

Feng Ye, Yiming Zhao, Yong Yu, Hongxu Zhou, Yong Pan, Yuan Xue, Peng Jia, Chuanmin Jia2026-08-11
⚡ electrical engineering

TDMA Based Communications Control Co-Design for Cooperative Carrying: Delay Calibration and Sampling-Rate Optimization

यह शोध पत्र एक भौतिकी-आधारित सिमुलेशन अध्ययन प्रस्तुत करता है जो यह प्रदर्शित करता है कि एडेप्टिव सैंपलिंग रेट एडजस्टमेंट (अनुकूली नमूना दर समायोजन) को TDMA-आधारित मल्टी-रोबोट सहकारी वहन प्रणालियों में रोटेटिंग लीडरशिप (घूर्णन नेतृत्व) के साथ संयोजित करना, वास्तविक नेटवर्क बाधाओं के तहत नियंत्रण स्थिरता, संचार दक्षता और निष्पक्ष एयरटाइम वितरण को प्रभावी ढंग से संतुलित करता है।

Zahra Seifaei, Maximilian Luebke, Torsten Reissland, Danial Dehghani, Norman Franchi2026-08-11
💻 computer science

GenTrack3: Hybrid Stochastic-Deterministic Online Multi-Object Tracking with Cluster-Aware Association

यह शोध पत्र GenTrack3 प्रस्तुत करता है, जो एक ऑनलाइन मल्टी-ऑब्जेक्ट ट्रैकिंग फ्रेमवर्क है जो अनिश्चितता के तहत समूह गतिशीलता (ग्रुप डायनेमिक्स) का समर्थन करते हुए मजबूत और स्केलेबल ट्रैकिंग प्राप्त करने के लिए एक नवीन क्लस्टर-अवेयर एसोसिएशन पद्धति के साथ नियतात्मक (डिटरमिनिस्टिक) और स्टोकेस्टिक सिद्धांतों को एकीकृत करता है।

Toan Van Nguyen, Rasmus G. K. Christiansen, Dirk Kraft, Leon Bodenhagen2026-08-11