💻 computer science

Interleaved POMDP Planning for Multi-Object Search in Unknown Multi-Room Household Environments

यह शोध पत्र Inter-POMDP को प्रस्तुत करता है, जो एक नवीन इंटरलीव्ड प्लानिंग एल्गोरिदम है जो अज्ञात, अव्यवस्थित घरेलू वातावरण में बहु-वस्तु खोज कार्यों को कुशलतापूर्वक और सुरक्षित रूप से हल करने के लिए एक LLM-सूचित उच्च-स्तरीय POUCT प्लैनर को बाधा-जागरूक निम्न-स्तरीय मोशन प्लैनर के साथ जोड़ता है, जो बेसलाइन विधियों की तुलना में टकराव, नेविगेशन चरणों और डिटेक्शन गणनाओं में महत्वपूर्ण कमी प्रदर्शित करता है।

Ruochu Yang, Ziyi Xia, Huibo Zhang, Yatong Han, Yiming Zhao, Yingke Li, Fumin Zhang, Yorai Wardi, Mengxue Hou2026-07-14
💻 computer science

SUREFlow: State-space Uncertainty-aware REsidual Flow Matching for Robust Robot Manipulation

SUREFlow एक माम्ब (Mamba) बैकबोन पर आधारित एक स्टेट-स्पेस अनसर्टेन्टी-अवेयर रेसिडुअल फ्लो मैचिंग फ्रेमवर्क है जो अविश्वसनीय क्रियाओं के चयनात्मक परिशोधन (selective refinement) को सक्षम करने के लिए एक्शन वेलोसिटी और इनपुट-डिपेंडेंट अनसर्टेन्टी का संयुक्त रूप से पूर्वानुमान लगाता है, जिससे बड़े विजन-लैंग्वेज-एक्शन मॉडल्स के तुलनीय रोबोट मैनिपुलेशन प्रदर्शन प्राप्त होता है जबकि यह काफी कम पैरामीटर्स का उपयोग करता है।

Md Tanvir Islam, Sai Navaneet Peddapalli, Sangmoon Lee, Sangtae Ahn2026-07-14
💻 computer science

Is Energy Guidance All You Need? Training-Free Norm Injection for Driving World Models

यह शोध पत्र प्रदर्शित करता है कि रेक्टिफाइड-फ्लो ड्राइविंग वर्ल्ड मॉडल्स में बिना पुन: प्रशिक्षण के, नियोजित प्रक्षेप पथों (ट्रैजेक्टरीज) को निर्देशित करने के लिए डिफरेंशिएबल एनर्जी फंक्शन्स को इंजेक्ट करके सैंपलिंग समय पर नियंत्रणीयता प्राप्त की जा सकती है, हालांकि यह सुनिश्चित करने के लिए बेहतर क्रॉस-स्ट्रीम कपलिंग की आवश्यकता की पहचान करता है कि उत्पन्न वीडियो इन निर्देशित पथों का निष्ठापूर्वक अनुसरण करे।

Xiyan Su, Frank Diermeyer, Markus Lienkamp2026-07-14
⚡ electrical engineering

D-SafeMPC: Diffusion-Driven Safe Model Predictive Control with Discrete-Time Control Barrier Functions

D-SafeMPC एक नवीन रोबोटिक प्लानिंग फ्रेमवर्क है जो सुरक्षित, गतिशील रूप से व्यवहार्य और लक्ष्य-निर्देशित प्रक्षेपपथों (trajectories) को सुनिश्चित करने के लिए एक पुनरावृत्ति मॉडल प्रेडिक्टिव कंट्रोल योजना के भीतर डिफ्यूजन मॉडल्स को डिस्क्रीट-टाइम कंट्रोल बैरियर और लयापुनोव फंक्शन्स के साथ एकीकृत करता है, जो अत्याधुनिक बेसलाइनों की तुलना में सिमुलेशन और वास्तविक दुनिया के प्रयोगों दोनों में बेहतर प्रदर्शन प्रदर्शित करता है।

Erdi Sayar, Ersin Daş, Joel W. Burdick, Alois Knoll, Erdal Kayacan2026-07-14
💻 computer science

A Single Diffusion-Policy Controller for Multi-Task Block Pushing with Zero-Shot Sim-to-Real Transfer

यह शोधपत्र एक ऐसे फ्रेमवर्क का प्रस्ताव करता है जो रिवर्स करिकुलम जनरेशन और ऑब्जेक्टिव-सेंट्रिक रिप्रेजेंटेशन द्वारा संवर्धित, रिइन्फोर्समेंट लर्निंग का उपयोग करके एक एकल डिफ्यूजन पॉलिसी को स्क्रैच से प्रशिक्षित करता है, ताकि स्पार्स-रिवॉर्ड सिमुलेशन में मल्टी-टास्क ब्लॉक-पुशिंग समस्याओं को सफलतापूर्वक हल किया जा सके और विभिन्न परिस्थितियों वाले वास्तविक दुनिया के वातावरणों में ज़ीरो-शॉट ट्रांसफर प्राप्त किया जा सके।

Haitong Ma, Haldun Balim, Yang Hu, Bo Dai, Na Li2026-07-14
🔢 mathematics

Real-Time Rulebook-Aware Nonlinear MPC for Autonomous Driving with Priority-Biased Tiered Slacks

यह शोध पत्र W-SQP प्रस्तुत करता है, जो एक वास्तविक समय (real-time), ऑडिट करने योग्य नॉनलीन मॉडल प्रेडिक्टिव कंट्रोलर है, जो प्राथमिकता-पूर्वाग्रह वाले टियर्ड स्लैक फॉर्मूलेशन (priority-biased tiered slack formulation) का उपयोग करके नियम उल्लंघनों को व्यवस्थित रूप से प्राथमिकता देते हुए और एक्चुएशन सीमाओं को बनाए रखते हुए, स्वायत्त ड्राइविंग में सुरक्षा, विनियमन, आराम और दक्षता के बीच संघर्षों को हल करता है।

Hadi Hajieghrary, Benedikt Walter, Chaitanya Shinde, Paul Schmitt, Miguel Hurtado2026-07-14
🤖 AI

Think When It Matters: Conditional VLM Reasoning for Social Navigation with RL Policies

यह शोध पत्र HUMA को प्रस्तुत करता है, जो एक हाइब्रिड आर्किटेक्चर है जो वास्तविक समय में, सामाजिक रूप से जागरूक मोबाइल रोबोट नेविगेशन को सक्षम करने के लिए कुशल सुदृढीकरण शिक्षण (reinforcement learning) नीतियों को सशर्त विजन-लैंग्वेज मॉडल तर्क के साथ गतिशील रूप से संयोजित करता है, जो कार्य सफलता में महत्वपूर्ण सुधार करता है और मानव टकरावों को कम करता है।

Ali Ahmadi, Hamed Rahimi, Adrien Jacquet Cretides, Marie Samson, Mahdi Khoramshahi, Mohamed Chetouani2026-07-14
💻 computer science

GraspGraphNet: Graph-Structured Multi-Embodiment Dexterous Grasp Generation

GraspGraphNet एक टोपोलॉजी-जागरूक, ग्राफ-संरचित ढांचा है जो एक एकल मॉडल को विभिन्न काइनेमैटिक संरचनाओं वाले विविध रोबोटिक हाथों में सीधे निष्पादन योग्य दक्ष ग्रैस्प (dexterous grasps) उत्पन्न करने में सक्षम बनाता है, जिससे बिना किसी पुनरप्रशिक्षण या पोस्ट-प्रोसेसिंग अनुकूलन के उच्च सफलता दर और मजबूती प्राप्त होती है।

Yeonseo Lee, Taeyeop Lee, Hyosup Shin, Guebin Hwang, Sungho Jo2026-07-14
💻 computer science

Desc++: Efficient Descriptor Enhancement for Data Association in Existing Visual SLAM Systems

Dess++ एक हल्का, कुशल संवर्द्धन मॉड्यूल है जो एक हाइब्रिड अटेंशन आर्किटेक्चर के माध्यम से डिस्क्रिप्टर निरूपणों और कीपॉइंट ज्यामिति को संयुक्त रूप से एनकोड करके मौजूदा SLAM सिस्टम में विजुअल डेटा एसोसिएशन में सुधार करता है, जिससे बिना किसी पाइपलाइन संशोधन या महत्वपूर्ण कम्प्यूटेशनल ओवरहेड के मिलान सटीकता और प्रक्षेपवक्र स्थिरता को बढ़ाया जाता है।

Ting-Wei Ou, Huang-Ting Lin, Kuu-Young Young2026-07-14
🤖 AI

VIA: Visual Interface Agent for Robot Control

यह शोध पत्र VIA को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो रोबोट को ब्राउज़र-आधारित 3D इंटरफ़ेस के माध्यम से नियंत्रित करने के लिए टास्क-विशिष्ट फाइन-ट्यूनिंग के बिना ऑफ-द-शेल्फ फाउंडेशन मॉडल्स का विजुअल इंटरफेस एजेंट के रूप में लाभ उठाता है, यह प्रदर्शित करते हुए कि फ्रंटियर एजेंट्स रोबोट नियंत्रण को एक इंटरैक्टिव सॉफ्टवेयर ऑपरेशन के रूप में मानकर जटिल मैनिपुलेशन कार्यों में उच्च ज़ीरो-शॉट सफलता दर प्राप्त कर सकते हैं।

Hengyuan Hu, Priya Sundaresan, Jensen Gao, Dorsa Sadigh2026-07-14