💻 computer science

World Action Planner: Generalizable Decision-Making with Action-Conditioned World Models

यह शोध पत्र वर्ल्ड एक्शन प्लानर (World Action Planner) का परिचय देता है, जो एक रोबोट प्लानिंग सिस्टम है जो विजन-लैंग्वेज मॉडल्स को मल्टी-टास्क पोज़-इमेज कंडिश्न्ड वर्ल्ड मॉडल के साथ जोड़ता है ताकि एजेंट इमेजिन्ड रोलआउट्स के माध्यम से एक्शन प्लान को पुनरावृत्ति से परिष्कृत कर सकें, जिससे स्टेट-ऑफ-द-आर्ट एंड-टू-एंड पॉलिसियों की तुलना में नवीन दृश्यों और कार्यों में बेहतर सामान्यीकरण प्राप्त किया जा सके।

Xiangcheng Zhang, Yilun Du2026-07-31
💻 computer science

Arm2Air: Cross-Embodiment Skeleton Transfer for 3D Relay Formation

Arm2Air एक गणनात्मक और डेटा-कुशल फ्रेमवर्क पेश करता है जो क्रॉस-एम्बॉडीमेंट ट्रांसफर और लो-रैंक एडेप्टेशन के माध्यम से रोबोटिक आर्म्स से बाधा-परिहार कंकालों (obstacle-avoidance skeletons) को यूएवी रिले प्लेसमेंट में स्थानांतरित करता है, जो पारंपरिक तरीकों की तुलना में जटिल 3D शहरी वातावरणों में नियोजन गति और नेटवर्क प्रदर्शन में महत्वपूर्ण सुधार करता है।

Dohun Lee, Kyeonghyun Yoo, Seokmin Kim, Byongho Lee, Seungjoo Oh, Hwangnam Kim2026-07-31
💻 computer science

HALO: Heterogeneous Admission through Localized Obligations for Safe Agentic Execution

यह शोध पत्र HALO को प्रस्तुत करता है, जो एक रनटाइम प्रोटोकॉल है जो स्थानीयकृत दायित्वों और प्रेषण से पहले पुन: जाँच कार्यों के आधार पर विषम AI प्रतिक्रियाओं से समर्थित घटकों को चुनिंदा रूप से स्वीकार करके सुरक्षित एजेंटिक निष्पादन सुनिश्चित करता है, जिससे यह उपयोगी कार्यक्षमता को बनाए रखने में पूर्ण-प्रतिक्रिया अस्वीकृति नीतियों से बेहतर प्रदर्शन करता है और पुराने या असुरक्षित संचालन को रोकता है।

Taewoo Park, Kyeonghyun Yoo, Kiseok Kim, Seunghyun Yoo, Hwangnam Kim2026-07-31
💻 computer science

RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy

रेडफ्लो (RedFlow) एक फाइन-ग्रेंड ऑफलाइन रीइन्फोर्समेंट लर्निंग फ्रेमवर्क है जो विफलता के अनुभवों को एक्शन-लेवल सुधारात्मक पर्यवेक्षण में बदलकर फ्लो-मैचिंग विजन-लैंग्वेज-एक्शन पॉलिसियों को बेहतर बनाता है, जिससे मौजूदा तरीकों की तुलना में वास्तविक दुनिया की सफलता दर और सैंपल दक्षता में महत्वपूर्ण सुधार होता है।

Zhengyang Yan, Junhao Li, Fangqi Zhu, Zijun Wang, Quanxin Shou, Yikun Miao, Xiaoyi Pang, Zicong Hong, Song Guo2026-07-31
💻 computer science

Learning Social Robot Navigation By Sensing Human Legs

यह शोध पत्र CALF को प्रस्तुत करता है, जो एक कस्टम सिम्युलेटर में प्रशिक्षित एक एंड-टू-एंड न्यूरल आर्किटेक्चर है, जो लो-माउंटेड LiDAR स्कैन से मानव पैर की गति की व्याख्या करने के लिए है, जिससे सामाजिक रूप से अनुपालन करने वाली रोबोट नेविगेशन सक्षम होता है जिसे ज़ीरो-शॉट वास्तविक दुनिया के परिनियोजन के माध्यम से सफलतापूर्वक मान्य किया गया है।

Alberto Vaglio, Andrea Garulli, Antonio Giannitrapani, Renato Quartullo, Tommaso Van Der Meer2026-07-31
🤖 machine learning

Filling the Pareto-Optimal Front for Affordance Segmentation on Embedded Devices Using RGB-D Cameras

यह शोध पत्र एम्बेडेड उपकरणों पर अफोर्डेंस सेगमेंटेशन (affordance segmentation) के लिए कॉम्पैक्ट डीप नेटवर्क में RGB-D डेटा को एकीकृत करने हेतु दो हार्डवेयर-जागरूक दृष्टिकोण प्रस्तावित करता है, जो स्मार्टफोन-अनुकूल ऊर्जा बजट के भीतर वास्तविक समय का प्रदर्शन सफलतापूर्वक प्राप्त करते हुए सामान्यीकरण सटीकता और हार्डवेयर बाधाओं के बीच संतुलन बनाने वाले पारेटो-इष्टतम (Pareto-optimal) समाधानों की पहचान करते हैं।

Edoardo Ragusa, Giovanni Paolo Canuti, Simone Lugani, Rodolfo Zunino, Paolo Gastaldo2026-07-31
💻 computer science

SemAnCorr: Semantic Anchored Correspondence for Zero-Shot Manipulation Skill Transfer

SemAnCorr एक प्रशिक्षण-मुक्त ढांचा है जो संयुक्त पोज़-संगतता अनुकूलन और कार्यात्मक मानचित्र प्रसार के माध्यम से सघन, अर्थपूर्ण रूप से सुसंगत और ज्यामितिक रूप से सुसंगत पत्राचार स्थापित करके ज्यामितिक रूप से विविध वस्तुओं के बीच सुदृढ़ ज़ीरो-शॉट हेरफेर कौशल हस्तांतरण को सक्षम बनाता है।

Xiaoxiang Dong, William Baron, Hongyi Chen, Uksang Yoo, Jeffrey Ichnowski, Weiming Zhi2026-07-31
💻 computer science

TacWAM: Anchor-Guided World Action Model with Mechanics-Aware Tactile Prediction

यह शोध पत्र TacWAM प्रस्तुत करता है, जो एक मैकेनिक्स-अवेयर वर्ल्ड एक्शन मॉडल है जो संपर्क-समृद्ध रोबोटिक हेरफेर (manipulation) को सुपरवाइज करने के लिए भविष्य की स्पर्श अवस्थाओं (tactile states) की भविष्यवाणी करने हेतु स्थानिक रूप से संरेखित स्पर्श एन्कोडिंग और एंकर-गाइडेड ट्राइ-मोडल अटेंशन को एकीकृत करता है, जिससे 75.0% की सफलता दर प्राप्त होती है जो मौजूदा विजुअल-ओनली बेसलाइन्स की तुलना में काफी बेहतर प्रदर्शन करती है।

Lei Jin, Yiding Ma, Xin Zhang, Chen Gao, Wei Wu, Yong Li2026-07-31
🤖 machine learning

QQWorld: Quantile-Quantile Matching for World Model Regularization

यह शोध पत्र QQWorld प्रस्तुत करता है, जो एक नवीन वर्ल्ड मॉडल रेगुलराइजेशन विधि है जो प्रभावी सुधारात्मक ग्रेडिएंट्स को वितरण की पूंछों (tails) में बनाए रखने के लिए Epps-Pulley ऑब्जेक्टिव को क्वांटाइल-क्वांटाइल मैचिंग दृष्टिकोण (एक क्रॉस-बैच वेरिएंट सहित) से बदल देता है, जिससे LeWorldModel बेसलाइन की तुलना में बेहतर गॉसियन संरेखण और उन्नत प्लानिंग प्रदर्शन प्राप्त होता है।

Zhoushun Yu, Xiaoyu Hu, Xiangyu Xu2026-07-31
💻 computer science

Machines that know they are aging: a framework for hardware-aware autonomous intelligence

यह शोध पत्र एजिंग-अवेयर ऑटोनॉमस इंटेलिजेंस (AAAI) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो स्वायत्त प्रणालियों को भौतिक उम्र बढ़ने के जवाब में अपने तर्क और मिशन रणनीतियों को अनुकूलित करने में सक्षम बनाने के लिए संज्ञानात्मक निर्णय लेने में वास्तविक समय की हार्डवेयर स्वास्थ्य निगरानी को एकीकृत करता है, जिससे महत्वपूर्ण वातावरणों में विनाशकारी विफलता को रोका जा सके और परिचालन जीवनकाल को बढ़ाया जा सके।

Cheng Siong Chin, Jianhua Zhang, Mohan Venkateshkumar2026-07-31