💻 computer science

FeDepth: Federated Learning for Depth Estimation under Robot Heterogeneity

यह शोध पत्र FeDepth प्रस्तुत करता है, जो एक डिस्क्रिप्टर-आधारित फेडरेटेड लर्निंग फ्रेमवर्क है जो विषम रोबोट प्लेटफॉर्म्स के बीच निरंतर डोमेन ट्रांज़िशन को मॉडल करने के लिए सॉफ्ट क्लस्टरिंग का उपयोग करता है, जिससे मानक और हार्ड-क्लस्टर्ड FL विधियों की तुलना में डेप्थ एस्टीमेशन की मजबूती में महत्वपूर्ण सुधार होता है।

Ganghyeon Lee, Inha Lee, Junhee Lee, Jeongeon Lee, Sung Whan Yoon, Kyungdon Joo2026-08-04
💻 computer science

Complete Motion Planning using Workspace-Fibered Decomposition for nR-Planar Manipulator

यह शोध पत्र एक वर्कस्पेस-फाइबर्ड डिकंपोजिशन फ्रेमवर्क प्रस्तावित करता है जो गैर-अतिरेक (non-redundant) उप-श्रृंखलाओं के बाधा-प्रतिबंधित सुलभ वर्कस्पपेस को वृद्धिशील रूप से निर्मित करके और उन्हें रेडंडेंट ओरिएंटेशन फाइबर्स के माध्यम से पुनरावर्ती रूप से ऊपर उठाकर, पूर्ण कॉन्फ़िगरेशन-स्पेस बाधाओं के स्पष्ट निर्माण से बचते हुए और टकराव-मुक्त कनेक्टिविटी को संरक्षित करते हुए, अव्यवस्थित वातावरण में nR प्लेनर रेडंडेंट मैनिपुलेटर्स के लिए कुशल पूर्ण मोशन प्लानिंग को सक्षम बनाता है।

Aayush Rath, Antony Thomas2026-08-04
💻 computer science

Hermite Curves as Trajectory Priors for Vision-Language-Action Models

यह शोध पत्र एक्शन चंक्स (action chunks) को स्मूथ पीसवाइज क्यूबिक कर्व्स (smooth piecewise cubic curves) के रूप में पैरामीटराइज करने के लिए हर्मिट ट्राजेक्टरी प्रायर्स (Hermite trajectory priors) का परिचय देता है, जो यह प्रदर्शित करता है कि हर्मिट रेगुलराइजेशन (Hermite Regularization) के माध्यम से स्मूथनेस और निरंतरता को स्पष्ट रूप से लागू करना, एक प्रभावी लर्निंग इंडक्टिव बायस (learning inductive bias) के रूप में कार्य करते हुए, सिमुलेशन और रियल-रोबोट कार्यों दोनों में विजन-लैंग्वेज-एक्शन (Vision-Language-Action) मॉडल्स की सफलता दर में महत्वपूर्ण सुधार करता है।

Qi Lv, Jianming Xing, Zhao Yang, Mingyuan Yao, Yinan Shi, Yawei Jueluo, Mike Zheng Shou, Xiang Deng2026-08-04
💻 computer science

DreamTrajectory: Trajectory-Guided Action Generation with World Model Alignment for Mobile Manipulation

DreamTrajectory एक प्रक्षेपवक्र-निर्देशित (trajectory-guided) ढांचा है जो मोबाइल मैनिपुलेशन के लिए मौजूदा विजन-लैंग्वेज-एक्शन नीतियों में सुधार करता है, जो समन्वित गति को निर्देशित करने के लिए एंड-इफेक्टर प्रक्षेपवक्र और होल-बॉडी क्रियाओं की संयुक्त रूप से भविष्यवाणी करता है, जबकि निष्पादित क्रियाओं को नियोजित प्रक्षेपवक्रों के साथ संरेखित करने के लिए टेस्ट-टाइम रिफाइनमेंट हेतु एक हल्के वर्ल्ड मॉडल का उपयोग करता है, जिससे सिमुलेशन और वास्तविक दुनिया के संपर्क-समृद्ध (contact-rich) कार्यों में सफलता दर में उल्लेखनीय वृद्धि होती है।

Zheng Yang, Wenjie Zhang, Xiangyu Chen, Wenxuan Song, Xianpeng Wang, Yihang Kang, Wen Chen, Lujia Wang, Renjing Xu, Xiao (…)2026-08-04
💻 computer science

GenTrack: Physical Alignment for Robot-Native Motion Generation and Zero-Shot Humanoid Tracking

GenTrack एक ऑनलाइन जनरेटर-ट्रैकर फ्रेमवर्क पेश करता है जो प्रभावी रूप से किनेमैटिक रूप से प्रशंसनीय और रोबोट-निष्पादनीय गतियों के बीच के अंतर को कम करने के लिए निष्पादन-आधारित गति निर्माण और ट्रैकर प्रशिक्षण के बीच बारी-बारी से कार्य करता है, जिससे बिना किसी अतिरिक्त डेटा संग्रह के विविध और आउट-ऑफ-डिस्ट्रीब्यूशन संदर्भों में श्रेष्ठ ज़ीरो-शॉट ह्यूमनॉइड ट्रैकिंग प्राप्त की जा सकती है।

Zeyu Ling, Xinyao Yu, Renye Yan, Jikang Cheng, Zhanke Wang, Qing Shuai, Changqing Zou2026-08-04
🤖 machine learning

When Replanning Becomes the Bottleneck: Budgeted Replanning for Embodied Agents

यह शोध पत्र BRACE को प्रस्तुत करता है, जो एक बजटयुक्त नियंत्रण ढांचा (budgeted control framework) है और जिसे E-RECAP टोकन प्रूनिंग विधि के साथ जोड़ा गया है, जो गतिशील रूप से टोकन बजट आवंटित करके और संदर्भों (contexts) को छाँटकर (pruning) एम्बोडीड एजेंटों में बार-बार होने वाले LLM-आधारित रीप्लानिंग के विलंबता बाधाओं (latency bottlenecks) को कम करता है, जिससे उच्च कार्य सफलता दरों को बनाए रखते हुए सर्विस-लेवल ऑब्जेक्टिव उल्लंघनों को महत्वपूर्ण रूप से कम किया जा सकता है।

Shuaijun Liu, Feiyang You, Xingwei Chen, Ningxin Su2026-08-04
💻 computer science

Perception-and-action system for humanoid robot task execution in construction

यह शोध पत्र एक नवीन धारणा-और-क्रिया (perception-and-action) प्रणाली प्रस्तावित करता है जिसमें Humanoid-PoseNet और Humanoid-ActionNet शामिल हैं, जो मानव प्रदर्शनों से मानव सदृश रोबोटों (humanoid robots) को निर्माण कार्यों को सीखने और उन्हें विश्वसनीय रूप से निष्पादित करने में सक्षम बनाता है, जिससे औसतन 82.45 मिमी की मोशन-ट्रैकिंग त्रुटि प्राप्त होती है।

Yanxi Liu, Yizhi Liu2026-08-04
💻 computer science

AffordTrajDP: Dynamic Affordance-Guided Visuomotor Policy Learning for Robotic Manipulation

AffordTrajDP एक गतिशील ढांचा है जो एक रिट्रीव्ड एंकर अफोर्डेंस को किसी वस्तु के SE(3) पोज़ के माध्यम से प्रसारित करके टेम्पोरल रूप से सुसंगत, स्टेट-अवेयर गाइडेंस ट्रैजेक्टरीज उत्पन्न करके रोबोटिक मैनिपुलेशन को बढ़ाता है, जिससे स्टैटिक अफोर्डेंस की सीमाओं को दूर किया जाता है और प्रिसिजन-क्रिटिकल कार्यों में बेहतर सफलता दर प्राप्त की जाती है।

Gaoyuan Wu, Ziyu Shan, Haoyang Du, Yuyao Jiang, Ziwei Wang2026-08-04
🤖 AI

SyncPlan: Long-Horizon LLM Coordination with Explicit Synchronization and Adaptive Correction

SyncPlan एक प्लान-एग्जीक्यूट-करेक्ट फ्रेमवर्क है जो सिंगल-शॉट सेंट्रलाइज्ड प्लानिंग, डिपेंडेंसी मैनेजमेंट के लिए एक्सप्लिसिट सिंक्रोनाइज़ेशन प्रिमिटिव्स और स्टेलेनेस डिटेक्टर द्वारा ट्रिगर होने वाले एडेप्टिव रिप्लानिंग को जोड़कर न्यूनतम लेटेंसी के साथ स्टेट-ऑफ-द-आर्ट लॉन्ग-होराइजन मल्टी-एजेंट कोऑर्डिनेशन प्राप्त करता है।

Shen You, Xiaoming Zhu, Weining Weng, Hefei Mei, Weixuan Wang, Zhongshen Li, Zeji LI, Ye-Wen Wang, Zijun Liao, Juchao Zh (…)2026-08-04
💻 computer science

TWINS: A Tactile Wearable Isomorphic Arm Networked System for Contact-Rich Manipulation Learning

यह शोध पत्र TWINS को प्रस्तुत करता है, जो एक पहनने योग्य दोहरी-भुजा वाले उपकरण और एक समरूप (isomorphic) रोबोट से युक्त एक रोबोटिक प्रणाली है, जिसमें वितरित स्पर्श सेंसर (distributed tactile sensors) लगे हुए हैं, जो शरीर की सतह के संपर्क संबंधी प्रदर्शनों (body-surface contact demonstrations) के संग्रह और उसके बाद संपर्क-समृद्ध हेरफेर कार्यों के लिए इमिटेशन लर्निंग नीतियों के प्रशिक्षण और परिनियोजन को सक्षम बनाता है।

Takahide Kitamura, Masaki Murooka, Natsuki Yamanobe, Yukiyasu Domae2026-08-04