💻 computer science

Toward Low-Latency Vision-Language Models with Doubly-Correct Predictions in Egocentric Visual Understanding

यह शोध पत्र विजन-लैंग्वेज मॉडल्स के लिए एक तर्क-आधारित (rationale-informed) प्रूनिंग रणनीति प्रस्तावित करता है जो "दोहरी-सटीक" (doubly-correct) भविष्यवाणियों को सुनिश्चित करती है—जहाँ आउटपुट सटीक और साक्ष्य-आधारित दोनों होते हैं—ताकि मानव-रोबोट सहयोग के लिए कम-विलंबता (low-latency), सुरक्षित और विश्वसनीय एगोसेंट्रिक विजुअल समझ प्राप्त की जा सके।

Qitong Wang, Fan Du, Pranav Maneriker, Jihui Jin, Christopher Rasmussen2026-06-25
💻 computer science

ARTOO-DARTU: Studying AR-HRC With AR Obstruction Mitigation During a Warehouse Task

यह शोध पत्र ARTOO-DARTU प्रस्तुत करता है, जो वेयरहाउस मानव-रोबोट सहयोग के लिए एक संवर्धित वास्तविकता (ऑगमेंटेड रियलिटी) प्रणाली है, जो दृश्य अवरोध को रोकने के लिए एक बाधा पहचान और शमन पाइपलाइन को एकीकृत करती है, जिससे एक 34-प्रतिभागी उपयोगकर्ता अध्ययन में प्रदर्शित होने के अनुसार कार्य दक्षता और वास्तविक दुनिया की दृश्यता में महत्वपूर्ण सुधार होता है।

Christian Fronk, Hanting Ye, Zhehan Qu, Maria Gorlatova2026-06-25
💻 computer science

Wear-Clearance-Impact Coupling in the Jansen Linkage: A Gait-Durability-Optimized Design Slows Joint Loosening

यह अध्ययन जानसेन लिंकेज में घिसाव (wear), क्लीयरेंस और प्रभाव (impact) को जोड़ने वाला पहला फॉरवर्ड-डायनामिक मॉडल प्रस्तुत करता है, जो यह प्रकट करता है कि हालांकि क्लीयरेंस की उपेक्षा करने से पीक लोड और गैर-समान घिसाव का काफी कम अनुमान लगता है, फिर भी चाल-टिकाऊपन-अनुकूलित (gait-durability-optimized) डिज़ाइन अराजक मल्टी-जॉइंट स्थितियों में भी जोड़ के ढीले होने के विरुद्ध सांख्यिकीय रूप से सुदृढ़ रहता है।

Jichao Wang2026-06-25
💻 computer science

GRAFT: Graph-Based Affordance Transfer via Part Correspondence

GRAFT एक ज्यामिति-जागरूक (geometry-aware) फ्रेमवर्क है जो वस्तुओं को ग्राफ़-आधारित भागों के रूप में प्रस्तुत करके कार्यात्मक और ज्यामितीय रूप से समान उदाहरणों को खोजने और सूक्ष्म-स्तरीय भाग पत्राचार (fine-grained part correspondence) के माध्यम से संपर्क बिंदुओं को प्रसारित करने द्वारा ज़ीरो-शॉट रोबोटिक हेरफेर स्थानांतरण को सक्षम बनाता है।

Mengying Lin, Utkarsh Mishra, Ajay Mandlekar, Danfei Xu2026-06-25
💻 computer science

WaveForward: An Omnidirectional Passive Wheeled Quadruped Robot with Casters

यह शोध पत्र WaveForward प्रस्तुत करता है, जो एक कम लागत वाला सर्वदिशीय (ओम्नीडायरेक्शनल) निष्क्रिय पहियेदार चतुष्पाद रोबोट है जो बहुमुखी गति प्राप्त करने और पारंपरिक लेग्ड मोशन की तुलना में परिवहन की लागत को काफी कम करने के लिए कैस्टर्स और एक असममित एक्टर-क्रिटिक नियंत्रण रणनीति का उपयोग करता है।

Chuanlin Zhao, Qifeng Zheng, Shuhan Wang, Tiancheng Ma, Weixian Lin, Xin Luo2026-06-25
⚡ electrical engineering

Delta-Position Estimation-Based IMU Odometry: A Comparison of MLP and Kolmogorov-Arnold Networks

यह शोध पत्र प्रदर्शित करता है कि एक कोलमोगोरोव-आर्नोल्ड नेटवर्क (KAN), जिसमें सीखने योग्य बी-स्प्लाइन (B-spline) सक्रियण हैं, इंक्रीमेंटल डिस्प्लेसमेंट (incremental displacement) का अनुमान लगाने के लिए प्रशिक्षित होने पर, एब्सोल्यूट पोजीशन (absolute position) के बजाय, 6.9 गुना कम मापदंडों के साथ 44% कम संचयी ड्रिफ्ट (cumulative drift) प्राप्त करके, IMU ओडोमेट्री में एक मानक मल्टी-लेयर पर्सेप्ट्रॉन (MLP) की तुलना में काफी बेहतर प्रदर्शन करता है।

Osman Tokluoglu, Emin Keresteci2026-06-25
💻 computer science

GROVE: Grounded Pedestrian Simulation via Natural Language for Interactive Social Robot Navigation

GROVE एक टेक्स्ट-टू-सिनारियो पैदल यात्री सिमुलेशन फ्रेमवर्क है जो कई सिमुलेशन वातावरणों में गतिशील रूप से यथार्थवादी, सामाजिक रूप से जटिल मानवीय व्यवहार उत्पन्न करने के लिए प्राकृतिक भाषा प्रॉम्प्ट का लाभ उठाता है, जिससे इंटरैक्टिव सोशल रोबोट नेविगेशन के प्रशिक्षण के लिए सिम-टू-रियल अंतराल को पाटा जा सके।

Duc Tai Nguyen, Volodymyr Shcherbyna, Anh Do Duc, Zhengcheng Shen, Teham Buiyan, Linh Kästner2026-06-25
💻 computer science

ASSCG: Just-Right Gating over Chattering for Fast-Slow LLM Planning in Autonomous Driving

यह शोध पत्र ASSCG प्रस्तुत करता है, जो एक अनुकूलन योग्य गेटिंग तंत्र (adaptive gating mechanism) है जो एक हल्के RWKV बैकबोन के माध्यम से, जिसे सुदृढीकरण शिक्षण (reinforcement learning) के साथ प्रशिक्षित किया गया है, फ्रेम-स्तरीय क्वेरी, पुन: उपयोग या ड्रॉप निर्णय लेकर स्वायत्त ड्राइविंग में खर्चीले LLM स्लो-प्लानर्स के आह्वान को अनुकूलित करता है, जिससे कई बेंचमार्क में अनुमान विलंबता (inference latency) को कम करते हुए नियोजन प्रदर्शन में महत्वपूर्ण सुधार होता है।

Sining Ang, Yuan Chen, Liu Haiyan, Xuanyao Mao, Jason Bao, Xuliang, Bingchuan Sun, Yan Wang2026-06-25
💻 computer science

Stage-Aware and Roughness-Constrained Diffusion Policy for Multi-Stage Robotic Polishing

यह शोध पत्र एक स्टेज-अवेयर और रफनेस-कंस्ट्रेंड डिफ्यूजन पॉलिसी (SRDP) प्रस्तावित करता है जो मल्टी-स्टेज रोबोटिक पॉलिशिंग कार्यों में स्टेज-ट्रांजिशन स्थिरता और सतह की गुणवत्ता को बढ़ाने के लिए प्रोसेस स्टेज का अनुमान लगाने और फीड स्पीड एवं कॉन्टैक्ट फोर्स पर भौतिक बाधाओं को लागू करने हेतु मल्टीमॉडल ऑब्जर्वेशन्स का लाभ उठाता है।

Shuai Ke, Jiexin Zhang, Huan Zhao, Zhiao Wei, Yikun Guo, Tiange Wu, Guoqiang Guo, Haoyuan Zhou, Jie Pan, Han Ding2026-06-25
🤖 machine learning

ROAD-VLA: Robust Online Adaptation via Self-Distillation for Vision-Language-Action Models

यह शोध पत्र ROAD-VLA प्रस्तुत करता है, जो एक विज़न-लैंग्वेज-एक्शन मॉडल के लिए एक सुदृढ़ ऑनलाइन अनुकूलन ढांचा है, जो एक प्रॉक्सिमल टीचर से डेंस, एक्शन-स्पेस सुपरविजन उत्पन्न करने के लिए एक एडवांटेज-गाइडेड सेल्फ-डिस्टिलेशन तंत्र का उपयोग करके स्पार्स रिवार्ड्स और सिम्बोलिक गाइडेंस की सीमाओं को दूर करता है, जिससे यह विविध रोबोटिक मैनिपुलेशन कार्यों में PPO से काफी बेहतर प्रदर्शन करता है।

Kejing Wang, Toan Nguyen, Minh Hoang Nguyen, Simon Khan, Flora D. Salim2026-06-25