💻 computer science

PressMimic: Pressure-Guided Motion Capture and Control for Humanoid Robot Imitation

PressMimic एक ऐसा फ्रेमवर्क है जो मोशन कैप्चर (FRAPPE++ मॉडल के माध्यम से) और नियंत्रण (प्रेशर-सुपरवाइज्ड पॉलिसी के माध्यम से) दोनों को बढ़ाने के लिए दबाव डेटा (pressure data) को एक एकीकृत मोडैलिटी के रूप में उपयोग करता है, जिससे दृश्य अस्पष्टताओं (visual ambiguities) को दूर किया जा सके और भौतिक रूप से सुसंगत, स्थिर ह्यूमनॉइड मोशन इमिटेशन सुनिश्चित किया जा सके।

Yi Lu, Shenghao Ren, Tianyu Xiong, Zhaoxiang Li, Jiaqi Li, He Zhang, Tao Yu, Qiu Shen, Xun Cao2026-06-26
💻 computer science

Humanoid-DART: Humanoid Loco-Manipulation using Diffusion-guided Augmentation through Relabeling and Tracking

Humanoid-DART एक स्व-पर्यवेक्षित (self-supervised) फ्रेमवर्क है जो डिफ्यूजन-आधारित प्रक्षेपवक्र (trajectory) पीढ़ी को सुदृढीकरण शिक्षण (reinforcement learning) के साथ जोड़ता है ताकि ह्यूमनॉइड रोबोटों को न्यूनतम विशेषज्ञ पर्यवेक्षण के साथ लक्ष्य स्थान का स्वचालित रूप से अन्वेषण करके विरल प्रदर्शनों (sparse demonstrations) से विविध लोको-मैनिपुलेशन कौशल सीखने में सक्षम बनाया जा सके।

Pranav Debbad, Kanish Thiagarajan, Victor Dhédin, Shafeef Omar, Majid Khadiv2026-06-26
🤖 AI

In-Context Model Predictive Generation: Open-Vocabulary Motion Synthesis from Language Models to Physics

यह शोध पत्र इन-कॉन्टेक्स्ट मॉडल प्रिडिक्टिव जनरेशन (ICMPG) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो लार्ज लैंग्वेज मॉडल प्लानिंग को क्लोज्ड-लूप, मॉडल प्रिडिक्टिव कंट्रोल-जैसे प्रोसेस में इन्फरेंस-टाइम फिजिकल फीडबैक के साथ एकीकृत करके टेक्स्ट-ड्रिवन मोशन सिंथेसिस में सिमेंटिक फिडेलिटी और फिजिकल रियलिज्म के बीच के अंतर को पाटता है।

Xiaomeng Fu, Junfan Lin, Yang Liu, Yaowei Wang, Guanbin Li, Liang Lin, Ziliang Chen2026-06-26
💻 computer science

RelAfford6D: Relational 6D Affordance Graphs for Constraint-Driven Robotic Manipulation

RelAfford6D एक नवीन, प्रशिक्षण-मुक्त ढांचा है जो संबंधात्मक 6D एफ़ॉर्डेंस ग्राफ़ (relational 6D affordance graphs) का निर्माण करके अमूर्त अर्थ विज्ञान और सटीक भौतिक नियंत्रण के बीच के अंतर को पाटता है ताकि मुक्त-रूप निर्देशों को गतिज बाधा संतुष्टि समस्याओं (kinematic constraint satisfaction problems) में अनुवादित किया जा सके, जिससे विश्लेषणात्मक रूप से तैयार किए गए प्रक्षेपवक्र ट्रैकिंग (trajectory tracking) के माध्यम से आर्टिकुलेटेड वस्तुओं के सुदृढ़ ज़ीरो-शॉट रोबोटिक हेरफेर को सक्षम बनाया जा सके।

Guodong Zhang, Qichen He, Wenyuan Xie, Shaokai Wu, Yanbiao Ji, Qiuchang Li, Bayram Bayramli, Yue Ding, Hongtao Lu2026-06-26
💻 computer science

ForesightSafety-VLA: A Unified Diagnostic Safety Benchmark for Vision-Language-Action Models

यह शोधपत्र ForesightSafety-VLA प्रस्तुत करता है, जो एक एकीकृत नैदानिक बेंचमार्क है जो एक व्यापक 13-श्रेणी सुरक्षा वर्गीकरण और नियंत्रित भिन्नता आयामों के माध्यम से विजन-लैंग्वेज-एक्शन मॉडलों का मूल्यांकन करता है ताकि यह प्रकट किया जा सके कि एम्बॉडीड (embodied) सुरक्षा विफलताएं केवल पोस्ट-हॉक फ़िल्टरिंग द्वारा हल होने के बजाय धारणा और नियंत्रण सक्षमता से घनिष्ठ रूप से जुड़ी हुई हैं।

Mingyang Lyu, Yinqian Sun, Yiyang Jia, Sicheng Shen, Moquan Sha, Huangrui Li, Feifei Zhao, Yi Zeng2026-06-26
💻 computer science

FlameVQA: A Physically-Grounded UAV Wildfire VQA Benchmark with Radiometric Thermal Supervision

यह शोधपत्र FlameVQA प्रस्तुत करता है, जो UAV-आधारित जंगल की आग की निगरानी के लिए एक नवीन बहुविकल्पीय विजुअल क्वेश्चन अनस्वर्सिंग बेंचमार्क है, जो तापमान-आधारित तर्क को सक्षम करने के लिए युग्मित RGB और रेडियोमेट्रिक थर्मल इमेजरी का लाभ उठाता है, जबकि क्रॉस-मोडल कार्यों में उनकी शक्तियों और धुएं से बाधित पहचान एवं कवरेज अनुमान में उनकी सीमाओं को उजागर करने के लिए वर्तमान मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स का मूल्यांकन करता है।

Mobin Habibpour, John Spodnik, Niloufar Alipour Talemi, Fatemeh Afghah2026-06-26
🤖 machine learning

Learning to Fold: prizewinning solution at LeHome Challenge 2026 (1st place online, 2nd offline)

यह शोध पत्र LeHome Challenge 2026 के लिए एक पुरस्कार विजेता द्विपक्षीय (bimanual) गारमेंट फोल्डिंग सिस्टम प्रस्तुत करता है जो एक विजन-लैंग्वेज-एक्शन पॉलिसी को सेल्फ-सुपरवाइज्ड रिइन्फोर्समेंट लर्निंग लूप के साथ बढ़ाकर शीर्ष रैंकिंग प्राप्त करता है, जहाँ पॉलिसी के स्वयं के सफलता और प्रगति के अनुमान एडवांटेज एस्टीमेशन और फेलियर डिटेक्शन को संचालित करते हैं, जिसे फ्लो-मैचिंग, डिस्ट्रिब्यूटेड ट्रेनिंग और रोबस्ट सिम-टू-रियल ट्रांसफर सहित इंजीनियरिंग अनुकूलन के एक व्यापक समूह द्वारा समर्थित किया गया है।

Ilia Larchenko2026-06-26
🤖 machine learning

Automating Potential-based Reward Shaping with Vision Language Model Guidance

यह शोध पत्र VLM-PBRS प्रस्तुत करता है, जो एक ऐसा ढांचा है जो रिवॉर्ड शेपिंग के लिए संभावित फलनों (potential functions) को स्वचालित रूप से सीखने के लिए हल्के विजन-लैंग्वेज मॉडल्स से प्राप्त प्राथमिकता फीडबैक का लाभ उठाता है, जिससे अनुकूलतम नीतियों को संरक्षित रखते हुए और रिवॉर्ड हैकिंग को रोकते हुए स्पार्स-रिवॉर्ड वातावरण में सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) को गति मिलती है।

Henrik Müller, Daniel Kudenko2026-06-26
🤖 AI

Advancing Omnimodal Embodied Agents from Isolated Skills to Everyday Physical Autonomy

यह शोध पत्र OmniAct को प्रस्तुत करता है, जो एक पदानुक्रमित अतुल्यकालिक ढांचा (hierarchical asynchronous framework) है जो साइबर-भौतिक नियोजन (cyber-physical planning), अनुकूलनशील स्मृति (adaptive memory) और दृश्य सत्यापन (visual verification) को एकीकृत करता है ताकि निरंतर शारीरिक एजेंटों (embodied agents) को अनस्ट्रक्चर्ड वातावरण में जटिल, दीर्घ-क्षितिज वाले कार्यों को स्वायत्त रूप से निष्पादित करने में सक्षम बनाया जा सके, साथ ही भौतिक विफलताओं के विरुद्ध दक्षता और मजबूती बनाए रखी जा सके।

Junhao Shi, Zezheng Huai, Siyin Wang, Jia Chen, Yubang Wang, Zhaoye Fei, Hechang Chen, Jingjing Gong, Xipeng Qiu, Yu-Gan (…)2026-06-26
💻 computer science

BOWConnect: Parallel Bayesian Optimization over Windows with Learned Local Cost Maps for Sample-Efficient Kinodynamic Motion Planning

यह शोध पत्र BOWConnect प्रस्तुत करता है, जो एक द्विदिश समानांतर काइनोडायनेमिक मोशन प्लानर (bidirectional parallel kinodynamic motion planner) है जो स्थानीय लागत मानचित्रों (local cost maps) को सीखने और सैंपलिंग को निर्देशित करने के लिए 'विंडोज़ पर बेयसियन ऑप्टिमाइज़ेशन' (Bayesian Optimization over Windows) का लाभ उठाता है, जिससे जटिल, उच्च-आयामी वातावरण में 100% सफलता के साथ सैंपल-कुशल, वास्तविक समय की योजना बनाना संभव होता है जहाँ मौजूदा विधियाँ संघर्ष करती हैं।

Sourav Raxit, Abdullah Al Redwan Newaz, Jose Fuentes, Leonardo Bobadilla2026-06-26