💻 computer science

GameChat: Multi-LLM Dialogue for Safe, Agile, and Socially Optimal Multi-Agent Navigation in Constrained Environments

यह शोध पत्र GameChat प्रस्तुत करता है, जो एक नवीन मल्टी-एजेंट नेविगेशन फ्रेमवर्क है जो सीमित वातावरणों में सुरक्षित, फुर्तीले और सामाजिक रूप से इष्टतम संघर्ष समाधान को सक्षम करने के लिए लार्ज लैंग्वेज मॉडल्स के बीच प्राकृतिक भाषा संचार का लाभ उठाता है, जो दक्षता और प्राथमिकता पालन में मौजूदा बेसलाइनों से काफी बेहतर प्रदर्शन करता है।

Vagul Mahadevan, Shangtong Zhang, Rohan Chandra2026-05-12
🔢 mathematics

A Radius of Robust Feasibility Approach to Directional Sensors in Uncertain Terrain

यह शोध पत्र एक वितरित ग्रीडी एल्गोरिदम (distributed greedy algorithm) प्रस्तावित करता है जो अनिश्चित भूभाग में दिशात्मक सेंसरों के ओरिएंटेशन को अनुकूलित करने के लिए रोबस्ट व्यवहार्यता (robust feasibility) की त्रिज्या को एकीकृत करता है, जिससे कवरेज को अधिकतम किया जा सके और स्थान की अनिश्चितताओं के विरुद्ध मजबूती सुनिश्चित की जा सके।

Vanshika Datta, C. Nahak2026-05-12
💻 computer science

Learning Agile Striker Skills for Humanoid Soccer Robots from Noisy Sensory Input

यह शोधपत्र एक चार-चरणीय सुदृढीकरण शिक्षण (reinforcement learning) ढांचे को प्रस्तुत करता है जो ग्राउंड ट्रुथ डेटा के साथ एक शिक्षक नीति (teacher policy) को प्रशिक्षित करके और इसे सिम-टू-रियल अंतराल को पाटने के लिए बाधा-युक्त सुदृढीकरण शिक्षण (constrained RL) और यथार्थवादी शोर मॉडलिंग के माध्यम से अनुकूलित छात्र नीति (student policy) में संकलित (distill) करके, मानव सदृश सॉकर रोबोटों को शोर युक्त संवेदी इनपुट और बाहरी विक्षोभों के तहत मजबूत, निरंतर बॉल-किकिंग निष्पादित करने में सक्षम बनाता है।

Zifan Xu, Myoungkyu Seo, Dongmyeong Lee, Hao Fu, Jiaheng Hu, Jiaxun Cui, Yuqian Jiang, Zhihan Wang, Anastasiia Brund, Jo (…)2026-05-12
💻 computer science

Large Video Planner Enables Generalizable Robot Control

यह शोध पत्र इंटरनेट-स्तर के मानव गतिविधि डेटा पर प्रशिक्षित एक बड़े पैमाने के वीडियो फाउंडेशन मॉडल को प्रस्तुत करता है जो नवीन रोबोटिक कार्यों के लिए ज़ीरो-शॉट वीडियो योजनाएं उत्पन्न करता है, जिन्हें फिर निष्पादन योग्य क्रियाओं में परिवर्तित किया जाता है ताकि मजबूत सामान्यीकरण और वास्तविक दुनिया की व्यवहार्यता का प्रदर्शन किया जा सके।

Boyuan Chen, Tianyuan Zhang, Haoran Geng, Caiyi Zhang, Peihao Li, Kiwhan Song, William T. Freeman, Jitendra Malik, Piete (…)2026-05-12
🤖 AI

Supervised Mixture-of-Experts for Surgical Grasping and Retraction

यह शोध पत्र एक सुपरवाइज्ड मिक्सचर-ऑफ-एक्सपर्ट्स आर्किटेक्चर प्रस्तुत करता है जो केवल स्टीरियो एंडोस्कोपिक छवियों और 150 से कम प्रदर्शनों (demonstrations) का उपयोग करके हल्केवेट इमिटेशन लर्निंग पॉलिसियों को लचीले ऊतकों (deformable tissue) पर मजबूत और डेटा-कुशल सर्जिकल ग्रैस्पिंग और रिट्रैक्शन प्राप्त करने में सक्षम बनाता है, जो इन-डिस्ट्रीब्यूशन और चुनौतीपूर्ण आउट-ऑफ-डिस्ट्रीब्यूशन परिदृश्यों दोनों में मानक मॉडलों से काफी बेहतर प्रदर्शन करता है और एक्स विवो (ex vivo) तथा प्रारंभिक इन विवो (in vivo) पोर्सिन सर्जरी में सफल ज़ीरो-शॉट ट्रांसफर प्रदर्शित करता है।

Lorenzo Mazza, Ariel Rodriguez, Rayan Younis, Martin Lelis, Ortrun Hellig, Chenpan Li, Sebastian Bodenstedt, Martin Wagn (…)2026-05-12
💻 computer science

Latent Reasoning VLA: Latent Thinking and Prediction for Vision-Language-Action Models

यह शोध पत्र लेटेंट रीजनिंग वीएलए (LaRA-VLA) का प्रस्ताव करता है, जो एक एकीकृत ढांचा है जो स्पष्ट रीजनिंग दृष्टिकोणों की तुलना में 90% तक कम इन्फरेंस लेटेंसी के साथ कुशल, वास्तविक समय के एम्बोडीड कंट्रोल को प्राप्त करने के लिए निरंतर लेटेंट रिप्रेजेंटेशन में मल्टी-मोडल चेन-ऑफ-थॉट रीजनिंग को आंतरिक रूप से समाहित करता है।

Shuanghao Bai, Jing Lyu, Wanqi Zhou, Zhe Li, Dakai Wang, Lei Xing, Xiaoguang Zhao, Pengwei Wang, Zhongyuan Wang, Cheng C (…)2026-05-12
💻 computer science

Now You See That: Learning End-to-End Humanoid Locomotion from Raw Pixels

यह शोध पत्र उच्च-सटीक डेप्थ सिमुलेशन और व्यवहार डिस्टिलेशन के माध्यम से सिम-टू-रियल अंतराल को दूर करते हुए, तथा विशिष्ट रिवॉर्ड शेपिंग और मल्टी-नेटवर्क लर्निंग के माध्यम से बहुमुखी टेरेन अनुकूलन को सक्षम करते हुए, रोबस्ट विजन-आधारित ह्यूमनॉइड लोकोमोशन के लिए एक एंड-टू-एंड फ्रेमवर्क प्रस्तुत करता है।

Wandong Sun, Yongbo Su, Leoric Huang, Alex Zhang, Dwyane Wei, Mu San, Daniel Tian, Ellie Cao, Baoshi Cao, Yang Liu, Finn (…)2026-05-12
💻 computer science

DynaRetarget: Dynamically-Feasible Retargeting using Sampling-Based Trajectory Optimization

यह शोध पत्र DynaRetarget प्रस्तुत करता है, जो एक नवीन पाइपलाइन है जो मानव गतियों को सुदृढ़, गतिशील रूप से व्यवहार्य ह्यूमनॉइड नियंत्रण नीतियों में गतिशील रूप से परिष्कृत करने के लिए सैंपलिंग-आधारित प्रक्षेपवक्र अनुकूलन (SBTO) ढांचे का लाभ उठाती है, जिससे बड़े पैमाने पर सिंथेटिक लोको-मैनिपुलेशन डेटासेट का निर्माण सक्षम होता है।

Victor Dhedin, Ilyass Taouil, Shafeef Omar, Dian Yu, Kun Tao, Angela Dai, Majid Khadiv2026-05-12
🤖 AI

When to Trust Imagination: Adaptive Action Execution for World Action Models

यह शोध पत्र वर्ल्ड एक्शन मॉडल्स (World Action Models) के लिए एक अनुकूलन योग्य निष्पादन ढांचे का प्रस्ताव करता है जो भविष्य की अग्रगामी गतिकी कारण ध्यान (Future Forward Dynamics Causal Attention) सत्यापनकर्ता का उपयोग करता है ताकि भविष्यवाणी-वास्तविकता निरंतरता के आधार पर एक्शन चंक आकारों को गतिशील रूप से समायोजित किया जा सके, जिससे रोबोटिक हेरफेर कार्यों की दक्षता और सफलता दर दोनों में महत्वपूर्ण सुधार होता है।

Rui Wang, Yue Zhang, Jiehong Lin, Kuncheng Luo, Jianan Wang, Zhongrui Wang, Xiaojuan Qi2026-05-12✓ Author reviewed ⓘ
⚡ electrical engineering

ReasonSTL: Bridging Natural Language and Signal Temporal Logic via Tool-Augmented Process-Rewarded Learning

यह शोधपत्र \textsc{ReasonSTL} का परिचय देता है, जो एक टूल-ऑगमेंटेड फ्रेमवर्क है जो प्राकृतिक भाषा की आवश्यकताओं को सिग्नल टेम्पोरल लॉजिक (STL) सूत्रों में सटीक और निजी रूप से अनुवादित करने के लिए प्रोसेस-रिवॉर्डेड लर्निंग के माध्यम से स्थानीय ओपन-सोर्स लैंग्वेज मॉडल्स को अनुकूलित करता है, जो मैनुअल स्पेसिफिकेशन और कमर्शियल एपीआई के लिए एक लागत प्रभावी विकल्प प्रदान करता है।

Bowen Ye, Zhijian Li, Junyue Huang, Junkai Ma, Xiang Yin2026-05-12