🤖 machine learning

RAPT: Model-Predictive Out-of-Distribution Detection and Failure Diagnosis for Sim-to-Real Humanoid Deployment

यह शोधपत्र RAPT प्रस्तुत करता है, जो एक हल्का, स्व-पर्यवेक्षित (self-supervised) मॉनिटर है जो सिम-टू-रियल (Sim-to-Real) परिनियोजन के दौरान ह्यूमनॉइड रोबोटों के लिए उच्च-आवृत्ति वाली आउट-ऑफ-डिस्ट्रीब्यूशन डिटेक्शन और व्याख्या योग्य, ज़ीरो-शॉट विफलता निदान को सक्षम बनाता है, जिससे साइलेंट फेलियर और हार्डवेयर क्षति के जोखिमों में काफी कमी आती है।

Humphrey Munn, Brendan Tidd, Peter Bohm, Marcus Gallagher, David Howard2026-07-22
🤖 machine learning

Beyond Content: Behavioral Policies Reveal Actors in Information Operations

यह शोध पत्र एक प्लेटफॉर्म-अज्ञेय (platform-agnostic) ढांचे को प्रस्तुत करता है जो स्थिर व्यवहार संबंधी नीतियों की पहचान करने के लिए उपयोगकर्ता गतिविधि को क्रमिक निर्णय प्रक्रियाओं के रूप में मॉडल करके दुर्भावनापूर्ण प्रभाव अभियानों का पता लगाने में पारंपरिक सामग्री-आधारित विधियों से बेहतर प्रदर्शन करता है, जिससे सीमित डेटा या सिंथेटिक सामग्री के साथ भी उच्च सटीकता और शीघ्र पता लगाना संभव होता है।

Philipp J. Schneider, Lanqin Yuan, Marian-Andrei Rizoiu2026-07-22
🤖 AI

Training and Simulation of Quadrupedal Robot in Adaptive Stair Climbing and Descending for Indoor Firefighting: An End-to-End Reinforcement Learning Approach

यह शोध पत्र एक दो-चरणीय एंड-टू-एंड सुदृढीकरण शिक्षण (reinforcement learning) ढांचे को प्रस्तुत करता है जो यूनिट्री गो2 (Unitite Go2) क्वाड्रुपेड रोबोटों को केवल स्थानीय ऊंचाई-मानक धारणा (local height-map perception) का उपयोग करके अमूर्त पिरामिड स्थलाकृति से वास्तविक वातावरण में कौशल स्थानांतरित करके, अग्निशमन खोज मिशनों के लिए विविध इनडोर सीढ़ियों (सीधी, एल-आकार की और सर्पिल) में स्वायत्त रूप से नेविगेट करने और अनुकूल रूप से चढ़ने या उतरने में सक्षम बनाता है।

Baixiao Huang, Baiyu Huang, Yu Hou2026-07-22
⚡ electrical engineering

Deep Reinforcement Learning for Interference Suppression in RIS-Aided Space-Air-Ground Integrated Networks

यह शोध पत्र एक पुनर्गठनीय इंटेलिजेंट सरफेस (RIS)-सहायता प्राप्त स्पेस-एयर-ग्राउंड इंटीग्रेटेड नेटवर्क के लिए एक डीप डिटरमिनिस्टिक पॉलिसी ग्रेडिएंट (DDPG) एल्गोरिदम प्रस्तावित करता है ताकि HAPS बीमफॉर्मिंग वेट्स को गतिशील रूप से अनुकूलित किया जा सके, जो एंटीना बैक-लोब्स से होने वाले क्रॉस-टियर इंटरफेरेंस को प्रभावी ढंग से दबाता है और पारंपरिक ज़ीरो-फोर्सिंग विधियों की तुलना में 11.3% तक थ्रूपुट सुधार प्राप्त करता है।

Pujitha Mamillapalli, Shikhar Verma, Tiago Koketsu Rodrigues, Abhinav Kumar2026-07-22
⚡ electrical engineering

Segmented Continuous Optimization

यह शोध पत्र सेगमेंटेड कंटीन्यूअस ऑप्टिमाइज़ेशन (SCO) प्रस्तुत करता है, जो एक नवीन ढांचा है जो स्थानीय और वैश्विक सिग्नल पैटर्न दोनों को पकड़ने के लिए C1C^1 निरंतरता के साथ विविध गैर-रेखीय मॉडलों पर पीसवाइज कंटीन्यूअस कर्व फिटिंग करके गैर-स्थिर टाइम-सीरीज डेटा के विश्लेषण को बढ़ाता है।

Teymur Aghayev2026-07-22
🤖 machine learning

Vidu S1: A Real-Time Interactive Video Generation Model

Vidu S1 एक वास्तविक समय की संवादात्मक वीडियो जनरेशन मॉडल है जो उपयोगकर्ताओं को वॉयस कमांड के माध्यम से डिजिटल पात्रों को नियंत्रित करने में सक्षम बनाती है ताकि उपभोक्ता GPU पर बिना किसी दृश्य गिरावट के 42 FPS तक अनंत लंबाई वाले, उच्च गुणवत्ता वाले 540p वीडियो उत्पन्न किए जा सकें।

Jintao Zhang, Kai Jiang, Jintao Chen, Xu Wang, Yang Luo, Yuji Wang, Dechuang Chen, Jungang Li, Chengyang Ye, Marco Chen (…)2026-07-22
🤖 AI

Don't Blame the Large Language Model: How Agent Harness Evolution Shapes Coding Agent Quality

यह शोध पत्र पहला नियंत्रित अनुदैर्ध्य अध्ययन प्रस्तुत करता है जो यह प्रदर्शित करता है कि कोडिंग एजेंटों की गुणवत्ता में उतार-चढ़ाव का प्राथमिक चालक अंतर्निहित लार्ज लैंग्वेज मॉडल्स के बजाय एजेंट हार्नेस का तीव्र विकास है, जैसा कि Qwen Code CLI के 35 क्रमिक रिलीज़ के गहन विश्लेषण से सिद्ध होता है।

Oussama Ben Sghaier, Hao Li, Bram Adams, Ahmed E. Hassan2026-07-22
💬 NLP

LP-SFT: Local-Preserving Supervised Fine-Tuning via Multimodal Entropy Structure

यह शोध पत्र LP-SFT का प्रस्ताव करता है, जो एक सुपरवाइज्ड फाइन-ट्यूनिंग विधि है जो एक स्थानीय रूप से सामान्यीकृत KL डाइवर्जेंस के माध्यम से गैर-लक्ष्य टोकन (non-target tokens) के बीच प्रीट्रेन्ड मॉडल की अंतर्निहित मल्टीमॉडल एंट्रॉपी संरचना को संरक्षित करती है, जिससे पूर्व-मौजूदा क्षमताओं और सैंपलिंग विविधता के क्षरण को कम करते हुए डाउनस्ट्रीम प्रदर्शन में सुधार होता है।

Yueyang Wang, Baolong Bi, Shuo Lu, Jingyuan Zhang, Jiajun Shi2026-07-22
🤖 machine learning

OpenMHC: Accelerating the Science of Wearable Foundation Models

यह शोध पत्र OpenMHC को प्रस्तुत करता है, जो लगभग 12,000 प्रतिभागियों के 6 करोड़ घंटों से अधिक के वियरेबल स्वास्थ्य डेटा, फाउंडेशन मॉडल्स के ओपन-सोर्स कार्यान्वयन और एक एकीकृत बेंचमार्क के साथ एक व्यापक ओपन-एक्सेस डेटासेट है, ताकि वियरेबल हेल्थ AI में अनुसंधान को लोकतांत्रिक और त्वरित बनाया जा सके।

Narayan Schuetz, Yuze Bai, Lianggang Pan, Edgar Eggert, Favour Nerrise, Juan Delgado-SanMartin, Max Rosenblattl, Milana (…)2026-07-22
🤖 AI

Integro-differential equations in angular stabilization of drone motion by distributed feedback control

यह शोधपत्र अनबाउंडेड मेमोरी (unbounded memory) वाले डिस्ट्रीब्यूटेड फीडबैक कंट्रोल के माध्यम से ड्रोन की गति को स्थिर करने के लिए एक सार्वभौमिक दृष्टिकोण प्रस्तावित करता है, जो इंटेग्रो-डिफरेंशियल समीकरणों को साधारण अवकल समीकरणों (ordinary differential equations) के तंत्र में कम करके जटिल घातांकीय कर्नेल (complex exponential kernels) के माध्यम से नए घातांकीय स्थिरता परिणामों को प्राप्त करने का प्रदर्शन करता है।

Alexander Domoshnitsky, Oleg Kupervasser, Anatoly Polonsky2026-07-22