💻 computer science

How to Instruct Your Robot: Dense Language Annotations Power Robot Policy Learning

यह शोधपत्र DeMiAn को प्रस्तुत करता है, जो एक दो-चरणीय ढांचा है जो VLM-जनित सघन, बहु-आयामी भाषाई एनोटेशन का लाभ उठाकर बिना किसी नए प्रदर्शन डेटा की आवश्यकता के विविध कार्यों में रोबोट नीति शिक्षण और सामान्यीकरण को महत्वपूर्ण रूप से सुधारता है।

Bosung Kim, Ruiyi Wang, David Acuna, Jaehun Jung, Alexander Trevithick, Brandon Cui, Yejin Choi, Prithviraj Ammanabrolu2026-05-19
💰 quantitative finance

Global Automation Atlas

यह शोध पत्र 124 देशों को कवर करने वाले एक नवीन, देश-विशिष्ट कार्य-आधारित ढांचे को प्रस्तुत करता है जो यह प्रकट करता है कि स्वचालन का जोखिम वैश्विक स्तर पर अत्यधिक असमान है, जो आय के साथ बढ़ता है लेकिन श्रम-प्रतिस्थापन प्रौद्योगिकियों के माध्यम से निम्न-आय वाले देशों को और महिलाओं को असमान रूप से प्रभावित करता है।

Prashant Garg, Tommaso Crosta, Jasmin Baier2026-05-19
💻 computer science

Visual Timelines of Police Encounters in Body-Worn Camera Footage: Operational Context and Activity Cataloging for Training and Analysis in OpenBWC

यह शोध पत्र एक गोपनीयता-सचेत प्रणाली प्रस्तुत करता है जो परिचालन संदर्भ और गति की तीव्रता के लिए 10-सेकंड की खिड़कियों को वर्गीकृत करके बॉडी-वर्न कैमरा फुटेज को विजुअल टाइमलाइन्स में परिवर्तित करती है, जिससे घटना की समीक्षा में तेजी आती है और अधिकारी प्रशिक्षण वर्कफ़्लो में सुधार होता है।

Angela Srbinovska, Christopher Homan, Adrian Martin, Ernest Fokoué2026-05-19
💬 NLP

SEMA-RAG: A Self-Evolving Multi-Agent Retrieval-Augmented Generation Framework for Medical Reasoning

यह शोध पत्र SEMA-RAG का प्रस्ताव करता है, जो एक स्व-विकसित मल्टी-एजेंट रिट्रीवल-ऑगमेंटेड जनरेशन फ्रेमवर्क है जो चिकित्सा संबंधी प्रश्नों के उत्तर देने में सटीकता को महत्वपूर्ण रूप से सुधारने और मतिभ्रम (hallucinations) को कम करने के लिए चिकित्सा तर्क को विशिष्ट व्याख्या, पुनरावृत्ति अन्वेषण और अधिनिर्णय भूमिकाओं में अलग करता है।

Yongfeng Huang, Ruiying Chen, James Cheng2026-05-19
💻 computer science

Scientific Logicality Enriched Methodology for LLM Reasoning: A Practice in Physics

यह शोध पत्र एक वैज्ञानिक तार्किकता-संवर्धित पद्धति प्रस्तुत करता है जो केवल प्रदर्शन मेट्रिक्स के बजाय तर्क चरणों के तर्कसंगत आधार को प्राथमिकता देती है, और भौतिकी-आधारित प्रयोगों के माध्यम से यह प्रदर्शित करती है कि तार्किक रूप से विश्वसनीय डेटा पर प्रशिक्षण बड़े भाषा मॉडलों (Large Language Models) की तार्किक अखंडता और समस्या-समाधान क्षमताओं दोनों को महत्वपूर्ण रूप से बढ़ाता है।

Zhaoxin Yu, Nan Xu, Kun Chen, Jiahao Zhao, Lei Wang, Wenji Mao2026-05-19
💻 computer science

DynMuon: A Dynamic Spectral Shaping View of Muon

यह शोध पत्र DynMuon को प्रस्तुत करता है, जो एक गतिशील स्पेक्ट्रल शेपिंग विधि है जो वक्रता (curvature) और शोर (noise) के आधार पर स्पेक्ट्रल पावर पैरामीटर pp को धनात्मक से हल्के ऋणात्मक मानों की ओर शेड्यूलिंग करके Muon-आधारित प्रशिक्षण को अनुकूलित करती है, जिससे मानक Muon की तुलना में कम वैलिडेशन लॉस और तेज़ अभिसरण (convergence) प्राप्त होता है।

Fangzhou Wu, Rikhav Shah, Sandeep Silwal, Qiuyi Zhang2026-05-19
💻 computer science

Capturing LLM Capabilities via Evidence-Calibrated Query Clustering

यह शोध पत्र ECC को प्रस्तुत करता है, जो एक साक्ष्य-कैलिब्रेटेड (evidence-calibrated) क्वेरी क्लस्टरिंग एल्गोरिदम है जो पोस्टीरियर मॉडल तुलनाओं के माध्यम से सिमेंटिक एम्बेडिंग्स को परिष्कृत करके सतही अर्थ (surface-level semantics) और लेटेंट क्षमता आवश्यकताओं (latent capability requirements) के बीच के अंतर को पाटता है, जिससे मौजूदा बेसलाइन की तुलना में LLM क्षमता रैंकिंग और रूटिंग प्रदर्शन में महत्वपूर्ण सुधार होता है।

Fangzhou Wu, Sandeep Silwal, Qiuyi Zhang2026-05-19
💬 NLP

The Point of No Return: Counterfactual Localization of Deceptive Commitment in Language-Model Reasoning

यह शोध पत्र "काउंटरफैक्टुअल लोकलाइजेशन" (counterfactual localization) प्रस्तुत करता है, जो एक स्केलेबल पद्धति है जिसका उपयोग यह सटीक रूप से पहचानने के लिए किया जाता है कि भाषा मॉडल अपने तर्क संबंधी निशानों (reasoning traces) के भीतर किस क्षण धोखेबाजी के प्रति प्रतिबद्ध होते हैं, जिससे यह पता चलता है कि यह प्रतिबद्धता सतही भाषाई संकेतों के बजाय सामान्यीकरण योग्य अटेंशन-आधारित गतिकी (attention-based dynamics) द्वारा संचालित होती है और इसे अटेंशन हेड्स के एक छोटे समूह द्वारा कारणवश दबाया जा सकता है।

Scott Merrill, Shashank Srivastava2026-05-19
💻 computer science

F2IND-IT! -- Multimodal Fuzzy Fake Indian News Detection using Images and Text

यह शोध पत्र F2IND-IT प्रस्तुत करता है, जो एक नवीन मल्टीमॉडल फ्रेमवर्क है जो मौजूदा विधियों की तुलना में भारतीय मीडिया पर बेहतर फेक न्यूज डिटेक्शन प्रदर्शन प्राप्त करने के लिए इमेज विश्लेषण हेतु ResNet-50, टेक्स्ट प्रोसेसिंग हेतु DistilBERT, और अटेंशन-आधारित फ्यूजन के साथ एक एडेप्टिव न्यूरो-फजी इन्फरेंस सिस्टम (ANFIS) को एकीकृत करता है।

Kushal Trivedi, Murtuza Shaikh, Khushi Singh, Jeevaraj S.2026-05-19
💻 computer science

A Systematic Survey on Deep Learning Architectures for Point Cloud Classification and Segmentation

यह शोध पत्र 3D पॉइंट क्लाउड वर्गीकरण और विभाजन के लिए डीप लर्निंग आर्किटेक्चर का एक व्यवस्थित सर्वेक्षण प्रस्तुत करता है, जिसमें डेटा विशेषताओं, पद्धतिगत वर्गीकरण, बेंचमार्क मूल्यांकन और भविष्य की अनुसंधान दिशाओं को शामिल किया गया है।

Minhas Kamal, Hiranya Garbha Kumar, Balakrishnan Prabhakaran2026-05-19