🤖 AI

SDR: Set-Distance Rewards for Radiology Report Generation

यह शोध पत्र सेट-डिस्टेंस रिवार्ड्स (SDR) को प्रस्तुत करता है, जो एक नवीन सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) दृष्टिकोण है जो चेस्ट एक्स-रे रिपोर्ट जनरेशन में सटीक-मिलान मेट्रिक्स की सीमाओं को दूर करने के लिए वाक्य एम्बेडिंग्स के बीच क्रम-अपरिवर्तनीय सेट-टू-सेट दूरियों का उपयोग करता है, जिससे सुपरवाइज्ड फाइन-ट्यूनिंग पर महत्वपूर्ण प्रदर्शन लाभ प्राप्त होता है और कैंडिडेट प्रूनिंग के माध्यम से कुशल टेस्ट-टाइम स्केलिंग सक्षम होती है।

Halil Ibrahim Gulluk, Max Van Puyvelde, Wim Van Criekinge, Olivier Gevaert2026-06-02
🤖 AI

DarkVesselNet: Multi-Modal Remote Sensing and Trajectory Reasoning for Dark Vessel Detection

यह शोधपत्र DarkVesselNet को प्रस्तुत करता है, जो एक मल्टी-मोडल रिमोट सेंसिंग सिस्टम है जो डार्क वेसल्स (अदृश्य जहाजों) की पहचान करने के लिए जियोस्पेशियल फाउंडेशन मॉडल्स और एनोमली डिटेक्शन तकनीकों का उपयोग करके सेंटिनल-1 SAR, सेंटिनल-2 ऑप्टिकल इमेजरी और AIS ट्रैजेक्टरी डेटा को फ्यूज करता है, जिसका कार्यान्वयन और सत्यापन एक ओपन-सोर्स पायथन पैकेज और हगिंग फेस स्पेस के रूप में प्रदान किया गया है।

Arun Sharma2026-06-02
🤖 AI

GeoSAM-3D: Geodesic Prompt Propagation for Open-Vocabulary 3D Scene Segmentation from Monocular Video

GeoSAM-3D एक ऐसा सिस्टम है जो गॉसियन स्प्लेटिंग पुनर्निर्माण (Gaussian Splatting reconstruction) को एक डिफरेंशिएबल जियोडेसिक प्रोपेगेशन कर्नेल (differentiable geodesic propagation kernel) के साथ जोड़कर मोनोकुलर वीडियो से ओपन-वोकेबुलरी 3D सीन सेगमेंटेशन को सक्षम बनाता है, ताकि घुमावदार सतहों पर उपयोगकर्ता के प्रॉम्प्ट्स को सटीक रूप से स्थानांतरित किया जा सके और विच्छेदित वस्तुओं के बीच लीकेज को कम किया जा सके।

Arun Sharma2026-06-02
💬 NLP

On the Limits of LLM Adaptability: Impact of Model-Internalized Priors on Annotation Task Performance

यह शोध पत्र यह प्रदर्शित करता है कि एनोटेशन कार्यों में लार्ज लैंग्वेज मॉडल्स का प्रदर्शन मुख्य रूप से उनके आंतरिकीकृत प्रायों (internalized priors) और कार्य परिभाषाओं के बीच संरेखण द्वारा सीमित है न कि टेक्स्ट-स्तरीय स्मृति (text-level memorization) द्वारा, जो यह प्रकट करता है कि लगभग दो-तिहाई ज़ीरो-शॉट त्रुटियाँ प्रॉम्प्ट-आधारित सुधार के प्रति प्रतिरोधी बनी रहती हैं।

Etienne Casanova, Rafal Kocielnik, R. Michael Alvarez2026-06-02
🤖 AI

Doing What They Say, Not What They Reason: Locating the Faithfulness Gap in LLM Agents

यह शोधपत्र एक नियंत्रित टेक्सस पोकर सिम्युलेटर के भीतर एलएलएम (LLM) एजेंटों में निष्ठा अंतराल (faithfulness gap) की जांच करता है, जो यह प्रकट करता है कि जबकि एजेंट अक्सर अपने घोषित तर्क को अपने निष्कर्षों के साथ संरेखित करने में विफल रहते हैं, वे विरोधाभासी रूप से अपने निष्कर्षों के अनुसार कार्य करते हैं, भले ही वे निष्कर्ष उनके अपने तर्क के विपरीत हों।

Yufeng Wang2026-06-02
🤖 AI

EnergyMamba: An Uncertainty-Aware Graph-Enhanced Selective State Space Model for Energy Consumption Prediction

यह शोध पत्र EnergyMamba को प्रस्तुत करता है, जो एक अनिश्चितता-जागरूक (uncertainty-aware) स्थानिक-कालिक ढांचा है जो युग्मित स्थानिक-कालिक मॉडलिंग के लिए ग्राफ-उन्नत चयनात्मक स्टेट स्पेस मॉडल (Graph-Enhanced Selective State Space Model) को गतिशील अनिश्चितता अंशांकन (dynamic uncertainty calibration) के लिए एक अनुकूली अनुक्रमिक कॉन्फॉर्मलाइज्ड क्वांटाइल रिग्रेशन (Adaptive Sequential Conformalized Quantile Regression) मॉड्यूल के साथ जोड़ता है, जो अत्याधुनिक बेसलाइनों की तुलना में बड़े पैमाने के ऊर्जा डेटासेट पर बेहतर भविष्यवाणी सटीकता और विश्वसनीयता प्राप्त करता है।

Dahai Yu, Rongchao Xu, Lin Jiang, Guang Wang2026-06-02
⚡ electrical engineering

PaCo-VLA: Passivity-Shielded Compliance Prior for Contact-Rich Vision-Language-Action Manipulation

PaCo-VLA एक ऐसा फ्रेमवर्क है जो विजन-लैंग्वेज-एक्शन मॉडल्स में उच्च-स्तरीय सिमेंटिक रीजनिंग और सुरक्षित, उच्च-आवृत्ति वाले कॉन्टैक्ट कंट्रोल के बीच के अंतर को पाटता है, जो नेटवर्क आउटपुट्स को एक प्रमाणित रूप से पैसिविटी-शील्डेड रनटाइम कॉन्ट्रैक्ट द्वारा शासित टास्क-लेवल कंप्लायंस प्रपोजल्स के रूप में मानता है।

Haofan Cao, Zhaoyang Li, Zhichao You, Liang Guo, Tianrui Li2026-06-02
🤖 AI

Acting with AI: An Interaction-Based Framework for Agentic Tort Liability

यह शोधपत्र मानव-एआई जुड़ावों को स्वायत्त विचलन (autonomous drift), शुद्ध उपकरण उपयोग (pure tool use) और सहयोगात्मक योजना (collaborative planning) में वर्गीकृत करके, एजेंटिक एआई प्रणालियों को अपकृत्य दायित्व (tort liability) सौंपने के लिए एक अंतःक्रिया-आधारित कानूनी ढांचे का प्रस्ताव करता है, जो जिम्मेदारी निर्धारित करने के लिए स्टेटफुल इंटरैक्शन लॉग्स (stateful interaction logs) का उपयोग करता है और सत्यापन एवं पारदर्शिता पर आधारित एक "तर्कसंगत एजेंट" (Reasonable Agent) मानक की वकालत करता है।

Yiheng Yao2026-06-02
🤖 AI

KACE: Knowledge-Adaptive Context Engineering for Mathematical Reasoning

KACE (नॉलेज-एडेप्टिव कॉन्टेक्स्ट इंजीनियरिंग) एक कठिनाई- और डोमेन-स्तरीकृत एपिस्टेमिक ट्री के माध्यम से ज्ञान भंडारण को उपयोग से अलग करके लार्ज लैंग्वेज मॉडल्स में गणितीय तर्क क्षमता को बढ़ाता है, जिससे AIME 2025 पर 62.2% की सटीकता प्राप्त होती है—जो मौजूदा बेसलाइन्स की तुलना में एक महत्वपूर्ण सुधार है—और यह टियर्ड सेल्फ-कंसिस्टेंसी के माध्यम से कॉन्टेक्स्ट ब्लोट से बचता है।

Jayant Parashar, Suchendra M. Bhandarkar2026-06-02
🤖 AI

CAFOSat: A Strongly Annotated Dataset for Infrastructure-Aware CAFO Mapping Using High-Resolution Imagery

यह शोध पत्र CAFOSat को प्रस्तुत करता है, जो 20 अमेरिकी राज्यों में 45,000 से अधिक उच्च-रिज़ॉल्यूशन वाले इमेज पैच का एक बड़े पैमाने पर, सुदृढ़ रूप से एनोटेट किया गया डेटासेट है, जो संकेंद्रित पशु आहार संचालन (CAFOs) के मानचित्रण और उन्नत रिमोट सेंसिंग मॉडल के बेंचमार्किंग में चुनौतियों को दूर करने के लिए परिष्कृत बहु-स्रोत इन्वेंट्री और बुनियादी ढांचा-स्तरीय लेबल को एकीकृत करता है।

Oishee Bintey Hoque, Nibir Chandra Mandal, Mandy L Wilson, Samarth Swarup, Madhav Marathe, Abhijin Adiga2026-06-02