🤖 AI

Why Limit the Residual Stream to Layers and Not Tokens? Persistent Memory for Continuous Latent Reasoning

यह शोध पत्र AGCLR प्रस्तुत करता है, जो मध्यवर्ती तथ्यों को ओवरराइट करने की "कॉन्सेप्ट बॉटलनेक" (concept bottleneck) की समस्या को दूर करने के लिए एक गेटेड पर्सिस्टेंट मेमोरी स्ट्रीम जोड़कर CoCoNuT रीजनिंग प्रतिमान (paradigm) को उन्नत करता है, जिससे रीजनिंग की गहराई बढ़ने के साथ मल्टी-हॉप रीजनिंग कार्यों पर प्रदर्शन में महत्वपूर्ण सुधार होता है।

Mujtaba Farhan, Maheep Chaudhary2026-06-09
🤖 AI

Automatic Extraction of Structured Information from Brain MRI Reports Using an Open-Weight Large Language Model

यह अध्ययन प्रदर्शित करता है कि ओपन-वेट एलएलएमए (LLM) लामा 3.1 (LLaMA 3.1), डच ब्रेन एमआरआई (MRI) रिपोर्ट से श्रेणीबद्ध चरों (categorical variables) और लीजन उल्लेखों (lesion mentions) के लिए उच्च सटीकता के साथ संरचित जानकारी को प्रभावी ढंग से निकालता है, जबकि फ्यू-शॉट प्रॉम्प्टिंग (few-shot prompting) संख्यात्मक डेटा निष्कर्षण पर इसके प्रदर्शन में महत्वपूर्ण सुधार करता है।

Kaouther Mouheb, Amos Pomp, Antoine Manenti, Romy de Haan, Farog Faghir, Joy Martens, Harro Seelaar, Francesco Mattace-R (…)2026-06-09
🤖 AI

Quantum-Enhanced Similarity Measures for Polarimetric Materials Classification

यह शोध पत्र एक क्वांटम-क्लासिकल हाइब्रिड पाइपलाइन प्रस्तावित करता है जो SWAP-टेस्ट फिडेलिटी एस्टीमेशन के माध्यम से सामग्री वर्गीकरण करने के लिए पोलारिमेट्रिक वोक्सेल एम्बेडिंग्स को क्वांटम अवस्थाओं में एनकोड करता है, जो क्लासिकल ऑप्टिमल ट्रांसपोर्ट विधियों की तुलना में 23 सामग्रियों के डेटासेट पर प्रतिस्पर्धी सटीकता और ओपन-सेट डिस्क्रिमिनेशन क्षमता प्रदर्शित करता है।

Sara Shojaei, Seyed Mohamad Ali Tousi, Emma Bennett, Param Sangani, Ali Shiri Sichani, Ilker Ersoy, Hadi Ali-Akbarpour (…)2026-06-09
🔭 astrophysics

Beyond Point Estimates: Benchmarking Uncertainty Quantification Methods on the AION-1 Astronomical Foundation Model

यह शोध पत्र गैलेक्सी प्रॉपर्टी रिग्रेशन के लिए AION-1 खगोलीय फाउंडेशन मॉडल पर सात अनिश्चितता मात्रा निर्धारण (uncertainty quantification) विधियों का बेंचमार्किंग करता है, जो यह प्रदर्शित करता है कि कॉन्फॉर्मल प्रेडिक्शन दृष्टिकोण—विशेष रूप से लोकली वैलिड एंड डिस्क्रिमिनेटिव (LVD) फ्रेमवर्क—गैर-कॉन्फॉर्मल बेसलाइनों की तुलना में विश्वसनीय, अनुकूलनीय और स्थानीय रूप से वैध अनिश्चितता अंतराल प्रदान करके बेहतर प्रदर्शन करते हैं जो वैज्ञानिक निष्कर्ष के लिए आवश्यक हैं।

Karla Tame-Narvaez, Aleksandra Ćiprijanović, Shubhendu Trivedi2026-06-09
🤖 AI

Land cover and flood type govern the detection limits of satellite-based flood mapping across diverse global flood events

यह अध्ययन 19 वैश्विक बाढ़ घटनाओं में पृथ्वी-ईओ-2.0 (Prithvi-EO-2.0) भू-स्थानिक फाउंडेशन मॉडल का मूल्यांकन करता है, जिससे यह पता चलता है कि पहचान की सटीकता मुख्य रूप से भूमि आवरण और बाढ़ के प्रकार द्वारा नियंत्रित होती है, जिसमें वृक्ष आवरण और निर्मित क्षेत्रों में प्रदर्शन में महत्वपूर्ण गिरावट देखी गई है, जबकि यह यह भी रेखांकित करता है कि पाइपलाइन इंजीनियरिंग और संदर्भ डेटा की विसंगतियां देखे गए त्रुटियों में पर्याप्त योगदान देती हैं।

Venkatesh Kolluru, Rajat Shinde, Abdelhak Marouane, Caden Helbling, Deepak Shah, Othneil Drew, Iksha Gurung, Manil Maske (…)2026-06-09
💻 computer science

Memetic Capture: A Pluralistic Policy Framework for Governing AI-Driven Cultural Disempowerment

यह शोध पत्र एआई-संचालित सांस्कृतिक अक्षमता को एक महत्वपूर्ण शासन संबंधी दृष्टि दोष के रूप में उजागर करने के लिए "मेमेटिक कैप्चर" (memetic capture) की अवधारणा प्रस्तुत करता है और सांस्कृतिक बहुलवादी शासन ढांचे (CPGF) का प्रस्ताव करता है, जो एक चार-स्तरीय नीति संरचना है जिसे मात्रात्मक मेट्रिक्स, लोकतांत्रिक सभाओं, बहुलवादी मानकों और ट्रांसनेशनल समन्वय के माध्यम से मानवीय मूल्यों की रक्षा करने के लिए डिज़ाइन किया गया है।

Subramanyam Sahoo2026-06-09
🤖 AI

Beyond Goodhart's Law: A Dynamic Benchmark for Evaluating Compliance in Multi-Agent Systems

यह शोध पत्र MAC-Bench प्रस्तुत करता है, जो मल्टी-एजेंट सिस्टम के प्रक्रियात्मक अनुपालन (procedural compliance) का मूल्यांकन और मात्रा निर्धारित करने के लिए SERV पाइपलाइन का उपयोग करने वाला एक गतिशील प्रतिकूल बेंचमार्क (dynamic adversarial benchmark) है, जो 'कम्प्लायंस-वेटेड सक्सेस रेट' (Compliance-Weighted Success Rate) और 'मैकियावेलियन गैप' (Machiavellian Gap) जैसे नवीन मेट्रिक्स के माध्यम से कार्य सफलता और सुरक्षा पालन के बीच महत्वपूर्ण समझौतों (trade-offs) को प्रकट करता है।

Yiyang Zhao, Zhuo Zhang, Qingxuan Le, Lizhen Qu, Zenglin Xu2026-06-09
💻 computer science

SLMJury: Can Small Language Models Judge as Well as Large Ones?

यह शोध पत्र SLMJury को पेश करता है, जो एक व्यापक ढांचा है जो बंद-अंत (closed-ended) और खुले-अंत (open-ended) कार्यों में न्यायाधीश के रूप में 16 छोटे भाषा मॉडलों (SLMs) का बेंचमार्किंग करता है, जिससे यह पता चलता है कि हालांकि कोई भी एक मॉडल हावी नहीं है, अनुकूलित तर्क रणनीतियों और बहस प्रोटोकॉल के माध्यम से SLM बड़े मॉडलों के तुलनीय विश्वसनीय मूल्यांकन प्रदर्शन प्राप्त कर सकते हैं।

Anish Laddha, Nitesh Pradhan, Gaurav Srivastava2026-06-09
🤖 AI

Scaling Participation in Modular AI Systems

यह शोध पत्र "स्केलिंग पार्टिसिपेशन" (scaling participation) को प्रस्तुत करता है, जो एक ऐसा प्रतिमान है जहाँ विविध हितधारक सहयोगपूर्ण मॉड्यूलर एआई सिस्टम बनाने के लिए विशिष्ट छोटे मॉडलों का योगदान देते हैं जो तर्क, तथ्यात्मकता और उभरती समस्या-समाधान क्षमताओं में मोनोलिथिक एलएलएम (LLMs) से बेहतर प्रदर्शन करते हैं।

Shangbin Feng, Yike Wang, Weijia Shi, Luke Zettlemoyer, Yejin Choi, Yulia Tsvetkov2026-06-09