cs.AI
21916 पेपर
The 2025 AI Agent Index: Documenting Technical and Safety Features of Deployed Agentic AI Systems
यह शोध पत्र 2025 एआई एजेंट इंडेक्स पेश करता है, जो तेजी से विकसित होते पारिस्थितिकी तंत्र की चुनौतियों का समाधान करने के लिए 30 अत्याधुनिक एआई एजेंटों की उत्पत्ति, क्षमताओं और सुरक्षा विशेषताओं को प्रलेखित करने वाला एक व्यापक संसाधन है, जो साथ ही सुरक्षा और सामाजिक प्रभावों के संबंध में डेवलपर्स की पारदर्शिता में महत्वपूर्ण अंतराल को भी उजागर करता है।
The Interference Gap: Comparing Retrieval Bounds in Human Memory and RAG Systems
यह शोध पत्र एक एकीकृत सिग्नल डिटेक्शन थ्योरी फ्रेमवर्क प्रस्तुत करता है जो यह प्रदर्शित करता है कि मानव एपिसोडिक मेमोरी, मानक डेंस पैसेज रिट्रीवल सिस्टम की तुलना में सिमेंटिक इंटरफेरेंस के प्रति कम संवेदनशीलता प्रदर्शित करती है, जिसमें हिप्पोराग (HippoRAG) जैसे संज्ञानात्मक रूप से प्रेरित मॉडल प्रदर्शन के अंतर को पाटते हैं, जिससे मानव और एआई रिट्रीवल तंत्रों की तुलना करने के लिए एक नया सैद्धांतिक आधार प्राप्त होता है।
"AI Watermarking": Bridging Policy Discourse and Technical Capabilities
यह शोधपत्र विधायी दस्तावेजों के आगमनात्मक कोडिंग (inductive coding) का उपयोग करते हुए, वर्तमान नियामक दृष्टिकोणों में प्रमुख अंतराल, अस्पष्टताओं और खामियों की पहचान करते हुए, एआई सामग्री पारदर्शिता पर अमेरिकी और यूरोपीय संघ के नीतिगत विमर्श और पहचान तंत्र की वास्तविक तकनीकी क्षमताओं के बीच के अंतर का आलोचनात्मक विश्लेषण करता है।
When Medical Safety Alignment Fails: A Benchmark for Evaluating LLMs on High-Risk Medical Queries
यह शोध पत्र \textsc{MedHarm} को प्रस्तुत करता है, जो 1,100 उच्च-जोखिम वाले चिकित्सा संबंधी प्रश्नों का एक बेंचमार्क है जो लार्ज लैंग्वेज मॉडल्स में सामान्य संरेखण (alignment) और वास्तविक चिकित्सा सुरक्षा के बीच एक महत्वपूर्ण अंतर को प्रकट करता है, यह प्रदर्शित करते हुए कि वर्तमान सुरक्षा उपाय अक्सर उपयोगिता और इनकार (refusal) के बीच संतुलन बनाते समय हानिकारक आउटपुट को रोकने में विफल रहते हैं।
Multi-Agent DRL for QoS and Energy Optimization in RIS-Enabled Open-RAN Industrial 6G TN/NTN Networks
यह शोध पत्र एकीकृत स्थलीय/गैर-स्थलीय औद्योगिक 6G नेटवर्क के लिए डेटा दरों, विलंबता (लेटेंसी) और ऊर्जा खपत को संयुक्त रूप से अनुकूलित करने हेतु एक RIS-सक्षम Open-RAN आर्किटेक्चर के भीतर एक मल्टी-एजेंट डीप रिइन्फोर्समेंट लर्निंग फ्रेमवर्क प्रस्तावित करता है, जो मौजूदा बेसलाइन की तुलना में महत्वपूर्ण प्रदर्शन लाभ प्राप्त करता है।
The Crowded Embedding Space: A Mean-Field Mechanism for Emergent Marginalization in Retrieval-Augmented Agents
यह शोध पत्र एक मीन-फील्ड ढांचे (mean-field framework) को प्रस्तुत करता है जो यह प्रदर्शित करता है कि रिट्रीवल-ऑगमेंटेड एजेंटों में, बहुसंख्यक हितों के लिए उच्च दस्तावेज़ घनत्व एम्बेडिंग स्पेस को ज्यामितीय रूप से अत्यधिक भीड़भाड़ वाला बना देता है, जिससे एक चरण संक्रमण (phase transition) उत्पन्न होता है जो स्थानीय प्रासंगिकता उद्देश्यों द्वारा संचालित उभरते स्व-संगठन के माध्यम से व्यवस्थित रूप से अल्पसंख्यक सामग्री को हाशिए पर धकेल देता है।
PIXELRAG: Web Screenshots Beat Text for Retrieval-Augmented Generation
PixelRAG एक नवीन रिट्रीवल-ऑगमेंटेड जनरेशन फ्रेमवर्क पेश करता है जो पूरी तरह से पिक्सेल स्पेस में संचालित होता है, जो पार्स किए गए टेक्स्ट के बजाय रॉ वेबसाइट स्क्रीनशॉट्स को रिट्रीव और प्रोसेस करता है, जिससे लेआउट लॉस समाप्त हो जाता है और पारंपरिक टेक्स्ट-आधारित RAG सिस्टम की तुलना में विविध बेंचमार्क पर बेहतर प्रदर्शन और दक्षता प्राप्त होती है।
Auditing LLM-Governed Social Robots with Culture-Specific Moral Gradients
यह शोध पत्र कई संस्कृतियों में LLM-शासित सामाजिक रोबोटों का मूल्यांकन करने के लिए एक ग्रेडिएंट-आधारित ऑडिट फ्रेमवर्क प्रस्तुत करता है, जो यह प्रकट करता है कि वर्तमान मॉडल सांस्कृतिक नैतिक प्राथमिकताओं को ट्रैक करने में महत्वपूर्ण, विषम विफलताओं को प्रदर्शित करते हैं जिन्हें केवल प्रॉम्प्टिंग के माध्यम से विश्वसनीय रूप से ठीक नहीं किया जा सकता है, जिससे बहुभाषी पूर्व-तैनाती ऑडिट और मॉडल-स्तरीय हस्तक्षेपों की आवश्यकता होती है।
Agentic Safety is an Epistemic Property, Not a Behavioral One
यह शोध पत्र तर्क देता है कि एआई सुरक्षा को केवल वर्तमान प्रदर्शन के व्यवहारिक गुण के रूप में नहीं, बल्कि "शिक्षण क्षमता" (teachability) के एक ज्ञानमीमांसीय गुण के रूप में पुनर्गठित किया जाना चाहिए—जो भविष्य के सुधारात्मक उत्तोलन (corrective leverage) को बनाए रखने की क्षमता है—ताकि यह सुनिश्चित किया जा सके कि उन्नत, स्व-सुधार करने वाली प्रणालियाँ समय के साथ सुधारात्मक बनी रहें।