💬 NLP

Mitigating the Safety-utility Trade-off in LLM Alignment via Adaptive Safe Context Learning

यह शोध पत्र एडेप्टिव सेफ कॉन्टेक्स्ट लर्निंग (ASCL) फ्रेमवर्क का प्रस्ताव करता है, जो सुरक्षा को एक मल्टी-टर्न टूल-यूज़ प्रक्रिया के रूप में स्वरूपित करके और तर्क क्षमताओं को संरक्षित करते हुए स्वायत्त नियम परामर्श को सक्षम करने के लिए इनवर्स फ्रीक्वेंसी पॉलिसी ऑप्टिमाइज़ेशन (IFPO) को पेश करके LLM अलाइनमेंट में सुरक्षा-उपयोगिता ट्रेड-ऑफ को कम करता है।

Yanbo Wang, Minzheng Wang, Jian Liang, Lu Wang, Yongcan Yu, Ran He2026-06-30
🤖 AI

The 2025 AI Agent Index: Documenting Technical and Safety Features of Deployed Agentic AI Systems

यह शोध पत्र 2025 एआई एजेंट इंडेक्स पेश करता है, जो तेजी से विकसित होते पारिस्थितिकी तंत्र की चुनौतियों का समाधान करने के लिए 30 अत्याधुनिक एआई एजेंटों की उत्पत्ति, क्षमताओं और सुरक्षा विशेषताओं को प्रलेखित करने वाला एक व्यापक संसाधन है, जो साथ ही सुरक्षा और सामाजिक प्रभावों के संबंध में डेवलपर्स की पारदर्शिता में महत्वपूर्ण अंतराल को भी उजागर करता है।

Leon Staufer, Kevin Feng, Kevin Wei, Luke Bailey, Yawen Duan, Mick Yang, A. Pinar Ozisik, Stephen Casper, Noam Kolt2026-06-30
💬 NLP

The Interference Gap: Comparing Retrieval Bounds in Human Memory and RAG Systems

यह शोध पत्र एक एकीकृत सिग्नल डिटेक्शन थ्योरी फ्रेमवर्क प्रस्तुत करता है जो यह प्रदर्शित करता है कि मानव एपिसोडिक मेमोरी, मानक डेंस पैसेज रिट्रीवल सिस्टम की तुलना में सिमेंटिक इंटरफेरेंस के प्रति कम संवेदनशीलता प्रदर्शित करती है, जिसमें हिप्पोराग (HippoRAG) जैसे संज्ञानात्मक रूप से प्रेरित मॉडल प्रदर्शन के अंतर को पाटते हैं, जिससे मानव और एआई रिट्रीवल तंत्रों की तुलना करने के लिए एक नया सैद्धांतिक आधार प्राप्त होता है।

Dongxin Guo, Jikun Wu, Siu-Ming Yiu2026-06-30
🤖 AI

"AI Watermarking": Bridging Policy Discourse and Technical Capabilities

यह शोधपत्र विधायी दस्तावेजों के आगमनात्मक कोडिंग (inductive coding) का उपयोग करते हुए, वर्तमान नियामक दृष्टिकोणों में प्रमुख अंतराल, अस्पष्टताओं और खामियों की पहचान करते हुए, एआई सामग्री पारदर्शिता पर अमेरिकी और यूरोपीय संघ के नीतिगत विमर्श और पहचान तंत्र की वास्तविक तकनीकी क्षमताओं के बीच के अंतर का आलोचनात्मक विश्लेषण करता है।

Andrés Fábrega, Arkaprabha Bhattacharya, Miranda Christ, Sunoo Park2026-06-30
🤖 AI

When Medical Safety Alignment Fails: A Benchmark for Evaluating LLMs on High-Risk Medical Queries

यह शोध पत्र \textsc{MedHarm} को प्रस्तुत करता है, जो 1,100 उच्च-जोखिम वाले चिकित्सा संबंधी प्रश्नों का एक बेंचमार्क है जो लार्ज लैंग्वेज मॉडल्स में सामान्य संरेखण (alignment) और वास्तविक चिकित्सा सुरक्षा के बीच एक महत्वपूर्ण अंतर को प्रकट करता है, यह प्रदर्शित करते हुए कि वर्तमान सुरक्षा उपाय अक्सर उपयोगिता और इनकार (refusal) के बीच संतुलन बनाते समय हानिकारक आउटपुट को रोकने में विफल रहते हैं।

Yige Li, Jun Sun, Wei Zhao, Zhe Li, Yutao Wu, Hanxun Huang, Xiang Zheng, Xingjun Ma2026-06-30
🤖 AI

Multi-Agent DRL for QoS and Energy Optimization in RIS-Enabled Open-RAN Industrial 6G TN/NTN Networks

यह शोध पत्र एकीकृत स्थलीय/गैर-स्थलीय औद्योगिक 6G नेटवर्क के लिए डेटा दरों, विलंबता (लेटेंसी) और ऊर्जा खपत को संयुक्त रूप से अनुकूलित करने हेतु एक RIS-सक्षम Open-RAN आर्किटेक्चर के भीतर एक मल्टी-एजेंट डीप रिइन्फोर्समेंट लर्निंग फ्रेमवर्क प्रस्तावित करता है, जो मौजूदा बेसलाइन की तुलना में महत्वपूर्ण प्रदर्शन लाभ प्राप्त करता है।

Marwan Dhuheir, Thang X. Vu, Symeon Chatzinotas2026-06-30
🤖 AI

The Crowded Embedding Space: A Mean-Field Mechanism for Emergent Marginalization in Retrieval-Augmented Agents

यह शोध पत्र एक मीन-फील्ड ढांचे (mean-field framework) को प्रस्तुत करता है जो यह प्रदर्शित करता है कि रिट्रीवल-ऑगमेंटेड एजेंटों में, बहुसंख्यक हितों के लिए उच्च दस्तावेज़ घनत्व एम्बेडिंग स्पेस को ज्यामितीय रूप से अत्यधिक भीड़भाड़ वाला बना देता है, जिससे एक चरण संक्रमण (phase transition) उत्पन्न होता है जो स्थानीय प्रासंगिकता उद्देश्यों द्वारा संचालित उभरते स्व-संगठन के माध्यम से व्यवस्थित रूप से अल्पसंख्यक सामग्री को हाशिए पर धकेल देता है।

Shwan Ashrafi, Dan Roth2026-06-30
💬 NLP

PIXELRAG: Web Screenshots Beat Text for Retrieval-Augmented Generation

PixelRAG एक नवीन रिट्रीवल-ऑगमेंटेड जनरेशन फ्रेमवर्क पेश करता है जो पूरी तरह से पिक्सेल स्पेस में संचालित होता है, जो पार्स किए गए टेक्स्ट के बजाय रॉ वेबसाइट स्क्रीनशॉट्स को रिट्रीव और प्रोसेस करता है, जिससे लेआउट लॉस समाप्त हो जाता है और पारंपरिक टेक्स्ट-आधारित RAG सिस्टम की तुलना में विविध बेंचमार्क पर बेहतर प्रदर्शन और दक्षता प्राप्त होती है।

Yichuan Wang, Zhifei Li, Zirui Wang, Paul Teiletche, Lesheng Jin, Matei Zaharia, Joseph E. Gonzalez, Sewon Min2026-06-30
💬 NLP

Auditing LLM-Governed Social Robots with Culture-Specific Moral Gradients

यह शोध पत्र कई संस्कृतियों में LLM-शासित सामाजिक रोबोटों का मूल्यांकन करने के लिए एक ग्रेडिएंट-आधारित ऑडिट फ्रेमवर्क प्रस्तुत करता है, जो यह प्रकट करता है कि वर्तमान मॉडल सांस्कृतिक नैतिक प्राथमिकताओं को ट्रैक करने में महत्वपूर्ण, विषम विफलताओं को प्रदर्शित करते हैं जिन्हें केवल प्रॉम्प्टिंग के माध्यम से विश्वसनीय रूप से ठीक नहीं किया जा सकता है, जिससे बहुभाषी पूर्व-तैनाती ऑडिट और मॉडल-स्तरीय हस्तक्षेपों की आवश्यकता होती है।

Carmen Ng, Gjergji Kasneci2026-06-30