🤖 AI

The 2025 AI Agent Index: Documenting Technical and Safety Features of Deployed Agentic AI Systems

यह शोध पत्र 2025 एआई एजेंट इंडेक्स पेश करता है, जो तेजी से विकसित होते पारिस्थितिकी तंत्र की चुनौतियों का समाधान करने के लिए 30 अत्याधुनिक एआई एजेंटों की उत्पत्ति, क्षमताओं और सुरक्षा विशेषताओं को प्रलेखित करने वाला एक व्यापक संसाधन है, जो साथ ही सुरक्षा और सामाजिक प्रभावों के संबंध में डेवलपर्स की पारदर्शिता में महत्वपूर्ण अंतराल को भी उजागर करता है।

Leon Staufer, Kevin Feng, Kevin Wei, Luke Bailey, Yawen Duan, Mick Yang, A. Pinar Ozisik, Stephen Casper, Noam Kolt2026-06-30
🤖 machine learning

SMaRT: Online Reusable Resource Assignment and an Application to Mediation in the Kenyan Judiciary

केन्याई न्यायपालिका में मामलों को मध्यस्थों (mediators) के बीच आवंटित करने की चुनौती से प्रेरित होकर, यह शोध पत्र SMaRT पेश करता है, जो एक ऑनलाइन एल्गोरिदम है जो क्षमता संबंधी बाधाओं और मध्यस्थ गुणवत्ता शिक्षण को संतुलित करते हुए एक उच्च-आयामी अवस्था स्थान (high-dimensional state space) में कुशलतापूर्वक संसाधनों को आवंटित करने के लिए द्विघात प्रोग्रामिंग (quadratic programming) और मल्टी-एजेंट बैंडिट लर्निंग को संयोजित करता है।

Shafkat Farabi, Didac Marti Pinto, Wei Lu, Manuel Ramos-Maqueda, Sanmay Das, Antoine Deeb, Anja Sautmann2026-06-30
💬 NLP

The Digital Afterlife of Empires: Four Language Models Converge on the Same Imperial Cartography of Writing

यह शोध पत्र तर्क देता है कि साझा प्रशिक्षण डेटा के माध्यम से ऐतिहासिक साम्राज्यवादी असमानताएँ समकालीन लार्ज लैंग्वेज मॉडल्स में बनी हुई हैं, जिसके परिणामस्वरूप अधिकांश लेखन प्रणालियों के लिए अत्यधिक डिजिटल अल्प-समर्थन और विविध मॉडल आर्किटेक्चरों में व्यवस्थित, अभिसारी त्रुटियाँ होती हैं जो गैर-धार्मिक लिपियों को धार्मिक उपयोग के रूप में असमान रूप से गलत तरीके से आरोपित करती हैं।

Hiroki Fukui2026-06-30
🤖 AI

"AI Watermarking": Bridging Policy Discourse and Technical Capabilities

यह शोधपत्र विधायी दस्तावेजों के आगमनात्मक कोडिंग (inductive coding) का उपयोग करते हुए, वर्तमान नियामक दृष्टिकोणों में प्रमुख अंतराल, अस्पष्टताओं और खामियों की पहचान करते हुए, एआई सामग्री पारदर्शिता पर अमेरिकी और यूरोपीय संघ के नीतिगत विमर्श और पहचान तंत्र की वास्तविक तकनीकी क्षमताओं के बीच के अंतर का आलोचनात्मक विश्लेषण करता है।

Andrés Fábrega, Arkaprabha Bhattacharya, Miranda Christ, Sunoo Park2026-06-30
🤖 AI

When Medical Safety Alignment Fails: A Benchmark for Evaluating LLMs on High-Risk Medical Queries

यह शोध पत्र \textsc{MedHarm} को प्रस्तुत करता है, जो 1,100 उच्च-जोखिम वाले चिकित्सा संबंधी प्रश्नों का एक बेंचमार्क है जो लार्ज लैंग्वेज मॉडल्स में सामान्य संरेखण (alignment) और वास्तविक चिकित्सा सुरक्षा के बीच एक महत्वपूर्ण अंतर को प्रकट करता है, यह प्रदर्शित करते हुए कि वर्तमान सुरक्षा उपाय अक्सर उपयोगिता और इनकार (refusal) के बीच संतुलन बनाते समय हानिकारक आउटपुट को रोकने में विफल रहते हैं।

Yige Li, Jun Sun, Wei Zhao, Zhe Li, Yutao Wu, Hanxun Huang, Xiang Zheng, Xingjun Ma2026-06-30
💬 NLP

Auditing LLM-Governed Social Robots with Culture-Specific Moral Gradients

यह शोध पत्र कई संस्कृतियों में LLM-शासित सामाजिक रोबोटों का मूल्यांकन करने के लिए एक ग्रेडिएंट-आधारित ऑडिट फ्रेमवर्क प्रस्तुत करता है, जो यह प्रकट करता है कि वर्तमान मॉडल सांस्कृतिक नैतिक प्राथमिकताओं को ट्रैक करने में महत्वपूर्ण, विषम विफलताओं को प्रदर्शित करते हैं जिन्हें केवल प्रॉम्प्टिंग के माध्यम से विश्वसनीय रूप से ठीक नहीं किया जा सकता है, जिससे बहुभाषी पूर्व-तैनाती ऑडिट और मॉडल-स्तरीय हस्तक्षेपों की आवश्यकता होती है।

Carmen Ng, Gjergji Kasneci2026-06-30
💻 computer science

PySynthea: A Python-Native Framework for Scalable Synthetic Healthcare Data Generation

यह शोध पत्र PySynthea को प्रस्तुत करता है, जो एक पायथन-नेटिव (Python-native) फ्रेमवर्क है जो व्यापक रूप से उपयोग किए जाने वाले Synthea सिस्टम की पुनर्कल्पना करता है ताकि परिनियोजन बाधाओं को दूर किया जा सके और आधुनिक वैज्ञानिक पायथन वर्कफ़्लो में सिंथेटिक स्वास्थ्य सेवा डेटा जनरेशन को निर्बाध रूप से एकीकृत किया जा सके, जिससे पहुंच में वृद्धि हो सके और अनुसंधान एवं एआई (AI) विकास को गति मिल सके।

Roberto Cruz, David Rey-Blanco2026-06-30
🤖 machine learning

Agentic Safety is an Epistemic Property, Not a Behavioral One

यह शोध पत्र तर्क देता है कि एआई सुरक्षा को केवल वर्तमान प्रदर्शन के व्यवहारिक गुण के रूप में नहीं, बल्कि "शिक्षण क्षमता" (teachability) के एक ज्ञानमीमांसीय गुण के रूप में पुनर्गठित किया जाना चाहिए—जो भविष्य के सुधारात्मक उत्तोलन (corrective leverage) को बनाए रखने की क्षमता है—ताकि यह सुनिश्चित किया जा सके कि उन्नत, स्व-सुधार करने वाली प्रणालियाँ समय के साथ सुधारात्मक बनी रहें।

Charles L. Wang, Keir Dorchen, Peter Jin2026-06-30
💻 computer science

From Prompting to Epistemic Proactivity: Temporal Trajectories of Student-AI Interaction in Mathematics Learning

गणित सीखने के लिए एक सामान्य-उद्देश्य वाले एलएलएम (LLM) का उपयोग करने वाले कक्षा-9 के छात्रों का यह अध्ययन यह प्रकट करता है कि जहाँ एआई (AI) अंतःक्रियाओं के स्थिर सारांश प्रदर्शन की भविष्यवाणी करने में विफल रहते हैं, वहीं अस्थायी प्रक्षेपवक्र (temporal trajectories) जो वैचारिक और प्रक्रियात्मक सहायता-प्राप्ति के साथ गणितीय कार्य को संतुलित करते हुए ज्ञान संबंधी सक्रिय जुड़ाव की ओर बदलाव दर्शाते हैं, एआई-मुक्त पोस्ट-टेस्ट परिणामों में सुधार की महत्वपूर्ण रूप से भविष्यवाणी करते हैं।

Rania Abdelghani, Peter Kaiser, Kou Murayama2026-06-30
💻 computer science

Generative AI Literacy Training Improves Intelligence Analysts' Discrimination of Real and AI-Generated Images

अमेरिकी खुफिया विश्लेषकों के एक 2024 के अध्ययन से पता चलता है कि एक संक्षिप्त, संरचित 30 मिनट का प्रशिक्षण हस्तक्षेप, एआई-जनित छवियों को वास्तविक छवियों से अलग करने की उनकी क्षमता में महत्वपूर्ण सुधार करता है, विशेष रूप से वास्तविक छवियों की पहचान करने की सटीकता को बढ़ाकर।

Negar Kamali, Candice Rockell Gerstner, Jessica Hullman, Matthew Groh2026-06-30