💻 computer science

AI Fact-Checking in the Wild: A Field Evaluation of LLM-Written Community Notes on X

यह शोध पत्र X के कम्युनिटी नोट्स पर तैनात एक LLM-आधारित तथ्य-जांच प्रणाली का पहला फील्ड मूल्यांकन प्रस्तुत करता है, जो तीन महीने के अध्ययन के माध्यम से यह प्रदर्शित करता है कि प्लेटफॉर्म की गतिशीलता को नियंत्रित करने पर, मानव-लिखित नोट्स की तुलना में AI-लिखित नोट्स उच्च हेल्पफुलनेस स्कोर और व्यापक क्रॉस-पार्टिसन सर्वसम्मति प्राप्त करते हैं।

Haiwen Li, Michiel A. Bakker2026-04-07
💻 computer science

Beyond the AI Tutor: Social Learning with LLM Agents

यह शोध पत्र दो नियंत्रित प्रयोग प्रस्तुत करता है जो यह प्रदर्शित करते हैं कि मल्टी-एजेंट एलएलएम (LLM) कॉन्फ़िगरेशन, जो विविध सहकर्मी और ट्यूटर इंटरैक्शन के माध्यम से सामाजिक शिक्षण का अनुकरण करते हैं, पारंपरिक वन-ऑन-वन एआई ट्यूटरिंग की तुलना में सीखने के परिणामों और विचारों की विविधता को महत्वपूर्ण रूप से बढ़ाते हैं।

Harsh Kumar (Jace), Zi Kang (Jace), Mu, Jonathan Vincentius, Ashton Anderson2026-04-07
💻 computer science

Evaluating Bounded Superintelligent Authority in Multi-Level Governance: A Framework for Governance Under Radical Capability Asymmetry

यह शोधपत्र एक छह-आयामी ढांचे का निर्माण करके शासन में संज्ञानात्मक तुलनीयता (cognitive comparability) की आधारभूत धारणा को चुनौती देता है, जो यह प्रकट करता है कि कैसे एक सीमित अति-बुद्धिमान सत्ता और शासितों के बीच चरम क्षमता विषमता वैधता, जवाबदेही, सुधारात्मकता (corrigibility) और गैर-प्रभुत्व में संरचनात्मक विफलताओं का कारण बनती है, और अंततः यह प्रदर्शित करता है कि मौजूदा संस्थागत संरचना बोधगम्यता की अपरिहार्यता और स्थायी प्रभुत्व के अनूठे मानदण्डिक संकटों को संबोधित करने के लिए अपर्याप्त है।

Tony Rost2026-04-07
💻 computer science

Prosocial Persuasion at Scale? Large Language Models Outperform Humans in Donation Appeals Across Levels of Personalization

दो पूर्व-पंजीकृत प्रयोगों से यह सिद्ध होता है कि बड़े भाषा मॉडल (लार्ज लैंग्वेज मॉडल्स) प्रेरक दान अपील उत्पन्न करने में मनुष्यों से बेहतर प्रदर्शन करते हैं, जिससे विभिन्न स्तरों के वैयक्तिकरण के बावजूद उच्च जुड़ाव और दान प्राप्त होता है।

John Caffier, Olga Stavrova, Bennett Kleinberg2026-04-07
🤖 AI

Position: Science of AI Evaluation Requires Item-level Benchmark Data

यह स्थिति पत्र (position paper) यह तर्क देता है कि एआई मूल्यांकन के एक कठोर विज्ञान को स्थापित करने के लिए प्रणालीगत वैधता विफलताओं को दूर करने हेतु आइटम-स्तरीय बेंचमार्क डेटा को अपनाना आवश्यक है, जो इस दावे का समर्थन करने के लिए अंतर-विषयक विश्लेषण और साक्ष्य-केंद्रित मूल्यांकन के लिए एक नए रिपॉजिटरी, ओपनइवल (OpenEval) का परिचय देता है।

Han Jiang, Susu Zhang, Xiaoyuan Yi, Xing Xie, Ziang Xiao2026-04-07
💻 computer science

The Algorithmic Blind Spot: Bias, Moral Status, and the Future of Robot Rights

यह शोध पत्र एआई नैतिकता में "एल्गोरिद्मिक ब्लाइंड स्पॉट" (एल्गोरिद्मिक अदृश्य बिंदु) की आलोचना करता है, और यह तर्क देता है कि भविष्य के रोबोट अधिकारों के काल्पनिक अनुमानों पर अत्यधिक ध्यान केंद्रित करना उन वास्तविक, अनुभवजन्य रूप से प्रलेखित नुकसानों और पूर्वाग्रहों को धुंधला करता है और उन्हें कमतर करता है जो वर्तमान में एल्गोरिद्मिक प्रणालियों द्वारा मानव आबादी पर थोपे जा रहे हैं।

Rahulrajan Karthikeyan, Moses Boudourides2026-04-07
🤖 AI

Is your AI Model Accurate Enough? The Difficult Choices Behind Rigorous AI Development and the EU AI Act

यह शोध पत्र एआई (AI) सटीकता को एक विशुद्ध रूप से वस्तुनिष्ठ मीट्रिक मानने की धारणा को चुनौती देता है, जिसमें इसे परिभाषित करने और मापने के लिए आवश्यक संदर्भ-निर्भर मानकीय विकल्पों का विश्लेषण करने हेतु यूरोपीय संघ एआई अधिनियम (EU AI Act) का उपयोग किया गया है, ताकि यह प्रदर्शित किया जा सके कि कैसे ये तकनीकी-मानकीय निर्णय जोखिम वितरण को आकार देते हैं और नियामकों एवं डेवलपर्स के लिए व्यावहारिक मार्गदर्शन प्रदान करते हैं।

Lucas G. Uberti-Bona Marin, Bram Rijsbosch, Kristof Meding, Gerasimos Spanakis, Gijs van Dijck, Konrad Kollnig2026-04-07
💻 computer science

From Pre-trained Models to Large Language Models: A Comprehensive Survey of AI-Driven Psychological Computing

यह सर्वेक्षण एआई-संचालित मनोवैज्ञानिक अनुसंधान के लिए एक नवीन कम्प्यूटेशनल वर्गीकरण प्रस्तुत करता है जो प्री-ट्रेंड मॉडल से लेकर लार्ज लैंग्वेज मॉडल के युग तक के 300 से अधिक कार्यों को चार मौलिक कार्य प्रकारों में व्यवस्थित करता है, जिससे पद्धतिगत विखंडन को दूर किया जा सके और अलग-थलग मनोवैज्ञानिक डोमेन में व्यवस्थित ज्ञान हस्तांतरण को सुगम बनाया जा सके।

Huiyao Chen, Ruimeng Liu, Yan Luo, Jiawen Zhang, Meishan Zhang, Baotian Hu, Min Zhang2026-04-07
💬 NLP

VIGIL: An Extensible System for Real-Time Detection and Mitigation of Cognitive Bias Triggers

यह शोध पत्र VIGIL को प्रस्तुत करता है, जो इन-सीटू (in-situ) विश्लेषण, प्रतिवर्ती (reversible) LLM-संचालित पुनर्गठन और गोपनीयता-लचीले अनुमान (privacy-flexible inference) जैसी विशेषताओं के माध्यम से ऑनलाइन सूचनाओं में संज्ञानात्मक पूर्वाग्रह ट्रिगर्स (cognitive bias triggers) का वास्तविक समय में पता लगाने और उन्हें कम करने के लिए डिज़ाइन किया गया पहला ओपन-सोर्स ब्राउज़र एक्सटेंशन है।

Bo Kang, Sander Noels, Tijl De Bie2026-04-07
💬 NLP

On the First Computer Science Research Paper in an Indian Language and the Future of Science in Indian Languages

यह शोधपत्र लेखक के पूर्णतः तेलुगु में लिखे गए पहले मौलिक कंप्यूटर विज्ञान अनुसंधान पत्र लिखने के अनुभव का विवरण देता है, जिसमें भाषाई और टाइपसेटिंग बाधाओं को दूर करने के लिए एक संस्कृत-आधारित तकनीकी शब्दावली और एक कस्टम XeLaTeX टेम्पलेट के निर्माण का विस्तृत विवरण दिया गया है, साथ ही सभी भारतीय भाषाओं में वैज्ञानिक लेखन को आगे बढ़ाने के लिए एक दृष्टिकोण प्रस्तावित किया गया है।

Siddhartha Visveswara Jayanti2026-04-07