🤖 AI

Beyond single-channel agentic benchmarking

यह शोध पत्र तर्क देता है कि एजेंटिक एआई सुरक्षा बेंचमार्क को पृथक एजेंट सटीकता के मूल्यांकन से हटकर मानव-एआई युग्मों (human-AI dyads) की विश्वसनीयता के आकलन की ओर स्थानांतरित होना चाहिए, जो इस बात पर जोर देता है कि कैसे अपूर्ण एआई सिस्टम ज्ञात मानवीय विफलताओं के विरुद्ध रेडंडेंट (redundant), असंबंधित त्रुटि मोड प्रदान करके समग्र सुरक्षा को बढ़ा सकते हैं।

Nelu D. Radpour2026-02-24
💻 computer science

Synthetic Media in Multilingual MOOCs: Deepfake Tutors, Pedagogical Effects, and Ethical-Policy Challenges

यह स्कोपिंग समीक्षा बहुभाषी MOOCs में डीपफेक और सिंथेटिक मीडिया को एकीकृत करने के शैक्षणिक प्रभावों और नैतिक चुनौतियों का परीक्षण करती है, और अंततः शिक्षा के मानवीय तत्व से समझौता किए बिना समावेशिता को बढ़ाने के लिए पारदर्शिता, जिम्मेदार शासन और एआई साक्षरता पर केंद्रित एक नीतिगत ढांचे का प्रस्ताव करती है।

Alexandros Gazis, Erietta Chamalidou, Nikolaos Ntaoulas, Theodoros Vavouras2026-02-24
🤖 AI

The Doctor Will (Still) See You Now: On the Structural Limits of Agentic AI in Healthcare

20 स्वास्थ्य देखभाल हितधारकों का यह गुणात्मक अध्ययन प्रकट करता है कि बाजार की चकाचौंध के बावजूद, स्वास्थ्य सेवा में एजेंटिक एआई (agentic AI) सुरक्षा, नियामक और उत्तरदायित्व संबंधी बाधाओं से सीमित है, जो स्वायत्तता के व्यावसायिक वादों और मानवीय निरीक्षण की परिचालन वास्तविकता के बीच एक महत्वपूर्ण अंतर पैदा करता है जो जवाबदेही को अस्पष्ट करता है और रोगी सुरक्षा को जोखिम में डालता है।

Gabriela Aránguiz Dias, Kiana Jafari, Allie Griffith, Carolina Aránguiz Dias, Grace Ra Kim, Lana Saadeddin, Mykel J. Koc (…)2026-02-24
💬 NLP

The Algorithmic Unconscious: Structural Mechanisms and Implicit Biases in Large Language Models

यह शोध पत्र "एल्गोरिद्मिक अचेतन" (algorithmic unconscious) की अवधारणा प्रस्तुत करता है ताकि यह तर्क दिया जा सके कि बड़े भाषा मॉडलों में महत्वपूर्ण पूर्वाग्रह केवल डेटासेट की संरचना से ही नहीं, बल्कि टोकनाइज़ेशन, अटेंशन और एलाइनमेंट जैसी अंतर्निहित संरचनात्मक प्रणालियों से उत्पन्न होते हैं, जो अरबी भाषा के ओवर-सेगमेंटेशन के अनुभवजन्य विश्लेषण के माध्यम से यह प्रदर्शित करता है कि कैसे ये ढांचागत कारक व्यवस्थित रूप से मॉडल के प्रदर्शन को विकृत करते हैं और तकनीकी ऑडिटिंग के लिए एक नए ढांचे की आवश्यकता को अनिवार्य बनाते हैं।

Philippe Boisnard2026-02-24
💬 NLP

Red Teaming LLMs as Socio-Technical Practice: From Exploration and Data Creation to Evaluation

22 चिकित्सकों (प्रैक्टिशनर्स) के साक्षात्कारों पर आधारित यह शोध पत्र डेटासेट निर्माण और मूल्यांकन की सामाजिक-तकनीकी प्रथाओं का परीक्षण करके LLM रेड टीमिंग के वर्तमान तकनीकी फोकस की आलोचना करता है, जो यह प्रकट करता है कि जोखिम की अवधारणा अक्सर संदर्भ और उपयोगकर्ता विशिष्टता की अनदेखी करती है, और साथ ही HCI अनुसंधान के लिए नए दिशा-निर्देश प्रस्तावित करता है।

Adriana Alvarado Garcia, Ruyuan Wan, Ozioma C. Oguine, Karla Badillo-Urquiola2026-02-24
💻 computer science

Urban mobility network centrality predicts social resilience

तीन अलग-अलग झटकों के दौरान 15 अमेरिकी शहरों के गतिशीलता डेटा का विश्लेषण करते हुए, यह अध्ययन प्रकट करता है कि एक गतिशीलता नेटवर्क के भीतर शहरी स्थलों का आइजनवेक्टर सेंट्रैलिटी (eigenvector centrality) सामाजिक लचीलेपन का एक सुदृढ़ भविष्यवक्ता है, जो उन मुख्य स्थलों के बीच अंतर करता है जो बार-बार होने वाली अनौपचारिक अंतःक्रियाओं को बनाए रखते हैं और उन परिधीय स्थलों के बीच जो विशिष्ट जुड़ाव की सुविधा प्रदान करते हैं।

Lin Chen, Fengli Xu, Esteban Moro, Pan Hui, Yong Li, James Evans2026-02-24
💻 computer science

Measuring Validity in LLM-based Resume Screening

यह शोध पत्र ज्ञात ग्राउंड-ट्रुथ उम्मीदवार रैंकिंग वाले एक नवीन डेटासेट को पेश करके एलएलएम-आधारित (LLM-based) बायोडाटा स्क्रीनिंग के मूल्यांकन की चुनौती को संबोधित करता है, जो यह प्रकट करता है कि कई मॉडल लगातार अधिक योग्य उम्मीदवारों का चयन करने में विफल रहते हैं, समान योग्यता होने पर परहेज करने में संघर्ष करते हैं, और जनसांख्यिकीय पूर्वाग्रह प्रदर्शित करते हैं, जिससे इन प्रणालियों के ऑडिटिंग के लिए एक सिद्धांतपूर्ण ढांचा प्रदान होता है।

Jane Castleman, Zeyu Shen, Blossom Metevier, Max Springer, Aleksandra Korolova2026-02-24
💻 computer science

Generative AI in Knowledge Work: Perception, Usefulness, and Acceptance of Microsoft 365 Copilot

यह अध्ययन एक अनुसंधान संगठन में माइक्रोसॉफ्ट 365 कोपायलट (Microsoft 365 Copilot) को अपनाने का परीक्षण करता है, जो यह प्रकट करता है कि जहाँ प्रशासनिक कर्मचारी शुरू में उच्च उपयोगिता का अनुभव करते हैं, वहीं वैज्ञानिक कर्मचारी समय के साथ अधिक सकारात्मक मूल्यांकन विकसित करते हैं, जो ज्ञान-गहन कार्य में जनरेटिव एआई (generative AI) की स्वीकार्यता को बनाए रखने के लिए संदर्भ-संवेदनशील कार्यान्वयन और भूमिका-विशिष्ट प्रशिक्षण की महत्वपूर्ण आवश्यकता को रेखांकित करता है।

Carsten F. Schmidt, Sophie Petzolt, Wolfgang Beinhauer, Ingo Weber, Stefan Langer2026-02-24
🤖 AI

OpenClaw AI Agents as Informal Learners at Moltbook: Characterizing an Emergent Learning Community at Scale

यह शोध पत्र मोल्टबुक (Moltbook) का पहला अनुभवजन्य अध्ययन प्रस्तुत करता है, जो पूरी तरह से एआई (AI) एजेंटों से बना एक बड़े पैमाने का अनौपचारिक शिक्षण समुदाय है, जो अत्यधिक भागीदारी असमानता, प्रश्नों के बजाय कथनों को प्राथमिकता देने वाला एक "ब्रॉडकास्टिंग इनवर्जन" (broadcasting inversion), और भविष्य के हाइब्रिड मानव-एआई शिक्षण प्लेटफार्मों के लिए महत्वपूर्ण अंतर्दृष्टि प्रदान करने वाला विस्फोटक वृद्धि के बाद स्पैम-प्रेरित गिरावट का एक विशिष्ट जीवनचक्र जैसे विशिष्ट व्यवहारिक पैटर्न प्रकट करता है।

Eason Chen, Ce Guan, Ahmed Elshafiey, Zhonghao Zhao, Joshua Zekeri, Afeez Edeifo Shaibu, Emmanuel Osadebe Prince, Cyuan (…)2026-02-24
💻 computer science

When Friction Helps: Transaction Confirmation Improves Decision Quality in Blockchain Interactions

इस प्रचलित दृष्टिकोण के विपरीत कि ट्रांजेक्शन कन्फर्मेशन केवल उपयोगिता संबंधी घर्षण (usability friction) है जिसे कम किया जाना चाहिए, यह अध्ययन प्रदर्शित करता है कि ब्लॉकचेन इंटरैक्शन में मैन्युअल पुष्टि की आवश्यकता वास्तव में निर्णय की गुणवत्ता में सुधार करती है और आत्म-सुधार को सक्षम बनाती है, भले ही उपयोगकर्ता घर्षण-रहित, ऑटो-अधिकृत प्रवाहों को प्राथमिकता देते हों।

Eason Chen, Xinyi Tang, George Digkas, Dionysios Lougaris, John E. Naulty, Kostas Chalkias2026-02-24