💬 NLP

A Two-Phase Stability Study of LLM Judges and Bar Council Examiners on Thai Bar-Exam Free-Form Essays

यह अध्ययन प्रकट करता है कि जहाँ स्पष्ट रूब्रिक्स वाले थाई बार-परीक्षा निबंधों पर एलएलएम (LLM) निर्णायक और मानव परीक्षक अभिसरित होते हैं, वहीं एलएलएम अस्पष्ट मामलों में अल्पसंख्यक मानव व्याख्या को पुनरुत्पादित करने में व्यवस्थित रूप से विफल रहते हैं, बल्कि इसके बजाय वे समान रूप से बहुमत मानव दृष्टिकोण के साथ संरेखित हो जाते हैं और इस प्रकार विशेषज्ञ असहमति के पूर्ण स्पेक्ट्रम को पकड़ने की अपनी अक्षमता को छिपा देते हैं।

Pawitsapak Akarajaradwong, Wuttikrai Lertprasertphakorn, Chompakorn Chaksangchaichot, Sarana Nutanong2026-05-26
🤖 AI

Posture Clip: Sit properly or I wont let you work

यह शोध पत्र PostureClip प्रस्तुत करता है, जो एक कॉलर-क्लिप किया जाने वाला उपकरण है जो उपयोगकर्ताओं के झुकने पर स्क्रीन को काला करके सही मुद्रा (पोश्चर) लागू करता है, और 165 प्रतिभागियों के साथ 4-सप्ताह के नियंत्रित अध्ययन के माध्यम से यह प्रदर्शित करता है कि इस उपकरण के माध्यम से वास्तविक समय में फीडबैक प्रदान करने से बिना फीडबैक या हस्तक्षेप वाले समूहों की तुलना में मुद्रा कोणों में काफी सुधार होता है और झुके हुए कोणों की अवधि कम होती है।

Arka Majhi, Aparajita Mondal2026-05-26
💻 computer science

The Illusion of Competence: Self-Perceived Digital Literacy and AI Readiness Among European Secondary Students

243 यूरोपीय माध्यमिक छात्रों के इस अध्ययन से एक महत्वपूर्ण "आत्मविश्वास-क्षमता अंतराल" (Confidence-Competence Divide) का पता चलता है जहाँ उच्च आत्म-कथित डिजिटल साक्षरता वास्तविक तकनीकी और एआई कौशल की कमी को छिपाती है, एक ऐसा अंतर जिसे STEM कक्षाओं में रूढ़िवादी खतरों और गलत सूचना के प्रति असुरक्षा की झूठी भावना द्वारा और भी बढ़ा दिया गया है, जो अंततः निष्क्रिय सिद्धांत से सक्रिय, व्यावहारिक तकनीकी शिक्षा की ओर बदलाव का आह्वान करता है।

Nicolas Rodriguez-Alvarez (Instituto de Educacion Secundaria Parquesol), Alan Martin Blanch-Marsolini (Instituto de Educ (…)2026-05-26
💬 NLP

GT-HarmBench: Benchmarking AI Safety Risks Through the Lens of Game Theory

यह शोध पत्र GT-HarmBench प्रस्तुत करता है, जो गेम थ्योरी संरचनाओं पर आधारित 1,535 उच्च-जोखिम वाले मल्टी-एजेंट परिदृश्यों का एक व्यापक बेंचमार्क है, जो यह प्रकट करता है कि अत्याधुनिक एआई मॉडल अक्सर सामाजिक रूप से लाभकारी परिणामों को चुनने में विफल रहते हैं और यह प्रदर्शित करता है कि गेम-थ्योरेटिक हस्तक्षेप इन जटिल वातावरणों में संरेखण (alignment) में महत्वपूर्ण सुधार कर सकते हैं।

Pepijn Cobben, Xuanqiang Angelo Huang, Thao Amelia Pham, Isabel Dahlgren, Terry Jingchen Zhang, Zhijing Jin2026-05-25
🤖 AI

Can the Recovery Mechanism Survive AI? Skill Formation, Labor, and What Current Measurement Misses

यह शोध पत्र तर्क देता है कि जबकि जनरेटिव एआई वर्तमान में मौजूदा श्रमिकों की क्षमता बढ़ा रहा है, यह अगली पीढ़ी के कौशल निर्माण के लिए आवश्यक "उत्पादक संघर्ष" (productive struggle) को क्षीण करके दीर्घकालिक आर्थिक सुधार तंत्र के लिए खतरा पैदा करता है—एक महत्वपूर्ण जोखिम जो वर्तमान मापन प्रणालियों द्वारा छिपा हुआ है जो बेहतर प्रदर्शन और वास्तविक सीखने के बीच अंतर करने में विफल रहती हैं।

Aysa Xuemo Fan2026-05-25
🔬 physics

The Cognitive Kardashev Scale: Quantifying the Material Envelope of Civilisational Computation

यह शोध पत्र एक "संज्ञानात्मक कार्दाशेव स्केल" (Cognitive Kardashev Scale) प्रस्तावित करता है जो ऊर्जा की उपलब्धता, आवंटन दक्षता और हार्डवेयर प्रदर्शन को एकीकृत करके एक सभ्यता की कम्प्यूटेशनल क्षमता को परिमाणित करता है ताकि यह अनुमान लगाया जा सके कि विभिन्न सभ्यतागत स्तर कितनी निरंतर एआई-ग्रेड सोच (AI-grade thinking) का समर्थन कर सकते हैं।

Sachin Sharma2026-05-25
🤖 AI

Whose Good, Whose Place? The Moral Geography of Agentic AI for Social Good

यह शोध पत्र सामाजिक भलाई के लिए एजेंटिक एआई (agentic AI) पर 112 अध्ययनों का विश्लेषण करता है ताकि एक महत्वपूर्ण "नैतिक-भौगोलिक विषमता" (moral-geographic asymmetry) को उजागर किया जा सके, जहाँ शोधकर्ता अक्सर भौगोलिक संदर्भ—विशेष रूप से SDG 16 जैसे संस्थागत लक्ष्यों के लिए—को छोड़ देते हैं और वास्तविक दुनिया के क्रियान्वयन की रिपोर्ट शायद ही कभी करते हैं, जिससे जवाबदेही के महत्वपूर्ण अंतराल स्पष्ट होते हैं और अधिक संदर्भ-विशिष्ट एवं सहभागी एआई प्रणालियों के लिए नए रिपोर्टिंग मानकों का प्रस्ताव मिलता है।

Poli Nemkova, Haeshitha Indukuri, Jaedon Charles2026-05-25
💻 computer science

Opportunities and Risks of Generative AI through the Health Information Journey

यह शोध पत्र एक चार-चरणीय ढांचे को प्रस्तुत करता है जो जनरेटिव एआई (generative AI) के दोहरे अवसरों और जोखिमों का विश्लेषण करता है, क्योंकि यह डिजिटल सामग्री से लेकर औपचारिक स्वास्थ्य सेवा तक की यात्रा के दौरान जनता के स्वास्थ्य संबंधी जानकारी से जुड़ने, उसे समझने और उस पर कार्य करने के तरीके को बदल रहा है।

Matthew R. DeVerna, Harry Yaojun Yan, Kai-Cheng Yang, Filippo Menczer2026-05-25
💬 NLP

A Comparative Evaluation of Structural Topic Models and BERTopic for Short, Open-Ended Survey Responses

यह शोध पत्र लघु, मुक्त-अंत वाले सर्वेक्षण प्रतिक्रियाओं का विश्लेषण करने के लिए स्ट्रक्चरल टॉपिक मॉडल्स (STM) और BERTopic की तुलना करता है, जिसमें यह पाया गया है कि जहाँ कॉन्टेक्स्टुअल ऑग्मेंटेशन के साथ BERTopic अधिक सुसंगत और व्याख्या योग्य विषय उत्पन्न करता है, वहीं STM इन्फेरेंशियल कोवेरिएट विश्लेषण के लिए श्रेष्ठ बना हुआ है, जो यह सुझाव देता है कि दोनों विधियाँ अनुप्रयुक्त सामाजिक विज्ञान अनुसंधान के लिए पूरक सामर्थ्य प्रदान करती हैं।

Yan Jiang, Sihong Liu, Philip A. Fisher2026-05-25
💬 NLP

A Fine-Tuned BERT Classifier for Personal-Letter Titles in Late-Ming and Early-Qing Collected Works

यह शोधपत्र लेप्टोन (Lepton) को प्रस्तुत करता है, जो कि तैंतीस उत्तर-मिंग और प्रारंभिक-किंग साहित्यकारों के 5,438 हस्त-लेबल वाले शीर्षकों पर प्रशिक्षित एक फाइन-ट्यून्ड बर्ट (BERT) क्लासिफायर है, जो व्यक्तिगत पत्रों को भ्रमित करने वाले प्रस्तावनाओं से सफलतापूर्वक अलग करता है और जिसे चाइना बायोग्राफिकल डेटाबेस के माध्यम से मिंग लेटर प्लेटफॉर्म के लिए लगभग 55,000 पत्रों की पहचान करने हेतु तैनात किया गया है।

Queenie Luo2026-05-25