📈 economics

Strategic Behavior of Large Language Models: Game Structure vs. Contextual Framing

यह शोध पत्र चार गेम थ्योरी परिदृश्यों में GPT-3.5, GPT-4 और LLaMa-2 की रणनीतिक निर्णय लेने की क्षमताओं का मूल्यांकन करता है, जिससे यह पता चलता है कि जहाँ GPT-3.5 संदर्भ संबंधी फ्रेमिंग के प्रति अत्यधिक संवेदनशील है लेकिन इसमें अमूर्त तर्क का अभाव है, वहीं GPT-4 और LLaMa-2 दोनों गेम संरचनाओं के अनुकूल होते हैं, जिसमें LLaMa-2 अंतर्निहित तंत्र की बेहतर समझ प्रदर्शित करता है, जिससे मॉडलों की विविध दक्षता और जटिल रणनीतिक कार्यों में उनकी वर्तमान सीमाओं पर प्रकाश पड़ता है।

Nunzio Lorè, Babak Heydari2026-07-15
💬 NLP

Stars, Stripes, and Silicon: Unravelling the ChatGPT's All-American, Monochrome, Cis-centric Bias

यह शोध पत्र तर्क देता है कि चैटजीपीटी (ChatGPT) जैसे बड़े भाषा मॉडलों का पूर्वाग्रह, विषाक्तता और अविश्वसनीयता मुख्य रूप से मॉडल आर्किटेक्चर के बजाय गैर-विविध प्रशिक्षण डेटा से उत्पन्न होती है, जिसके लिए सामाजिक नुकसान को कम करने और न्यायसंगत एआई (AI) तैनाती सुनिश्चित करने हेतु अंतर-विषयक सहयोग और सुदृढ़ शासन ढांचे की आवश्यकता है।

Federico Torrielli2026-07-15
💬 NLP

Toward Metaphor-Fluid Conversation Design for Voice User Interfaces

यह शोध पत्र वॉइस यूजर इंटरफेस के लिए एक "मेटाफर-फ्लुइड डिज़ाइन" (रूपक-प्रवाहपूर्ण डिज़ाइन) दृष्टिकोण का प्रस्ताव करता है और उसे प्रमाणित करता है जो विशिष्ट संवादात्मक संदर्भों के अनुसार रूपक संबंधी प्रस्तुतियों को गतिशील रूप से अनुकूलित करता है, और यह प्रदर्शित करता है कि इस प्रकार की तरलता स्थिर, एक-समान डिज़ाइनों की तुलना में उपयोगकर्ता द्वारा अपनाए जाने, आनंद और पसंद के स्तर को महत्वपूर्ण रूप से बढ़ाती है।

Smit Desai, Jessie Chin, Dakuo Wang, Benjamin Cowan, Michael Twidale2026-07-15
💻 computer science

So Many Opinions, So Many LLMs: Comparing Large Language Models to Traditional Machine Learning for Open- Ended Survey Analysis

यह अध्ययन खुले-अंत वाले सर्वेक्षण प्रतिक्रियाओं के विश्लेषण के लिए बड़े भाषा मॉडलों (LLMs) की पारंपरिक मशीन लर्निंग से तुलना करता है, जिसमें यह पाया गया है कि जहाँ LLMs जटिल विषयों और भावनाओं को समझने में बेहतर वर्गीकरण सटीकता प्राप्त करते हैं, वहीं वे अपने तर्क में निरंतरता और व्याख्यात्मकता के संबंध में महत्वपूर्ण समझौते प्रस्तुत करते हैं।

Abdullah Akinde, Mariam Akinde, Rasheedat Emiola, Ahmed Akinsola2026-07-15
💻 computer science

A Threshold Exceedance Framework for CBRN Uplift Evaluation in Frontier Language Models

यह शोध पत्र यह मूल्यांकन करने के लिए एक मानकीकृत थ्रेशोल्ड एक्सीडेंस क्राइटेरिया (TEC) ढांचे को प्रस्तुत करता है कि क्या सीमांत भाषा मॉडल उच्च-परिणाम वाले CBRN हमलों की योजना बनाने में गैर-विशेषज्ञ क्षमताओं को भौतिक रूप से बढ़ाते हैं, और इसे एक बड़े पैमाने के अध्ययन पर लागू करता है जो यह प्रकट करता है कि हालांकि मॉडल-सहायता प्राप्त योजनाएं विशेषज्ञ निर्देशात्मक स्तर तक पहुंच सकती हैं, पुष्टि किया गया भौतिक उत्थान वर्तमान में रेडियोलॉजिकल डोमेन तक सीमित है।

Rahul Gupta, Abhinav Mohanty, Payal Motwani, Venkatesh Saligrama, Satyapriya Krishna, Connor Harris, Gary Anthony Ackerm (…)2026-07-15
💻 computer science

A Semi-Automated System for Generating Dialogue-Based TTS Lessons Using Large Language Models: An Exploratory Study of Educational Potential

यह अन्वेषणात्मक अध्ययन प्रदर्शित करता है कि विशेषज्ञ-नौसिखिया संवाद-आधारित टेक्स्ट-टू-स्पीच पाठ उत्पन्न करने के लिए लार्ज लैंग्वेज मॉडल्स का उपयोग करने वाली एक अर्ध-स्वचालित प्रणाली, एकल-वक्ता टीटीएसटी (TTS) की तुलना में छात्र समझ और संज्ञानात्मक जुड़ाव को महत्वपूर्ण रूप से बढ़ाती है, जो ऑडियो स्वाभाविकता में समझौते के बावजूद पारंपरिक प्रशिक्षक स्वर के एक व्यवहार्य, शिक्षक-संवर्धित विकल्प के रूप में कार्य करती है।

Gendo Kumoi, Fumie Watanabe, Tota Suko, Takashi Ishida, Yuko Kuma, Manabu Kobayashi, Shigeichi Hirasawa2026-07-15
💬 NLP

Evaluating Health Misinformation in Low-Resource Languages: Integrating Small Language Models with a Culturally-Sensitive Responsible NLP Framework (Bangla as a Case Study)

यह शोध पत्र एक सांस्कृतिक रूप से संवेदनशील 'रिस्पॉन्सिबल एनएलपी' (Responsible NLP) ढांचे का प्रस्ताव देकर कम-संसाधन वाली भाषाओं में स्वास्थ्य संबंधी गलत सूचनाओं की चुनौती को संबोधित करता है और यह प्रदर्शित करता है कि 'Phi-4 स्मॉल लैंग्वेज मॉडल' बांग्ला में दावे निष्कर्षण (claim extraction) के लिए परिशुद्धता (precision) और रिकॉल (recall) का एक इष्टतम संतुलन प्रदान करता है, जो संसाधन-गहन लार्ज लैंग्वेज मॉडल्स से बेहतर प्रदर्शन करता है।

Farnaz Farid, Raihan Alam, Al Al-Areqi, Farhad Ahamed, Muhammad Hassan Khan, Sadia Hossain, Irena Veljanova, Anika Tabas (…)2026-07-15
💻 computer science

How Agentic Is Agentic Commerce? A Population-Scale Measurement of x402 Adoption and Authenticity

यह शोध पत्र प्रकट करता है कि करोड़ों की संख्या में x402 सेटलमेंट्स, जिन्हें अक्सर एक फलते-फूलते एआई एजेंट अर्थव्यवस्था के प्रमाण के रूप में उद्धृत किया जाता है, काफी हद तक निर्मित और काल्पनिक हैं, जिनमें विशाल बहुमत वास्तविक, स्वतंत्र एजेंट-टू-एजेंट वाणिज्य के बजाय आंतरिक या प्रायोजक-संचालित लेनदेन का प्रतिनिधित्व करता है।

Shengchen Ling, Yajin Zhou, Lei Wu, Cong Wang2026-07-15
🤖 machine learning

Evidence-Grounded Verified Agentic Reasoning: A Path Toward Eliminating LLM Hallucination in Empirical Inference via Tool-Attested Kernel Proofs

यह शोधपत्र EG-VAR प्रस्तुत करता है, जो एक Lean 4-आधारित एजेंटिक रीजनिंग आर्किटेक्चर है जो यह सुनिश्चित करके अनुभवजन्य अनुमान (empirical inference) में LLM मतिभ्रम (hallucinations) को समाप्त करता है कि सभी सत्यापित आउटपुट प्रमाणित टूल कॉल्स और कर्नेल-चेक्ड प्रमाणों से संरचनात्मक रूप से व्युत्पन्न हैं, जबकि किसी भी असमर्थित दावे का स्पष्ट रूप से ऑडिट करता है या उससे परहेज करता है।

Junyu Ren2026-07-15
💻 computer science

Practical Judgment, Virtue, and Intuition in the Use of Opaque AI-Enabled Systems

यह शोध पत्र यह तर्क देता है कि अपारदर्शी, स्वायत्त एआई प्रणालियों से जुड़ी नैतिक और कानूनी चिंताओं को व्यावहारिक निर्णय, सद्गुण और अंतर्ज्ञान जैसी गैर-मापन योग्य मानवीय क्षमताओं को प्राथमिकता देकर प्रभावी ढंग से कम किया जा सकता है, जिसमें सैन्य क्षेत्र का प्राथमिक उदाहरण के रूप में उपयोग करते हुए यह प्रदर्शित किया गया है कि कैसे ये गुण तकनीकी अपारदर्शिता और सामाजिक मानदंडों के बीच के अंतर को पाटते हैं।

Nathan G. Wood, Andrew P. Rebera2026-07-15