🤖 AI

Mind the (DH) Gap! A Contrast in Risky Choices Between Reasoning and Conversational LLMs

यह अध्ययन तर्क करने वाले (reasoning) और संवादात्मक (conversational) लार्ज लैंग्वेज मॉडल्स के बीच जोखिम भरे निर्णय लेने की प्रक्रिया में एक महत्वपूर्ण विचलन को प्रकट करता है, जिसमें यह पाया गया है कि रीजनिंग मॉडल्स इष्टतम एजेंटों के समान तर्कसंगत और संदर्भ-असंवेदनशील व्यवहार प्रदर्शित करते हैं, जबकि संवादात्मक मॉडल्स मानव जैसे पूर्वाग्रह और स्पष्ट विवरणों एवं परिणाम इतिहास के बीच एक बड़ा अंतर प्रदर्शित करते हैं।

Luise Ge, Yongyan Zhang, Yevgeniy Vorobeychik2026-04-22
🤖 AI

Beyond the 'Diff': Addressing Agentic Entropy in Agentic Software Development

यह शोध पत्र एक प्रक्रिया-उन्मुख व्याख्यात्मकता ढांचे (explainability framework) को प्रस्तुत करता है जिसे "एजेंटिक एंट्रॉपी" (agentic entropy)—स्वायत्त कोडिंग एजेंटों के कार्यों और वास्तुशिल्प इरादे (architectural intent) के बीच प्रणालीगत विचलन—को कम करने के लिए डिज़ाइन किया गया है, जो ले (lay) और पेशेवर दोनों प्रकार के डेवलपर्स के लिए प्रभावी मानव निरीक्षण सुनिश्चित करने हेतु अनुरूपता सीडिंग (conformity seeding), तर्क निगरानी (reasoning monitoring) और कारण ग्राफ इंटरफेस (causal graph interfaces) के माध्यम से इरादा-स्तरीय टेलीमेट्री प्रदान करता है।

Matteo Casserini, Alessandro Facchini, Andrea Ferrario2026-04-22
🤖 AI

Geometry-Aware CLIP Retrieval via Local Cross-Modal Alignment and Steering

यह शोध पत्र एक ज्यामिति-जागरूक (geometry-aware) CLIP रिट्रीवल फ्रेमवर्क प्रस्तावित करता है जो क्वेरी-कंडीशन्ड लोकल स्टीयरिंग और हंगेरियन मैचिंग के माध्यम से पड़ोस-स्तर के पुन: रैंकिंग द्वारा स्थानीय ज्यामितीय विसंगतियों को संबोधित करके एट्रिब्यूट-बाइंडिंग और कंपोजिशनल कार्यों पर प्रदर्शन को बढ़ाता है, जो कि बिना पुन: प्रशिक्षण के केवल अनुमान (inference) समय पर ही संभव है।

Nirmalendu Prakash, Narmeen Fatimah Oozeer, Xin Su, Phillip Howard, Shaan Shah, Zoe Wanying He, Shuang Wu, Shivam Raval (…)2026-04-22
🤖 AI

Machine individuality: Separating genuine idiosyncrasy from response bias in large language models

यह अध्ययन व्यापक मनोवैज्ञानिक भाषाई डेटा पर क्रॉस रैंडम-इफेक्ट्स मॉडल लागू करता है ताकि यह प्रदर्शित किया जा सके कि बड़े भाषा मॉडल स्थिर, उद्दीपन-विशिष्ट व्यवहार संबंधी अंतर प्रदर्शित करते हैं जिन्हें "मशीन व्यक्तित्व" (machine individuality) कहा जाता है, जो वैश्विक प्रतिक्रिया पूर्वाग्रहों और स्टोकेस्टिक शोर से भिन्न हैं।

Valentin Kriegmair, Dirk U. Wulff2026-04-22
🤖 AI

Agentic Forecasting using Sequential Bayesian Updating of Linguistic Beliefs

यह शोध पत्र BLF (बायेसियन लिंग्विस्टिक फोरकास्टर) को प्रस्तुत करता है, जो एक एजेंटिक सिस्टम है जो अर्ध-संरचित भाषाई विश्वास अवस्था (सेमी-स्ट्रक्चर्ड लिंग्विस्टिक बिलीफ स्टेट), पदानुक्रमित बहु-परीक्षण एकत्रीकरण (हायरार्किकल मल्टी-ट्रायल एग्रीगेशन), और अग्रणी सार्वजनिक पूर्वानुमान विधियों को पछाड़ने के लिए पदानुक्रमित अंशांकन (हायरार्किकल कैलिब्रेशन) का उपयोग करके ForecastBench बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त करता है।

Kevin Murphy2026-04-22
💻 computer science

Who Shapes Brazil's Vaccine Debate? Semi-Supervised Modeling of Stance and Polarization in YouTube's Media Ecosystem

यह अध्ययन एक अर्ध-पर्यवेक्षित ढांचे (semi-supervised framework) का उपयोग करते हुए यूट्यूब पर ब्राजील के वैक्सीन संबंधी विमर्श का सबसे बड़ा अनुदैर्ध्य विश्लेषण प्रस्तुत करता है, जो 1.4 मिलियन टिप्पणियों को वर्गीकृत करता है और यह प्रकट करता है कि कैसे संकट के दौरान ध्रुवीकरण में उछाल आता है जबकि महामारी के बाद के युग में यह खंडित हो जाता है, जिसमें विज्ञान संचारक और डिजिटल-नेटिव आउटलेट समर्थनात्मक और विरोधी दोनों प्रकार की सहभागिता के प्रमुख चालक के रूप में उभरते हैं।

Geovana S. de Oliveira, Ana P. C. Silva, Fabricio Murai, Carlos H. G. Ferreira2026-04-22
🤖 machine learning

Compile to Compress: Boosting Formal Theorem Provers by Compiler Outputs

यह शोध पत्र "कंपाइल टू कंप्रेस" (Compile to Compress) पेश करता है, जो एक लर्निंग-टू-रिफाइन फ्रेमवर्क है जो कुशल, वेरीफायर-गाइडेड ट्री सर्च को सक्षम करने के लिए कंपाइलर-जनरेटेड फेलियर मोड्स के संक्षिप्त सेट का लाभ उठाता है, जिससे मौजूदा लार्ज लैंग्वेज मॉडल प्रूवर्स की तुलना में काफी कम टेस्ट-टाइम कंप्यूट के साथ पुटनम बेंच (PutnamBench) पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Guchan Li, Rui Tian, Hongning Wang2026-04-22
💻 computer science

CentaurTA Studio: A Self-Improving Human-Agent Collaboration System for Thematic Analysis

सेंटौरटीए (CentaurTA) स्टूडियो एक स्व-सुधार करने वाला, वेब-आधारित मानव-एजेंट सहयोग तंत्र है जो कई डोमेन में उच्च-सटीक, स्केलेबल और नियंत्रणीय विषयगत विश्लेषण प्राप्त करने के लिए एक दो-चरणीय फीडबैक पाइपलाइन, निरंतर प्रॉम्प्ट अनुकूलन और रूब्रिक-आधारित मूल्यांकन को एकीकृत करता है।

Lei Wang, Min Huang, Eduard Dragut2026-04-22
💬 NLP

Two-dimensional early exit optimisation of LLM inference

यह शोध पत्र एक मॉडल-अज्ञेय (model-agnostic) द्वि-आयामी अर्ली एग्जिट (early exit) रणनीति प्रस्तुत करता है जो वर्गीकरण कार्यों के लिए एलएलएम (LLM) इन्फरेंस में गुणात्मक कम्प्यूटेशनल बचत और महत्वपूर्ण गति वृद्धि प्राप्त करने के लिए लेयर-वार और सेंटेंस-वार प्रोसेसिंग को समन्वित करती है, विशेष रूप से तब जब इनपुट संरचनाओं के माध्यम से सिमेंटिक जानकारी पूर्वानुमानित रूप से संचित होती है।

Jan Hůla, David Adamczyk, Tomáš Filip, Martin Pavlíček, Petr Sosík2026-04-22
💻 computer science

SpikeMLLM: Spike-based Multimodal Large Language Models via Modality-Specific Temporal Scales and Temporal Compression

SpikeMLLM एक स्पाइक-आधारित फ्रेमवर्क के रूप में मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स (Multimodal Large Models) को पेश करता है जो मोडैलिटी-विशिष्ट टेम्पोरल स्केल्स (Modality-Specific Temporal Scales) और टेम्पोरल कम्प्रेशन (Temporal Compression) का लाभ उठाकर काफी कम कम्प्यूटेशनल ओवरहेड के साथ लगभग लॉसलेस प्रदर्शन प्राप्त करता है, जिसे बेंचमार्क परिणामों और एक कस्टम RTL एक्सेलेरेटर द्वारा प्रमाणित किया गया है जो बेहतर थ्रूपुट और पावर दक्षता प्रदर्शित करता है।

Han Xu, Zhiyong Qin, Di Shang, Jiahong Zhang, Xuerui Qiu, Bo Lei, Tiejun Huang, Bo Xu, Guoqi Li2026-04-22