💬 NLP

Digital Pantheon: Simulating and Auditing Coalition Formation with LLM Agents

यह शोध पत्र एक बहु-एजेंट ढांचे को प्रस्तुत करता है जो वैचारिक निष्ठा के साथ पक्षपाती राजनीतिक गठबंधन वार्ताओं को सिम्युलेट करने के लिए फाइन-ट्यूनिंग, प्रेफरेंस ऑप्टिमाइज़ेशन और रिट्रीवल-ऑगमेंटेड जनरेशन को जोड़ता है, जिसमें यह मान्य करने के लिए एक नवीन वंश-अनुक्रमण (लीनिएज ट्रेसिंग) प्रणाली पेश की गई है कि घोषणापत्र-आधारित सामग्री वास्तविक दुनिया के समझौते के परिणामों की कैसे भविष्यवाणी करती है।

Dylan Van Mulders, Matthias Bogaert, Dirk Van den Poel2026-07-17
🤖 AI

The Industrialization of Research ; On AI-Driven Science and Its Consequences

यह निबंध तर्क देता है कि एआई-संचालित अनुसंधान की ओर बदलाव विज्ञान के एक "औद्योगिकीकरण" का प्रतिनिधित्व करता है, जो कि आशाजनक होने के साथ-साथ, इसकी क्षमता के जिम्मेदार उपयोग को सुनिश्चित करने के लिए सात महत्वपूर्ण चुनौतियों—मानवीय विशेषज्ञता के क्षरण, सिद्धांतों की अपारदर्शिता और प्रणालीगत पूर्वाग्रहों सहित—को संबोधित करने की आवश्यकता पर बल देता है।

Emmanuel Jeannot2026-07-17
💬 NLP

MedFailBench: A Clinician-Built Open-Source Benchmark for Medical AI Safety Boundary Inspection

MedFailBench एक ओपन-सोर्स, क्लिनिशियन-निर्मित बेंचमार्क है जो चिकित्सा एआई मूल्यांकन के केंद्र को उत्तर की सटीकता से हटाकर विशिष्ट सुरक्षा सीमा विफलताओं (सेफ्टी बाउंड्री फेलियर्स) की पहचान करने पर केंद्रित करता है, जिसके लिए यह मॉडल त्रुटियों के विश्लेषण हेतु एक गंभीरता-एनोटेटेड विफलता एटलस और वर्गीकरण (टैक्सोनॉमी) प्रदान करता है।

Goktug Ozkan2026-07-17
💬 NLP

T^2MLR: Transformer with Temporal Middle-Layer Recurrence

यह शोधपत्र T^2MLR प्रस्तुत करता है, जो एक ट्रांसफॉर्मर आर्किटेक्चर है जो पिछले टोकन के कैश किए गए मध्य-परत (middle-layer) निरूपणों को वर्तमान टोकन की प्रारंभिक परतों में संलयित (fuse) करके लेटेंट रीजनिंग (latent reasoning) को बढ़ाता है, जो एक लक्षित दृष्टिकोण है जो मानक बेसलाइन और पूर्ण-परत पुनरावृत्ति (full-layer recurrence) से बेहतर प्रदर्शन करता है और मौजूदा प्रीट्रेन्ड मॉडलों के कुशल रेट्रोफिटिंग की अनुमति देता है।

Ziyang Cai, Xingyu Zhu, Yihe Dong, Yinghui He, Sanjeev Arora2026-07-17
🤖 AI

Plover: Steering GUI Agents through Plan-Centric Interaction

Plover एक प्लान-केंद्रित विज़न-आधारित GUI ऑटोमेशन सिस्टम है जो कार्य योजनाओं (task plans) को संपादन योग्य आर्टिफैक्ट्स के रूप में बाहरीकृत करके पारदर्शिता और नियंत्रण क्षमता को बढ़ाता है, जिससे उपयोगकर्ता निष्पादन के दौरान एजेंट के व्यवहार का निरीक्षण, पर्यवेक्षण और स्थानीय सुधार करने में सक्षम होते हैं।

Madhumitha Venkatesan, Shicheng Wen, Jiajing Guo, Jorge Piazentin Ono, Liu Ren, Dongyu Liu2026-07-17
📊 statistics

Subjective Risk Decomposition: A New View for Uncertainty Quantification

यह शोध पत्र अनिश्चितता परिमाणीकरण (uncertainty quantification) के लिए एक नवीन ढांचे का प्रस्ताव करता है जहाँ एपिस्टेमिक (epistemic) और एलियटोरिक (aleatoric) अनिश्चितता मापों को एक स्ट्रिक्टली प्रॉपर लॉस (strictly proper loss) पर आधारित व्यक्तिपरक जोखिम के अपघटन के परिणाम के रूप में व्युत्पन्न किया गया है, जिससे मौजूदा मेट्रिक्स का एकीकरण होता है और यूक्यू (UQ) के लिए एक लर्निंग-थ्योरेटिक दृष्टिकोण की नींव स्थापित होती है।

Raghad Alamri, Michele Caprio, Gavin Brown2026-07-17
💬 NLP

Mask-Aware Policy Gradients for Diffusion Language Models

यह शोध पत्र मास्क-अवेयर पॉलिसी ग्रेडिएंट्स (Mask-Aware Policy Gradients) का परिचय देता है, जो एक सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो मास्क किए गए डिफ्यूजन लैंग्वेज मॉडल जनरेशन को टोकन चयन और स्थिति मास्किंग को संयुक्त रूप से अनुकूलित करने के लिए एक दो-चरणीय निर्णय प्रक्रिया के रूप में औपचारिक रूप देता है, जिससे लॉग-लाइक्लीहुड (log-likelihood) की जटिलता को दूर किया जा सकता है और गणितीय तर्क एवं कोडिंग बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त किया जा सकता है।

Haran Raajesh, Kulin Shah, Adam Klivans, Philipp Krähenbühl2026-07-17
🤖 AI

Symbal: Detecting Systematic Misalignments in Model-Generated Captions

यह शोधपत्र Symbal को प्रस्तुत करता है, जो फाउंडेशन मॉडल्स का उपयोग करने वाली एक द्वि-चरणीय विधि है जिसका उपयोग छवियों और MLLM-जनित कैप्शन के बीच व्यवस्थित विसंगतियों का पता लगाने और उनका सारांश प्रस्तुत करने के लिए किया जाता है, साथ ही SymbalBench को भी प्रस्तुत करता है, जो एक बड़े पैमाने का बेंचमार्क है जो अंतर्निहित मॉडल्स तक पहुँच की आवश्यकता के बिना इमेज-टेक्स्ट डेटासेट के ऑडिट करने में Symbal के उत्कृष्ट प्रदर्शन को प्रदर्शित करता है।

Maya Varma, Jean-Benoit Delbrouck, Sophie Ostmeier, Akshay Chaudhari, Curtis Langlotz2026-07-17
💬 NLP

In-Place Tokenizer Expansion for Pre-trained LLMs

यह शोध पत्र एक इन-प्लेस टोकेनाइज़र एक्सपेंशन विधि प्रस्तुत करता है जो एक बहुभाषी कॉर्पस पर BPE मर्ज को जारी रखकर और सब-टोकेन एवरेजिंग के माध्यम से नए एम्बेडिंग्स को इनिशियलाइज़ करके प्री-ट्रेंड LLMs को अपग्रेड करती है, जिससे मॉडल की गुणवत्ता से समझौता किए बिना हिंदी और वियतनामी जैसी भाषाओं के लिए टोकन काउंट को काफी कम किया जाता है और डिकोड गति में सुधार किया जाता है।

Jimmy T. H. Smith, Tarek Dakhran, Alberto Cabrera, Simon S. Lee, Paul Pak, Aditya Tadimeti, Tim Seyde, Maxime Labonne, A (…)2026-07-17
🤖 AI

SearchOS-V1: Towards Robust Open-Domain Information-Seeking Agent Collaboration

यह शोध पत्र SearchOS को प्रस्तुत करता है, जो एक सुदृढ़ मल्टी-एजेंट फ्रेमवर्क है जो सर्च-ओरिएंटेड कॉन्टेक्स्ट मैनेजमेंट के माध्यम से कार्य की प्रगति को एक साझा स्थिति (shared state) में बाहरी रूप से प्रस्तुत करके, दक्षता को अधिकतम करने के लिए पाइपलाइन-पैरेलल शेड्यूलिंग का उपयोग करके, और दोहराव वाले सर्च लूप्स को रोकने तथा साक्ष्य कवरेज में सुधार करने के लिए पदानुक्रमित कौशल (hierarchical skills) के साथ एक मिडलवेयर हार्नेस का उपयोग करके ओपन-डोमेन सूचना अन्वेषण को बढ़ाता है।

Yuyao Zhang, Junjie Gao, Zhengxian Wu, Jiaming Fan, Jin Zhang, Shihan Ma, Yao Yao, Weiran Qi, Chuyan Jin, Guiyu Ma, Xing (…)2026-07-17