📊 statistics

An Odd Estimator for Shapley Values

यह शोध पत्र OddSHAP प्रस्तुत करता है, जो एक नवीन Shapley मान अनुमानक (estimator) है जो सैद्धांतिक रूप से यह सिद्ध करके अत्याधुनिक सटीकता प्राप्त करता है कि युग्मित नमूनाकरण (paired sampling) सेट फलन के अप्रासंगिक सम घटकों (even components) को फ़िल्टर कर देता है, जिससे केवल विषम उपस्थान (odd subspace) पर कुशल बहुपद प्रतिगमन (polynomial regression) सक्षम हो जाता है।

Fabian Fumagalli, Landon Butler, Justin Singh Kang, Kannan Ramchandran, R. Teal Witter2026-06-01
🤖 AI

Plain Transformers are Surprisingly Powerful Link Predictors

यह शोध पत्र PENCIL को प्रस्तुत करता है, जो एक स्केलेबल और पैरामीटर-कुशल एनकोडर-ओनली प्लेन ट्रांसफॉर्मर है जो बिना किसी हस्तनिर्मित संरचनात्मक पूर्वग्रहों या नोड विशेषताओं पर निर्भर हुए, लिंक प्रेडिक्शन में जटिल ग्राफ न्यूरल नेटवर्क और ह्यूरिस्टिक-आधारित दृष्टिकोणों से बेहतर प्रदर्शन करने के लिए सैंपल्ड लोकल सबग्राफ्स पर अटेंशन का लाभ उठाता है।

Quang Truong, Yu Song, Donald Loveland, Mingxuan Ju, Tong Zhao, Neil Shah, Jiliang Tang2026-06-01
🤖 AI

Mixture of Concept Bottleneck Experts

यह शोध पत्र मिक्सचर ऑफ कॉन्सेप्ट बॉटलनेक एक्सपर्ट्स (M-CBE) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो व्याख्यात्मकता बनाए रखते हुए भविष्यवाणात्मक सटीकता और अनुकूलन क्षमता में सुधार करने के लिए विविध कार्यात्मक रूपों वाले कई विशेषज्ञों का उपयोग करके कॉन्सेप्ट बॉटलनेक मॉडल्स को उन्नत करता है।

Francesco De Santis, Gabriele Ciravegna, Giovanni De Felice, Arianna Casanova, Francesco Giannini, Michelangelo Diligent (…)2026-06-01
💬 NLP

Stop the Flip-Flop: Context-Preserving Verification for Fast Revocable Diffusion Decoding

यह शोध पत्र COVER को प्रस्तुत करता है, जो एक संदर्भ-संरक्षण सत्यापन विधि (context-preserving verification method) है जो कुशल, उच्च-गुणवत्ता वाले समानांतर टोकन जनरेशन को सक्षम करने के लिए KV कैश ओवरराइड और एक स्थिरता-जागरूक स्कोरिंग तंत्र का उपयोग करके फास्ट रिवोकेबल डिफ्यूजन डिकोडिंग में फ्लिप-फ्लॉप दोलनों (flip-flop oscillations) को समाप्त करती है।

Yanzheng Xiang, Lan Wei, Yizhen Yao, Qinglin Zhu, Hanqi Yan, Chen Jin, Philip Alexander Teare, Dandan Zhang, Lin Gui, Am (…)2026-06-01
💬 NLP

Pull Requests as a Training Signal for Repo-Level Code Editing

यह शोध पत्र Clean-PR को प्रस्तुत करता है, जो एक मिड-ट्रेनिंग प्रतिमान (paradigm) है जो पुनर्गठित (reconstructed) GitHub पुल रिक्वेस्ट के एक विशाल संग्रह का लाभ उठाता है ताकि मॉडल रिपॉजिटरी-स्तरीय कोड संपादन क्षमताओं को आत्मसात कर सकें, जो जटिल एजेंट स्कैफोल्डिंग पर निर्भर हुए बिना SWE-bench पर बेसलाइन से काफी बेहतर प्रदर्शन करता है।

Qinglin Zhu, Tianyu Chen, Shuai Lu, Lei Ji, Runcong Zhao, Murong Ma, Xiangxiang Dai, Yulan He, Lin Gui, Peng cheng, Yeyu (…)2026-06-01
🤖 AI

A Kinetic Energy Perspective of Flow Matching

यह शोध पत्र काइनेटिक पाथ एनर्जी (KPE) को एक भौतिकी-प्रेरित नैदानिक (diagnostic) के रूप में प्रस्तुत करता है जो फ्लो-आधारित जनरेटिव मॉडल्स में प्रक्षेपवक्र प्रयास (trajectory effort) को सिमेंटिक फिडेलिटी और डेटा स्पर्सिटी से जोड़ता है, जो एक गैर-एकदिष्ट (non-monotonic) संबंध को प्रकट करता है जहाँ अत्यधिक ऊर्जा मेमोराइजेशन का कारण बनती है, और बेहतर जनरेशन गुणवत्ता के लिए इस संतुलन को अनुकूलित करने हेतु एक ट्रेनिंग-फ्री इन्फरेंस रणनीति के रूप में काइनेटिक ट्रजेक्टरी शेपिंग (KTS) का प्रस्ताव करता है।

Ziyun Li, Huancheng Hu, Soon Hoe Lim, Xuyu Li, Fei Gao, Enmao Diao, Zezhen Ding, Michalis Vazirgiannis, Henrik Bostrom2026-06-01
🤖 AI

Inverting Data Transformations via Diffusion Sampling

यह शोधपत्र ट्रांसफॉर्मेशन-इनवर्टिंग एनर्जी डिफ्यूजन (TIED) को प्रस्तुत करता है, जो एक नवीन विधि है जो अज्ञात डेटा रूपांतरणों को संभाव्य रूप से उलटने के लिए ली ग्रुप्स (Lie groups) पर डिफ्यूजन प्रक्रियाओं और एक नए ट्रिवियलाइज्ड टारगेट-स्कोर आइडेंटिटी का लाभ उठाती है, जिससे इमेज होमोग्राफी और PDE सिमिट्रीज़ जैसे इनपुट विरूपणों के प्रति प्रीट्रेंड न्यूरल नेटवर्क्स की मजबूती बढ़ती है।

Jinwoo Kim, Sékou-Oumar Kaba, Jiyun Park, Seunghoon Hong, Siamak Ravanbakhsh2026-06-01
💬 NLP

A Behavioural and Representational Evaluation of Goal-Directedness in Language Model Agents

यह शोधपत्र एक ऐसे ढांचे का प्रस्ताव करता है जो भाषा मॉडल एजेंटों में लक्ष्य-निर्देशितता (goal-directedness) का मूल्यांकन करने के लिए व्यवहारिक परीक्षण को व्याख्यात्मक विश्लेषण (interpretability analysis) के साथ जोड़ता है, और ग्रिड-वर्ल्ड केस स्टडी के माध्यम से यह प्रदर्शित करता है कि जबकि एजेंट सुदृढ़ प्रदर्शन प्रदर्शित करते हैं, उनके स्थानिक मानचित्रों (spatial maps) और कार्य योजनाओं (action plans) के आंतरिक प्रतिनिधित्व तर्क प्रक्रिया के दौरान गैर-रेखीय पुनर्गठन (non-linear reorganization) से गुजरते हैं, जो केवल व्यवहारिक अवलोकन से परे आत्मनिरीक्षण संबंधी जांच की आवश्यकता को रेखांकित करता है।

Raghu Arghal, Fade Chen, Niall Dalton, Evgenii Kortukov, Calum McNamara, Angelos Nalmpantis, Moksh Nirvaan, Gabriele Sar (…)2026-06-01
💬 NLP

Weight Decay Improves Language Model Plasticity

यह शोध पत्र यह प्रदर्शित करता है कि बड़े भाषा मॉडलों के प्रीट्रेनिंग के दौरान वेट डिके (weight decay) बढ़ाने से उनकी डाउनस्ट्रीम प्लास्टिसिटी और फाइन-ट्यूनिंग प्रदर्शन में वृद्धि होती है, भले ही इसके परिणामस्वरूप प्रीट्रेनिंग वैलिडेशन लॉस अधिक हो जाए, क्योंकि यह रैखिक रूप से विभाज्य (linearly separable) निरूपणों को बढ़ावा देता है और अटेंशन मैकेनिज्म को नियमित (regularize) करता है।

Tessa Han, Sebastian Bordt, Hanlin Zhang, Sham Kakade2026-06-01