💻 computer science

Bounded Context Management for Tabular Foundation Models on Stream Learning

यह शोध पत्र CURE को प्रस्तुत करता है, जो स्ट्रीम लर्निंग में टैबुलर फाउंडेशन मॉडल्स के लिए एक कॉन्टेक्स्ट मैनेजमेंट पॉलिसी है, जो एंट्रॉपी-गेटेड एडमिशन और रेडंडेंसी-अवेयर इविक्शन के माध्यम से रेडंडेंट उदाहरणों को हटाते हुए और हालिया एवं अनिश्चित उदाहरणों को संरक्षित करते हुए डिस्ट्रीब्यूशन शिफ्ट के तहत प्रेडिक्शन परफॉरमेंस को ऑप्टिमाइज़ करता है।

Jinmo Lee, Doyun Choi, Moongi Choi, Jaemin Yoo2026-06-19
💻 computer science

ForecastBench-Sim: A Simulated-World Forecasting Benchmark

यह शोधपत्र ForecastBench-Sim को प्रस्तुत करता है, जो Freeciv गेम सिमुलेशन पर आधारित एक नवीन पूर्वानुमान बेंचमार्क है, जो गतिशील वातावरण में संभाव्य तर्क (probabilistic reasoning) का अध्ययन करने के लिए तुरंत हल करने योग्य, नियंत्रित और विविध पूर्वानुमान कार्यों को सक्षम करके वास्तविक दुनिया की बाधाओं को दूर करता है।

Jaeho Lee, Nick Merrill, Ezra Karger2026-06-19
💻 computer science

Dual-Channel Grounded World Modeling (DCGWM): Structural Prevention of Objective Interference Collapse via Heterogeneous External Grounding with Inward-Only Gradient Flow

यह शोध पत्र ड्यूल-चैनल ग्राउंडेड वर्ल्ड मॉडलिंग (DCGWM) का प्रस्ताव करता है, जो एक नवीन आर्किटेक्चर है जो भौतिक और सामाजिक-व्यवहार संबंधी गतिकी को बिना किसी क्रॉस-सबस्पेस हस्तक्षेप के अलग-अलग ग्राउंड करने के लिए इनवर्ड-ओनली ग्रेडिएंट फ्लो वाले एक विभाजित लेटेंट स्पेस का उपयोग करके जॉइंट एम्बेडिंग प्रेडिक्टिव आर्किटेक्चर में ऑब्जेक्टिव इंटरफेरेंस कोलैप्स को संरचनात्मक रूप से रोकता है।

Akshay Hazare2026-06-19
💻 computer science

TW-LegalBench: Measuring Taiwanese Legal Understanding

यह शोध पत्र TW-LegalBench प्रस्तुत करता है, जो बहुविकल्पीय प्रश्नों, निबंध लेखन और निर्णय पूर्वानुमान के माध्यम से लार्ज लैंग्वेज मॉडल्स का मूल्यांकन करने के लिए ताइवान के आधिकारिक कानूनी संग्रह का उपयोग करने वाला एक व्यापक बेंचमार्क है, जो यह प्रकट करता है कि जबकि शीर्ष मॉडल वकीलों के योग्यता स्तर के करीब पहुँचते हैं, वे अभी भी न्यायाधीशों और अभियोजकों से काफी पीछे हैं और सटीक कानूनी उद्धरण (साइटेशन) के साथ संघर्ष करते हैं।

Fei-Yueh Chen, Chun Huang Lin, Chan Wei Hsu, Kuan Hsuan Yeh, Zih-Ching Chen, Kuan-Ming Chen, Patrick Chung-Chia Huang2026-06-19
🤖 AI

Human-AI Agent Interaction in a Business Context

यह अध्ययन व्यावसायिक संदर्भों में मानव-एआई एजेंट इंटरैक्शन को अनुकूलित करने के लिए सिद्धांतों, मानदंडों और डिज़ाइन तत्वों की पहचान करने और उनका मूल्यांकन करने के लिए एक मिश्रित-पद्धति दृष्टिकोण का उपयोग करता है, जिसका लक्ष्य उपयोगकर्ता अनुभव को बढ़ाना, विश्वास बनाना और अनुकूलन को सुगम बनाना है।

Kathrin Paimann, Elizangela Valarini, Sebastian Juhl2026-06-19
💻 computer science

Morpheus: A Morphology-Aware Neural Tokenizer and Word Embedder for Turkish

मॉर्फियस (Morpheus) तुर्की भाषा के लिए एक नवीन न्यूरल टोकेनाइज़र और वर्ड एंबेडर है जो मानक सबवर्ड विधियों की तुलना में लॉसलेस, मॉर्फोलॉजी-अवेयर टोकेनाइज़ेशन के साथ बेहतर संपीड़न दक्षता और मॉर्फोलॉजिकल संरेखण प्राप्त करने के लिए एक डिफरेंशिएबल पॉइसन-बिनोमियल डायनेमिक प्रोग्राम का उपयोग करता है, जबकि उच्च गुणवत्ता वाले रूट-सेंट्रिक वर्ड एम्बेडिंग भी उत्पन्न करता है।

Tolga Şakar2026-06-19
💻 computer science

SWE-Future: Forecast-Conditioned Data Synthesis for Future-Oriented Software Engineering Agents

यह शोधपत्र SWE-Future को प्रस्तुत करता है, जो एक ऐसी विधि है जो आगामी फीचर, बगफिक्स और रिफैक्टर आवश्यकताओं का पूर्वानुमान लगाने के लिए पूर्व-मौजूद रिपॉजिटरी डेटा का उपयोग करके यथार्थवादी, भविष्योन्मुखी सॉफ्टवेयर इंजीनियरिंग कार्यों को संश्लेषित करती है, जिससे एक ऐसा बेंचमार्क निर्मित होता है जो ऐतिहासिक पुल रिक्वेस्ट (pull requests) को पुन: खेलने के डेटा संदूषण (data contamination) जोखिमों से बचता है और वास्तविक रिपॉजिटरी विकास के प्रति उच्च प्रासंगिकता बनाए रखता है।

Qiao Zhao, JianYing Qu, Jun Zhang, Yehua Yang, Hanwen Du, Zhongkai Sun2026-06-19
💻 computer science

What Must Generalist Agents Remember?

यह शोधपत्र यह स्थापित करता है कि सामान्यज्ञ एजेंटों (generalist agents) को अवलोकन संबंधी अस्पष्टताओं को सुलझाने और संक्रमण गतिकी (transition dynamics) के पुनर्निर्माण के लिए स्मृति में डोमेन-प्रासंगिक जानकारी संग्रहीत करनी चाहिए, जो यह सिद्ध करता है कि केवल वर्तमान अवस्था के अवलोकनों पर निर्भर रहकर विविध वातावरणों में निकट-इष्टतम प्रदर्शन करना असंभव है।

Khurram Yamin, Namrata Deka, Maitreyi Swaroop, Albert Ting, Jeff Schneider, Bryan Wilder2026-06-19
💻 computer science

RedactionBench

यह शोधपत्र रेडैक्शनबेंच (RedactionBench), जो कि एक मैन्युअल रूप से एनोटेटेड बेंचमार्क है, और एक नवीन आर-स्कोर (R-Score) मीट्रिक प्रस्तुत करता है जिसे विविध डोमेन में पीआईआई (PII) रेडैक्शन की प्रासंगिक अखंडता का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो यह प्रकट करता है कि वर्तमान मॉडल गोपनीयता की व्यक्तिपरक प्रकृति के साथ संघर्ष करते हैं और अनिवार्य तथा प्रासंगिक रेडैक्शन सर्वसम्मति के बीच एक महत्वपूर्ण अंतर को उजागर करते हैं।

Sean Brynjólfsson, Shashvat Jayakrishnan, Esha Sali, Diptanshu Purwar, Madhav Aggarwal2026-06-19
💻 computer science

Bayesian Anytime Pareto Set Identification for Multi-Objective Multi-Armed Bandits

यह शोध पत्र टॉप-टू पारेटो फ्रंट थॉम्पसन सैंपलिंग (TTPFTS) को प्रस्तुत करता है, जो मल्टी-ऑब्जेक्टिव मल्टी-आर्म्ड बैंडिट्स के लिए पहला एनीटाइम बेयसियन एल्गोरिदम है जो पारेटो ऑप्टिमल सेट्स की पहचान करता है, और इसकी सैद्धांतिक शुद्धता, अत्याधुनिक विधियों के विरुद्ध बेहतर प्रदर्शन, और लर्निंग प्रोग्रेस की निगरानी के लिए एक नवीन अनसर्टेन्टी क्वांटिफिकेशन मेट्रिक के साथ आणविक खोज (मॉलिक्यूलर डिस्कवरी) में इसकी व्यावहारिक उपयोगिता को प्रदर्शित करता है।

Lennert Saerens, Bram Silue, Eleni Litsa, Peter Vrancx, Pieter Libin2026-06-19