🤖 AI

FALAT: Tracing Failures in LLM Agent Trajectories via Dependency-Guided Search

यह शोध पत्र FALAT का प्रस्ताव करता है, जो एक नैदानिक ढांचा (diagnostic framework) है जो LLM एजेंट प्रक्षेप पथों (trajectories) में विफलता के आरोपण (failure attribution) में सुधार करता है, जो समस्या को त्रुटि-प्रवर्तक चरणों और उन चरणों के बीच अंतर करने के लिए एक निर्भरता-निर्देशित खोज (dependency-guided search) के रूप में रूपरेखा देता है जो केवल पूर्व की गलतियों को प्रसारित कर रहे हैं, जिससे जिम्मेदार एजेंटों और निर्णायक विफलता चरणों की पहचान करने में मौजूदा बेसलाइन से बेहतर प्रदर्शन करता है।

Md Nakhla Rafi, Md Ahasanuzzaman, Dong Jae Kim, Zhijie Wang, Tse-Hsun Chen2026-06-02
🤖 machine learning

Behavior-Invariant Task Representation Learning with Transformer-based World Models for Offline Meta-Reinforcement Learning

यह शोध पत्र ऑफलाइन मेटा-रिनफोर्समेंट लर्निंग के लिए एक नवीन ढांचे का प्रस्ताव करता है जो सूचना-सैद्धांतिक, व्यवहार-अपरिवर्तनीय कार्य प्रतिनिधित्व शिक्षण को ट्रांसफार्मर-आधारित स्टोकेस्टिक वर्ल्ड मॉडल और कंजर्वेटिव वैल्यू पेनल्टीज़ के साथ जोड़ता है ताकि वितरण बदलाव (डिस्ट्रीब्यूशन शिफ्ट) को दूर किया जा सके और स्पार्स-रिवॉर्ड, आउट-ऑफ-डिस्ट्रीब्यूशन वातावरण में मजबूत सामान्यीकरण प्राप्त किया जा सके।

Fuyuan Qian, Menglong Zhang, Song Wang, Quanying Liu2026-06-02
📊 statistics

Bayesian Inference of Nonlinear Malaria Dynamics in Ghana via an Ensemble Markov Chain Monte Carlo Sampler

यह अध्ययन डेटा की सीमाओं को दूर करने और 2024 से 2026 तक घाना में आयु-विशिष्ट मलेरिया पुनरुत्थान के संभाव्य पूर्वानुमान उत्पन्न करने के लिए एक एन्सेम्बल मार्कोव चेन मोंटे कार्लो सैंपलर का उपयोग करते हुए एक बेयसियन गैर-रेखीय अनुमान ढांचे को प्रस्तुत करता है, जिससे डेटा-संचालित राष्ट्रीय नियंत्रण रणनीतियों को समर्थन मिलता है।

T. Ansah-Narh, Y. Asare Afrane, J. Bremang Tandoh2026-06-02
🤖 machine learning

Extending Causal Metamodeling to a non-Markovian Queue

यह शोध पत्र गैर-घातांकीय (non-exponential) वितरणों को फेज-टाइप (phase-type) वितरणों के साथ सन्निकटित करके मॉड्यूलर डायनेमिक बेयसियन नेटवर्क (MDBNs) को गैर-मार्कोवियन कतारों (queues) तक विस्तारित करता है, जिससे प्रत्यक्ष सिमुलेशन की तुलना में महत्वपूर्ण गति वृद्धि के साथ सटीक और कुशल कारण अनुमान (causal inference) सक्षम होता है।

Pracheta Amaranath, Anant Bhide, David Jensen, Peter Haas2026-06-02
🤖 AI

DASH: Dual-Branch Score Distillation for Guidance-Calibrated Compact Diffusion Models

यह शोध पत्र DASH को प्रस्तुत करता है, जो एक डुअल-ब्रांच डिस्टिलेशन फ्रेमवर्क है जो दोनों स्कोर शाखाओं (score branches) को स्वतंत्र रूप से सुपरवाइज करके और शिक्षक के महत्व पाठ्यक्रम (importance curriculum) को स्थानांतरित करके संकुचित डिफ्यूजन मॉडल्स में अनडिटरमाइंड गाइडेंस गैप को हल करता है, जिससे उच्च-गुणवत्ता वाली गाइडेंस फिडेलिटी को बनाए रखते हुए महत्वपूर्ण पैरामीटर कमी प्राप्त की जाती है।

Abdullah Al Shafi, Kazi Saeed Alam, Sk Imran Hossain, Engelbert Mephu Nguifo2026-06-02
💬 NLP

Dynamic Coordination Strategy Selection for Enterprise Multi-Agent Systems

यह शोध पत्र 1,440 कार्यों में एंटरप्राइज मल्टी-एजेंट सिस्टम्स में डायनेमिक कोऑर्डिनेशन स्ट्रैटेजी सिलेक्शन का मूल्यांकन करता है और पाता है कि जहाँ एक डिटरमिनिस्टिक "एक्ज़ैक्ट विनर" मॉडल अस्थिर है, वहीं एक कैलिब्रेटेड रूटिंग दृष्टिकोण विविध मॉडल्स और प्रॉब्लम क्लासेस में सर्वश्रेष्ठ देखे गए स्ट्रैटेजी के 0.10 क्वालिटी पॉइंट्स के भीतर लगातार नियर-ऑप्टिमल प्रदर्शन प्राप्त करता है।

Thanh Luong Tuan2026-06-02
📈 economics

Certificates without Electrons? Theory and Evidence on Impacts from AI-Driven Power Demand

यह शोध पत्र गेम-थ्योरेटिक मॉडलिंग और अनुभवजन्य साक्ष्य को संयोजित करता है जिससे यह प्रदर्शित होता है कि एआई-संचालित बिजली की मांग, उपभोग और नवीकरणीय उत्पादन के बीच समय के बेमेल होने के कारण ग्रिड की विश्वसनीयता को कम करती है, कीमतें बढ़ाती है और उत्सर्जन में वृद्धि करती है, जो यह प्रकट करता है कि वर्तमान नवीकरणीय प्रमाणपत्र रणनीतियां इन प्रभावों को कम करने में विफल रहती हैं जबकि स्टोरेज के साथ सह-स्थान (colocation) और स्थानिक पुनर्वितरण जैसे समाधान प्रभावी विकल्प प्रदान करते हैं।

Dana Golden, Aruna Balasubramanian, Niranjan Balasubramanian2026-06-02
🤖 machine learning

Beyond Independent Manipulation: Individual Fairness-aware Strategic Classification with Peer Imitation

यह शोध पत्र इंडिविजुअल फेयरनेस-अवेयर स्ट्रैटेजिक क्लासिफिकेशन (IFSC) प्रस्तुत करता है, जो एक ऐसा ढांचा है जो स्वतंत्र हेरफेर धारणाओं की सीमाओं को संबोधित करता है, व्यक्तिगत निष्पक्षता द्वारा संचालित साथियों के अनुकरण (पीयर इमिटेशन) के रूप में एजेंटों के रणनीतिक व्यवहार को मॉडल करता है, जिससे ऐसे सुदृढ़ क्लासिफायर सीखे जा सकते हैं जो अनुकरण-प्रेरित विरूपणों को कम करते हैं।

Xinpeng Lv, Chunyuan Zheng, Yunxin Mao, Renzhe Xu, Jinxuan Yang, Yuanlong Chen, Wangrong Huang, Shaowu Yang, Wenjing Yan (…)2026-06-02
🤖 AI

Subliminal Learning is a LoRA Artifact

यह शोध पत्र यह प्रदर्शित करता है कि सब्लिमिनल लर्निंग (subliminal learning), जहाँ व्यवहार संबंधी लक्षण निर्दोष डेटा के माध्यम से भाषा मॉडलों के बीच प्रसारित होते हैं, एक सुदृढ़ क्षमता नहीं बल्कि विशिष्ट LoRA हाइपरपैरामीटर्स और फाइनट्यूनिंग संदर्भों के कारण उत्पन्न एक नाजुक आर्टिफैक्ट है।

Todd Nief, Harvey Yiyun Fu, Mark Muchane, Ari Holtzman2026-06-02
📊 statistics

Hybrid Probabilistic Forecasting of Under-Five Malaria Admissions in Ghana: A Gaussian Process Regression with Holt-Winters Smoothing

यह अध्ययन एक हाइब्रिड गॉसियन प्रोसेस रिग्रेशन और होल्ट-विंटर्स स्मूथिंग फ्रेमवर्क प्रस्तावित करता है जो घाना में मासिक पांच वर्ष से कम आयु के मलेरिया प्रवेशों के पूर्वानुमान में पारंपरिक मॉडलों से काफी बेहतर प्रदर्शन करता है, जो स्थानिक सेटिंग्स में परिचालन योजना और प्रारंभिक चेतावनी के लिए एक सुदृढ़, संभाव्य उपकरण प्रदान करता है।

T. Ansah-Narh, Y. Asare Afrane, J. Bremang Tandoh2026-06-02