💻 computer science

Why Do Reasoning Models Lose Coverage? The Role of Data and Forks in the Road

यह शोधपत्र फाइन-ट्यून किए गए रीजनिंग मॉडल्स में "रीजनिंग श्रिंकेज" (तर्क संकुचन) की घटना की जांच करता है, जिसमें प्रशिक्षण डेटा में अस्पष्ट निर्णय-बिंदु परिदृश्यों की व्यापकता को प्राथमिक कारण के रूप में पहचाना गया है और यह प्रदर्शित किया गया है कि लक्षित डेटा संश्लेषण और विविधता-जागरूक डिकोडिंग इस कवरेज हानि को प्रभावी ढंग से कम कर सकते हैं।

Ngoc-Hieu Nguyen, Parshin Shojaee, Phuc Minh Nguyen, Nan Zhang, Chandan K Reddy, Khoa D Doan, Rui Zhang2026-05-19
💻 computer science

Privacy-Preserving Generation Fraud Detection for Distributed Photovoltaic Systems: A Solar Irradiance-Fused Federated Learning Framework

यह शोध पत्र एक गोपनीयता-संरक्षण फेडरेटेड लर्निंग फ्रेमवर्क प्रस्तावित करता है जो वितरित आवासीय फोटोवोल्टिक प्रणालियों में जनरेशन फ्रॉड (उत्पादन धोखाधड़ी) का प्रभावी ढंग से पता लगाने के लिए को-अटेंशन मैकेनिज्म और प्रोटोटाइप अलाइनमेंट के माध्यम से सौर विकिरण डेटा को एकीकृत करता है, साथ ही स्केलेबिलिटी, गोपनीयता और क्लास इम्बैलेंस की चुनौतियों का समाधान भी करता है।

Xiaolu Chen, Chenghao Huang, Yanru Zhang, Hao Wang2026-05-19
💻 computer science

Learning Multi-Timescale Abstractions for Hierarchical Combinatorial Planning

यह शोध पत्र अनुक्रमिक स्टोकेस्टिक कॉम्बिनेटोरियल ऑप्टिमाइज़ेशन (Sequential Stochastic Combinatorial Optimization) के लिए एक मॉडल-आधारित पदानुक्रमित ढांचे (hierarchical framework) को प्रस्तुत करता है जो बड़े एक्शन स्पेस और लंबी क्षितिज (long horizons) वाले वातावरणों में कुशल नियोजन और संसाधन आवंटन को सक्षम करने के लिए एक SMDP-जागरूक वर्ल्ड मॉडल और मल्टी-टाइमस्केल लेटेंट डायनेमिक्स का उपयोग करता है।

Vivienne Huiling Wang, Tinghuai Wang, Joni Pajarinen2026-05-19
💻 computer science

The Range Shrinks, the Threat Remains: Re-evaluating LLM Package Hallucinations on the 2026 Frontier-Model Cohort

यह शोध पत्र स्प्रैकलन एट अल. के 2025 के एलएलएम (LLM) पैकेज मतिभ्रम (hallucinations) पर आधारित अध्ययन को पांच 2026 के फ्रंटियर मॉडल्स का उपयोग करके दोहराता और विस्तारित करता है, जिससे यह पता चलता है कि हालांकि मतिभ्रम की दर में काफी कमी आई है और मॉडल्स के बीच का अंतर कम हुआ है, फिर भी एक निरंतर खतरा बना हुआ है जो 127 मॉडल-अज्ञेय (model-agnostic) मतिभ्रम वाले पैकेज नामों के एक नए पहचाने गए सेट और विशिष्ट क्रॉस-इकोसिस्टम एवं क्रॉस-मॉडल व्यवहार संबंधी पैटर्न द्वारा अभिलक्षित है।

Aleksandr Churilov (Independent Researcher)2026-05-19✓ Author reviewed
💻 computer science

S-Bus: Automatic Read-Set Reconstruction for Multi-Agent LLM State Coordination

यह शोधपत्र S-Bus प्रस्तुत करता है, जो एक HTTP मिडलवेयर है जो एजेंट रीड सेट्स को स्वचालित रूप से पुनर्गठित करने और ऑब्ज़ेबल-रीड आइसोलेशन (ORI) को लागू करने के लिए सर्वर-साइड डिलीवरीलॉग का उपयोग करता है, जिससे एजेंट SDKs में बदलाव की आवश्यकता के बिना समवर्ती मल्टी-एजेंट LLM सिस्टम में स्ट्रक्चरल रेस कंडीशंस को रोका जा सकता है।

Sajjad Khan2026-05-19
💻 computer science

Scale Determines Whether Language Models Organize Representation Geometry for Prediction

यह शोध पत्र Subspace PGA को प्रस्तुत करता है जिससे यह पता चलता है कि जबकि भाषा मॉडल की प्रतिनिधित्व ज्यामिति (representation geometry) भविष्यवाणी के लिए व्यवस्थित होती है, छोटे मॉडल बाद की परतों में इस संरेखण (alignment) को खो देते हैं जो प्रमुख दिशाओं द्वारा छिपा हुआ एक क्षमता संबंधी समझौता (capacity trade-off) है, जबकि बड़े मॉडल प्रशिक्षण के दौरान इसे बनाए रखते हैं।

Weilun Xu2026-05-19
💻 computer science

Mechanism Learning: Prototype-Anchored Mechanism Inference for Scientific Forecasting

यह शोध पत्र "मैकेनिज्म लर्निंग" (mechanism learning) को प्रस्तुत करता है, जो एक सुदृढ़ पूर्वानुमान ढांचा है जो प्रोटोटाइप-एंकरित डिस्क्रिप्टर्स (prototype-anchored descriptors) के माध्यम से सक्रिय स्थानीय विकास नियमों का अनुमान लगाकर भविष्य की अवस्थाओं की भविष्यवाणी करता है, और डेटा-दुर्लभ एवं जटिल गतिशील व्यवस्थाओं में प्रत्यक्ष भविष्यवाणी और मौजूदा मॉडलों की तुलना में बेहतर प्रदर्शन प्राप्त करता है।

Qian Jiang, Liping Sun2026-05-19
💻 computer science

Visual Timelines of Police Encounters in Body-Worn Camera Footage: Operational Context and Activity Cataloging for Training and Analysis in OpenBWC

यह शोध पत्र एक गोपनीयता-सचेत प्रणाली प्रस्तुत करता है जो परिचालन संदर्भ और गति की तीव्रता के लिए 10-सेकंड की खिड़कियों को वर्गीकृत करके बॉडी-वर्न कैमरा फुटेज को विजुअल टाइमलाइन्स में परिवर्तित करती है, जिससे घटना की समीक्षा में तेजी आती है और अधिकारी प्रशिक्षण वर्कफ़्लो में सुधार होता है।

Angela Srbinovska, Christopher Homan, Adrian Martin, Ernest Fokoué2026-05-19
💻 computer science

Parallel Recursive LSTM

यह शोध पत्र पैरेलल रिकर्सिव एलएसटीएम (PR-LSTM) का परिचय देता है, जो एक पदानुक्रमित आर्किटेक्चर है जो एक संतुलित गणना वृक्ष (balanced computation tree) पर टोकन अवस्थाओं को पुनरावर्ती रूप से विलय करके लघुगणकीय समानांतर गहराई (logarithmic parallel depth) प्राप्त करता है, जिससे यह पुनरावर्ती मॉडलों की मजबूत अवस्था-ट्रैकिंग क्षमताओं को समानांतर प्रसंस्करण की दक्षता के साथ जोड़कर बिना द्विघाती स्केलिंग (quadratic scaling) के लॉन्ग-कॉन्टेक्स्ट बेंचमार्क पर मानक RNNs, LSTMs और ट्रांसफॉर्मर्स से बेहतर प्रदर्शन करता है।

Tristan Gaudreault, Yongyi Mao2026-05-19
💻 computer science

DynMuon: A Dynamic Spectral Shaping View of Muon

यह शोध पत्र DynMuon को प्रस्तुत करता है, जो एक गतिशील स्पेक्ट्रल शेपिंग विधि है जो वक्रता (curvature) और शोर (noise) के आधार पर स्पेक्ट्रल पावर पैरामीटर pp को धनात्मक से हल्के ऋणात्मक मानों की ओर शेड्यूलिंग करके Muon-आधारित प्रशिक्षण को अनुकूलित करती है, जिससे मानक Muon की तुलना में कम वैलिडेशन लॉस और तेज़ अभिसरण (convergence) प्राप्त होता है।

Fangzhou Wu, Rikhav Shah, Sandeep Silwal, Qiuyi Zhang2026-05-19