🤖 AI

The Confidence Shortcut: A Reasoning Failure Mode of Masked Diffusion Models

यह शोध पत्र तर्क देता है कि मास्कड डिफ्यूजन मॉडल्स (Masked Diffusion Models) में कॉन्फिडेंस-आधारित डिकोडिंग और उसकी संबंधित प्रशिक्षण योजनाएं जटिल तर्क के लिए आवश्यक तार्किक प्रवाह के साथ मौलिक रूप से विसंगत हैं, जिसके कारण अधिक मजबूत, यद्यपि स्पष्ट रूप से अक्षम दिखने वाले रैंडम मास्किंग दृष्टिकोण की तुलना में चुनौतीपूर्ण कार्यों पर त्रुटियों में महत्वपूर्ण वृद्धि होती है।

Dueun Kim, Albert No2026-05-29
💻 computer science

Toward User Preference Alignment in LLM Recommendation via Explicit Context Feedback

यह शोध पत्र अगले पीढ़ी के LLM-आधारित अनुशंसा प्रणालियों (recommender systems) में स्पष्ट प्रासंगिक फीडबैक, जैसे कि उपयोगकर्ता की टिप्पणियों और समीक्षाओं, को प्राथमिकता देने का समर्थन करता है ताकि निहित संकेतों (implicit signals) की सीमाओं को दूर किया जा सके, जिससे अधिक सटीक, व्याख्यात्मक और व्यक्तिगत उपयोगकर्ता प्राथमिकता संरेखण प्राप्त किया जा सके।

Weizhi Zhang, Wooseong Yang, Yuxin Cui, Zhaohui Guo, Hins Hu, Liangwei Yang, Henry Peng Zou, Qifei Wang, Hanqing Zeng, J (…)2026-05-29
🔢 mathematics

Real-rootedness of the Poincaré polynomials of M0,n\overline{\mathcal M}_{0,n}: an AI-assisted proof

यह शोध पत्र एक एआई-सहायता प्राप्त प्रमाण प्रस्तुत करता है जो स्थिर परिमेय वक्रों (stable rational curves) के मोडुली स्पेस और फुल्टन-मैकफर्सन स्पेस के पोइनकारे बहुपदों की वास्तविक-मूलता (real-rootedness) की पुष्टि करता है, जिसमें उनके बेट्टी संख्याओं (Betti numbers) की सख्त इंटरलेसिंग (interlacing) और अल्ट्रा-लॉग-कॉन्केविटी (ultra-log-concavity) को स्थापित करने के लिए एक नवीन द्विचरीय विरूपण (bivariate deformation) और स्टर्म-रोल (Sturm–Rolle) तर्क का उपयोग किया गया है।

Gergely Bérczi, Young-Hoon Kiem2026-05-29
🤖 machine learning

Parallax: Parameterized Local Linear Attention for Language Modeling

यह शोध पत्र पैरलैक्स (Parallax) को प्रस्तुत करता है, जो एक स्केलेबल और संख्यात्मक रूप से स्थिर पैरामीटराइज्ड लोकल लीनियर अटेंशन (Local Linear Attention) तंत्र है, जो LLA की कम्प्यूटेशनल बाधाओं को समाप्त करके, हार्डवेयर दक्षता को अनुकूलित करके और म्यूऑन (Muon) ऑप्टिमाइज़र के साथ एक नवीन तालमेल प्रदर्शित करके लैंग्वेज मॉडलिंग में पारेटो सुधार (Pareto improvements) प्राप्त करता है।

Yifei Zuo, Dhruv Pai, Zhichen Zeng, Alec Dewulf, Shuming Hu, Zhaoran Wang2026-05-29
💻 computer science

UA-Legal-Bench: A Benchmark for Evaluating Large Language Models on Ukrainian Legal Reasoning

यह शोध पत्र UA-Legal-Bench प्रस्तुत करता है, जो यूक्रेन के विशाल यूनिफाइड स्टेट रजिस्टर ऑफ कोर्ट डिसीजन्स से प्राप्त एक व्यापक पांच-कार्य वाला बेंचमार्क है, जिसका उद्देश्य यूक्रेनी कानूनी तर्क पर लार्ज लैंग्वेज मॉडल्स का मूल्यांकन करना है, जो कार्य-निर्भर फ्यू-शॉट प्रभावों, असंतुलित डेटा पर सटीकता की कमियों और विभिन्न मॉडल परिवारों में अलग-अलग स्केलिंग व्यवहारों के बारे में महत्वपूर्ण अंतर्दृष्टि प्रकट करता है।

Volodymyr Ovcharov2026-05-29
🤖 AI

Paper Agents, Paper Gains: An Empirical Analysis of DeFi Investment Agents

यह शोध पत्र शुरुआती डीएफआई (DeFi) निवेश एजेंट बाजार का विश्लेषण करता है, जो यह प्रकट करता है कि $3 बिलियन से अधिक के संयुक्त टोकन मूल्यांकन के बावजूद, वर्तमान तैनाती में मजबूत स्वायत्त निष्पादन का अभाव है, अत्यधिक धन संकेंद्रण प्रदर्शित होता है जिसमें औसत उपयोगकर्ताओं के लिए महत्वपूर्ण शुद्ध हानि होती है, और मार्केट कैप तथा ट्रेजरी फंडामेंटल्स के बीच एक बड़ा अंतर है, जो निवेश-ग्रेड मानक स्थापित करने के लिए एक परिपक्वता ढांचे की आवश्यकता को दर्शाता है।

Jay Yu, Amy Zhao, Danning Sui2026-05-29
🔬 materials science

Sustainable Metal-Organic Framework Water Harvesters in the Artificial Intelligence Era

यह परिप्रेक्ष्य लेख इस बात का अन्वेषण करता है कि कैसे कृत्रिम बुद्धिमत्ता को सहयोगात्मक अधिशोषण (cooperative adsorption) और बहुभिन्नरूपी रणनीतियों (multivariate strategies) जैसे उन्नत डिजाइन सिद्धांतों के साथ एकीकृत करके, शुष्क परिस्थितियों में कुशल वायुमंडलीय जल संचयन के लिए टिकाऊ मेटल-ऑर्गेनिक फ्रेमवर्क्स (metal-organic frameworks) की खोज और अनुकूलन को कैसे त्वरित किया जा सकता है।

Reid A. Coyle (Department of Chemistry, Washington University, St. Louis, MO, United States), Shyam Chand Pal (Departmen (…)2026-05-29
🤖 machine learning

TIMEGATE: Sustainable Time-Boxed Promotion Gates for Continual ML Adaptation Under Resource Constraints

यह शोधपत्र TIMEGATE को पेश करता है, जो टिकाऊ निरंतर मशीन लर्निंग (continual machine learning) के लिए एक नीति ढांचा (policy framework) है, जो समय और कंप्यूट का बजट निर्धारित करके संसाधन-सीमित अनुकूलन चक्रों को अनुकूलित करता है, और एक मीट्रिक-उपलब्धता संकेत (metric-availability signal) का उपयोग करके आंशिक मूल्यांकन को सक्षम करता है जो विविध मॉडलों और डेटासेटों में सटीकता बनाए रखते हुए ऊर्जा और वॉल-क्लॉक लागतों को महत्वपूर्ण रूप से कम करता है।

Abhijit Chakrabroty, Suddhasvatta Das, Kevin A. Gary, Yash Shah2026-05-29
🤖 machine learning

Stochastic Lifting for Generating Trajectories of Stochastic Physical Systems

यह शोध पत्र स्टोकेस्टिक लिफ्टिंग (Stochastic Lifting) प्रस्तुत करता है, जो एक ऐसी विधि है जो विविध, गैर-संकुचित (non-collapsing) प्रक्षेप पथों को ऑटोरेग्रेसिव इन्फरेंस के माध्यम से उत्पन्न करने में सक्षम एक नियतात्मक मानचित्र (deterministic map) सीखने के लिए स्वतंत्र उच्च-आयामी यादृच्छिक लेबल के साथ अवस्था संक्रमणों (state transitions) को संवर्धित करके सुचारू स्टोकेस्टिक भौतिक प्रणालियों को मॉडल करती है।

Jules Berman, Tobias Blickhan, Benjamin Peherstorfer2026-05-29
🤖 AI

GTA: Generating Long-Horizon Tasks for Web Agents at Scale

यह शोध पत्र GTA को प्रस्तुत करता है, जो एक स्केलेबल फ्रेमवर्क है जो मौजूदा बेंचमार्क की सीमाओं को दूर करने और मजबूत प्रशिक्षण एवं मूल्यांकन को सक्षम करने के लिए क्रॉलिंग, रिट्रीवल-आधारित सीडिंग और स्वचालित सत्यापन को एकीकृत करके वास्तविक, मल्टी-हॉप वेब एजेंट कार्यों को निष्पादन योग्य प्रक्षेपवक्रों (ट्रैजेक्टरीज) के साथ स्वचालित रूप से उत्पन्न करता है।

Tenghao Huang, Kung-Hsiang Huang, Prafulla Kumar Choubey, Yilun Zhou, Muhao Chen, Jonathan May, Chien-Sheng Wu2026-05-29