🤖 AI

The Faithfulness Gap: Certifying Semantic Equivalence Between Natural-Language and Formal Mathematical Statements

यह शोधपत्र द्विदिश प्रमाणिकता फिंगरप्रिंटिंग (BPF) को प्रस्तुत करता है, जो प्राकृतिक-भाषा जांचों (natural-language probes) के विरुद्ध अपने तार्किक परिणाम पड़ोस (logical consequence neighborhoods) की तुलना करके ऑटो-फॉर्मलाइज्ड गणितीय कथनों की निष्ठा (faithfulness) को प्रमाणित करने वाला एक ढांचा है, जिससे काउंटरफैक्चुअल प्रोब जनरेशन (Counterfactual Probe Generation) और फेथफुलनेस-गाइडेड डिकोडिंग (Faithfulness-Guided Decoding) जैसे नवीन घटकों के माध्यम से सिमेंटिक ड्रिफ्ट (semantic drift) को महत्वपूर्ण रूप से कम किया जाता है।

Noor Islam S. Mohammad, Tamim Sheikh2026-06-16
🔬 physics

Learning Interface Breakup: A Geometry-Conditioned Latent Surrogate for Spray Formation

यह शोध पत्र एक ज्यामिति-सशर्त लेटेंट सरोगेट मॉडल प्रस्तुत करता है जो कुशल नोजल डिजाइन के लिए क्षणिक द्वि-चरणीय स्प्रे ब्रेकअप गतिकी (transient two-phase spray breakup dynamics) को सटीक रूप से पुनर्गठित करने हेतु एक कॉम्पैक्ट प्रॉक्सी के रूप में एडेप्टिव मेश रिफाइनमेंट सेल-डेंसिटी क्षेत्रों को एनकोड करके हाई-फिडेलिटी सीएफडी (CFD) सिमुलेशन की तुलना में 6×1046\times10^4 की गति-वृद्धि प्राप्त करता है।

Julius H Ramlau, Friedrich Hastedt, Tolga Birdal, Ehecatl-Antonio del Río Chanona, Nausheen S Basha, Omar K Matar2026-06-16
🧬 biology

Infant Spontaneous Movement Noise Improves Exploration in Deep RL

यह शोध पत्र यह प्रदर्शित करता है कि डीप रिइन्फोर्समेंट लर्निंग में एक्सप्लोरेशन नॉइज़ (exploration noise) के टेम्पोरल ऑटोकोरिलेशन (temporal autocorrelation) को क्रमिक रूप से बढ़ाकर, शिशु की स्वतःस्फूर्त गतिविधियों के विकासात्मक क्रम की नकल करने से, पारंपरिक व्हाइट नॉइज़ रणनीतियों की तुलना में अधिक संरचित अन्वेषण और बेहतर शिक्षण दक्षता प्राप्त होती है।

Francisco M. López, Markus R. Ernst, Francisco Cruz, Matej Hoffmann, and Jochen Triesch2026-06-16
🤖 AI

ARB4WM: An Adversarial Robustness Benchmark for World Models in Continuous Control

यह शोध पत्र ARB4WM को प्रस्तुत करता है, जो एक एकीकृत बेंचमार्क फ्रेमवर्क है जो विभिन्न गड़बड़ी रणनीतियों और टेम्पोरल अटैक मोड के तहत पॉलिसी, वैल्यू और लेटेंट-डायनामिक्स स्तरों पर पांच व्हाइट-बॉक्स लॉस ऑब्जेक्टिव्स का व्यवस्थित रूप से परीक्षण करके निरंतर नियंत्रण (कंटीन्यूअस कंट्रोल) में वर्ल्ड-मॉडल एजेंटों की एडवरसेरियल रोबस्टनेस का मूल्यांकन करता है।

Junjian Zhang, Hao Tan, Ruonan Li, Dong Zhu, Aiping Li, Zhaoquan Gu2026-06-16
🤖 AI

CoffeeBench: Benchmarking Long-Horizon LLM Agents in Heterogeneous Multi-Agent Economies

यह शोध पत्र CoffeeBench प्रस्तुत करता है, जो एक विषम बहु-एजेंट कॉफी अर्थव्यवस्था के भीतर लॉन्ग-होरिज़न (long-horizon) LLM एजेंटों का मूल्यांकन करने के लिए डिज़ाइन किया गया एक बेंचमार्क है, जो यह प्रकट करता है कि जहाँ अधिकांश मॉडल सक्रिय संचार के माध्यम से सकारात्मक शुद्ध आय प्राप्त करते हैं, वहीं कुछ मॉडल सुसंगत योजना के बावजूद "आइडल-ड्रिफ्ट" (idle-drift) जैसे विशिष्ट विफलता मोड प्रदर्शित करते हैं।

Issa Sugiura, Daichi Hattori, Kazuo Araragi, Keita Ogawa, Shota Onose, Taro Makino, Teppei Usuki, Takashi Ishida2026-06-16
🤖 AI

The Integrator Advantage: Controlled Agentic AI for Small and Medium-Sized Companies

यह शोध पत्र यह तर्क देता है कि लघु और मध्यम आकार की कंपनियां मानव-केंद्रित निरीक्षण, शासन और पूर्ण कार्यबल प्रतिस्थापन के बजाय मापने योग्य उत्पादकता लाभों को प्राथमिकता देने वाले एक व्यापक एकीकरण ढांचे के माध्यम से नियंत्रित आंशिक स्वायत्तता लागू करके एजेंटिक एआई (Agentic AI) के अल्पकालिक मूल्य को अधिकतम कर सकती हैं।

Christopner Koch, Joshua A. Wellbrock2026-06-16
🤖 AI

PATCH: Action-Chunk-Conditioned Latent Patch Innovation Monitoring for Robot Manipulation

यह शोधपत्र PATCH को प्रस्तुत करता है, जो एक एक्शन-चंक-कंडीशन्ड लेटेंट पैच इनोवेशन मॉनिटर है, जो गतिशील वातावरण में रोबोटिक हेरफेर की मजबूती को बढ़ाने के लिए कार्य-प्रासंगिक निष्पादन जोखिमों को सौम्य दृश्य विविधताओं से अलग करता है ताकि स्थानीयकृत हस्तक्षेप और नीति पुनरारंभ को ट्रिगर किया जा सके।

Yanan Zhou, Ranpeng Qiu, Yincong Chen, Jiajie Cui, Weiming Zhi2026-06-16
🔬 applied physics

Adaptive inference and function vectors in deep transformers

यह शोध पत्र डीप ट्रांसफॉर्मर्स के एक मीन-फील्ड सिद्धांत को वितरित अनुमान प्रणालियों (डिस्ट्रिब्यूटेड इन्फरेंस सिस्टम्स) के रूप में प्रस्तुत करता है जो पदानुक्रमित रूप से लेटेंट कॉन्टेक्स्ट वेरिएबल्स का अनुमान लगाने के लिए आंतरिक "फंक्शन वेक्टर्स" का उपयोग करते हैं, यह प्रदर्शित करते हुए कि फीडफॉरवर्ड ब्लॉक्स और गहराई, पहले की समझ की तुलना में अधिक समृद्ध श्रेणी के एडेप्टिव इन-कॉन्टेक्स्ट लर्निंग एल्गोरिदम को सक्षम करती है।

Ravin Raj, Gautam Reddy2026-06-16
🤖 AI

User as Code: Executable Memory for Personalized Agents

यह शोध पत्र 'यूजर एज़ कोड' (UaC) को प्रस्तुत करता है, जो एक ऐसा प्रतिमान (पैराडाइम) है जो व्यक्तिगत एजेंट मेमोरी को असंरचित टेक्स्ट के बजाय निष्पादन योग्य पायथन कोड के रूप में निरूपित करता है, जिससे ऐतिहासिक डेटा को एकत्रित करने, विरोधाभासों को सुलझाने और नियतात्मक गणना (डिटरमिनिस्टिक कम्प्यूटेशन) के माध्यम से सुरक्षा नियमों को सक्रिय रूप से लागू करने में उत्कृष्ट प्रदर्शन सक्षम होता है।

Bojie Li2026-06-16
🤖 AI

AgentFairBench: Do LLM Agents Discriminate When They Act?

यह शोध पत्र AgentFairBench प्रस्तुत करता है, जो LLM एजेंटों के कार्यों में जनसांख्यिकीय असमानताओं को मापने के लिए एक लागत प्रभावी, बहु-डोमेन बेंचमार्क और कार्यप्रणाली है, जो यह प्रकट करता है कि सांख्यिकीय शोर (statistical noise) और परीक्षण की अरिटी (test arity) को उचित रूप से ध्यान में रखने पर, Claude Haiku 4.5 जैसे उन्नत मॉडल भर्ती, ऋण देने या चिकित्सा ट्राइएज (medical triage) परिदृश्यों में कोई महत्वपूर्ण भेदभावपूर्ण प्रभाव प्रदर्शित नहीं करते हैं।

Triveni Morla, Rohith Reddy Bellibaltu, Manpreet Singh, Manmeet Singh Kapoor2026-06-16