🤖 AI

Reasoning as Pattern Matching: Shared Mechanisms in Human and LLM Everyday Reasoning

यह शोध पत्र मानव और एलएलएम (LLM) तर्क के बीच के अंतर को इस तथ्य को प्रदर्शित करके चुनौती देता है कि दोनों ही अमूर्त विश्व मॉडलों (abstract world models) के बजाय पैटर्न-मैचिंग तंत्रों द्वारा संचालित समान त्रुटि पैटर्न प्रदर्शित करते हैं, जिसमें विशिष्ट एलएलएम अटेंशन हेड्स अप्रासंगिक विवरणों के कारण होने वाली मानवीय तर्क विफलताओं की भविष्यवाणी करने में सक्षम हैं।

Zach Studdiford, Gary Lupyan2026-06-12
🤖 AI

Beyond Runtime Enforcement: Shield Synthesis as Defensibility Analysis for Adversarial Networks

यह शोध पत्र तर्क देता है कि शील्ड संश्लेषण (shield synthesis) को सुरक्षित एजेंट नीतियों को लागू करने वाले एक रनटाइम तंत्र के रूप में प्राथमिक रूप से कार्य करने के बजाय, नेटवर्क सुरक्षा के बारे में औपचारिक "रक्षात्मक निर्णय" (defensibility verdicts) और वास्तुशिल्प अंतर्दृष्टि प्राप्त करने के लिए एक डिज़ाइन-टाइम विश्लेषणात्मक ढांचे के रूप में पुनर्कल्पित किया जाना चाहिए।

Achraf Hsain, Sultan Almuhammadi2026-06-12
🤖 AI

EurekAgent: Agent Environment Engineering is All You Need For Autonomous Scientific Discovery

यह शोध पत्र EurekAgent को प्रस्तुत करता है, जो एक स्वायत्त वैज्ञानिक खोज प्रणाली है जो अनुसंधान के केंद्र को एजेंट वर्कफ़्लो डिज़ाइन से बदलकर "एनवायरनमेंट इंजीनियरिंग" (वातावरण इंजीनियरिंग) पर स्थानांतरित कर देती है—अर्थात उत्पादक व्यवहारों को बढ़ाने और हानिकारक व्यवहारों को दबाने के लिए अनुमतियों, आर्टिफ़ेक्ट्स, बजट और मानवीय निरीक्षण को संरचित करना, जिससे गणित, कर्नेल इंजीनियरिंग और मशीन लर्निंग कार्यों में अत्याधुनिक परिणाम प्राप्त किए जा सकें।

Amy Xin, Jiening Siow, Junjie Wang, Zijun Yao, Fanjin Zhang, Jian Song, Lei Hou, Juanzi Li2026-06-12
🤖 AI

Agents-K1: Towards Agent-native Knowledge Orchestration

यह शोध पत्र Agents-K1 को प्रस्तुत करता है, जो एक एंड-टू-एंड पाइपलाइन है जो एक मल्टीमॉडल पार्सर, एक GRPO-प्रशिक्षित एक्सट्रैक्शन बैकबोन और एक एकीकृत रिट्रीवल इंटरफेस को एकीकृत करके कच्चे वैज्ञानिक दस्तावेजों को एजेंट-नेटिव नॉलेज ग्राफ में परिवर्तित करती है, जिसके परिणामस्वरूप बड़े पैमाने पर Scholar-KG डेटासेट प्राप्त होता है और वैज्ञानिक सूचना निष्कर्षण एवं मल्टी-हॉप रीजनिंग में बेहतर प्रदर्शन प्रदर्शित होता है।

Zongsheng Cao, Bihao Zhan, Jinxin Shi, Jiong Wang, Fangchen Yu, Zhijie Zhong, Zijie Guo, Tianshuo Peng, Zhuo Liu, Yi Xie (…)2026-06-12
🤖 AI

SpatialClaw: Rethinking Action Interface for Agentic Spatial Reasoning

यह शोधपत्र SpatialClaw को प्रस्तुत करता है, जो एक स्टेटफुल कोड निष्पादन इंटरफ़ेस (stateful code execution interface) का उपयोग करके विजन-लैंग्वेज मॉडल्स में ओपन-एंडेड 3D/4D स्थानिक तर्क (spatial reasoning) को बढ़ाता है, जिससे एजेंटों को धारणा संबंधी कार्यों (perception operations) को लचीले ढंग से संयोजित करने और मॉडल-विशिष्ट अनुकूलन के बिना 20 बेंचमार्क में अत्याधुनिक प्रदर्शन प्राप्त करने में सक्षम बनाया जाता है।

Seokju Cho, Ryo Hachiuma, Abhishek Badki, Hang Su, Byung-Kwan Lee, Chan Hee Song, Sifei Liu, Subhashree Radhakrishnan, S (…)2026-06-12
🤖 AI

LSTM based IoT Device Identification

यह शोध पत्र ऑल्टो यूनिवर्सिटी (Aalto university) के डेटासेट पर स्लाइडिंग-विंडो अनुक्रम लंबाई को अनुकूलित करके, कच्चे नेटवर्क पैकेट कैप्चर से 27 प्रकार के IoT उपकरणों की पहचान करने के लिए लॉन्ग शॉर्ट-टर्म मेमोरी (LSTM) नेटवर्क का उपयोग करते हुए एक एंड-टू-एंड मशीन लर्निंग पाइपलाइन प्रस्तुत करता है, जिसने 79.85% सटीकता और 75.70% मैक्रो-औसत F1-स्कोर प्राप्त किया है।

Kahraman Kostas2026-06-11
📊 statistics

Pass@K Policy Optimization: Solving Harder Reinforcement Learning Problems

यह शोधपत्र पास-एट-के (Pass-at-k) पॉलिसी ऑप्टिमाइजेशन (PKPO) को प्रस्तुत करता है, जो एक नवीन सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो पृथक प्रयासों के बजाय नमूना सेटों की सामूहिक सफलता (pass@k) को सीधे अनुकूलित करने के लिए निष्पक्ष अनुमानकों (unbiased estimators) को व्युत्पन्न करता है, जिससे k-एनीलिंग (k-annealing) के माध्यम से pass@1 प्रदर्शन को बनाए रखते हुए या उसमें सुधार करते हुए अन्वेषण को बढ़ावा मिलता है और कठिन समस्याओं को हल करने में मदद मिलती है।

Christian Walder, Deep Karkhanis2026-06-11
🤖 AI

\texttt{Range-Arithmetic}: Verifiable Deep Learning Inference on an Untrusted Party

यह शोध पत्र \texttt{Range-Arithmetic} को प्रस्तुत करता है, जो एक नवीन ढांचा (framework) है जो गैर-अंकगणितीय ऑपरेशनों को सम-चेक प्रोटोकॉल (sum-check protocols) और रेंज प्रमाणों (range proofs) के अनुकूल अंकगणितीय चरणों में परिवर्तित करके अविश्वसनीय पक्षों (untrusted parties) पर कुशल और सत्यापन योग्य डीप लर्निंग इन्फरेंस को सक्षम बनाता है, जिससे मौजूदा विधियों की तुलना में कम्प्यूटेशनल लागत और संचार ओवरहेड कम हो जाता है।

Ali Rahimi, Babak H. Khalaj, Mohammad Ali Maddah-Ali2026-06-11
🤖 AI

MLaGA: Multimodal Large Language and Graph Assistant

यह शोध पत्र MLaGA को प्रस्तुत करता है, जो एक नवीन मल्टीमॉडल असिस्टेंट है जो एक स्ट्रक्चर-अवेयर एनकोडर और इंस्ट्रक्शन-ट्यूनिंग का उपयोग करके विविध टेक्स्ट और इमेज एट्रिब्यूट्स वाले जटिल ग्राफ स्ट्रक्चर्स पर प्रभावी ढंग से तर्क करने के माध्यम से ग्राफ विश्लेषण के अंतराल को पाटता है।

Dongzhe Fan, Yi Fang, Jiajin Liu, Djellel Difallah, Qiaoyu Tan2026-06-11