💬 NLP

Plato's Cave: A Human-Centered Research Verification System

यह शोध पत्र प्लेटो के केव (Plato's Cave) को प्रस्तुत करता है, जो एक ओपन-सोर्स, मानव-केंद्रित प्रणाली है जो शोध पत्रों के तर्कों का एक निर्देशित अचक्रीय ग्राफ (directed acyclic graph) बनाकर, विश्वसनीयता स्कोर प्रदान करने के लिए वेब एजेंटों का उपयोग करके, और समग्र तर्कपूर्ण संरचना का मूल्यांकन करके शोध पत्रों को सत्यापित करती है और एक अंतिम मूल्यांकन उत्पन्न करती है।

Matheus Kunzler Maldaner, Raul Valle, Junsung Kim, Tonuka Sultan, Pranav Bhargava, Matthew Maloni, John Courtney, Hoang (…)2026-03-26
💻 computer science

The Free-Market Algorithm: Self-Organizing Optimization for Open-Ended Complex Systems

यह शोध पत्र फ्री-मार्केट एल्गोरिदम (FMA) को प्रस्तुत करता है, जो एक नवीन मेटाहेयुरिस्टिक (metaheuristic) है जो मुक्त-अंत वाले जटिल तंत्रों में पदानुक्रमित समाधान पथों को स्वायत्त रूप से खोजने के लिए उभरते हुए आपूर्ति-और-मांग गतिकी का उपयोग करता है, और पूर्व-निर्धारित फिटनेस फंक्शनों के बिना प्रीबायोटिक रासायनिक नेटवर्क के पुनर्निर्माण और मैक्रोइकॉनोमिक संकेतकों के पूर्वानुमान में अपनी प्रभावकारिता को सफलतापूर्वक प्रदर्शित करता है।

Martin Jaraiz2026-03-26
🤖 AI

AI-Generated Code Is Not Reproducible (Yet): An Empirical Study of Dependency Gaps in LLM-Based Coding Agents

यह अनुभवजन्य अध्ययन प्रकट करता है कि अत्याधुनिक एलएलएम (LLM) एजेंटों से उत्पन्न एआई-जनित कोड में वर्तमान में पूर्ण पुनरुत्पादकता का अभाव है, क्योंकि घोषित और वास्तविक रनटाइम निर्भरताओं के बीच महत्वपूर्ण अंतराल के कारण केवल 68.3% प्रोजेक्ट ही स्वच्छ वातावरण में सफलतापूर्वक निष्पादित होते हैं।

Bhanu Prakash Vangala, Ali Adibifar, Ashish Gehani, Tanu Malik2026-03-25
🤖 AI

STRIATUM-CTF: A Protocol-Driven Agentic Framework for General-Purpose CTF Solving

यह शोध पत्र STRIUM-CTF को प्रस्तुत करता है, जो एक मॉड्यूलर एजेंटिक फ्रेमवर्क है जो स्वायत्त, बहु-चरणीय साइबर सुरक्षा तर्क (reasoning) को सक्षम करने के लिए मॉडल कॉन्टेक्स्ट प्रोटोकॉल का लाभ उठाता है, जिसने 21 मानव टीमों को पछाड़ते हुए एक लाइव 2025 कैप्चर-द-फ्लैग प्रतियोगिता में प्रथम स्थान प्राप्त किया।

James Hugglestone, Samuel Jacob Chacko, Dawson Stoller, Ryan Schmidt, Xiuwen Liu2026-03-25
📊 statistics

Behavioral Heterogeneity as Quantum-Inspired Representation

यह शोध पत्र एक क्वांटम-प्रेरित ढांचे का प्रस्ताव करता है जो ड्राइवर की विषमता को डेंसिटी मैट्रिसेस (density matrices) द्वारा प्रतिनिधित्व किए गए विकसित होते गुप्त अवस्थाओं के रूप में मॉडल करता है, जिसमें अनुभवजन्य ड्राइविंग डेटा से व्यवहार संबंधी प्रोफाइल निकालने और विश्लेषण करने के लिए गैर-रेखीय रैंडम फूरियर फीचर्स (non-linear Random Fourier Features) और संदर्भ-निर्भर टेम्पोरल डायनेमिक्स का उपयोग किया गया है।

Mohammad Elayan, Wissam Kontar2026-03-25
💬 NLP

SciNav: A General Agent Framework for Scientific Coding Tasks

यह शोध पत्र SciNav को पेश करता है, जो वैज्ञानिक कोडिंग कार्यों के लिए एक सामान्य एजेंट फ्रेमवर्क है जो सीमित बजट के तहत उच्च-गुणवत्ता वाले समाधानों को कुशलतापूर्वक खोजने और चुनने के लिए एक ट्री सर्च प्रक्रिया के भीतर युग्मवार सापेक्ष निर्णयों (pairwise relative judgments) का लाभ उठाता है, जो विविध बेंचमार्क में मौजूदा प्रॉम्प्टिंग विधियों और पूर्ववर्ती एजेंटों से काफी बेहतर प्रदर्शन करता है।

Tianshu Zhang, Huan Sun2026-03-24
💻 computer science

Reason-to-Transmit: Deliberative Adaptive Communication for Cooperative Perception

यह शोध पत्र Reason-to-Transmit (R2T) को प्रस्तुत करता है, जो एक विचारशील अनुकूलन संचार ढांचा (deliberative adaptive communication framework) है जो बैंडविड्थ-कुशल सहकारी धारणा (cooperative perception) के लिए स्थानीय संदर्भ और सूचना अंतराल के बारे में तर्क करने हेतु एक हल्के ट्रांसफार्मर मॉड्यूल का उपयोग करता है, जो मौजूदा प्रतिक्रियात्मक विधियों की तुलना में महत्वपूर्ण प्रदर्शन लाभ प्रदर्शित करता है, विशेष रूप से उच्च-अवरोध (high-occlusion) वाले परिदृश्यों में।

Aayam Bansal, Ishaan Gangwani2026-03-24
💻 computer science

When Agents Disagree: The Selection Bottleneck in Multi-Agent LLM Pipelines

यह शोध पत्र एक "चयन बाधा" (selection bottleneck) थ्रेशोल्ड की पहचान करके मल्टी-एजेंट एलएलएम (LLM) प्रदर्शन पर परस्पर विरोधी निष्कर्षों को सुलझाता है, यह प्रदर्शित करते हुए कि उच्च-गुणवत्ता वाला जज-आधारित चयन संश्लेषण-आधारित एकत्रीकरण की तुलना में काफी बेहतर प्रदर्शन करता है और चयनकर्ता की गुणवत्ता, जनरेटर की विविधता की तुलना में अधिक महत्वपूर्ण डिज़ाइन लीवर है।

Artem Maryanskyy2026-03-24
💻 computer science

ALARA for Agents: Least-Privilege Context Engineering Through Portable Composable Multi-Agent Teams

यह शोधपत्र ALARA को प्रस्तुत करता है, जो एक डिक्लेरेटिव कॉन्टेक्स्ट-एजेंट-टूल (CAT) डेटा लेयर और \texttt{npcsh} कमांड-लाइन शेल है, जो संरचनात्मक रूप से पार्स की गई कॉन्फ़िगरेशन फाइलों के माध्यम से मल्टी-एजेंट सिस्टम के लिए लीस्ट-प्रिविलेज एक्सेस (न्यूनतम विशेषाधिकार पहुंच) को लागू करता है, जिससे व्यवहारगत परिवर्तनों की गारंटी सुनिश्चित होती है और विविध मॉडलों एवं कार्यों में एजेंट क्षमताओं के स्केलेबल, सहयोगात्मक प्रबंधन को सक्षम बनाया जाता है।

Christopher J. Agostino, Nayan D'Souza2026-03-24
💬 NLP

Measuring Reasoning Trace Legibility: Can Those Who Understand Teach?

यह शोध पत्र तर्क देता है कि रीजनिंग लैंग्वेज मॉडल्स का मूल्यांकन केवल उत्तर की शुद्धता पर ही नहीं, बल्कि उनके रीजनिंग ट्रेसेस (तर्क पथों) की सुपाठ्यता पर भी किया जाना चाहिए, जिसमें "ट्रांसफर यूटिलिटी" को एक मीट्रिक के रूप में पेश किया गया है और यह खुलासा किया गया है कि शीर्ष प्रदर्शन करने वाले मॉडल अक्सर कम सुपाठ्य ट्रेसेस उत्पन्न करते हैं, क्योंकि वर्तमान प्रशिक्षण विधियों में सुपाठ्यता के लिए कोई अंतर्निहित पुरस्कार नहीं है।

Dani Roytburg, Shreya Sridhar, Daphne Ippolito2026-03-24