🤖 AI

SearchSkill: Teaching LLMs to Use Search Tools with Evolving Skill Banks

यह शोधपत्र SearchSkill का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो पुन: प्रयोज्य खोज कौशल के एक विकसित होते SkillBank के माध्यम से क्वेरीज़ की स्पष्ट रूप से योजना बनाकर भाषा मॉडलों के ओपन-डोमेन प्रश्न उत्तर देने की क्षमता को बढ़ाता है, जिससे बर्बाद होने वाले खोज बजट को कम करके और परमाणु (atomic), केंद्रित क्वेरीज़ को बढ़ावा देकर पुनर्प्राप्ति दक्षता और उत्तर सटीकता में सुधार होता है।

Jinchao Hu, Meizhi Zhong, Kehai Chen, Min Zhang2026-05-12
🤖 AI

Phase Transitions in Affective Meaning Divergence: The Hidden Drift Before the Break

यह शोध पत्र भावनात्मक अर्थ विचलन (AMD) को संबंध टूटने के एक महत्वपूर्ण भविष्यवक्ता के रूप में औपचारिक रूप देता है, जो गेम-थ्योरेटिक मॉडलिंग और संवादात्मक डेटा के अनुभवजन्य विश्लेषण के माध्यम से यह प्रदर्शित करता है कि बातचीत में मरम्मत समन्वय (repair coordination) में एक अचानक, हिस्टेरेटिक पतन होता है जब AMD-जनित भार एक विशिष्ट सीमा से अधिक हो जाता है, जो कि एक ऐसी घटना है जो पारंपरिक विषाक्तता और भावना मेट्रिक्स से बेहतर प्रदर्शन करने वाले विशिष्ट क्रिटिकल-स्लोइंग-डाउन हस्ताक्षरों द्वारा लक्षित है।

Napassorn Litchiowong2026-05-12
🤖 AI

Octopus Protocol: One-Shot Hardware Discovery and Control for AI Agents via Infrastructure-as-Prompts

ऑक्टोपस प्रोटोकॉल (Octopus Protocol) एक लैंग्वेज-मॉडल-संचालित कोडिंग एजेंट का उपयोग करके विविध हार्डवेयर के लिए टाइप किए गए कंट्रोल टूल्स को स्वचालित रूप से खोजने, इंटरफेस करने और तैनात करने के माध्यम से, एकल शेल कमांड द्वारा क्लोज्ड-लूप विजुअल-मोटर कंट्रोल को सक्षम बनाकर, AI एजेंट्स के लिए हार्डवेयर इंटीग्रेशन की इंजीनियरिंग लागत को समाप्त करता है।

Quilee Simeon, Justin M. Wei, Yile Fan2026-05-12
🤖 AI

Single-Configuration Attack Success Rate Is Not Enough: Jailbreak Evaluations Should Report Distributional Attack Success

यह स्थिति पत्र तर्क देता है कि एकल-कॉन्फ़िगरेशन सफलता दरों पर निर्भर वर्तमान जेलब्रेक मूल्यांकन खतरों को चित्रित करने के लिए अपर्याप्त हैं और पैरामीटर विविधताओं के माध्यम से हमले के प्रदर्शन के पूर्ण दायरे को बेहतर ढंग से पकड़ने के लिए वेरिएंट सेंसिटिविटी मेजर (VSM) और यूनियन कवरेज (UC) जैसे वितरण संबंधी मेट्रिक्स को अपनाने का प्रस्ताव देता है।

Carsten Maple, Abhishek Kumar, Riya Tapwal2026-05-12
🤖 AI

Robust Multi-Agent LLMs under Byzantine Faults

यह शोध पत्र सेल्फ-एंकोर्ड कंसेंसस (SAC) को प्रस्तुत करता है, जो एक पूर्णतः विकेंद्रीकृत इटरेटिव फ़िल्टर-एंड-रिफ़ाइन प्रोटोकॉल है जो लार्ज लैंग्वेज मॉडल मल्टी-एजेंट सिस्टम को असुरक्षित लीडर-आधारित समन्वय या स्व-रिपोर्टेड कॉन्फिडेंस पर निर्भर रहे बिना, विविध संचार टोपोलॉजी में बायज़ेंटाइन दोषों का मजबूती से प्रतिरोध करने और विश्वसनीय प्रदर्शन बनाए रखने में सक्षम बनाता है।

Haejoon Lee, Vincent-Daniel Yun, Hyeonho Oh, Dimitra Panagou, Sai Praneeth Karimireddy2026-05-12
🤖 AI

CauSim: Scaling Causal Reasoning with Increasingly Complex Causal Simulators

CauSim एक ऐसा फ्रेमवर्क है जो LLMs को तेजी से जटिल, निष्पादन योग्य स्ट्रक्चरल कॉज़ल मॉडल्स (SCMs) बनाने में सक्षम बनाकर कॉज़ल रीजनिंग डेटा की कमी को दूर करता है, जो सत्यापन योग्य प्रशिक्षण डेटा उत्पन्न करने के लिए स्केलेबल सिम्युलेटर्स के रूप में कार्य करते हैं और विविध प्रस्तुतियों (representations) में मॉडल के प्रदर्शन में सुधार करते हैं।

Nicolás Astorga, Anita Kriz, Mihaela van der Schaar2026-05-12
🤖 AI

Constant-Target Energy Matching: A Unified Framework for Continuous and Discrete Density Estimation

यह शोधपत्र कॉन्स्टेंट-टारगेट एनर्जी मैचिंग (CTEM) को प्रस्तुत करता है, जो एक एकीकृत ऊर्जा-आधारित ढांचा है जो अनबाउंडेड रेश्यो रिग्रेशन को 1 के कॉन्स्टेंट टार्गेट वाले बाउंडेड एनर्जी-डिफरेंस ऑब्जेक्टिव में बदलकर निरंतर (continuous), असतत (discrete) और मिश्रित-चर डोमेन में स्थिर और प्रभावी डेंसिटी एस्टीमेशन को सक्षम बनाता है।

Zhijun Zeng, Yixuan Jiang, Pipi Hu, Zuoqiang Shi2026-05-12
🤖 AI

Field-Localized Forgery Detection for Digital Identity Documents

यह शोध पत्र FLiD का प्रस्ताव करता है, जो एक हल्का फील्ड-लोकलाइज्ड फ्रेमवर्क है जो विशिष्ट चेहरे और टेक्स्ट क्षेत्रों को लक्षित करके डिजिटल पहचान दस्तावेजों में जालसाजी का पता लगाता है, और मौजूदा फुल-डॉक्यूमेंट और सामान्य-उद्देश्य वाले मैनिपुलेशन डिटेक्टरों की तुलना में बेहतर सटीकता और काफी कम कम्प्यूटेशनल लागत प्राप्त करता है।

Abhishek Kumar, Riya Tapwal, Carsten Maple, Mark Hooper2026-05-12
🤖 AI

When (and How) to Trust the Expert: Diagnosing Query-Time Expert-Guided Reinforcement Learning

यह शोध पत्र एक साझा बैकबोन और व्यापक बेंचमार्क पर क्वेरी-टाइम विशेषज्ञ-निर्देशित सुदृढीकरण सीखने (रिनफोर्समेंट लर्निंग) विधियों के मूल्यांकन को सामंजस्यपूर्ण बनाता है ताकि तीन विशिष्ट विफलता मोड की पहचान की जा सके, यह प्रदर्शित करते हुए कि कोई भी एकल दृष्टिकोण सभी स्थितियों में हावी नहीं होता है और विशेषज्ञ की गुणवत्ता एवं कार्य विशेषताओं के आधार पर विधि चयन के मार्गदर्शन के लिए एक निर्णय नियम प्रदान करता है।

Yann Berthelot, Philippe Preux, Riad Akrour2026-05-12
🤖 machine learning

Contextual Plackett-Luce: An Efficient Neural Model for Probabilistic Sequence Selection under Ambiguity

यह शोध पत्र कॉन्टेक्स्टुअल प्लैकेट-लूस (CPL) का प्रस्ताव करता है, जो एक कुशल न्यूरल मॉडल है जो अस्पष्ट, मल्टी-मोडल अनुक्रम भविष्यवाणी कार्यों को प्रभावी ढंग से संभालने के लिए समानांतर स्कोरिंग को एक हल्के ऑटोरेग्रेसिव चयन प्रक्रिया के साथ जोड़ता है और साथ ही गणनात्मक दक्षता बनाए रखता है।

Noam Mizrachi, Nadav Har-Tuv, Shai Shalev-Shwartz2026-05-12✓ Author reviewed