Symmetry Defeats Auditing
यह शोध पत्र एक विशिष्ट हमले का प्रदर्शन करता है जो शेनॉय एवं अन्य (2026) द्वारा एआई प्रणालियों के ऑडिटिंग के लिए प्रस्तावित 'इंट्रोस्पेक्शन एडैप्टर्स' को विफल करने के लिए समरूपता (सिमेट्री) का लाभ उठाता है।
23845 पेपर
यह शोध पत्र एक विशिष्ट हमले का प्रदर्शन करता है जो शेनॉय एवं अन्य (2026) द्वारा एआई प्रणालियों के ऑडिटिंग के लिए प्रस्तावित 'इंट्रोस्पेक्शन एडैप्टर्स' को विफल करने के लिए समरूपता (सिमेट्री) का लाभ उठाता है।
यह शोधपत्र चीन में एक ऑडिट योग्य आपूर्ति श्रृंखला ज्ञान ग्राफ (knowledge graph) के निर्माण के लिए लार्ज लैंग्वेज मॉडल्स का उपयोग करते हुए एक स्केलेबल, स्निपेट-संचालित विधि का प्रस्ताव करता है जो फर्म और संबंध कवरेज दोनों में पारंपरिक प्रकटीकरण-आधारित बेंचमार्क से काफी बेहतर प्रदर्शन करता है और साथ ही प्रसंस्करण लागत को भी भारी रूप से कम करता है।
FPMoE एक हल्का, ओपन-सोर्स कोड जनरेशन मॉडल है जो फंक्शनल प्रोग्रामिंग भाषाओं में मौजूदा मॉडलों की सीमाओं को दूर करने के लिए समर्पित और साझा विशेषज्ञों के साथ एक स्पार्स मिक्स्चर-ऑफ-एक्सपर्ट्स आर्किटेक्चर का लाभ उठाता है, जिससे केवल 3B सक्रिय पैरामीटर्स के साथ बहुत बड़े मॉडलों के बराबर प्रदर्शन करते हुए Haskell, OCaml और Scala पर बेहतर प्रदर्शन प्राप्त होता है।
यह शोध पत्र TCP-MCP प्रस्तुत करता है, जो एक सह-विकास (co-evolution) ढांचा है जो एजेंट प्रॉम्प्ट और संचार टोपोलॉजी को संयुक्त रूप से अनुकूलित करता है ताकि मौजूदा मल्टी-एजेंट सिस्टम की तुलना में टोकन लागत को काफी कम करते हुए जटिल बेंचमार्क पर उच्च सटीकता प्राप्त की जा सके।
यह शोध पत्र संरेखित (aligned) भाषा मॉडलों में "भंगुर सुरक्षा" (brittle safety) का निदान करने के लिए "कॉन्टेक्स्ट-फ्लिप इवैल्यूएशन" (context-flip evaluation) प्रस्तुत करता है, जो यह प्रकट करता है कि वे सुरक्षा नियमों का इतनी कठोरता से पालन करते हैं कि परिस्थितिजन्य परिवर्तन उन कार्यों को हानिकारक बना देने पर भी वे नहीं बदलते, जो कि समझ की कमी के बजाय नीतिगत ओवरराइड्स (policy overrides) के कारण होने वाली विफलता है जो मानक क्रिया-स्तरीय गार्डरेल्स (action-level guardrails) की सीमाओं को उजागर करती है और राज्य-जागरूक (state-aware) वास्तुशिल्प समाधानों को प्रेरित करती है।
MolLingo एक मल्टी-एजेंट सिस्टम है जो एक साझा मेमोरी और एक नवीन BRICS-आधारित फ्रैगमेंटेशन प्रतिनिधित्व के माध्यम से विशेष एजेंटों को समन्वित करके आणविक डिजाइन को स्वचालित करता है ताकि रासायनिक संरचना और LLM सिमेंटिक्स के बीच के अंतर को पाटा जा सके, जिससे चिकित्सीय अनुकूलन (therapeutic optimization) में अत्याधुनिक प्रदर्शन प्राप्त होता है और यह दोनों फ्रंटियर LLMs और विशिष्ट बेसलाइन्स से बेहतर प्रदर्शन करता है।
यह शोध पत्र एक प्रोडक्शन-स्केल विज्ञापन प्रणाली प्रस्तुत करता है जो उपयोगकर्ता प्रोफाइल से संभावित विज्ञापनदाताओं का पूर्वानुमान लगाने के लिए एक फाइन-ट्यून्ड ओपन-सोर्स LLM को एक पूरक सहायक प्रेडिक्टर के रूप में एकीकृत करती है, जिससे कैंडिडेट जनरेशन को बढ़ाया जाता है और डाउनस्ट्रीम रैंकिंग के लिए सूचनात्मक प्रायर्स (priors) प्रदान किए जाते हैं ताकि महत्वपूर्ण ऑफलाइन और ऑनलाइन व्यावसायिक सुधार प्राप्त किए जा सकें।
DecomposeRL एक अर्ध-पर्यवेक्षित (semi-supervised), सुराग योग्य (traceable) क्लेम वेरिफिकेशन फ्रेमवर्क है जो एक डेटा-क्यूरेशन फनल और GRPO-आधारित सुदृढीकरण शिक्षण (reinforcement learning) का लाभ उठाकर एक संक्षिप्त 7B मॉडल को प्रशिक्षित करता है, जो बहुत बड़े बेसलाइन्स के समान प्रदर्शन प्राप्त करने के साथ-साथ व्याख्यात्मक तर्क ट्रेसेस (interpretable reasoning traces) भी उत्पन्न करता है।
यह अध्ययन प्रदर्शित करता है कि चार-हेड क्रॉस-अटेंशन से उन्नत एक डुअल मैसेज पासिंग न्यूरल नेटवर्क, विशिष्ट ड्रग-ड्रग इंटरेक्शन तंत्र की भविष्यवाणी करने में कॉनकैटिनेशन-आधारित और टेनरी ग्राफ आर्किटेक्चर दोनों से काफी बेहतर प्रदर्शन करता है, जैसा कि होल्ड-आउट एसिटिलसालिसिलिक एसिड पेयर्स पर पूर्ण सटीकता द्वारा सत्यापित किया गया है।
यह शोध पत्र FundaPod को प्रस्तुत करता है, जो एक मल्टी-पर्सोना एजेंट प्लेटफॉर्म है जो मानव-केंद्रित, पारदर्शी और सत्यापन योग्य मौलिक निवेश अनुसंधान का समर्थन करने के लिए एक नॉलेज ग्राफ मेमोरी सिस्टम का लाभ उठाता है, जिससे स्वतंत्र AI एजेंटों को साक्ष्य एकत्र करने और मानव निर्णय के लिए असहमति को सामने लाने में सक्षम बनाया जा सके।