🤖 AI

HALLMARK: Diagnosing Three Failure Modes in LLM Citation Verifiers

यह शोधपत्र HALLMARK को पेश करता है, जो LLMs में साइटेशन हेलोसिनेशन (citation hallucination) के निदान के लिए एक व्यापक बेंचमार्क है, जो यह प्रकट करता है कि वास्तविक फैब्रिकेशन्स को चूकने की उच्च लागत के बावजूद, फॉल्स-पॉजिटिव दरएं—न कि रिकॉल—साइटेशन वेरीफायर की तैनात करने योग्यता (deployability) को निर्धारित करने वाला महत्वपूर्ण बॉटलनेक हैं।

Patrik Reizinger, Wieland Brendel2026-07-23
🤖 machine learning

Recovering Clinical Utility Under Differential Privacy: Empirical Validation of Adaptive Federated Aggregation on Heterogeneous Cardiovascular Datasets

यह शोध पत्र पांच वास्तविक दुनिया के विषम हृदय रोग संबंधी डेटासेट पर FedCVR ढांचे को अनुभवजन्य रूप से मान्य करता है, जो यह प्रदर्शित करता है कि इसका सर्वर-साइड अनुकूली एकत्रीकरण (adaptive aggregation) एक व्यवहार्य गोपनीयता बजट बनाए रखते हुए मानक FedAvg की तुलना में सांख्यिकीय रूप से बेहतर नैदानिक प्रदर्शन प्राप्त करने के लिए डिफरेंशियल प्राइवेसी शोर (differential privacy noise) को प्रभावी ढंग से कम करता है।

Rodrigo Tertulino, Laercio Alencar, Ricardo Almeida2026-07-23
💻 computer science

ChannelGuard: Safe Models Do Not Compose into Safe Multi-Agent Systems

यह शोध पत्र ChannelGuard को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त (training-free), रक्षा-इन-डेप्थ (defense-in-depth) ढांचा है जो प्रत्येक इंटर-एजेंट चैनल पर नियतात्मक सूचना-अवरोध गेट्स (deterministic information-bottleneck gates) रखकर मल्टी-एजेंट LLM सिस्टम को सुरक्षित करता है, जिससे अपारदर्शी प्रदाता-पक्ष फिल्टरों या अतिरिक्त LLM कॉल्स पर निर्भर रहे बिना टूल पॉइजनिंग को प्रभावी ढंग से रोका जा सकता है और प्रॉम्प्ट इंजेक्शन की सफलता दर को कम किया जा सकता है।

Elias Hossain, Md Mehedi Hasan Nipu, Fatema Tuj Johora Faria, Tasfia Nuzhat Ornee, Maleeha Sheikh2026-07-23
💻 computer science

Building Trust in Autonomous Commerce: A Verifiable Global Event Timeline and AI-Ready Fraud Intelligence Layer

यह शोध पत्र एजेंटिक कॉमर्स के लिए एक सत्यापन योग्य वैश्विक घटना टाइमलाइन और एआई-रेडी फ्रॉड इंटेलिजेंस लेयर का प्रस्ताव करता है जो छेड़छाड़-रोधी ऑडिटेबिलिटी, प्रतिलिपि योग्य क्रमबद्धता और क्रिप्टोग्राफिक रूप से हस्ताक्षरित फ्रॉड मार्कर्स प्रदान करने के लिए डिटरमिनिस्टिक इवेंट स्कीमा, मर्केल-आधारित कमिटमेंट्स और ब्लॉकचेन एंकरिंग को जोड़ता है, जिससे प्रोटोटाइप कार्यान्वयन में उच्च-प्रदर्शन सत्यापन और लॉगरिदमिक प्रूफ आकार प्राप्त होता है।

Rajat Srivastava2026-07-23
💻 computer science

Intelligent Disruption: Undetectable Attacks on Wireless Autoencoders

यह शोध पत्र एक डीप लर्निंग-आधारित इंटेलिजेंट अटैक फ्रेमवर्क प्रस्तावित करता है जो संचयी लीकेज इंटरफेरेंस (cumulative leakage interference) को कम करने के लिए डीप न्यूरल नेटवर्क ट्रांसमिट पावर कंट्रोल और अनुकूलन योग्य गड़बड़ी (adaptive perturbations) उत्पन्न करने के लिए कंडीशनल जेनेरेटिव एडवरसैरियल नेटवर्क को जोड़ता है, जिससे जटिल, गतिशील वातावरण में वायरलेस ऑटोएनकोडर्स पर एडवरसैरियल हमलों की अनडिटेक्टेबिलिटी (undetectability), एग्रेसिविटी (aggressivity) और एडेप्टेबिलिटी (adaptability) को बढ़ाया जा सके।

Han Jiang, Jifa Zhang, Hu Jin, Nan Zhao, Mingqian Liu, Yunfei Chen2026-07-23
💻 computer science

When HTTP 402 Meets the Blockchain: Risks on Emerging x402 Payments

यह शोध पत्र उभरते हुए x402 भुगतान प्रोटोकॉल का पहला व्यवस्थित सुरक्षा विश्लेषण प्रस्तुत करता है, जो सभी 15 मूल्यांकित सुविधा प्रदाताओं (facilitators) में गंभीर कमजोरियों को उजागर करता है जो संपत्ति की चोरी और सेवा से इनकार जैसे गंभीर हमलों को सक्षम बनाती हैं, साथ ही एक पहचान उपकरण का प्रस्ताव देता है और जिम्मेदार प्रकटीकरण के बाद उद्योग-व्यापी शमन उपायों को प्रलेखित करता है।

Qinying Wang, Yong Yang, Yuan Chen, Shouling Ji, Mathias Payer2026-07-23
🤖 machine learning

End-to-End Differential Privacy in Training Deep Neural Network Classifiers

यह शोध पत्र एक एंड-टू-एंड डिफरेंशियल प्राइवेट प्रशिक्षण ढांचे का प्रस्ताव करता है जो सॉफ्टमैक्स आउटपुट पर डिरिचलेट मैकेनिज्म को लागू करके और टाइट बाउंड्स के लिए रेनी डिफरेंशियल प्राइवेसी का लाभ उठाकर केवल संवेदनशील इनपुट्स को निजीकृत करता है और लेबल्स को सार्वजनिक रखता है, जिससे विभिन्न प्राइवेसी बजटों के तहत कई डेटासेट्स पर अत्याधुनिक सटीकता प्राप्त होती है।

Huaiyuan Rao, Calvin Hawkins, Alexander Benvenuti, Matthew Hale2026-07-23
💬 NLP

Twin Agent: Context Residual Compression for Privilege Separated Agents

यह शोध पत्र ट्विन एजेंट (Twin Agent) का प्रस्ताव करता है, जो एक सामान्य विशेषाधिकार पृथक्करण ढांचा (privilege separation framework) है जो एक एक्सप्लोर एजेंट (Explore Agent) का उपयोग अविश्वसनीय संदर्भ (untrusted context) को संसाधित करने के लिए और केवल संक्षिप्त संकेतों (compact hints) को सेफ एजेंट (Safe Agent) के साथ संचारित करने के लिए करता है, जिससे विविध बेंचमार्क में प्रॉम्प्ट इंजेक्शन हमलों के विरुद्ध सुरक्षा और कार्य उपयोगिता (task utility) के बीच एक इष्टतम संतुलन प्राप्त होता है।

Zhanhao Hu, Dennis Jacob, Xiao Huang, Zhaorun Chen, Bo Li, David Wagner2026-07-23
💻 computer science

An Automated Framework for Extracting Reachable Attack Chains from Cyber Threat Intelligence Reports

यह शोध पत्र एक स्वचालित ढांचे का प्रस्ताव करता है जो अनस्ट्रक्चर्ड साइबर थ्रेट इंटेलिजेंस रिपोर्टों से पूर्वशर्तों (preconditions) और पश्चातशर्तों (postconditions) के साथ स्ट्रक्चर्ड अटैक यूनिट्स को निकालने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, उन्हें प्रभावी रीचेबिलिटी एनालिसिस और मल्टी-स्टेज अटैक चेन रीजनिंग को सक्षम करने के लिए डैटलॉग (Datalog) नियमों में संकलित करता है।

Wenbo Hou, Ning Hu, Xueping Wang, Jiahao Gu, Wenjian Luo2026-07-23
🤖 machine learning

Know Your Agent: Reconnaissance-Driven Pentesting of AI Agents

यह शोध पत्र "नो योर एजेंट" (KYA) को पेश करता है, जो एक ऐसा फ्रेमवर्क है जो लक्षित प्रोफाइल बनाने और अधिक शक्तिशाली इनडायरेक्ट प्रॉम्प्ट इंजेक्शन हमलों को तैयार करने के लिए एआई एजेंटों की व्यवस्थित रूप से जांच करके उनके ब्लैक-बॉक्स, टोही-संचालित (रेकनाइसेंस-ड्रिवन) पेन्टेस्टिंग को स्वचालित करता है।

Or Zion Eliav, Eyal Lenga, Shir Bernstien, Yisroel Mirsky2026-07-23