🤖 AI

Comparing AI Agents to Cybersecurity Professionals in Real-World Penetration Testing

यह शोध पत्र एक लाइव एंटरप्राइज वातावरण में मानव साइबर सुरक्षा पेशेवरों के विरुद्ध एआई एजेंटों का पहला व्यापक मूल्यांकन प्रस्तुत करता है, जो यह प्रदर्शित करता है कि प्रस्तावित मल्टी-एजेंट फ्रेमवर्क ARTEMIS ने वैध कमजोरियों को खोजने में दस में से नौ मानव प्रतिभागियों को पीछे छोड़ दिया और GUI-आधारित कार्यों को संभालने में वर्तमान सीमाओं और उच्च फाल्स-पॉजिटिव दरों के बावजूद महत्वपूर्ण लागत लाभ प्रदान किए।

Justin W. Lin, Eliot Krzysztof Jones, Donovan Julian Jasper, Ethan Jun-shen Ho, Anna Wu, Arnold Tianyi Yang, Neil Perry (…)2026-03-04
💻 computer science

zkCraft: Prompt-Guided LLM as a Zero-Shot Mutation Pattern Oracle for TCCT-Powered ZK Fuzzing

zkCraft एक व्यावहारिक ढांचा है जो म्यूटेशन पैटर्न उत्पन्न करने के लिए प्रॉम्प्ट-निर्देशित LLMs का लाभ उठाता है और ज़ीरो-नॉलेज सर्किट्स में सिमेंटिक विसंगतियों का कुशलतापूर्वक पता लगाने के लिए एक नवीन प्रूफ-बेयरिंग सर्च मैकेनिज्म का उपयोग करता है, जिससे सॉल्वर निर्भरता को कम करते हुए औपचारिक सत्यापन (फॉर्मल वेरिफिकेशन) और स्वचालित डिबगिंग के बीच के अंतर को पाटा जा सकता है।

Rong Fu, Jia Yee Tan, Youjin Wang, Ziyu Kong, Zeli Su, Zhaolu Kang, Shuning Zhang, Xianda Li, Kun Liu, Simon Fong2026-03-04
💻 computer science

Deep Learning for Contextualized NetFlow-Based Network Intrusion Detection: Methods, Data, Evaluation and Deployment

यह शोध पत्र विधियों के चार-आयामी वर्गीकरण का प्रस्ताव करते हुए, वास्तविक और एन्क्रिप्टेड नेटवर्क वातावरण में मल्टी-फ्लो अटैक अभियानों का विश्वसनीय पता लगाने को सुनिश्चित करने के लिए मूल्यांकन संबंधी कमियों और परिचालन संबंधी बाधाओं को आलोचनात्मक रूप से संबोधित करते हुए, नेटफ्लो-आधारित नेटवर्क घुसपैठ का पता लगाने के लिए संदर्भ-जागरूक (context-aware) डीप लर्निंग में हालिया प्रगति का संश्लेषण करता है।

Abdelkader El Mahdaouy, Issam Ait Yahia, Soufiane Oualil, Ismail Berrada2026-03-04
🤖 AI

SuperLocalMemory: Privacy-Preserving Multi-Agent Memory with Bayesian Trust Defense Against Memory Poisoning

SuperLocalMemory एक गोपनीयता-संरक्षित, स्थानीय-प्रथम मल्टी-एजेंट मेमोरी सिस्टम है जो क्लाउड इंफ्रास्ट्रक्चर या LLM इन्फरेंस पर निर्भर रहे बिना, आर्किटेक्चरल आइसोलेशन और बेयसियन ट्रस्ट स्कोरिंग के माध्यम से मेमोरी पॉइजनिंग हमलों को रोकता है और एडेप्टिव री-रैंकिंग के माध्यम से रिट्रीवल सटीकता को बढ़ाता है।

Varun Pratap Bhardwaj2026-03-04
🤖 AI

Quantifying Frontier LLM Capabilities for Container Sandbox Escape

यह शोध पत्र SANDBOXESCAPEBENCH प्रस्तुत करता है, जो एक ओपन बेंचमार्क है जिसे विभिन्न कमजोरियों का फायदा उठाकर कंटेनरीकृत सैंडबॉक्स वातावरण से बाहर निकलने की फ्रंटियर लार्ज लैंग्वेज मॉडल्स की क्षमता का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो यह प्रदर्शित करता है कि सक्षम मॉडल त्रुटियां मौजूद होने पर इन आइसोलेशन परतों को सफलतापूर्वक तोड़ सकते हैं।

Rahul Marchand, Art O Cathain, Jerome Wynne, Philippos Maximos Giavridis, Sam Deverett, John Wilkinson, Jason Gwartz, Ha (…)2026-03-04
🤖 AI

ZeroDayBench: Evaluating LLM Agents on Unseen Zero-Day Vulnerabilities for Cyberdefense

यह शोध पत्र ZeroDayBench प्रस्तुत करता है, जो ओपन-सोर्स कोडबेस में 22 नवीन ज़ीरो-डे (zero-day) कमजोरियों को स्वायत्त रूप से खोजने और उन्हें पैच करने की क्षमता पर फ्रंटियर LLM एजेंटों का मूल्यांकन करने वाला एक बेंचमार्क है, जिससे यह पता चलता है कि वर्तमान मॉडल अभी भी ऐसे सक्रिय साइबर रक्षा कार्यों को विश्वसनीय रूप से करने में सक्षम नहीं हैं।

Nancy Lau, Louis Sloot, Jyoutir Raj, Giuseppe Marco Boscardin, Evan Harris, Dylan Bowman, Mario Brajkovski, Jaideep Chaw (…)2026-03-04
⚡ electrical engineering

Authenticated Contradictions from Desynchronized Provenance and Watermarking

यह शोध पत्र "इंटीग्रिटी क्लैश" (Integrity Clash) की पहचान और अनुभवजन्य रूप से प्रदर्शन करता है, जो एक ऐसी भेद्यता है जहाँ डिजिटल संपत्तियां अपनी तकनीकी स्वतंत्रता के कारण मानव लेखकत्व का दावा करने वाले वैध C2PA प्रोवेनेंस (provenance) और AI-जनित वॉटरमार्क को एक साथ धारण कर सकती हैं, और एक क्रॉस-लेयर ऑडिट प्रोटोकॉल प्रस्तावित करता है जो दोनों संकेतों का संयुक्त रूप से मूल्यांकन करके इस विरोधाभास को हल करता है ताकि 100% वर्गीकरण सटीकता प्राप्त की जा सके।

Alexander Nemecek, Hengzhi He, Guang Cheng, Erman Ayday2026-03-04
💻 computer science

TraceGuard: Process-Guided Firewall against Reasoning Backdoors in Large Language Models

TraceGuard एक प्रक्रिया-निर्देशित सुरक्षा ढांचा है जो स्वचालित फोरेंसिक संश्लेषण, स्टेप-अवेयर फाइन-ट्यूनिंग और वेरीफायर-गाइडेड रीइन्फोर्समेंट लर्निंग को नियोजित करके कॉम्पैक्ट लैंग्वेज मॉडल्स को मजबूत रीजनिंग फायरवॉल में परिवर्तित करता है ताकि लेक्सिकल ओवरफिटिंग की सीमाओं को पार करते हुए रीजनिंग बैकडोर्स का पता लगाया जा सके और उन्हें कम किया जा सके।

Zhen Guo, Shanghao Shi, Hao Li, Shamim Yazdani, Ning Zhang, Reza Tourani2026-03-04
💻 computer science

Composable Attestation: A Generalized Framework for Continuous and Incremental Trust in AI-Driven Distributed Systems

यह शोध पत्र "कंपोजेबल अटेस्टेशन" (composable attestation) प्रस्तुत करता है, जो एक सामान्यीकृत क्रिप्टोग्राफिक ढांचा है जो ट्रांजिटिविटी (transitivity) और डिटरमिनिज्म (determinism) जैसे गणितीय गुणों के साथ-साथ मर्केल ट्री (Merkle trees) जैसी संरचनाओं का लाभ उठाकर AI-संचालित वितरित प्रणालियों में मॉड्यूलर, निरंतर और वृद्धिशील विश्वास सत्यापन को सक्षम बनाता है ताकि पूर्ण प्रणाली पुन: प्रमाणीकरण की आवश्यकता से बचा जा सके।

Sheng Sun, Sarah Evans2026-03-04
💻 computer science

Extending the Formalism and Theoretical Foundations of Cryptography to AI

यह शोधपत्र एक एकीकृत सुरक्षा खेल (security game), एक हमला वर्गीकरण (attack taxonomy), और एक मॉड्यूलर अपघटन ढांचे (modular decomposition framework) को पेश करके स्वायत्त एआई एजेंटों को सुरक्षित करने के लिए एक औपचारिक आधार स्थापित करता है, जो एक्सेस कंट्रोल के बारे में सिद्धांतपूर्ण तर्क करने में सक्षम बनाता है, डेटा गोपनीयता और सिस्टम पूर्णता के बीच मौलिक समझौतों (trade-offs) को प्रकट करता है, और मॉड्यूलर सुरक्षा डिजाइनों की सुदृढ़ता को सिद्ध करता है।

Federico Villa, F. Betül Durak, Tadayoshi Kohno, Tapdig Maharramli, Franziska Roesner2026-03-04