💻 computer science

From Frontier to Shadow AI: A Simmering Threat to Assurance and Security in Critical Infrastructure

यह शोध पत्र ऑस्ट्रेलियाई महत्वपूर्ण बुनियादी ढांचे में शैडो एआई (shadow AI) का पहला अनुभवजन्य अध्ययन प्रस्तुत करता है, जो यह प्रकट करता है कि कैसे फ्रंटियर एआई का अनधिकृत उपयोग डेटा बाईपास, अनअसेस्ड क्षमता विस्तार और अवलोकन क्षमता की हानि के माध्यम से आश्वासन और सुरक्षा को क्षीण करता है, जिससे प्रणालीगत जोखिमों को कम करने के लिए अनुकूलित शासन रणनीतियों की आवश्यकता होती है।

Mohan Baruwal Chhetri, Shahroz Tariq, Tooba Aamir, Marthie Grobler, Chandra Thapa, Ronal Singh2026-06-02
🤖 AI

Persona Attack: Incremental Memory Injection Jailbreak Attack against Large Language Models

यह शोध पत्र "पर्सोना अटैक" (Persona Attack) को प्रस्तुत करता है, जो एक नवीन जेलब्रेक विधि है जो एक लार्ज लैंग्वेज मॉडल की कन्वर्सेशन मेमोरी में निर्देशों को क्रमिक रूप से इंजेक्ट करके उसके कॉन्टेक्स्ट विंडो को मैनिपुलेट करती है, यह प्रदर्शित करते हुए कि इन इंजेक्शनों को संचित करना सुरक्षा संरेखण (safety alignments) को ओवरराइड कर सकता है और विभिन्न मॉडलों एवं निर्देश कॉन्फ़िगरेशन में 95% तक हमला सफलता दर प्राप्त कर सकता है।

Junyoung Park, Seongyong Ju, Sunghwan Park, Jaewoo Lee2026-06-02
💻 computer science

Inferring Routing-Layer Defense Mechanisms from Observable Behavior in OLSR-Based MANETs

यह अध्ययन प्रदर्शित करता है कि OLSR-आधारित MANETs में फिक्टिव मिटिगेशन (Fictive Mitigation) डिफेंस के गुप्त डिज़ाइन के बावजूद, मशीन लर्निंग मॉडल निष्क्रिय रूप से अवलोकन योग्य रूटिंग डायनेमिक्स से इसकी उपस्थिति का सफलतापूर्वक अनुमान लगा सकते हैं, उच्च सटीकता प्राप्त कर सकते हैं और यह प्रकट कर सकते हैं कि मोबिलिटी-प्रशिक्षित मॉडल नेटवर्क की स्थितियों में बेहतर सामान्यीकरण करते हैं।

Nadav Schweitzer, Kiril Danilchenko, Ariel Stulman2026-06-02
🤖 machine learning

Bit-Exact AI Inference Verification Without Performance Tradeoffs

यह शोध पत्र यह प्रदर्शित करता है कि नियत (deterministic) आउटपुट को पुन: गणना करने के लिए केवल सॉफ्टवेयर-आधारित इम्यूलेशन का लाभ उठाकर, बिना किसी प्रदर्शन संबंधी समझौते के बिट-सटीक (bit-exact) AI इन्फरेंस सत्यापन प्राप्त किया जा सकता है, जिससे संचित राउंडिंग त्रुटियों को ऑडिट योग्य हस्ताक्षरों में परिवर्तित किया जा सके जो गुप्त विरोधियों को GPU गैर-नियतता (non-determinism) का लाभ उठाने से रोकते हैं।

Naci Cankaya2026-06-02
🤖 machine learning

Same Payload, Different Channel: Measuring Trust Asymmetry in Tool-Using Language Models

यह शोध पत्र सेफ्टी एसिमेट्री स्कोर (SAS) को प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि टूल का उपयोग करने वाले भाषा मॉडल चैनल-निर्भर विश्वास पूर्वाग्रह प्रदर्शित करते हैं, जो उपयोगकर्ता संदेशों की तुलना में टूल मेटाडेटा या आउटपुट के माध्यम से वितरित किए जाने पर समान प्रतिकूल पेलोड के प्रति काफी अधिक संवेदनशील हो जाते हैं, एक ऐसी घटना जो गैर-रेखीय सुरक्षा निरूपण और टूल डेटा को विश्वसनीय निर्देशों के रूप में निहित उपचार द्वारा संचालित होती है।

Mohammed Sameer Syed (University of Arizona), Rozhin Yasaei (University of Arizona)2026-06-02
💻 computer science

NICE: A Framework for Declarative and Machine-Checkable Vulnerability Reproduction

यह शोध पत्र NICE को प्रस्तुत करता है, जो विविध श्रेणियों और लक्षित प्रकारों में सॉफ़्टवेयर कमजोरियों को मान्य करने के लिए मशीन-जांच योग्य, पुनरुत्पादक और साझा करने योग्य वातावरण बनाने हेतु NixOS डिक्लेरेटिव रेसिपीज़ का लाभ उठाता है।

Minh-Luân Nguyen, Olivier Levillain, Julien Malka, Stefano Zacchiroli, Théo Zimmermann2026-06-02
💻 computer science

GCVE: A Decentralized Model for Vulnerability Identification, Publication, and Operational Enrichment

यह शोध पत्र GCVE प्रस्तुत करता है, जो एक विकेंद्रीकृत सामाजिक-तकनीकी मॉडल है जो अद्वितीय पहचान, वितरित प्रकाशन और सुरक्षा ज्ञान के परिचालन संवर्धन के लिए एक वैश्विक, मुक्त बुनियादी ढांचे को स्थापित करके केंद्रीकृत भेद्यता नियंत्रण और स्वतंत्र सलाहकार प्रकाशन के बीच के अंतर को पाटता है।

Alexandre Dulaunoy2026-06-02
💻 computer science

Framework for Discovering GPS Spoofing Attacks in Drone Swarms

यह शोध पत्र सुरक्षा खतरों के एक नए वर्ग को पहचानता है जिसे स्वार्म प्रोपेगेशन वल्नरेबिलिटीजज़ (SPVs) कहा जाता है, जहाँ एक एकल ड्रोन की GPS स्पूफिंग से एक स्वार्म में कैस्केडिंग विफलताएं उत्पन्न होती हैं, और विभिन्न स्वार्म कंट्रोल एल्गोरिदम और टोपोलॉजी में इन कमजोरियों का प्रभावी ढंग से पता लगाने के लिए दो फज़िंग टूल्स, स्वार्मफज़ग्राफ (SwarmFuzzGraph) और स्वार्मफज़बाइनरी (SwarmFuzzBinary) का प्रस्ताव करता है।

Yingao Elaine Yao, Pritam Dash, Karthik Pattabiraman2026-06-02
🤖 AI

Adversarial Feeds Steer LLM Agent Decisions Against Their Defaults

यह शोध पत्र यह प्रदर्शित करता है कि बाहरी सूचना फीड का क्यूरेशन और क्रमबद्धता एलएलएम (LLM) एजेंटों को व्यवस्थित रूप से प्रतिकूल निर्णयों की ओर मोड़ सकती है, विशेष रूप से तब जब वे अनिश्चित होते हैं, जो यह प्रकट करता है कि सुरक्षा मूल्यांकनों को मॉडल का अलग से परीक्षण करने के बजाय अपस्ट्रीम अनुशंसाअर (recommender) परत का ऑडिट करना चाहिए।

Rana Muhammad Usman2026-06-02✓ Author reviewed
🤖 AI

Benchmarking Security Risk Detection and Verification in Open Agentic Skill Ecosystems

यह शोध पत्र SkillVetBench प्रस्तुत करता है, जो ओपन एजेंटिक स्किल इकोसिस्टम्स के लिए एक दो-चरणीय सुरक्षा बेंचमार्क है, जो उन दुर्भावनापूर्ण व्यवहारों का प्रभावी ढंग से पता लगाने और सत्यापन करने के लिए स्किल स्पेसिफिकेशन के सिमेंटिक विश्लेषण को एक इंस्ट्रुमेंटेड सैंडबॉक्स में रनटाइम निष्पादन के साथ जोड़ता है जिन्हें स्टैटिक विधियाँ मिस कर देती हैं।

Ismail Hossain, Sai Puppala, Zhuoran Lu, Sajedul Talukder, Nan Jiang2026-06-02