🤖 AI

JavaVulBench: A Java Vulnerability Benchmark with Realistic Splits, a Unified Multi-Backend Harness, and a Leakage-Aware Evaluation Mode

यह शोध पत्र JavaVulBench को प्रस्तुत करता है, जो एक व्यापक जावा भेद्यता (vulnerability) बेंचमार्क है, जिसमें यथार्थवादी मूल्यांकन विभाजन के साथ एक बड़े पैमाने का, बहु-स्तर (multi-granularity) डेटासेट और एक एकीकृत हारनेस (harness) है जो कई बैकएंड्स के माध्यम से विविध एनकोडर और जनरेटिव मॉडल्स के निष्पक्ष, लीकेज-जागरूक तुलना को सक्षम बनाता है।

Norbert Sandor Szolnoki, Gabor Antal2026-07-07
🤖 AI

PromptPET: Privacy-Utility Optimized Prompt Obfuscation

यह शोध पत्र PROMPTPET को प्रस्तुत करता है, जो एक LLM-आधारित एजेंट है जो उपयोगकर्ता की गोपनीयता और चैटबॉट उपयोगिता के बीच के संतुलन को अनुकूलित करने के लिए उपयोगकर्ता के प्रॉम्प्ट में संवेदनशील जानकारी हेतु सबसे प्रभावी अस्पष्टीकरण क्रिया (रे redaction, अमूर्तीकरण, प्रतिस्थापन, या एक नवीन शोर/शोर-निवारण योजना) को गतिशील रूप से चुनता है।

Ke Yang, Olivia Figueira, Umar Iqbal, Athina Markopoulou2026-07-07
💻 computer science

Overloading Large Vision-Language Models for Jailbreaking

यह शोध पत्र एक नवीन "सूचना ओवरलोडिंग" (information overloading) जेलब्रेक हमले का प्रस्ताव करता है जो लार्ज विजन-लैंग्वेज मॉडल्स को जटिल मल्टीमॉडल इनपुट के साथ अभिभूत करने के लिए रिकर्सिव इमेज-टाइपोग्राफी लेआउट का लाभ उठाता है, जिससे सुरक्षा संरेखण (safety alignment) को कमजोर करने के लिए गहन क्रॉस-मोडल प्रोसेसिंग का फायदा उठाकर ओपन-सोर्स और कमर्शियल मॉडल्स में अत्याधुनिक सफलता दर प्राप्त की जा सकती है।

Haoyu Zhang, Yangyang Guo, Mohan Kankanhalli2026-07-07
🤖 AI

Builder, Defender, Breaker: The Case Against Removing the Human from the AI-Driven Security Lifecycle

यह शोध पत्र यह तर्क देता है कि एआई-संचालित सुरक्षा चक्र से मनुष्यों को हटाना मौलिक रूप से त्रुटिपूर्ण है क्योंकि यह निर्माण, रक्षा और परीक्षण की भूमिकाओं के बीच आवश्यक स्वतंत्रता को समाप्त कर देता है, जिससे साझा अंध बिंदु (blind spots) उत्पन्न होते हैं, जवाबदेही क्षीण होती है, और सिस्टम पूर्वानुमेय प्रतिकूल शोषण (adversarial exploitation) के प्रति असुरक्षित हो जाते हैं।

Mohamed Chahine Ghanem2026-07-07
🤖 AI

CONTRA: Red-Teaming Configurations of Personalizable Agents

यह शोध पत्र CONTRA को प्रस्तुत करता है, जो एक LLM-सहायता प्राप्त ट्री-सर्च एल्गोरिदम है जो यह प्रदर्शित करता है कि कैसे व्यक्तिगत बनाने योग्य (personalizable) LLM एजेंटों को अनजाने में दुर्भावनापूर्ण कार्यों को निष्पादित करने के लिए कॉन्फ़िगर किया जा सकता है, जिससे यह पता चलता है कि 75.1% लोकप्रिय स्किल्स में ऐसी कमजोरियां मौजूद हैं जिन्हें वर्तमान सुरक्षा स्कैन पहचानने में विफल रहते हैं।

Jonathan Nöther, Adish Singla, Goran Radanovic2026-07-07
🤖 AI

Agentic and Generative AI for Open-Source Intelligence and Cyber Investigations: Taxonomy, Evaluation, Challenges, and Future Directions

यह सर्वेक्षण OSINT में एजेंटिक और जनरेटिव AI के लिए 11-श्रेणी वाले वर्गीकरण (टैक्सोनॉमी) को स्थापित करने के लिए 74 अध्ययनों की व्यवस्थित समीक्षा करता है, मतिभ्रम (hallucinations) के पहचाने गए जोखिम और उनके अनुभवजन्य मापन के बीच एक महत्वपूर्ण अंतर की पहचान करता है, इंटेलिजेंस लाइफसाइकिल के माध्यम से वर्तमान अनुसंधान की शक्तियों और कमजोरियों का मानचित्रण करता है, और एक मानव-इन-द-लूप को-पायलट मॉडल की वकालत करने वाला एक दस-सूत्रीय एजेंडा प्रस्तावित करता है जो सबसे व्यवहार्य निकट-अवधि परिनियोजन रणनीति है।

Eduardo Almeida Palmieri, Mohamed Chahine Ghanem, Dipo Dunsin, Zubair Baig, Ed de Quincey, Kim-Kwang Raymond Choo2026-07-07
🤖 AI

LLM-Enhanced Hierarchical Heterogeneous Graph Representation Learning for Malicious Python Package Detection

यह शोध पत्र एक LLM-संवर्धित पदानुक्रमित विषम ग्राफ प्रतिनिधित्व शिक्षण (hierarchical heterogeneous graph representation learning) ढांचे का प्रस्ताव करता है जो सटीक, व्याख्या योग्य और सूक्ष्म-स्तरीय मैलिशियस पायथन पैकेज डिटेक्शन प्राप्त करने के लिए संरचनात्मक कोड निर्भरताओं को LLM-व्युत्पन्न सिमेंटिक भूमिकाओं के साथ एकीकृत करता है।

Hang Gao, Xiaoyu Chen, Baoquan Cui, Zhen Tang, Peng Qiao, Fengge Wu, Jian Zhang2026-07-07
🤖 machine learning

Scalable Differentially Private Data Compression via Diffusion and Stochastic Codes

यह शोध पत्र DP-DiPP को प्रस्तुत करता है, जो एक स्केलेबल डिफरेंशियल प्राइवेट इमेज कंप्रेशन फ्रेमवर्क है जो उच्च-आयामी डेटा के लिए मजबूत गोपनीयता गारंटी और उपयोगिता बनाए रखते हुए काफी उच्च संपीड़न दर (10-30 गुना बेहतर) प्राप्त करने के लिए डिफ्यूजन मॉडल्स के साथ स्टोकेस्टिक कोड्स को जोड़ता है।

Gergely Flamich, Oykü Sıla Güner, Yanxiao Liu, Deniz Gündüz2026-07-07
🔢 mathematics

Calculating the floor of y**(1/m)

यह शोध पत्र प्राकृतिक संख्याओं y>2y > 2 और m>1m > 1 के लिए y1/my^{1/m} के फ्लोर (floor) की गणना करने हेतु दो न्यूटन-राफसन-आधारित एल्गोरिदम प्रस्तुत करता है, जो पारंपरिक बाइनरी सर्च दृष्टिकोणों के विकल्प के रूप में यह निर्धारित करने की एक विधि प्रदान करता है कि क्या yy किसी अन्य पूर्णांक की पूर्णांक घात है।

Alexandros V. Gerbessiotis2026-07-07
🤖 AI

How to Avoid Debate: Scalable AI Safety via Doubly-Efficient Interactive Proofs

यह शोध पत्र ऑरेकल-सहायता प्राप्त गणनाओं के लिए 'डबली-एफिशिएंट सिंगल-प्रूवर इंटरैक्टिव प्रूफ' पेश करके एआई सुरक्षा सत्यापन के लिए एक स्केलेबल दृष्टिकोण का प्रस्ताव करता है, जिससे यह सिद्ध होता है कि दो एआई मॉडलों के बीच प्रतिस्पर्धी बहस की अक्सर अवास्तविक धारणाओं पर निर्भर किए बिना विश्वसनीय संरेखण सत्यापन संभव है।

Liyan Chen, Yael Tauman Kalai, Zoe Xi2026-07-07