💬 NLP

Unveiling Unicode's Unseen Underpinnings in Undermining Authorship Attribution

यह शोध पत्र स्टाइलोमेट्रिक लेखकत्व निर्धारण (stylometric authorship attribution) के विरुद्ध पारंपरिक अनामीकरण विधियों की सीमाओं का विश्लेषण करता है और सार्वजनिक संचार में उपयोगकर्ता की पहचान की सुरक्षा के लिए एक प्रतिरोधी प्रति-रणनीति के रूप में यूनिकोड स्टेग्नोग्राफी (Unicode steganography) का प्रस्ताव करता है।

Robert Dilworth2026-04-24
💬 NLP

Tuning for TraceTarnish: Techniques, Trends, and Testing Tangible Traits

यह शोध पत्र प्रमुख भाषाई विशेषताओं—विशेष रूप से फंक्शन और कंटेंट वर्ड फ्रीक्वेंसी और टाइप-टोकन रेश्यो—की पहचान करके एडवर्सरियल स्टाइलोमेट्री अटैक "TraceTarnished" का मूल्यांकन करता है, जो लेखक के छद्म रूप (authorship obfuscation) का पता लगाने के लिए समझौते के संकेतक (indicators of compromise) और हमले की प्रभावशीलता को बढ़ाने के लिए आधारभूत तत्वों के रूप में कार्य करते हैं।

Robert Dilworth2026-04-24
💻 computer science

Focus on What Matters: Fisher-Guided Adaptive Multimodal Fusion for Vulnerability Detection

यह शोध पत्र TaCCS-DFA प्रस्तावित करता है, जो एक नवीन ढांचा है जो फिशर सूचना (Fisher information) का उपयोग करके एक अनुकूलन योग्य, कार्य-सशर्त संलयन रणनीति के माध्यम से पूरक संकेतों को चुनिंदा रूप से एकीकृत करता है, जिससे नैव (naive) मल्टीमॉडल संलयन की सीमाओं को संबोधित किया जाता है और न्यूनतम विलंबता ओवरहेड के साथ महत्वपूर्ण प्रदर्शन लाभ प्राप्त किया जाता है।

Yun Bian, Yi Chen, HaiQuan Wang, ShiHao Li, Zhe Cui2026-04-24
💻 computer science

How Generative AI Empowers Attackers and Defenders Across the Trust & Safety Landscape

43 ट्रस्ट और सेफ्टी विशेषज्ञों के एक गुणात्मक अध्ययन के माध्यम से, यह शोध पत्र प्रकट करता है कि जनरेटिव एआई (Generative AI) हमलावरों के लिए बड़े पैमाने पर हानिकारक सामग्री बनाने की बाधाओं को कम करने के साथ-साथ, संरक्षकों को पहचान, जांच और शमन के लिए शक्तिशाली उपकरण भी प्रदान करता है, जो अंततः ऑनलाइन सुरक्षा पर इस दोधारी प्रभाव से निपटने के लिए एक रणनीतिक ढांचा प्रदान करता है।

Patrick Gage Kelley, Steven Rousso-Schindler, Renee Shelby, Kurt Thomas, Allison Woodruff2026-04-24
💬 NLP

StegoStylo: Squelching Stylometric Scrutiny through Steganographic Stitching

यह शोध पत्र उन्नत प्रतिकूल हमलों (adversarial attacks) और स्टेग्नोग्राफिक तकनीकों, विशेष रूप से TraceTarnish\textit{TraceTarnish} और ज़ीरो-विड्थ कैरेक्टर एम्बेडिंग को प्रस्तुत करता है, ताकि लेखक के शैलीगत फिंगरप्रिंट्स को प्रभावी ढंग से अस्पष्ट किया जा सके और दुर्भावनापूर्ण स्टाइलोमेट्रिक विश्लेषण के विरुद्ध गोपनीयता की रक्षा की जा सके।

Robert Dilworth2026-04-24
💬 NLP

Intent Laundering: AI Safety Datasets Are Not What They Seem

यह शोध पत्र प्रकट करता है कि व्यापक रूप से उपयोग किए जाने वाले एआई सुरक्षा डेटासेट दोषपूर्ण हैं क्योंकि वे यथार्थवादी प्रतिकूल व्यवहार के बजाय स्पष्ट "ट्रिगरिंग क्यूज़" (triggering cues) पर निर्भर करते हैं, जो यह प्रदर्शित करता है कि जब "इंटेंट लॉन्ड्रिंग" (intent laundering) नामक तकनीक के माध्यम से इन संकेतों को हटा दिया जाता है, तो शीर्ष स्तर के मॉडल भी हानिकारक आउटपुट को रोकने में विफल हो जाते हैं।

Shahriar Golchin, Marc Wetter2026-04-24
💻 computer science

CRED-1: An Open Multi-Signal Domain Credibility Dataset for Automated Pre-Bunking of Online Misinformation

यह शोधपत्र CRED-1 प्रस्तुत करता है, जो 2,672 डोमेन का एक पुनरुत्पादक (reproducible), ओपन-सोर्स डेटासेट है जिसे मल्टी-सिग्नल विश्वसनीयता स्कोर के साथ समृद्ध किया गया है, और इसे ऑन-डिवाइस ब्राउज़र एक्सटेंशन के माध्यम से ऑनलाइन गलत सूचनाओं के गोपनीयता-संरक्षित, क्लाइंट-साइड प्री-बंकिंग को सक्षम करने के लिए डिज़ाइन किया गया है।

Alexander Loth, Martin Kappes, Marc-Oliver Pahl2026-04-24
💻 computer science

Omission Constraints Decay While Commission Constraints Persist in Long-Context LLM Agents

यह शोध पत्र "सिक्योरिटी-रिकॉल डायवर्जेंस" (Security-Recall Divergence) की पहचान और मात्रा निर्धारण करता है, जो एक ऐसी घटना है जहाँ एलएलएम (LLM) एजेंट बातचीत की लंबाई बढ़ने के साथ निषेध-आधारित सुरक्षा बाधाओं (लोप/omissions) का पालन करने में तेजी से विफल होते हैं, जबकि साथ ही आवश्यकता-आधारित बाधाओं (आदेशों/commissions) के प्रति सख्त अनुपालन बनाए रखते हैं, एक ऐसा विफलता मोड जो मानक निगरानी के लिए अदृश्य रहता है लेकिन जिसे मॉडल-विशिष्ट 'सेफ टर्न डेप्थ' (Safe Turn Depth) से पहले बाधाओं को पुनः इंजेक्ट करके कम किया जा सकता है।

Yeran Gamage2026-04-24
💻 computer science

SDNGuardStack: An Explainable Ensemble Learning Framework for High-Accuracy Intrusion Detection in Software-Defined Networks

यह शोध पत्र SDNGuardStack प्रस्तुत करता है, जो एक व्याख्यात्मक एन्सेम्बल लर्निंग फ्रेमवर्क है जिसे InSDN डेटासेट पर प्रशिक्षित किया गया है और जो सुरक्षा विश्लेषकों के लिए पारदर्शी, कार्रवाई योग्य अंतर्दृष्टि प्रदान करने के लिए SHAP का उपयोग करते हुए SDN घुसपैठ का पता लगाने में 99.98% सटीकता प्राप्त करता है।

Ashikuzzaman, Md. Saifuzzaman Abhi, Mahabubur Rahman, Md. Manjur Ahmed, Md. Mehedi Hasan, Md. Ahsan Arif2026-04-24
🤖 machine learning

Differentially Private Model Merging

यह शोध पत्र पोस्ट-प्रोसेसिंग तकनीकों, विशेष रूप से रैंडम सिलेक्शन (यादृच्छिक चयन) और लीनियर कॉम्बिनेशन (रैखिक संयोजन), को प्रस्तावित करता है ताकि पूर्व-प्रशिक्षित मॉडलों के एक सेट से बिना किसी अतिरिक्त प्रशिक्षण के मनचाही डिफरेंशियल प्राइवेसी आवश्यकताओं को पूरा करने वाले मॉडल उत्पन्न किए जा सकें, जो सैद्धांतिक रूप से लीनियर कॉम्बिनेशन की श्रेष्ठता को प्रदर्शित करता है और विभिन्न डेटासेट्स पर इस दृष्टिकोण को मान्य करता है।

Qichuan Yin, Manzil Zaheer, Tian Li2026-04-24