🤖 machine learning

Geometry-Aware Tabular Diffusion

यह शोध पत्र ज्योमेट्री-अवेयर टैबुलर डिफ्यूजन (GATD) को प्रस्तुत करता है, जो एक ऐसी विधि है जो स्पष्ट युग्वतीय ज्यामितीय संबंधों (कोणों और लंबाई) को सहायक पर्यवेक्षण के रूप में शामिल करके टैबुलर डेटा संश्लेषण को उन्नत करती है, जिससे काफी कम मापदंडों के साथ अत्याधुनिक प्रदर्शन प्राप्त होता है और यह प्रदर्शित होता है कि यह संबंधात्मक इंडक्टिव बायस विभिन्न डिफ्यूजन आर्किटेक्चर में एक पोर्टेबल सुधार है।

David Turtora Zagardo2026-06-03
💻 computer science

MultiTurnPSB: Evaluating Multi-Turn Jailbreak Attacks an dClassifier-Based Defenses for Medical AI Safety

यह शोध पत्र MultiTurnPSB को प्रस्तुत करता है, जो एक चार-चरण वाला प्रतिकूल बेंचमार्क (adversarial benchmark) है, जो यह दर्शाता है कि मल्टी-टर्न इंटरैक्शन एकल-टर्न मूल्यांकन की तुलना में मेडिकल एआई सुरक्षा को महत्वपूर्ण रूप से कम कर देते हैं, और साथ ही यह भी प्रकट करता है कि क्लासिफायर-आधारित रक्षा प्रणालियों को हमलों को रोकने और सौहार्दपूर्ण (benign) प्रश्नों पर गलत अलार्म उत्पन्न करने के बीच एक गंभीर समझौते का सामना करना पड़ता है।

Anushka Sheoran, Yiduo Hao2026-06-03
💻 computer science

D-Judge: Disrupting Multi-Turn Jailbreaks using Semantics-Preserving Output Rewriting

यह शोध पत्र D-Judge को प्रस्तुत करता है, जो एक ऐसा रक्षा तंत्र है जो LLM की प्रतिक्रियाओं को उनके मूल अर्थ को सुरक्षित रखते हुए और हमलावर-नियंत्रित जज मॉडलों से मिलने वाले फीडबैक संकेतों को जानबूझकर गलत दिशा में मोड़कर मल्टी-टर्न जेलब्रेक हमलों को बाधित करता है, जिससे प्रॉम्प्ट रिफाइनमेंट की पुनरावृत्ति प्रक्रिया पटरी से उतर जाती है।

Huanli Gong, Zhipeng Wei, Yu Fu, Haz Sameen Shahgir, Ananya Gupta, Yue Dong, N. Benjamin Erichson2026-06-03
💻 computer science

Inference Cost Attacks for Retrieval-Augmented Large Language Models

यह शोध पत्र रिट्रीवल-ऑगमेंटेड इन्फरेंस कॉस्ट अटैक (RA-ICA) का परिचय देता है, जो एक नवीन ढांचा है जो एलएलएम (LLM) एजेंटों और मेमोरी-ऑगमेंटेड ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइज़ेशन एल्गोरिदम का उपयोग करके बाहरी ज्ञान भंडारों को ऐसे दुर्भावनापूर्ण दस्तावेजों से विषाक्त करता है जो उत्तर की अखंडता को बनाए रखते हुए आरएजी (RAG)-संवर्धित एलएलएम प्रणालियों में टोकन खपत को महत्वपूर्ण रूप से बढ़ा देते हैं।

Chengliang Liu, Liangbo Ning, Yujuan Ding, Wenqi Fan2026-06-03
💻 computer science

A New Framework for Cybersecurity Refusals in AI Agents

यह शोध पत्र आक्रामक साइबर सुरक्षा कार्यों को करने वाले एआई एजेंटों में इनकार सीमाओं (refusal boundaries) को परिभाषित करने और उनका मूल्यांकन करने के लिए पहला ढांचा प्रस्तुत करता है, जो यह प्रकट करता है कि अधिकांश अत्याधुनिक मॉडल वर्तमान में हानिकारक अनुरोधों को उचित रूप से अस्वीकार करने में विफल रहते हैं।

Eliot Krzysztof Jones, Mateusz Dziemian, Matt Fredrikson, J Zico Kolter2026-06-03
💻 computer science

Cross-Vendor Sola ISPM Benchmark: Evaluating Agentic AI for Federated Identity Security Reasoning

यह शोध पत्र क्रॉस-वेंडर सोला ISPM बेंचमार्क प्रस्तुत करता है जो खंडित मल्टी-क्लाउड पहचान प्रणालियों में एजेंटिक एआई (Agentic AI) की तर्क करने की क्षमता का मूल्यांकन करता है, यह प्रदर्शित करते हुए कि स्पष्ट संबंधपरक संदर्भ प्रदान करने से क्रॉस-वेंडर सुरक्षा विश्लेषण में उत्तर की सटीकता में महत्वपूर्ण सुधार होता है और विफलता दर में कमी आती है।

Eden Yavin, Gal Engelberg, Konstantin Koutsyi, Leon Goldberg, Gal Baron2026-06-03
💻 computer science

On Improving Robustness of Deepfake Image Detectors

यह शोध पत्र एक एकीकृत, आर्किटेक्चर-अज्ञेय (architecture-agnostic) ढांचे का प्रस्ताव करता है जो फ्रीक्वेंसी डोमेन में उच्च-क्रम सांख्यिकीय मॉडलिंग, नॉइज़-रेसिड्यूल फीचर्स और पैच-लेवल सिमेंटिक डिसरप्शन का लाभ उठाकर एडवरसैरियल हमलों के विरुद्ध डीपफेक डिटेक्टरों की मजबूती को बढ़ाता है, जिससे एडवरसैरियल ट्रेनिंग डेटा पर निर्भर किए बिना महत्वपूर्ण सटीकता सुधार प्राप्त होता है।

Abu Taib Mohammed Shahjahan, Mohammad Mannan, Abdessamad Ben Hamza, Amr Youssef2026-06-03
💻 computer science

Quantifying Side-Channel Leakage in Public Metrology Releases

यह शोध पत्र एक प्रोफाइल किया गया सांख्यिकीय साइड-चैनल ऑडिट विकसित करके सार्वजनिक मेट्रोलॉजी रिलीज से छिपी हुई सेटिंग्स के लीक होने के जोखिम को औपचारिक और परिमाणात्मक रूप देता है, जो सटीक सूचना-सैद्धांतिक सीमाओं और एक विशिष्ट नौवें-क्रम के लीकेज नियम को व्युत्पन्न करता है, जिसे फिर एक्सट्रीम-अल्ट्रावॉयलेट रफनेस स्पेक्ट्रा पर एक केस स्टडी के माध्यम से मान्य किया जाता है।

Faruk Alpay, Taylan Alpay2026-06-03
🤖 machine learning

Gate AI: LLM Security Benchmark Evaluation Methodology and Results

यह शोध पत्र एलएलएम (LLM) सुरक्षा डिटेक्टरों के लिए एक कठोर मूल्यांकन हारनेस पेश करता है जो एक एकल वैश्विक थ्रेशोल्ड के साथ 5-गुना क्रॉस-वैलिडेशन का उपयोग करके प्रति-डेटासेट थ्रेशोल्ड ट्यूनिंग और अज्ञात ऑपरेटिंग पॉइंट्स जैसी व्यवस्थित कमजोरियों को समाप्त करता है, और मजबूत सामान्यीकरण और निष्पक्ष तुलना सुनिश्चित करने के लिए नैदानिकों की एक व्यापक बैटरी का उपयोग करता है।

Ryle Goehausen, Marcus Sousa2026-06-03
💻 computer science

Secure AltDA Integration for Ethereum L2s: An End-to-End Validation Framework

यह शोध पत्र एथेरियम L2s में सुरक्षित अल्टरनेटिव डेटा अवेलेबिलिटी (AltDA) एकीकरण के लिए एक मानक सत्यापन ढांचे को प्रस्तुत करता है, जो सेलेस्टिया-ब्लोबस्ट्रीम (Celestia-Blobstream) और आइगनडीए (EigenDA) जैसी विविध आर्किटेक्चर के बीच यह सुनिश्चित करके कि प्रत्येक प्रतिकूल इनपुट एक अद्वितीय, सुपरिभाषित परिणाम उत्पन्न करे, सर्वसम्मति विफलताओं और ब्रिज हमलों को रोकने के लिए एक नियतात्मक अनुवाद मॉडल को परिभाषित करता है।

Bowen Xue, Samuel Laferriere2026-06-03