💻 computer science

SARSteer: Safeguarding Large Audio-Language Models via Safe-Ablated Refusal Steering

यह शोध पत्र SARSteer को प्रस्तुत करता है, जो लार्ज ऑडियो-लैंग्वेज मॉडल्स के लिए पहला इन्फरेंस-टाइम डिफेंस फ्रेमवर्क है जो टेक्स्ट-व्युत्पन्न रिफ्यूसल स्टीयरिंग को डीकंपोज्ड सेफ-स्पेस एब्लेशन के साथ जोड़ता है ताकि हानिकर ऑडियो-प्रेरित प्रतिक्रियाओं को प्रभावी ढंग से कम किया जा सके और सौहार्दपूर्ण प्रश्नों पर ओवर-रिफ्यूजल से बचा जा सके।

Weilin Lin, Jianze Li, Hui Xiong, Li Liu2026-06-15
🤖 machine learning

Private Prediction via PAC Privacy

यह शोध पत्र निजी मशीन लर्निंग प्रेडिक्शन के लिए एक PAC गोपनीयता ढांचे का प्रस्ताव करता है जो उच्च-उपयोगिता मॉडल सर्विंग और उसके बाद पारंपरिक डिफरेंशियल प्राइवेसी की तुलना में काफी मजबूत गोपनीयता गारंटी के साथ निजी मॉडल डिस्टिलेशन को सक्षम करने के लिए लीनियर म्यूचुअल इंफॉर्मेशन एक्यूमुलेशन प्राप्त करने हेतु इंस्टेंस-आधारित एम्पिरिकल स्टेबिलिटी और एक नए एडेप्टिव एडवर्सरियल कंपोजिशन थ्योरम का लाभ उठाता है।

Xiaochen Zhu, Mayuri Sridhar, Srinivas Devadas2026-06-15
🤖 machine learning

NeST: Neuron Selective Tuning for LLM Safety

NeST एक पैरामीटर-कुशल पोस्ट-हॉक सुरक्षा संरेखण ढांचा है जो केवल साधारण दुर्भावनापूर्ण प्रॉम्प्ट्स का उपयोग करके सुरक्षा-प्रासंगिक फीड-फॉरवर्ड न्यूरॉन्स के क्लस्टर्स की पहचान करता है और उन्हें चुनिंदा रूप से ट्यून करता है, जिससे टेक्स्ट और मल्टीमॉडल मॉडल्स में विविध जेलब्रेक्स के विरुद्ध न्यूनतम कम्प्यूटेशनल ओवरहेड के साथ एक मजबूत रक्षा प्राप्त होती है।

Sasha Behrouzi, Lichao Wu, Mohamadreza Rostami, Ahmad-Reza Sadeghi2026-06-15
💻 computer science

Perils of Parallelism: Transaction Fee Mechanisms under Execution Uncertainty

यह शोध पत्र विश्लेषण करता है कि कैसे आधुनिक ब्लॉकचेन में निष्पादन समानांतरता (execution parallelism) और आकस्मिकता (contingency), उपयोगकर्ता और शेड्यूलर प्रोत्साहन के बीच अंतर्निहित ट्रेड-ऑफ पैदा करते हैं, जो मौजूदा शुल्क तंत्रों के लिए एक असंभवता परिणाम (impossibility result) को सिद्ध करता है और एक नया ढांचा प्रस्तावित करता है जो Sui और Monad जैसे सिस्टम में निष्पक्षता और प्रदर्शन के लिए इष्टतम सीमाओं को प्राप्त करता है।

Sarisht Wadhwa, Aviv Yaish, Fan Zhang, Kartik Nayak2026-06-15
💻 computer science

A Modern Large-Scale Memory Characterization Laboratory

यह शोध पत्र एक बड़े पैमाने के मेमोरी कैरेक्टराइजेशन प्रयोगशाला के भीतर DRAM Bender इंफ्रास्ट्रक्चर में अपडेट प्रस्तुत करता है, जो आधुनिक कंप्यूटिंग सिस्टम में महत्वपूर्ण मेमोरी बाधाओं को दूर करने में अनुसंधान समुदाय की सहायता के लिए इसकी बहुमुखीता, इंटरफ़ेस समर्थन और स्केलेबिलिटी को बढ़ाता है।

Ataberk Olgun, Haocong Luo, Ismail Emir Yuksel, F. Nisa Bostanci, A. Giray Yaglikci, Onur Mutlu2026-06-15
🤖 AI

Safety-Contract Graph Multi-Agent Reinforcement Learning for Autonomous Network Security Response

यह शोध पत्र ACD³-GAT को प्रस्तुत करता है, जो एक सुरक्षा-अनुबंध ग्राफ मल्टी-एजेंट सुदृढीकरण शिक्षण ढांचा (safety-contract graph multi-agent reinforcement learning framework) है जो CAGE चैलेंज 4 बेंचमार्क में पारंपरिक रिवॉर्ड-ओनली दृष्टिकोणों की तुलना में डाउनटाइम उल्लंघनों और लागतों को महत्वपूर्ण रूप से कम करते हुए, स्वायत्त नेटवर्क सुरक्षा प्रतिक्रिया प्रदर्शन और सख्त परिचालन बजट बाधाओं के बीच प्रभावी ढंग से संतुलन बनाता है।

Jose Luis Lima de Jesus Silva2026-06-15
💻 computer science

Choric Masking in Ambient Release Systems: A Finite Certificate Calculus for Trace Indistinguishability under Bounded Audiences

यह शोध पत्र "कोरिक मास्किंग" (choric masking) नामक एक परिमित प्रमाणन कलन (finite certificate calculus) प्रस्तुत करता है ताकि परिवेशी रिलीज प्रणालियों (ambient release systems) में संरक्षित डेटा की अनलिंकेबिलिटी (unlinkability) को औपचारिक रूप से सत्यापित और ऑडिट किया जा सके, जो ट्रेस अविभेद्यता (trace indistinguishability) को एक प्रक्षेपित मापन स्थान (projected measurement space) के भीतर एक ज्यामितीय प्रतिच्छेदन समस्या के रूप में मॉडल करता है, जिससे सीमित दर्शक अवलोकन (bounded audience observation) के तहत गोपनीयता उल्लंघनों का पता लगाने और उन्हें प्रमाणित करने के लिए कठोर गणितीय उपकरण प्रदान किए जा सकें।

Faruk Alpay, Taylan Alpay2026-06-15
🤖 AI

Hidden in Plain Sight: Benchmarking Agent Safety Against Decomposition Attacks with DECOMPBENCH

यह शोध पत्र DeCompBench प्रस्तुत करता है, जो डीकंपोज़िशन हमलों (decomposition attacks) के विरुद्ध LLM-आधारित एजेंटों की सुरक्षा का मूल्यांकन करने के लिए डिज़ाइन किया गया एक नया बेंचमार्क है, जो यह प्रकट करता है कि जबकि एजेंट अखंड हानिकारक कार्यों को प्रभावी ढंग से अस्वीकार करते हैं, वे अक्सर तब दुर्भावनापूर्ण इरादों का पता लगाने और उन्हें रोकने में विफल रहते हैं जब उन कार्यों को व्यक्तिगत रूप से निर्दोष उप-कार्यों में विभाजित किया जाता है।

Vikhyath Kothamasu, Virginia Smith, Chhavi Yadav2026-06-15
🔢 mathematics

Hierarchical Identity-Based Signature with Designated Aggregator from Lattices

यह शोध पत्र 'हायरार्किकल आइडेंटिटी-बेस्ड सिग्नेचर विद डेसिग्नेटेड एग्रीगेटर' (HIBS-DA) फ्रेमवर्क प्रस्तुत करता है और पहला लैटिस-आधारित निर्माण पेश करता है जो विभिन्न पदानुक्रमित स्तरों के उपयोगकर्ताओं को व्यक्तिगत हस्ताक्षर उत्पन्न करने में सक्षम बनाता है जिन्हें संचार और सत्यापन लागत को कम करने के लिए एक एकल, संक्षिप्त हस्ताक्षर में एकत्रित किया जा सकता है, जबकि जालसाजी के विरुद्ध सुरक्षा भी बनी रहती है।

Stuti Kumari, Kunal Dey, Vikas Srivastava, Sumit Kumar Debnath2026-06-15