💻 computer science

Measuring Memecoin Fragility

यह शोध पत्र मेमेकॉइन इकोसिस्टम फ्रैजिलिटी फ्रेमवर्क (ME2F) को प्रस्तुत करता है, जो अस्थिरता, व्हेल प्रभुत्व और सेंटिमेंट एम्प्लीफिकेशन को मापने वाला एक नवीन त्रि-आयामी मॉडल है, जो यह प्रकट करता है कि राजनीतिक विषयों वाले मेमेकॉइन्स उच्चतम भंगुरता प्रदर्शित करते हैं जबकि स्थापित टोकन और प्रमुख ब्लॉकचेन अधिक लचीले बने रहते हैं।

Yuexin Xiang, Qishuang Fu, Yuquan Li, Qin Wang, Tsz Hon Yuen, Jiangshan Yu2026-07-14
💬 NLP

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models

यह शोध पत्र एक लर्निंग-ड्रिवन ऑटोमेटेड रेड-टीमिंग फ्रेमवर्क पेश करता है जो सुरक्षा मूल्यांकन को एक कंस्ट्रेंड एडवर्सरियल सर्च समस्या के रूप में मानता है, जो इवोल्यूशनरी प्रॉम्प्ट जनरेशन और हायरार्किकल डिटेक्शन को जोड़कर मैनुअल एक्सपर्ट विधियों की तुलना में काफी उच्च भेद्यता खोज दर और व्यापक श्रेणी कवरेज प्रदर्शित करता है।

Zhang Wei, Hanxuan Chen, Peilu Hu, Zhenyuan Wei, Chenwei Liang, Jiayi Gu, Wenqian Weng, Jacqueline Pang, Hao Yan, Li Mei (…)2026-07-14
🤖 AI

Private Seeds, Public LLMs: Realistic and Privacy-Preserving Synthetic Data Generation

यह शोध पत्र RPSG प्रस्तुत करता है, जो एक नवीन ढांचा है जो उच्च-सटीकता वाले सिंथेटिक डेटा को उत्पन्न करने के लिए निजी सीड टेक्स्ट का लाभ उठाता है और मजबूत गोपनीयता सुरक्षा सुनिश्चित करने के लिए औपचारिक डिफरेंशियल प्राइवेसी तंत्र को एकीकृत करता है।

Qian Ma, Sarah Rajtmajer2026-07-14
🤖 AI

A Theory of Least Autonomy in AI

यह शोधपत्र एजेंटिक एआई (agentic AI) प्रणालियों के लिए 'न्यूनतम विशेषाधिकार' (least privilege) सिद्धांत के एक आवश्यक सामान्यीकरण के रूप में "न्यूनतम स्वायत्तता" (least autonomy) का प्रस्ताव करता है, जो जटिल प्राधिकरण संरचनाओं (authorization compositions) और क्रॉस-डोमेन क्षमता हेरफेर (cross-domain capability manipulations) का पता लगाने और उन्हें नियंत्रित करने के लिए कंपोजिशनल ब्लास्ट रेडियस मेट्रिक्स (compositional blast radius metrics), निर्देशित एजेंट प्रभाव ग्राफ (directed agent influence graphs) और मिलीभगत विधेयकों (collusion predicates) को संयोजित करने वाले एक औपचारिक सिद्धांत को प्रस्तुत करता है।

Christophe Parisel2026-07-14
💻 computer science

Trivial Prompt Reframing Bypasses Safety Guardrails in Googles MedGemma-4B

यह शोध पत्र प्रदर्शित करता है कि सरल, आम लोगों के लिए सुलभ प्रॉम्प्ट रिफ्रेमिंग तकनीकें, विशेष रूप से अनुरोधों को मेडिकल बोर्ड परीक्षा के प्रश्नों के रूप में पुनर्गठित करना या डॉक्टर के अधिकार का उपयोग करना, गूगल के ओपन-वेट मेडजेम्मा-4बी (MedGemma-4B) मॉडल के सुरक्षा गार्डरेल्स को महत्वपूर्ण रूप से बायपास कर सकती है, जिससे ड्रग इंटरैक्शन और अन्य प्रतिबंधित चिकित्सा सलाह के संबंध में गैर-अनुपालन वाले आउटपुट की उच्च दर प्राप्त होती है।

Avi-ad Avraam Buskila2026-07-14
💻 computer science

Generative Testing of Automated Speech Recognition Systems

यह शोध पत्र GATAS को प्रस्तुत करता है, जो एक ब्लैक-बॉक्स एडवरसेरियल टेस्टिंग फ्रेमवर्क है जो फोनम-स्तरीय लेटेंट स्पेस इंटरपोलेशन को अनुकूलित करके प्राकृतिक लगने वाले स्पीच इनपुट उत्पन्न करता है जिससे ASR सिस्टम में ट्रांसक्रिप्शन त्रुटियां होती हैं, और मौजूदा विधियों की तुलना में बेहतर धारणात्मक गुणवत्ता के साथ 98% सफलता दर प्राप्त करता है।

Yanis Xabier Wilbrand Peña, Oliver Weißl, Andrea Stocco2026-07-14
🤖 machine learning

SMETA-ZSL:Semantic Meta-Alignment for Zero-Shot Threat Classification

यह शोध पत्र SMETA-ZSL का प्रस्ताव करता है, जो एक नवीन ढांचा है जो सेमेंटिक ओवरलैप और क्लास इम्बैलेंस जैसी चुनौतियों से निपटने के लिए सेमेंटिक मेटा-अलाइनमेंट, कॉन्ट्रास्टिव फाइन-ट्यूनिंग और नॉलेज डिस्टिलेशन को संयोजित करता है, जिससे सात बेंचमार्क में स्टेट-ऑफ-द-आर्ट जनरलाइज्ड ज़ीरो-शॉट थ्रेट क्लासिफिकेशन प्रदर्शन प्राप्त होता है।

Ivan Alejandro Montoya Sanchez, Anantaa Kotal, Aritran Piplai2026-07-14
💬 NLP

A Survey on LLM Watermarking: Theory and Deployment

यह सर्वेक्षण मुख्य डिज़ाइन विकल्पों, थ्रेट मॉडल और सुरक्षा-उपयोगिता ट्रेड-ऑफ के इर्द-गिर्द क्षेत्र को व्यवस्थित करके LLM वॉटरमार्किंग की एक व्यवस्थित, परिनियोजन-उन्मुख समीक्षा प्रदान करता है ताकि चिकित्सकों को मजबूत एट्रिब्यूशन विधियों का चयन करने और विश्वसनीय AI परिनियोजन के लिए भविष्य की अनुसंधान दिशाओं की पहचान करने में मार्गदर्शन किया जा सके।

Huy Phan, Kieu Dang, Ojaswi Dulal, Aiham AL Shukairi, Abby Shine, Chase Garner, Phung Lai2026-07-14
🤖 AI

Minionese: Comprehensive Benchmark and Mechanistic Study of Multilingual LLM Safety

यह शोध पत्र मिनीओनीज़ (Minionese) प्रस्तुत करता है, जो एक व्यापक बहुभाषी बेंचमार्क और यांत्रिक अध्ययन है जो यह प्रदर्शित करता है कि लिपि की पहचान, विक्षोभ के प्रकार और संसाधन स्तरों के कारण एलएलएम (LLM) सुरक्षा संरेखण विभिन्न भाषाओं में भंगुर है, जो यह प्रकट करता है कि कम-संसाधन वाले जेलब्रेक इनकार तंत्र (refusal mechanisms) को बायपास करने के लिए ज्यामितीय रूप से गलत संरेखित उप-स्थानों (subspaces) का लाभ उठाते हैं।

Chigozirim Ifebi, Brent Kong, Ayushi Mehrotra2026-07-14
💻 computer science

Understanding Implicit Trust Errors in Core Carrier Networks through Multi-Agent Flaw Discovery and Analysis

यह शोध पत्र iFinder को प्रस्तुत करता है, जो एक LLM-संचालित मल्टी-एजेंट सिस्टम है जो 3GPP विनिर्देशों को कोड विश्लेषण और स्वचालित एक्सप्लॉइट जनरेशन के साथ क्रॉस-रेफरेंस करके क्लाउड-नेटिव सेलुलर कोर नेटवर्क में "इम्प्लिसिट ट्रस्ट एरर्स" (iTrues) की पहचान और सत्यापन करता है, जिसने व्यावसायिक 5G नेटवर्क में एक पुष्ट सेशन-हाइजैकिंग दोष सहित 84 पहले से अज्ञात कमजोरियों की सफलतापूर्वक खोज की है।

Ziyu Lin, Ziting Wang, Xinfeng Li, Wei Dong, XiaoFeng Wang2026-07-14