🤖 AI

BadScientist: Can a Research Agent Write Convincing but Unsound Papers that Fool LLM Reviewers?

यह शोध पत्र "BadScientist" का परिचय देता है, जो एक ऐसा ढांचा (framework) है जो यह प्रदर्शित करता है कि AI एजेंट विश्वसनीय लेकिन दोषपूर्ण शोध पत्र तैयार कर सकते हैं जो LLM-आधारित सहकर्मी समीक्षा (peer review) प्रणालियों को सफलतापूर्वक धोखा देने में सक्षम हैं, जिससे महत्वपूर्ण कमजोरियों का पता चलता है जहाँ अखंडता संबंधी चिंताएँ स्वीकृति को रोकने में विफल रहती हैं और वर्तमान शमन रणनीतियाँ काफी हद तक अप्रभावी सिद्ध होती हैं।

Fengqing Jiang, Yichen Feng, Yuetai Li, Luyao Niu, Basel Alomair, Radha Poovendran2026-06-17
⚡ electrical engineering

Learning QoE from Packet-Level Measurements in Encrypted Video Conferencing Traffic

यह शोध पत्र एक हल्का, CNN-आधारित फ्रेमवर्क प्रस्तावित करता है जो केवल एन्क्रिप्टेड पैकेट आकार डेटा का उपयोग करके BRISQUE और MOS जैसे वीडियो कॉन्फ्रेंसिंग गुणवत्ता के अनुभव (QoE) मेट्रिक्स की सटीक भविष्यवाणी करता है, जिससे ISPs को सामग्री तक पहुँच बनाए बिना प्रदर्शन का आकलन करने में सक्षम बनाया जा सके।

Michael Sidorov, Ofer Hadar2026-06-17
💻 computer science

Loss Landscape Poisoning: Targeted Extraction of Unseen Training Data from LLMs

यह शोध पत्र "लॉस लैंडस्केप पॉइज़निंग" (Loss Landscape Poisoning) को प्रस्तुत करता है, जो एक नवीन हमला है जहाँ एक विरोधी मॉडल के लॉस लैंडस्केप को नया आकार देने के लिए प्रशिक्षण डेटा को विषाक्त करता है, जिससे मॉडल को भाषा और विज़न-लैंग्वेज मॉडलों में भी उच्च सफलता दर के साथ अनदेखे, संवेदनशील लक्षित रिकॉर्ड्स को याद करने और निकालने के लिए मजबूर किया जाता है, हालांकि इस हमले को डिफरेंशियल प्राइवेसी द्वारा कम किया जा सकता है या एक नई लैंडस्केप-प्रोबिंग तकनीक द्वारा विफल किया जा सकता है।

Md Abdullah Al Mamun, Ngoc Phu Doan, Pedram Zaree, Ihsen Alouani, Nael Abu-Ghazaleh2026-06-17
💻 computer science

An Evaluation of Data Leakage Risks in Tool-Using LLM Agents in Realistic Scenarios

सिंगापुर और कोरिया के एआई सुरक्षा संस्थानों द्वारा किया गया यह संयुक्त मूल्यांकन यह प्रकट करता है कि यथार्थवादी परिदृश्यों में गैर-प्रतिरोधी, सौहार्दपूर्ण अनुरोध भी डेटा जागरूकता और नीति अनुपालन की विफलताओं के कारण एलएलएम एजेंटों में अक्सर डेटा रिसाव का कारण बनते हैं, जो यह दर्शाता है कि परिचालन सुरक्षा जोखिम प्रतिकूल खतरों से अलग हैं और कार्य क्षमता से अलग मूल्यांकन की आवश्यकता है।

Hankyul Baek, Jaewon Noh, Sang Seo, Yongsu Kim, Gabriel Waikin Loh Matienzo, Young Il Kim, Ee Wei Seah, Akriti Vij2026-06-17
💻 computer science

LineageMark: Multi-user White-box Watermarking for Contribution Tracing in Model Derivation Chains

LineageMark एक मल्टी-यूज़र व्हाइट-बॉक्स वॉटरमार्किंग फ्रेमवर्क है जो स्थिर मापदंडों (stable parameters) पर प्रोजेक्शन सांख्यिकी (projection statistics) के रूप में वॉटरमार्क को एनकोड करके बड़े भाषा मॉडल व्युत्पत्ति श्रृंखलाओं (derivation chains) में सुदृढ़ योगदान ट्रैकिंग को सक्षम बनाता है, जिससे वृद्धिशील अपडेट (incremental updates), फाइन-ट्यूनिंग और अन्य मॉडल विक्षोभों (perturbations) के दौरान निरंतरता और अखंडता सुनिश्चित होती है।

Bingxue Zhang, Xiaofeng Xu, Feida Zhu2026-06-17
💻 computer science

Syntactic Systems Cannot See Semantic Invariants

यह शोधपत्र 'ओपन इंडक्शन' (open induction) और 'कॉज़ सेट साइकिल्स' (clause set cycles) की तुलनीयता के संबंध में एक खुले प्रश्न को हल करता है, यह प्रदर्शित करते हुए कि सिंटैक्टिक सिस्टम (syntactic systems) निरंतर क्रम (constant ordering) के बारे में संख्यात्मक तथ्यों तक पहुँचने में अपनी अक्षमता के कारण सिमेंटिक इनवेरियंट्स (semantic invariants) को सिद्ध करने में विफल रहते हैं, जो एक ऐसी सीमा है जिसे लेखक एक "सिंटैक्टिक इनवेरियन्स प्रिंसिपल" (Syntactic Invariance Principle) के रूप में सामान्यीकृत करते हैं और अनुमान लगाते हैं कि यह P\mathsf{P} बनाम NP\mathsf{NP} समस्या में ज्ञात बाधाओं का आधार हो सकता है।

Fabio F. G. Buono2026-06-17
💻 computer science

ARVO: Atlas of Reproducible Vulnerabilities for Open-Source Software

यह शोध पत्र ARVO को प्रस्तुत करता है, जो OSS-Fuzz से प्राप्त 6,100 से अधिक पुनरुत्पादनीय (reproducible) ओपन-सोर्स कमजोरियों का एक बड़े पैमाने का डेटासेट है, जो डाउनस्ट्रीम सुरक्षा अनुसंधान को बढ़ाने के लिए लगातार पुनर्गठित करने योग्य (rebuildable) और विश्लेषण योग्य भेद्यता उदाहरण प्रदान करके पुनरुत्पादकता और विविधता के बीच के समझौते को संबोधित करता है।

Xiang Mei, Jordi Del Castillo, Pulkit Singh Singaria, Haoran Xi, Abdelouahab Benchikh, Tiffany Bao, Ruoyu Wang, Yan Shos (…)2026-06-17
💻 computer science

OTRO: Oblivious Tokenization Path with Square-Root ORAM

OTRO एक कुशल, ओब्लिवियस टोकेनाइजेशन सिस्टम है जिसे कॉन्फिडेंशियल LLM सर्विंग के लिए डिज़ाइन किया गया है जो एपोक-आधारित रोटेशन और चंक्ड KV-कैश-अवेयर ओवरलैप के साथ स्क्वायर-रूट ORAM इंस्टेंस के एक पूल का लाभ उठाकर मेमोरी एक्सेस पैटर्न्स से होने वाले साइड-चैनल लीक्स को कम करता है, जिससे नगण्य लेटेंसी ओवरहेड प्राप्त होता है और दृश्यमान लीकेज में महत्वपूर्ण रूप से कमी आती है।

Jonghyun Lee, Yongqin Wang, Rachit Rajat, Daniel Wong, Mengyuan Li, Murali Annavaram2026-06-17
🤖 AI

SoK: AI-Augmented Binary Reversing

यह शोध पत्र 144 शोध पत्रों का विश्लेषण करके AI-संवर्धित बाइनरी रिवर्सिंग (AI-augmented binary reversing) पर ज्ञान के पहले व्यापक व्यवस्थितकरण को प्रस्तुत करता है ताकि एक एकीकृत वर्गीकरण स्थापित किया जा सके जो पारंपरिक तकनीकों को आधुनिक AI दृष्टिकोणों से जोड़ता है, जिससे इस क्षेत्र के विकास को स्पष्ट किया जा सके, निरंतर चुनौतियों की पहचान की जा सके और भविष्य के अनुसंधान का मार्गदर्शन किया जा सके।

Yujeong Kwon, Yiyue Zhang, Shakhzod Yuldoshkhujaev, Kexin Pei, Dokyung Song, Hyungjoon Koo2026-06-17
💬 NLP

PARSE: Provenance-Aware Retrieval Sanitization for Professional Domain LLM Agents

यह शोध पत्र PARSE को प्रस्तुत करता है, जो एक प्रोवेनेंस-अवेयर रिट्रीवल सैनिटाइजेशन पाइपलाइन है जो उपयोगिता को बनाए रखते हुए वास्तविक दुनिया के पेशेवर दस्तावेजों पर प्रॉम्प्ट इंजेक्शन हमले की सफलता दर को महत्वपूर्ण रूप से कम करता है, जो सिंथेटिक बेंचमार्क पर मूल्यांकन किए जाने पर मौजूदा सुरक्षा प्रणालियों की महत्वपूर्ण विफलता को संबोधित करता है।

Aaditya Pai2026-06-17