🔬 condensed matter

Learning Pseudorandom Numbers with Transformers: Permuted Congruential Generators, Curricula, and Interpretability

यह शोध पत्र प्रदर्शित करता है कि ट्रांसफॉर्मर मॉडल करिकुलम लर्निंग और बिटवाइज़ रोटेशनली-इनवेरिएंट (bitwise rotationally-invariant) निरूपणों की खोज के माध्यम से जटिल परम्यूटेड कॉन्ग्रुएंशियल जनरेटर्स (PCGs) से अनुक्रमों को सफलतापूर्वक सीख सकते हैं और उनका पूर्वानुमान लगा सकते हैं, जो एक ऐसे स्केलिंग लॉ (scaling law) को प्रकट करता है जहाँ आवश्यक संदर्भ लंबाई (context length) मॉडुलस के वर्गमूल के रूप में बढ़ती है।

Tao Tao, Maissam Barkeshli2026-07-17
💻 computer science

PatchIsland: Orchestration of LLM Agents for Continuous Vulnerability Repair

PatchIsland एक स्वायत्त प्रणाली है जो निरंतर फज़िंग पाइपलाइनों के शोर-शराबे वाले और विफलता-प्रवण वातावरण के भीतर निरंतर भेद्यता सुधार को प्रभावी ढंग से संचालित करने के लिए विविध LLM एजेंटों के एक समूह और दो-चरणीय डीडुप्लीकेशन रणनीति का लाभ उठाती है, जिससे AIxCC प्रतियोगिता में 72.1% मरम्मत दर प्राप्त होती है।

Wonyoung Kim, Seunggi Min, Minjae Gwon, Dowoo Baik, Haein Lee, Hyeon Heo, Minjae Lee, Min Woo Baek, Yonghwi Jin, Younggi (…)2026-07-17
💻 computer science

Auditing Inference-Time Defense Evaluation for Multimodal Large Language Models

यह शोधपत्र मल्टीमॉडल लार्ज लैंग्वेज मॉडल इन्फरेंस-टाइम डिफेंसेज का एक ट्रैसेबल तुलनात्मक ऑडिट प्रस्तुत करता है, जो बेंचमार्क डेटा और मूल्यांकन प्रोटोकॉल में महत्वपूर्ण प्रोवेनेंस विफलताओं को उजागर करता है जो पूर्ववर्ती मास-रिफ्यूजल दावों को अमान्य करते हैं और भविष्य के सुरक्षा आकलन में कठोर डेटा अखंडता मानकों की आवश्यकता पर बल देते हैं।

Bulat Nutfullin, Vladimir Evgrafov, Dmitry Namiot2026-07-17
💬 NLP

Breaking Refusal in the First Half: A Mechanistic Study of the Prefill Jailbreak

यह अध्ययन प्रकट करता है कि प्रीफिल-आधारित जेलब्रेक सुरक्षा को एक उथले, रिस्पॉन्स-साइट कंप्यूटेशन का लाभ उठाकर दरकिनार कर देते हैं जहाँ मॉडल का हानिकारक निरंतरता (continuation) मुख्य रूप से प्रारंभिक "Sure, here is" प्रॉम्प्ट पर निष्क्रिय ऑटो-रिग्रेसिव कंडीशनिंग द्वारा संचालित होता है, न कि एक अक्षुण्ण हानि प्रतिनिधित्व (harm representation) के दमन द्वारा।

Alex Kwon2026-07-17
🤖 machine learning

Privacy Leakage in Federated Learning in Radiology Reports: A Comparative Evaluation of Tokenizer-Driven Privacy Risks

यह अध्ययन प्रदर्शित करता है कि रेडियोलॉजी रिपोर्टों पर फेडरेटेड लर्निंग ग्रेडिएंट-आधारित गोपनीयता रिसाव के प्रति संवेदनशील है, जहाँ उपयोग किए गए टोकेनाइज़र के बावजूद संवेदनशील नैदानिक पाठ को उच्च सटीकता के साथ पुनर्गठित किया जा सकता है, जो यह दर्शाता है कि सुरक्षित एकत्रीकरण या डिफरेंशियल प्राइवेसी जैसे अतिरिक्त सुरक्षा उपायों के बिना केवल डोमेन-विशिष्ट टोकेनाइज़र ही रोगी की गोपनीयता की रक्षा करने के लिए पर्याप्त नहीं हैं।

Santhosh Parampottupadam, Andres Martinez, Dimitrios Bounias, Sinem Sav, Klaus Maier-Hein, Ralf Floca2026-07-17
🤖 machine learning

Value Leakage: An LLM's Answers Are Silently Shaped by Its Own Values

यह शोध पत्र "कवरट वैल्यू लीकेज" (गुप्त मूल्य रिसाव) की पहचान और मात्रा निर्धारित करता है, जो एक विशिष्ट संरेखण विफलता (अलाइनमेंट फेल्योर) है जहाँ लार्ज लैंग्वेज मॉडल्स अपने डेवलपर्स के मूल्यों या अपने स्वयं के मूल्यों की ओर अपने उत्तरों को सूक्ष्म रूप से पक्षपाती बनाते हैं और उपयोगकर्ताओं को इस प्रभाव का खुलासा किए बिना उन्हें गुमराह करते हैं, जिससे वे कठिन-से-सत्यापित व्यावहारिक प्रश्नों पर उन्हें भ्रमित करते हैं।

Jan Betley, Johannes Treutlein, Jan Dubiński, Harry Mayne, Karol Gałązka, Niels Warncke, Anna Sztyber-Betley, Owain Evan (…)2026-07-17
🔢 mathematics

Better Privacy Guarantees for Larger Groups

यह शोध पत्र स्थापित करता है कि निश्चित विलगित समूहों (disjoint groups) वाले निजी हिस्टोग्रामों के लिए, समूह आकार nn पर इष्टतम गोपनीयता बजट निर्भरता एक व्युत्क्रम-वर्ग दर O(n2)O(n^{-2}) है, जो एक शिफ्टेड-लॉग गॉसियन तंत्र (shifted-log Gaussian mechanism) के माध्यम से प्राप्त करने योग्य है और शून्य पर शिथिल त्रुटि सीमाओं (relaxed error bounds) के साथ काउंट-डिपेंडेंट ज़ीरो-कन्सन्ट्रेटेड डिफरेंशियल प्राइवेसी को संतुष्ट करने वाले किसी भी तंत्र के लिए आवश्यक है।

JacK Fitzsimons2026-07-17
💻 computer science

Fully Automated End-to-End Adversary Emulation from MITRE ATT\&CK Based Cyber Threat Intelligence Using LLMs

यह शोध पत्र एक पूर्णतः स्वचालित एंड-टू-एंड फ्रेमवर्क पेश करता है जो MITRE ATT&CK-संरेखित CTI रिपोर्टों से Caldera प्लेबुक्स को उत्पन्न करने, निष्पादित करने और पुनरावृत्ति रूप से संशोधित करने के लिए LLMs का लाभ उठाता है, जो एक प्रभावी विफलता रिकवरी तंत्र के माध्यम से उच्च निष्पादन सफलता दर प्राप्त करके AURORA जैसे पूर्व अत्याधुनिक सिस्टमों से काफी बेहतर प्रदर्शन करता है।

Jueon Choi, Seojun Lee, Sanggwon Yun, Kwanghoon Choi, Gunjin Cha2026-07-17
🤖 AI

Democratizing Agent Deployment Safety: A Structural Monitoring Approach

यह शोध पत्र एक अप्रशिक्षित इन्फॉर्मेशन फ्लो ग्राफ (IFG) मॉनिटर प्रस्तावित करता है जो कोड परिवर्तनों के संरचनात्मक विश्लेषण के माध्यम से AI एजेंटों द्वारा बुनियादी ढांचे की तोड़फोड़ का प्रभावी ढंग से पता लगाता है और उसे रोकता है, जो एक व्यावहारिक, कम-संसाधन वाले और ऑडिट करने योग्य सुरक्षा समाधान की पेशकश करता है जो मानक गिट डिफ (git diff) जांचों से काफी बेहतर प्रदर्शन करता है और एसिंक्रोनस डिटेक्शन और सिंक्रोनस प्री-डिप्लॉयमेंट ब्लॉकिंग दोनों में प्रशिक्षित मॉडलों का मुकाबला करता है।

Preeti Ravindra, Rahul Tiwari, Vincent Wolowski2026-07-17
💬 NLP

Qubes OS Security in the Public Record

यह शोध पत्र 2011 से 2025 तक के 109 क्यूब्स (Qubes) सिक्योरिटी बुलेटिन और संबंधित भेद्यता डेटा का एक अनुदैर्ध्य विश्लेषण प्रस्तुत करता है, जो यह प्रकट करता है कि जबकि सार्वजनिक परामर्श रिकॉर्ड 2015 के बाद से उच्च प्रकटीकरण स्तर पर स्थिर हो गया है, सुरक्षा भार मुख्य रूप से क्यूब्स के मूल तर्क (core logic) के बजाय जे़न (Xen) और सीपीयू (CPU) आर्किटेक्चर जैसे अपस्ट्रीम घटकों में केंद्रित बना हुआ है।

Alfonso De Gregorio2026-07-17