💻 computer science

Governance by Construction for Generalist Agents

यह शोध पत्र CUGA को प्रस्तुत करता है, जो एक मॉड्यूलर पॉलिसी-एज़-कोड सिस्टम है जो पांच संरचनात्मक चेकपॉइंट्स के माध्यम से जनरलिट LLM एजेंटों के निष्पादन पाइपलाइन में सीधे गवर्नेंस को समाहित करता है, जिससे मॉडल फाइन-ट्यूनिंग की आवश्यकता के बिना एंटरप्राइज वातावरण में सुरक्षित, ऑडिट योग्य और अनुपालन योग्य स्वायत्त संचालन सक्षम होता है।

Segev Shlomov, Iftach Shoham, Alon Oved, Ido Levy, Sami Marreed, Harold Ship, Offer Akrabi, Sergey Zeltyn, Avi Yaeli, Ni (…)2026-05-21
🤖 machine learning

Sutra: Tensor-Op RNNs as a Compilation Target for Vector Symbolic Architectures

यह शोध पत्र Sutra को प्रस्तुत करता है, जो एक विशुद्ध कार्यात्मक (purely functional) प्रोग्रामिंग भाषा है जो प्रतीकात्मक वेक्टर सिम्बोलिक आर्किटेक्चर (Vector Symbolic Architecture) ऑपरेशन्स को फ्यूज्ड PyTorch टेंसर ग्राफ्स में संकलित करती है, जिससे प्रोग्राम विविध फ्रोजन एम्बेडिंग सबस्ट्रेट्स (frozen embedding substrates) पर पूर्ण डिकोडिंग सटीकता प्राप्त करने और बैकप्रोपैगेशन के माध्यम से प्रशिक्षित होने में सक्षम होते हैं, जबकि वे पूरी तरह से सुपाठ्य और सोर्स कोड के रूप में पुन: संकलित करने योग्य रहते हैं।

Emma Leonhart2026-05-21✓ Author reviewed
💻 computer science

Causal Past Logic for Runtime Verification of Distributed LLM Agent Workflows

यह शोध पत्र कॉज़ल पास्ट लॉजिक (CPL) को प्रस्तुत करता है, जो ज़िपरजेन (ZipperGen) फ्रेमवर्क में एकीकृत एक स्रोत-स्तरीय टेम्पोरल लॉजिक है, जो वितरित LLM एजेंटों को अनुक्रमिक लॉग के बजाय कारण-संबंधी रूप से दृश्यमान घटनाओं के आधार पर कंट्रोल फ्लो के ऑनलाइन रनटाइम सत्यापन को सक्षम बनाता है, जिसमें सिमेंटिक शुद्धता सुनिश्चित करने के लिए एक वेक्टर-क्लॉक मॉनिटर का उपयोग किया गया है।

Benedikt Bollig2026-05-21
🤖 machine learning

Diagnosing Overhead in Dispatch Operations: Cross-architecture Observatory

यह शोध पत्र DODOCO को प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि Mixture-of-Experts मॉडल्स में AlltoAll डिस्पैच ओवरहेड, विशेषज्ञ प्लेसमेंट या मॉक बेंचमार्क के बजाय, अंतर्निहित, आर्किटेक्चर-विशिष्ट रूटिंग असंतुलन द्वारा संचालित होता है, जो यह प्रकट करता है कि मॉडल डिज़ाइन (जैसे MLA/GDN बनाम MHA/Mamba) समानांतरता पैमाने या सिंथेटिक डेटा धारणाओं की तुलना में लोड वितरण को कहीं अधिक महत्वपूर्ण रूप से निर्धारित करता है।

Bole Ma, Jan Eitzinger, Harald Koestler, Gerhard Wellein2026-05-21
💬 NLP

Playing Devil's Advocate: Off-the-Shelf Persona Vectors Rival Targeted Steering for Sycophancy

यह शोध पत्र प्रदर्शित करता है कि ऑफ-द-शेल्फ पर्सोना स्टीयरिंग वेक्टर्स, जो संदेह या सूक्ष्मता जैसे गुणों को बढ़ावा देते हैं, मॉडल की चापलूसी (सिकोफैंसी) को लक्षित कॉन्ट्रास्टिव एक्टिवेशन एडिशन (CAA) के स्तर तक प्रभावी ढंग से कम करते हैं और साथ ही सही उपयोगकर्ता इनपुट पर सटीकता को बेहतर ढंग से बनाए रखते हैं, जो यह सुझाव देता है कि चापलूसी एक पर्सोना-स्तरीय गुण है न कि एक एकल स्टीयरेबल दिशा।

Ishaan Kelkar, Nebras Alam, Vikram Kakaria, Madhur Panwar, Vasu Sharma, Maheep Chaudhary2026-05-21
💻 computer science

DySink: Dynamic Frame Sinks for Autoregressive Long Video Generation

DySink एक रिट्रीवल-आधारित फ्रेमवर्क है जो ऑटोरेग्रेसिव लॉन्ग वीडियो जनरेशन के लिए स्थिर अर्ली-फ्रेम एंकर्स को गतिशील रूप से चयनित, विजुअली रेलेवेंट हिस्टोरिकल फ्रेम्स से बदल देता है और अटेंशन कोलैप्स को रोकने के लिए एक सिंक एनोमली गेट का उपयोग करता है, जिससे डायनेमिक कंटीन्यूटी और टेम्पोरल क्वालिटी दोनों में सुधार होता है।

Bo Ye, Xinyu Cui, Jian Zhao, Tong Wei, Min-Ling Zhang2026-05-21
💻 computer science

AutoRPA: Efficient GUI Automation through LLM-Driven Code Synthesis from Interactions

AutoRPA एक ऐसा फ्रेमवर्क है जो अक्षम LLM-आधारित ReAct एजेंटों और पारंपरिक RPA के बीच के अंतर को पाटता है, जो अंततः कार्य-समाधान क्षमताओं को बनाए रखते हुए टोकन उपयोग और रनटाइम लागत में महत्वपूर्ण कमी लाता है, और इसके लिए इंटरैक्शन ट्रेजेक्टरीज को मजबूत, पुन: प्रयोज्य RPA फंक्शन्स में स्वचालित रूप से डिस्टिल करता है।

Minghao Chen, Xinyi Hu, Zhou Yu, Yufei Yin2026-05-21
💬 NLP

ACL-Verbatim: hallucination-free question answering for research

यह शोध पत्र ACL-Verbatim को प्रस्तुत करता है, जो अनुसंधान के लिए एक भ्रम-मुक्त (hallucination-free) प्रश्न उत्तर प्रणाली है जो उपयोगकर्ता के प्रश्नों को ACL एंथोलॉजी में वर्बेटिम (verbatim) टेक्स्ट स्पैन से मैप करने के लिए एक्सट्रैक्टिव विधियों का उपयोग करती है, जिसे एक नए ग्राउंड ट्रुथ डेटासेट द्वारा समर्थित किया गया है जहाँ 150M-पैरामीटर वाला मॉडर्नबर्ट (ModernBERT) मॉडल अग्रणी LLM एक्सट्रैक्टर्स से बेहतर प्रदर्शन करता है।

Gábor Recski, Szilveszter Tóth, Nadia Verdha, István Boros, Ádám Kovács2026-05-21
🤖 machine learning

Efficient Learning of Deep State Space Models via Importance Smoothing

यह शोध पत्र पैरेलल वेरिएशनल मोंटे कार्लो (PVMC) को प्रस्तुत करता है, जो एक नई प्रशिक्षण विधि है जो वेरिएशनल ऑटो-एनकोडिंग और अनुक्रमिक मोंटे कार्लो दृष्टिकोणों के बीच के अंतर को पाटती है ताकि डिस्क्रिमिनेटिव और जेनरेटिव दोनों कार्यों के लिए डीप स्टेट स्पेस मॉडल के सुदृढ़, स्केलेबल और 10 गुना तेज़ प्रशिक्षण को सक्षम किया जा सके।

John-Joseph Brady, Nikolas Nusken, Yunpeng Li2026-05-21
💻 computer science

Detecting Trojaned DNNs via Spectral Regression Analysis

यह शोध पत्र MIST को प्रस्तुत करता है, जो एक ट्रोजन डिटेक्शन विधि है जो मॉडल के प्री-एक्टिवेशन स्पेक्ट्रल इवोल्यूशन में विचलन का विश्लेषण करके दुर्भावनापूर्ण फाइन-ट्यूनिंग अपडेट की पहचान करती है, और ट्रिगर या पॉइज़न्ड डेटा के ज्ञान की आवश्यकता के बिना उच्च सटीकता प्राप्त करती है।

Samuele Pasini, Jinhan Kim, Paolo Tonella2026-05-21