💬 NLP

AutoMonitor-Bench: Evaluating the Reliability of LLM-Based Misbehavior Monitor

यह शोध पत्र AutoMonitor-Bench प्रस्तुत करता है, जो विविध कार्यों में LLM-आधारित दुर्व्यवहार मॉनिटरों (misbehavior monitors) के व्यवस्थित मूल्यांकन के लिए पहला बेंचमार्क है, जो महत्वपूर्ण प्रदर्शन परिवर्तनशीलता और एक मौलिक सुरक्षा-उपयोगिता ट्रेड-ऑफ (safety-utility trade-off) को प्रकट करता है और यह प्रदर्शित करता है कि ज्ञात दुर्व्यवहार डेटा पर फाइन-ट्यूनिंग करना अनदेखे या अंतर्निहित विफलताओं का पता लगाने की चुनौतियों को पूरी तरह से हल नहीं करता है।

Shu Yang, Jingyu Hu, Tong Li, Hanqi Yan, Wenxuan Wang, Di Wang2026-05-13
💬 NLP

HE-SNR: Uncovering Latent Logic via Entropy for Guiding Mid-Training on SWE-bench

यह शोध पत्र एक डेटा फ़िल्टरिंग रणनीति और HE-SNR मीट्रिक को पेश करके SWE-bench के लिए प्रभावी मिड-ट्रेनिंग मीट्रिक्स की कमी को संबोधित करता है, जो जटिल सॉफ्टवेयर इंजीनियरिंग कार्यों के लिए लार्ज लैंग्वेज मॉडल अनुकूलन को बेहतर ढंग से निर्देशित करने के लिए एंट्रॉपी कम्प्रेशन हाइपोथीसिसिस (Entropy Compression Hypothesis) पर आधारित है।

Yueyang Wang, Jiawei Fu, Baolong Bi, Xili Wang, Xiaoqing Liu2026-05-13
💬 NLP

Beyond RAG for Agent Memory: Retrieval by Decoupling and Aggregation

यह शोध पत्र xMemory प्रस्तुत करता है, जो एक नवीन एजेंट मेमोरी फ्रेमवर्क है जो इंटरेक्शन इतिहास को पुन: प्रयोज्य घटकों में अलग करके और उन्हें पदानुक्रमित रूप से एकत्रित करके मानक RAG में सुधार करता है ताकि शीर्ष-डाउन रिट्रीवल (top-down retrieval) सक्षम हो सके, जो महत्वपूर्ण विवरणों को संरक्षित करते हुए रेडंडेंसी को कम करता है, जिससे उत्तर की गुणवत्ता और इन्फरेंस दक्षता बढ़ती है।

Zhanghao Hu, Qinglin Zhu, Runcong Zhao, Di Liang, Hanqi Yan, Yulan He, Lin Gui2026-05-13
💬 NLP

A Theoretical Analysis of Why Masked Diffusion Models Mitigate the Reversal Curse

यह शोध पत्र एक सैद्धांतिक विश्लेषण और अनुभवजन्य सत्यापन प्रदान करता है जो यह प्रदर्शित करता है कि मास्क्ड डिफ्यूजन मॉडल 'रिवर्सल कर्ज़' (Reversal Curse) को कम करते हैं क्योंकि उनके साझा ट्रांसफॉर्मर पैरामीटर्स और सापेक्ष स्थिति संबंधी एन्कोडिंग एक पैरामीटर-स्तरीय युग्मन (parameter-level coupling) निर्मित करते है जो फॉरवर्ड मास्क्ड ट्रेनिंग के दौरान सीखे गए टोकन-जोड़ी साक्ष्यों को रिवर्स क्वेरीज़ के लिए प्रभावी ढंग से पुन: उपयोग करने की अनुमति देता है।

Moongyu Jeon, Sangwoo Shin, BumJun Kim, Kyelim Lee, Albert No2026-05-13
💬 NLP

RACC: Representation-Aware Coverage Criteria for LLM Safety Testing

यह शोध पत्र RACC (रिप्रजेंटेशन-अवेयर कवरेज क्राइटेरिया) प्रस्तुत करता है, जो LLM सुरक्षा परीक्षण के लिए एक स्केलेबल फ्रेमवर्क है जो टेस्ट सुइट की पर्याप्तता का मूल्यांकन करने और हमले के निर्माण (अटैक जनरेशन) को निर्देशित करने के लिए हिडन स्टेट्स से सुरक्षा-विशिष्ट रिप्रजेंटेशन्स निकालता है, जो पारंपरिक न्यूरॉन-स्तरीय कवरेज मानदंडों की सीमाओं को प्रभावी ढंग से दूर करता है।

Zeming Wei, Zhixin Zhang, Chengcan Wu, Yihao Zhang, Xiaokun Luan, Meng Sun2026-05-13
💬 NLP

Safety Alignment as Continual Learning: Mitigating the Alignment Tax via Orthogonal Gradient Projection

यह शोध पत्र OGPSA का प्रस्ताव करता है, जो एक हल्का निरंतर शिक्षण (continual learning) तरीका है जो सुरक्षा पोस्ट-ट्रेनिंग में एलाइनमेंट टैक्स (alignment tax) को कम करने के लिए सुरक्षा ग्रेडिएंट्स को एक ऑर्थोगोनल सबस्पेस पर प्रोजेक्ट करता है ताकि बड़े पैमाने पर डेटा रिप्ले की आवश्यकता के बिना सामान्य मॉडल क्षमताओं को संरक्षित किया जा सके।

Guanglong Sun, Siyuan Zhang, Liyuan Wang, Jun Zhu, Hang Su, Yi Zhong2026-05-13
💬 NLP

100,000+ Movie Reviews from Kazakhstan: Russian, Kazakh, and Code-Switched Texts

यह शोधपत्र कजाकिस्तान के 1,00,000 से अधिक मूवी रिव्यूज का एक नया सार्वजनिक रूप से उपलब्ध बहुभाषी कॉर्पस प्रस्तुत करता है, जो भाषा और भावना के लिए एनोटेटेड है, और ध्रुवीयता (पोलैरिटी) तथा स्कोर वर्गीकरण कार्यों पर क्लासिकल बेसलाइन के विरुद्ध ट्रांसफार्मर मॉडल का मूल्यांकन करता है।

Rustem Yeshpanov2026-05-13
💬 NLP

PlantMarkerBench: A Multi-Species Benchmark for Evidence-Grounded Plant Marker Reasoning

यह शोधपत्र PlantMarkerBench प्रस्तुत करता है, जो एक व्यापक बहु-प्रजाति बेंचमार्क है जिसे पादप कोशिका-प्रकार-विशिष्ट मार्कर जीन के लिए साहित्य-आधारित साक्ष्यों की व्याख्या करने और वर्गीकृत करने की भाषा मॉडलों की क्षमता का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो जटिल, गैर-प्रत्यक्ष और संदिग्ध जैविक संदर्भों को संभालने में महत्वपूर्ण प्रदर्शन अंतराल को प्रकट करता है।

Sajib Acharjee Dip, Song Li, Liqing Zhang2026-05-13
💬 NLP

ANCHOR: Abductive Network Construction with Hierarchical Orchestration for Reliable Probability Inference in Large Language Models

यह शोध पत्र \textsc{Anchor} का परिचय देता है, जो एक पदानुक्रमित बेयसियन ढांचा (hierarchical Bayesian framework) है जो डेंस फैक्टर नेटवर्क का निर्माण करता है और बड़े भाषा मॉडलों (Large Language Models) में स्पार्स फैक्टर स्पेस की सीमाओं को दूर करने के लिए कारण मॉडलिंग (causal modeling) को एकीकृत करता है, जिससे अपूर्ण सूचना के तहत संभाव्यता अनुमान (probability inference) की विश्वसनीयता और दक्षता में महत्वपूर्ण सुधार होता है।

Wentao Qiu, Guanran Luo, Zhongquan Jian, Jingqi Gao, Meihong Wang, Qingqiang Wu2026-05-13
🤖 machine learning

Steering Without Breaking: Mechanistically Informed Interventions for Discrete Diffusion Language Models

यह शोध पत्र यह पहचानता है कि समान हस्तक्षेप अनुसूचियाँ (uniform intervention schedules) विभिन्न गुणों के विशिष्ट टेम्पोरल कमिटमेंट पैटर्न की अनदेखी करके डिस्क्रीट डिफ्यूजन लैंग्वेज मॉडल्स की गुणवत्ता को कम करती हैं, और एक नवीन एडेप्टिव शेड्यूलर प्रस्तावित करता है जो सटीक, उच्च-शक्ति वाले मल्टी-एट्रीब्यूट नियंत्रण को प्राप्त करने के लिए विशिष्ट फॉर्मेशन स्टेप्स पर स्टीयरिंग प्रयासों को केंद्रित करता है, जिससे जनरेशन क्वालिटी से समझौता नहीं होता है।

Hanhan Zhou, Shamik Roy, Rashmi Gangadharaiah2026-05-13