💬 NLP

The Amplifying Mirror: Locating and Steering the Partisan Direction inside a Large Language Model

यह शोध पत्र यह प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल्स (LLMs) में पक्षपाती राजनीतिक पूर्वाग्रह कोई अस्पष्ट उभरता हुआ गुण नहीं है, बल्कि मॉडल के एक्टिवेशन स्पेस के भीतर एक सटीक, सीखने योग्य ज्यामितीय विशेषता है जिसे जनरेट किए गए टेक्स्ट को व्यवस्थित रूप से बदलने के लिए पहचाना, विघटित और कारणवश हेरफेर (causally manipulate) किया जा सकता है।

Wendy K. Tam2026-06-09
💬 NLP

Continuous Language Diffusion as a Decoder-Interface Problem

यह शोध पत्र उस तंत्र की जांच करता है जिसके माध्यम से निरंतर डिफ्यूजन मॉडल (continuous diffusion models) व्याख्यात्मक न होने वाले गॉसियन-दूषित एम्बेडिंग्स (Gaussian-corrupted embeddings) से सुसंगत पाठ उत्पन्न करते हैं, एक "डिकोडर-बेसिन" (decoder-basin) घटना की पहचान करता है जहाँ सफल डिनोइजिंग (denoising) डिकोडर स्थिरता के उच्च क्षेत्रों तक पहुँचने पर निर्भर करती है बजाय लेटेंट त्रुटि को न्यूनतम करने के, और इन मॉडलों को प्रतिनिधित्व-डिकोडर प्रणालियों के रूप में मूल्यांकन करने के लिए एक नैदानिक प्रोटोकॉल का प्रस्ताव करता है।

Zhicheng Du, Lan Ma2026-06-09
🤖 AI

Momentum for Reasoning: Dense Intrinsic Signals in Policy Optimization

यह शोध पत्र ISPO को प्रस्तुत करता है, जो एक नवीन पॉलिसी ऑप्टिमाइज़ेशन विधि है जो ज़ीरो-एडवांटेज कोलैप्स (Zero-Advantage Collapse) और हैलुसिनेटेड सर्टेन्टी (Hallucinated Certainty) को समाप्त करने के लिए पॉलिसी की अपनी संभावनाओं से प्राप्त इंट्रिन्सिक सिग्नल्स के साथ बाइनरी रिवार्ड्स को सघन बनाता है, जिससे चुनौतीपूर्ण गणितीय बेंचमार्क पर लार्ज लैंग्वेज मॉडल्स के लॉन्ग-चेन रीजनिंग प्रदर्शन में महत्वपूर्ण सुधार होता है।

Hao Chen, Zhanming Shen, Liyao Li, Yanyu Chen, Xuhang Zhu, Xiaomeng Hu, Qi Zhang, Ru Peng, Xiaoyu Shen, Haobo Wang, Junb (…)2026-06-09
💬 NLP

PaperMentor: A Human-Centered Multi-Agent Writing Tutor for AI Research Papers on Overleaf

PaperMentor ओवरलीफ (Overleaf) के लिए एक ओपन-सोर्स, मानव-केंद्रित मल्टी-एजेंट राइटिंग असिस्टेंट है जो AI अनुसंधान पत्रों पर कार्रवाई योग्य, इनलाइन फीडबैक प्रदान करने के लिए एक क्यूरेटेड विशेषज्ञ कौशल लाइब्रेरी का लाभ उठाता है, जो मानवीय लेखकत्व को सुरक्षित रखते हुए एक यूजर स्टडी में बेसलाइन मॉडलों से काफी बेहतर प्रदर्शन करता है।

Jiarui Liu, Terry Jingchen Zhang, Ryan Faulkner, X. Angelo Huang, Vilém Zouhar, Dominik Glandorf, Isabel Dahlgren, Van Q (…)2026-06-09
💬 NLP

Building Customer Support AI Agents at 100M-User Scale: An Evaluation-Driven Framework

यह शोध पत्र नुबैंक (Nubank) में विकसित एक एकीकृत, मूल्यांकन-संचालित ढांचे को प्रस्तुत करता है जो संरचित संदर्भ इंजीनियरिंग (structured context engineering), मानव-इन-द-लूप इटरेशन (human-in-the-loop iteration), और कठोर एलएलएम जज मूल्यांकन (LLM judge evaluation) को एकीकृत करता है ताकि पांच डोमेन में 10 करोड़ से अधिक उपयोगकर्ताओं के लिए प्रोडक्शन-रेडी ग्राहक सहायता एआई एजेंटों को सफलतापूर्वक तैनात किया जा सके, जिससे संतुष्टि और सेल्फ-सर्विस दरों में महत्वपूर्ण सुधार हुआ है और ऑफलाइन मेट्रिक्स तथा ऑनलाइन प्रभाव के बीच एक मजबूत सहसंबंध प्रदर्शित हुआ है।

Aman Gupta, Kevin Rossell, Edesio Alcobaça, Jose Chrystian Lima Pacheco, Carolina Baptista de Lima, Shao Tang, Luiz Paul (…)2026-06-09
💬 NLP

Are Reasoning Vision-Language Models Robust to Semantic Visual Distractions?

यह शोध पत्र Distract-Bench प्रस्तुत करता है, जो एक नया बेंचमार्क है जो यह प्रदर्शित करता है कि रीजनिंग विजन-लैंग्वेज मॉडल्स (Reasoning Vision-Language Models) पारंपरिक संवेदी विकृतियों (perceptual corruptions) की तुलना में सिमेंटिक विजुअल डिस्ट्रैक्शंस (semantic visual distractions)—अर्थात अर्थपूर्ण लेकिन अप्रासंगिक संकेतों—के प्रति काफी अधिक संवेदनशील होते हैं, क्योंकि ये डिस्ट्रैक्शंस अक्सर मॉडल्स की सही विजुअल परसेप्शन के बावजूद उनकी रीजनिंग प्रक्रियाओं को गुमराह कर देते हैं।

Yizheng Sun, Mochuan Zhan, Yanan Ma, Jia Tong See, Yifan Wang, Ziyi Wang, Hao Li, Yang Cui, Wenhao Cai, Jingyu Sun, Chen (…)2026-06-09
💬 NLP

From Statute to Control Flow: Span-Grounded Deontic Trees for Defeasible Scope Parsing

यह शोध पत्र NormBench प्रस्तुत करता है, जो एक बहुभाषी बेंचमार्क है जिसमें स्पैन-ग्राउंडेड डियोन्टिक ट्रीज़ (SG-DT) का उपयोग किया गया है ताकि नियम-अनुसरण करने वाले एजेंटों में 'साइलेंट स्कोप ओमिशन' (Silent Scope Omission) का निदान और शमन किया जा सके, जो अंतिम-कार्य परिणामों से ध्यान हटाकर विखंडनीय कानूनी स्कोप के सटीक संरचनात्मक पार्सिंग पर केंद्रित है, जिससे यह प्रकट होता है कि सीमित मध्यवर्ती प्रतिनिधित्व जटिल नियामक संदर्भों में अपवाद प्रबंधन में महत्वपूर्ण सुधार करते हैं।

Jian Chen, Siyuan Li, Chucheng Wan, Zixuan Yuan2026-06-09
💬 NLP

PACT: Learning Diverse Diagnostic Strategies via Privileged Synthesis and Branch Consensus

यह शोध पत्र PACT का प्रस्ताव करता है, जो विविध, सत्यापित नैदानिक संवादों को उत्पन्न करने के लिए प्रिविलेज्ड सिंथेसिस (Privileged Synthesis) का लाभ उठाता है और बिना किसी हस्तक्षेप के कई तर्क प्रतिमानों (reasoning paradigms) को प्रभावी ढंग से सीखने के लिए ब्रांच कंसेंसस (Branch Consensus) प्रशिक्षण का उपयोग करता है, जिससे एक नए गतिशील चीनी चिकित्सा निदान बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Gen Li, Yuanze Hu, Zhichao Yang, Qingchen Yu, Jianwei Lv, Yue Guo, Yujing Liu, Faguo Wu, Hongwei Zheng, Xiandong Li, Bo (…)2026-06-09
💬 NLP

CARE: A Conformal Safety Layer for Medical Summarization

यह शोध पत्र CARE को प्रस्तुत करता है, जो एक पोस्ट-हॉक (post-hoc), मॉडल-अज्ञेय (model-agnostic) सुरक्षा परत है जो LLM-जनित चिकित्सा सारांशों में मतिभ्रम (hallucinations) और चिकित्सकीय रूप से महत्वपूर्ण लोपों (omissions) को सीमित करने के लिए कॉन्फॉर्मल रिस्क कंट्रोल (conformal risk control) का उपयोग करके औपचारिक, परिमित-नमूना गारंटी प्रदान करता है, जिससे कठोर सुरक्षा मानकों को बनाए रखते हुए नैदानिक समीक्षा के बोझ को काफी कम किया जा सकता है।

Suhana Bedi, Bridget Lin, Anson Y. Zhou, Chloe O. Stanwyck, Jenelle A. Jindal, Sanmi Koyejo, David Stutz, Nigam H. Shah2026-06-09
💬 NLP

Language-Aware Token Boosting: LLM Language Confusion Reduction Without Tuning

यह शोध पत्र लैंग्वेज-अवेयर टोकन बूस्टिंग (LATB) नामक एक ट्यूनिंग-मुक्त प्रतिमान और इसके अनुकूली संस्करण को प्रस्तुत करता है, जो फाइन-ट्यूनिंग की आवश्यकता के बिना जनरेशन की गुणवत्ता बनाए रखते हुए लक्षित टोकन गड़बड़ी (perturbations) लागू करके लार्ज लैंग्वेज मॉडल्स में भाषाई भ्रम को प्रभावी ढंग से कम करता है।

Trapoom Ukarapol, Pakhapoom Sarapat, Nut Chukamphaeng2026-06-09