💬 NLP

Solver-Independent Automated Problem Formulation via LLMs for High-Cost Simulation-Driven Design

यह शोध पत्र APF प्रस्तुत करता है, जो एक सॉल्वर-स्वतंत्र ढांचा है जो बड़े भाषा मॉडलों और एक नवीन डेटा जनरेशन पाइपलाइन का लाभ उठाता है ताकि उच्च-लागत वाले सिमुलेशन-संचालित डिज़ाइन के लिए अस्पष्ट प्राकृतिक भाषा डिज़ाइन आवश्यकताओं को सटीक, निष्पादन योग्य अनुकूलन सूचियों (optimization formulations) में स्वचालित रूप से अनुवादित किया जा सके, जो एंटीना डिज़ाइन अनुप्रयोगों में मौजूदा विधियों से काफी बेहतर प्रदर्शन करता है।

Yuchen Li, Handing Wang, Bing Xue, Mengjie Zhang, Yaochu Jin2026-04-14
💬 NLP

Doc-PP: Document Policy Preservation Benchmark for Large Vision-Language Models

यह शोध पत्र Doc-PP प्रस्तुत करता है, जो यह प्रकट करता है कि लार्ज विजन-लैंग्वेज मॉडल्स (Large Vision-Language Models) सख्त नीतियों के तहत मल्टीमॉडल दस्तावेज़ों पर तर्क करते समय अक्सर संवेदनशील जानकारी लीक कर देते हैं, और इन कमजोरियों को कम करने के लिए तर्क (reasoning) को नीति सत्यापन (policy verification) से प्रभावी ढंग से अलग करने हेतु DVA फ्रेमवर्क का प्रस्ताव करता है।

Haeun Jang, Hwan Chang, Hwanhee Lee2026-04-14
💬 NLP

Disco-RAG: Discourse-Aware Retrieval-Augmented Generation

डिस्को-आरएजी (Disco-RAG) एक विमर्श-जागरूक (discourse-aware) ढांचा है जो संरचनात्मक संकेतों को पकड़ने के लिए इंट्रा-चंक विमर्श वृक्षों (intra-chunk discourse trees) और इंटर-चंक वक्तृत्व ग्राफों (inter-chunk rhetorical graphs) का निर्माण करके रिट्रीवल-ऑगमेंटेड जनरेशन (Retrieval-Augmented Generation) को उन्नत करता है, जिससे बिना फाइन-ट्यूनिंग के प्रश्न उत्तर और दीर्घ-दस्तावेज़ सारांश बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Dongqi Liu, Hang Ding, Qiming Feng, Xurong Xie, Zhucun Xue, Chengjie Wang, Jian Li, Jiangning Zhang, Yabiao Wang2026-04-14
💬 NLP

The Poisoned Apple Effect: Strategic Manipulation of Mediated Markets via Technology Expansion of AI Agents

यह शोध पत्र यह प्रदर्शित करता है कि आर्थिक बाजारों में एआई एजेंट प्रौद्योगिकियों का रणनीतिक विस्तार एक "पॉइज़न्ड एप्पल" (विषैला सेब) प्रभाव को जन्म दे सकता है, जहाँ अभिनेता केवल नियामक परिणामों को अपने पक्ष में हेरफेर करने के लिए अप्रयुक्त उपकरणों को जारी करते हैं, जिससे स्थिर ढाँचों की भेद्यता उजागर होती है और गतिशील बाजार डिजाइनों की आवश्यकता अनिवार्य हो जाती है।

Eilam Shapira, Roi Reichart, Moshe Tennenholtz2026-04-14
💬 NLP

Powerful Training-Free Membership Inference Against Autoregressive Language Models

यह शोध पत्र EZ-MIA को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त सदस्यता अनुमान हमला (membership inference attack) है जो मौजूदा अत्याधुनिक विधियों की तुलना में काफी उच्च पहचान दरों और कम फाल्स पॉजिटिव के साथ फाइन-ट्यून्ड ऑटोरेग्रेसिव लैंग्वेज मॉडल्स में मेमोराइजेशन का पता लगाने के लिए "एरर ज़ोन" स्कोर का लाभ उठाता है।

David Ilić, David Stanojević, Kostadin Cvejoski2026-04-14
💬 NLP

ClaimDB: A Fact Verification Benchmark over Large Structured Data

यह शोधपत्र ClaimDB प्रस्तुत करता है, जो 80 वास्तविक जीवन के डेटाबेसों से बना एक बड़े पैमाने का तथ्य-सत्यापन बेंचमार्क है जो वर्तमान LLMs को केवल साक्ष्य पढ़ने से आगे बढ़कर निष्पादन योग्य प्रोग्राम तर्क (executable program reasoning) की ओर बढ़ने की चुनौती देता है, जिससे मौजूदा मॉडलों में महत्वपूर्ण सटीकता और परहेज (abstention) संबंधी सीमाएं प्रकट होती हैं।

Michael Theologitis, Preetam Prabhu Srikar Dammu, Chirag Shah, Dan Suciu2026-04-14
💬 NLP

Who Gets Which Message? Auditing Demographic Bias in LLM-Generated Targeted Text

यह शोध पत्र प्रमुख लार्ज लैंग्वेज मॉडल्स का एक व्यवस्थित ऑडिट प्रस्तुत करता है, जो यह प्रकट करता है कि जनसांख्यिकीय-आधारित लक्षित संदेशिंग लगातार लिंग और आयु संबंधी रूढ़ियों को बढ़ाती है—जैसे कि पुरुषों और युवाओं के लिए एजेंसी (कर्तृत्व) पर तथा महिलाओं और वरिष्ठ नागरिकों के लिए गर्मजोशी (warmth) पर जोर देना—और ये पूर्वाग्रह प्रासंगिक प्रॉम्प्ट्स द्वारा और अधिक तीव्र हो जाते हैं, जिससे रूढ़िवादी दर्शकों के लिए उच्च प्रेरक स्कोर प्राप्त होता है।

Tunazzina Islam2026-04-14
💬 NLP

MCERF: Advancing Multimodal LLM Evaluation of Engineering Documentation with Enhanced Retrieval

यह शोध पत्र MCERF को प्रस्तुत करता है, जो एक मल्टीमॉडल रिट्रीवल और रीजनिंग फ्रेमवर्क है जो जटिल टेक्स्ट, तालिकाओं और छवियों वाली इंजीनियरिंग दस्तावेज़ों पर प्रश्न-उत्तर की सटीकता में महत्वपूर्ण सुधार करने के लिए ColPali मॉडल और एडेप्टिव रूटिंग रणनीतियों का लाभ उठाता है, जिससे बेसलाइन RAG सिस्टम की तुलना में 41.1% की सापेक्ष वृद्धि प्राप्त होती है।

Kiarash Naghavi Khanghah, Hoang Anh Nguyen, Anna C. Doris, Amir Mohammad Vahedi, Daniele Grandi, Faez Ahmed, Hongyi Xu2026-04-14
🤖 AI

Seven simple steps for log analysis in AI systems

यह शोध पत्र कठोर और पुनरुत्पादक मूल्यांकन सुनिश्चित करने के लिए AI सिस्टम लॉग का विश्लेषण करने हेतु एक मानकीकृत, सात-चरणीय पाइपलाइन प्रस्तावित करता है, जिसमें Inspect Scout लाइब्रेरी में कार्यान्वयन मार्गदर्शन और सामान्य त्रुटियों के उदाहरण भी शामिल हैं।

Magda Dubois, Ekin Zorer, Maia Hamin, Joe Skinner, Alexandra Souly, Jerome Wynne, Harry Coppock, Lucas Satos, Sayash Kap (…)2026-04-14
💬 NLP

ACE-TA: An Agentic Teaching Assistant for Grounded Q&A, Quiz Generation, and Code Tutoring

यह शोध पत्र ACE-TA को प्रस्तुत करता है, जो एक एजेंटिक फ्रेमवर्क है जो पूर्व-प्रशिक्षित लार्ज लैंग्वेज मॉडल्स का उपयोग करके ग्राउंडेड कॉन्सेप्चुअल प्रश्नोत्तर, एडेप्टिव क्विज़ जनरेशन, और इंटरैक्टिव, सैंडबॉक्स्ड कोड ट्यूटरिंग के लिए प्रोग्रामिंग कोर्स संबंधी प्रश्नों को स्वायत्त रूप से विशिष्ट मॉड्यूल में रूट करता है।

Himanshu Tripathi, Charlottee Crowell, Kaley Newlin, Subash Neupane, Shahram Rahimi, Jason Keith2026-04-14