💬 NLP

Legal2LogicICL: Improving Generalization in Transforming Legal Cases to Logical Formulas via Diverse Few-Shot Learning

यह शोधपत्र Legal2LogicICL का प्रस्ताव करता है, जो एक रिट्रीवल-ऑगमेंटेड फ्यू-शॉट लर्निंग फ्रेमवर्क है जो उदाहरणों की विविधता और समानता को संतुलित करते हुए तथा एंटिटी-प्रेरित रिट्रीवल बायस (entity-induced retrieval bias) को कम करते हुए प्राकृतिक भाषा वाले कानूनी मामलों को तार्किक सूत्रों में बदलने की सामान्यीकरण क्षमता और सटीकता में सुधार करता है, जो कि नए पेश किए गए Legal2Proleg डेटासेट द्वारा समर्थित है।

Jieying Xue, Phuong Minh Nguyen, Ha Thanh Nguyen, May Myo Zin, Ken Satoh2026-04-14
🤖 AI

SWE-AGILE: A Software Agent Framework for Efficiently Managing Dynamic Reasoning Context

SWE-AGILE एक नवीन सॉफ़्टवेयर एजेंट फ्रेमवर्क है जो विस्तृत तर्क (reasoning) के स्लाइडिंग विंडो को बनाए रखते हुए ऐतिहासिक संदर्भ को संक्षिप्त सारांशों में संकुचित करने की एक गतिशील रणनीति का उपयोग करके स्वायत्त सॉफ़्टवेयर इंजीनियरिंग में तर्क की गहराई और संदर्भ सीमाओं के बीच के समझौते को संबोधित करता है, जिससे कुशल 7B-8B मॉडलों के साथ SWE-Bench-Verified पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Shuquan Lian, Juncheng Liu, Yazhe Chen, Yuhong Chen, Hui Li2026-04-14
💬 NLP

Evaluating Cooperation in LLM Social Groups through Elected Leadership

यह शोध पत्र एलएलएम (LLM) मल्टी-एजेंट सिस्टम में निर्वाचित नेतृत्व के अनुकरण के लिए एक ओपन-सोर्स फ्रेमवर्क पेश करता है, जो अनुभवजन्य अध्ययन के माध्यम से यह प्रदर्शित करता है कि इस प्रकार की शासन संरचनाएं असंरचित सहयोग की तुलना में सामाजिक कल्याण और उत्तरजीविता समय को महत्वपूर्ण रूप से बढ़ाती हैं।

Ryan Faulkner, Anushka Deshpande, David Guzman Piedrahita, Joel Z. Leibo, Zhijing Jin2026-04-14
💬 NLP

Discourse Diversity in Multi-Turn Empathic Dialogue

यह शोध पत्र प्रकट करता है कि बड़े भाषा मॉडल बहु-चरण सहानुभूतिपूर्ण बातचीत के दौरान विमर्श चालों (discourse moves) को पुन: उपयोग करने में अत्यधिक कठोरता प्रदर्शित करते हैं, और MINT का प्रस्ताव करता है, जो एक सुदृढीकरण शिक्षण (reinforcement learning) ढांचा है जो विमर्श विविधता और समग्र सहानुभूति गुणवत्ता दोनों में महत्वपूर्ण सुधार करने के लिए क्रॉस-टर्न रणनीति नवीनता (cross-turn tactic novelty) के लिए अनुकूलित करता है।

Hongli Zhan, Emma S. Gueorguieva, Javier Hernandez, Jina Suh, Desmond C. Ong, Junyi Jessy Li2026-04-14
💬 NLP

LangFlow: Continuous Diffusion Rivals Discrete in Language Modeling

लॉगफ्लो (LangFlow) एक नवीन निरंतर डिफ्यूजन लैंग्वेज मॉडल पेश करता है जो ब्रेगमन डायवर्जेंस (Bregman divergence) के माध्यम से फ्लो मैचिंग (Flow Matching) का लाभ उठाकर, एक गमबेल-आधारित (Gumbel-based) सीखने योग्य नॉइज़ शेड्यूलर और एक बेहतर प्रशिक्षण प्रोटोकॉल का उपयोग करके अपने डिस्क्रीट समकक्षों के साथ प्रदर्शन के अंतर को पाटता है, जिससे प्रतिस्पर्धी परप्लेक्सिटी स्कोर प्राप्त होते हैं और ज़ीरो-शॉट ट्रांसफर में ऑटोरेग्रेसिव बेसलाइनों से बेहतर प्रदर्शन होता है।

Yuxin Chen, Chumeng Liang, Hangke Sui, Ruihan Guo, Chaoran Cheng, Jiaxuan You, Ge Liu2026-04-14
🤖 machine learning

ClawGUI: A Unified Framework for Training, Evaluating, and Deploying GUI Agents

यह शोध पत्र ClawGUI को प्रस्तुत करता है, जो वर्चुअल और फिजिकल डिवाइसेस के लिए एक स्थिर RL इंफ्रास्ट्रक्चर, एक मानकीकृत बेंचमार्किंग पाइपलाइन और क्रॉस-प्लेटफॉर्म एजेंट डिप्लॉयमेंट प्रदान करके GUI एजेंट्स के प्रशिक्षण, मूल्यांकन और परिनियोजन (डिप्लॉयमेंट) को एकीकृत करने वाला एक ओपन-सोर्स फ्रेमवर्क है, जो अंततः ClawGUI-2B मॉडल को मोबाइल GUI कार्यों में मौजूदा बेसलाइन्स से बेहतर प्रदर्शन करने में सक्षम बनाता है।

Fei Tang, Zhiqiong Lu, Boxuan Zhang, Weiming Lu, Jun Xiao, Yueting Zhuang, Yongliang Shen2026-04-14
💬 NLP

CLSGen: A Dual-Head Fine-Tuning Framework for Joint Probabilistic Classification and Verbalized Explanation

यह शोध पत्र CLSGen को प्रस्तुत करता है, जो एक नवीन ड्यूल-हेड फाइन-ट्यूनिंग फ्रेमवर्क है जो लार्ज लैंग्वेज मॉडल्स को सुसंगत मौखिक स्पष्टीकरण (verbalized explanations) उत्पन्न करने की अपनी क्षमता को बनाए रखते हुए बाइनरी क्लासिफिकेशन के लिए विश्वसनीय मात्रात्मक संभाव्यताएं (quantitative probabilities) उत्पन्न करने में सक्षम बनाता है, जिससे पारंपरिक विभेदक दृष्टिकोणों (discriminative approaches) में पाई जाने वाली कैटास्ट्रोफिक फॉरगेटिंग और भाषाई पतन (linguistic collapse) की सीमाओं को दूर किया जा सके।

WonJin Yoon, Kangyu Zhu, Ian Bulovic, Autumn Sehy, Yanjun Gao, Dmitriy Dligach, Majid Afshar, Timothy A. Miller2026-04-14
💬 NLP

Saar-Voice: A Multi-Speaker Saarbrücken Dialect Speech Corpus

यह शोधपत्र सार-वॉइस (Saar-Voice) का परिचय देता है, जो नौ वक्ताओं के संरेखित पाठ और ऑडियो के साथ सारब्रुकन जर्मन बोली का एक छह घंटे का भाषण संग्रह है, जिसे एनएलपी (NLP) में बोलियों के अल्प-प्रतिनिधित्व को संबोधित करने और कम-संसाधन वाले, बोली-जागरूक टेक्स्ट-टू-स्पीच सिस्टम में भविष्य के अनुसंधान को समर्थन देने के लिए डिज़ाइन किया गया है।

Lena S. Oberkircher, Jesujoba O. Alabi, Dietrich Klakow, Jürgen Trouvain2026-04-14
🤖 AI

Detecting Safety Violations Across Many Agent Traces

यह शोध पत्र मीरकैट (Meerkat) को प्रस्तुत करता है, जो एक नवीन प्रणाली है जो एजेंटिक खोज (agentic search) के साथ क्लस्टरिंग को जोड़ती है ताकि एजेंट ट्रेसेस के बड़े सेट में दुर्लभ और जटिल सुरक्षा उल्लंघनों का कुशलतापूर्वक पता लगाया जा सके, जो सीड परिदृश्यों (seed scenarios) या व्यापक सूचीकरण (exhaustive enumeration) पर निर्भर रहे बिना दुरुपयोग, रिवॉर्ड हैकिंग और डेवलपर धोखाधड़ी की पहचान करने में मौजूदा बेसलाइनों से काफी बेहतर प्रदर्शन करता है।

Adam Stein, Davis Brown, Hamed Hassani, Mayur Naik, Eric Wong2026-04-14
💬 NLP

Neurons Speak in Ranges: Breaking Free from Discrete Neuronal Attribution

यह शोध पत्र "NeuronLens" का प्रस्ताव करके बड़े भाषा मॉडलों (large language models) में पॉलीसेमैनिसिटी (polysemanticity) के कारण होने वाले विविक्त न्यूरॉन-अवधारणा एट्रिब्यूशन (discrete neuron-concept attribution) की सीमाओं को चुनौती देता है, जो व्यक्तिगत न्यूरॉन्स के बजाय अवधारणा-विशिष्ट सक्रियण श्रेणियों (concept-specific activation ranges) का विश्लेषण और हस्तक्षेप करके अधिक सटीक व्याख्यात्मकता (interpretability) और लक्षित हेरफेर (targeted manipulation) प्राप्त करता है।

Muhammad Umair Haider, Hammad Rizwan, Hassan Sajjad, Peizhong Ju, A. B. Siddique2026-04-13