💬 NLP

Do Language Models Follow Occam's Razor? An Evaluation of Parsimony in Inductive and Abductive Reasoning

यह शोध पत्र एक सिंथेटिक ढांचे और स्वचालित मीट्रिक को प्रस्तुत करता है जो यह मूल्यांकन करता है कि क्या बड़े भाषा मॉडल आगमनात्मक (inductive) और अनुमानित (abductive) तर्क में ओकहम के रेज़र (Occam's Razor) का पालन करते हैं, जिससे यह पता चलता है कि हालांकि मॉडल सरल परिदृश्यों को संभाल सकते हैं, वे उन्नत तर्क तकनीकों के बावजूद जटिल विश्व मॉडलों में सही और संक्षिप्त परिकल्पनाएं उत्पन्न करने में संघर्ष करते हैं।

Yunxin Sun, Abulhair Saparov2026-03-27
💬 NLP

ReSum: Unlocking Long-Horizon Search Intelligence via Context Summarization

यह शोध पत्र ReSum को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त (training-free), प्लग-एंड-प्ले फ्रेमवर्क है जो LLM-आधारित वेब एजेंटों को आवधिक इतिहास सारांश (periodic history summarization) के माध्यम से कॉन्टेक्स्ट विंडो की सीमाओं को पार करने में सक्षम बनाता है, जिसे आगे एडवांटेज ब्रॉडकास्टिंग (advantage broadcasting) के माध्यम से लॉन्ग-होराइजन क्रेडिट असाइनमेंट को अनुकूलित करने के लिए ReSum-GRPO द्वारा बढ़ाया गया है।

Xixi Wu, Kuan Li, Yida Zhao, Liwen Zhang, Litu Ou, Huifeng Yin, Zhongwang Zhang, Xinmiao Yu, Dingchu Zhang, Yong Jiang (…)2026-03-27
💬 NLP

GeoResponder: Towards Building Geospatial LLMs for Time-Critical Disaster Response

यह शोध पत्र GeoResponder को प्रस्तुत करता है, जो एक स्कैफोल्डेड इंस्ट्रक्शन-ट्यूनिंग करिकुलम के माध्यम से लार्ज लैंग्वेज मॉडल्स की भू-स्थानिक तर्क क्षमताओं को बढ़ाता है, जिससे उन्हें सड़क नेटवर्कों पर सटीक रूप से नेविगेट करने और आवश्यक बुनियादी ढांचे का पता लगाने के माध्यम से समय-संवेदनशील आपदा प्रतिक्रिया कार्यों में प्रभावी ढंग से सहायता करने में सक्षम बनाया जा सके।

Ahmed El Fekih Zguir, Ferda Ofli, Muhammad Imran2026-03-27
💬 NLP

DiffuGuard: How Intrinsic Safety is Lost and Found in Diffusion Large Language Models

यह शोध पत्र DiffuGuard को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त रक्षा ढांचा (training-free defense framework) है जो स्टोकेस्टिक एनीलिंग (stochastic annealing) और ब्लॉक-स्तरीय ऑडिट तंत्र के माध्यम से हानिकारक ग्रीडी रीमास्किंग पूर्वाग्रहों (greedy remasking biases) और डिनोइजिंग-पाथ निर्भरता (denoising-path dependence) को संबोधित करके डिफ्यूजन लार्ज लैंग्वेज मॉडल्स में अद्वितीय जेलब्रेक कमजोरियों को कम करता है, जिससे मॉडल उपयोगिता को संरक्षित करते हुए हमले की सफलता दर में महत्वपूर्ण रूप से कमी आती है।

Zherui Li, Zheng Nie, Zhenhong Zhou, Yue Liu, Yitong Zhang, Yu Cheng, Qingsong Wen, Kun Wang, Yufei Guo, Jiaheng Zhang2026-03-27
💬 NLP

CQA-Eval: Designing Reliable Evaluations of Multi-paragraph Clinical QA under Resource Constraints

यह शोध पत्र CQA-Eval प्रस्तुत करता है, जो संसाधन संबंधी बाधाओं के तहत बहु-पैराग्राफ नैदानिक प्रश्न-उत्तर (QA) प्रणालियों का कुशलतापूर्वक मूल्यांकन करने के लिए एक रूपरेखा और सिफारिशों का समूह है, जो चिकित्सकों के एनोटेशन के माध्यम से यह प्रदर्शित करता है कि सूक्ष्म वाक्य-स्तरीय विश्लेषण शुद्धता सहमति (correctness agreement) में सुधार करता है जबकि स्थूल-स्तरीय विश्लेषण प्रासंगिकता को बेहतर ढंग से पकड़ता है, और यह कि वाक्यों के एक छोटे उपसमुच्चय को एनोटेट करना पूर्ण स्थूल एनोटेशन के तुलनीय विश्वसनीयता प्राप्त कर सकता है।

Federica Bologna, Tiffany Pan, Matthew Wilkens, Yue Guo, Lucy Lu Wang2026-03-27
💬 NLP

FactAppeal: Identifying Epistemic Factual Appeals in News Media

यह शोधपत्र FactAppeal प्रस्तुत करता है, जो 3,226 समाचार वाक्यों का एक मैन्युअल रूप से एनोटेट किया गया डेटासेट है जिसे सूक्ष्म साक्ष्य संरचनाओं और स्रोत विशेषताओं को कैप्चर करने के माध्यम से एपिस्टेमिक अपील पहचान (Epistemic Appeal Identification) के नवीन कार्य को आगे बढ़ाने के लिए डिज़ाइन किया गया है, साथ ही उन एनकोडर और जनरेटिव मॉडल्स का बेंचमार्किंग भी करता है जो 0.73 का मैक्रो-F1 स्कोर प्राप्त करते हैं।

Guy Mor-Lan, Tamir Sheafer, Shaul R. Shenhav2026-03-27
💬 NLP

CNSocialDepress: A Chinese Social Media Dataset for Depression Risk Detection and Structured Analysis

यह शोध पत्र CNSocialDepress को प्रस्तुत करता है, जो एक व्यापक चीनी सोशल मीडिया डेटासेट है जिसमें 44,178 पोस्ट और विशेषज्ञों द्वारा एनोटेट किए गए मनोवैज्ञानिक गुण शामिल हैं जो पारंपरिक बाइनरी वर्गीकरण से परे सूक्ष्म, व्याख्या योग्य अवसाद जोखिम पहचान और संरचित विश्लेषण को सक्षम करते हैं।

Jinyuan Xu, Tian Lan, Xintao Yu, Xue He, Hezhi Zhang, Ying Wang, Pierre Magistry, Mathieu Valette, Lei Li2026-03-27
💬 NLP

See the Text: From Tokenization to Visual Reading

यह शोध पत्र SeeTok को प्रस्तुत करता है, जो एक विज़न-केंद्रित दृष्टिकोण है जो टेक्स्ट को छवियों के रूप में रेंडर करता है ताकि मल्टीमॉडल LLMs इसे व्याख्यायित कर सकें, जो मानव दृश्य पठन की नकल करके महत्वपूर्ण कम्प्यूटेशनल दक्षता, टाइपोग्राफिक शोर के प्रति बेहतर मजबूती और बेहतर क्रॉस-लिंगुअल सामान्यीकरण प्राप्त करने के लिए सबवर्ड टोकनाइज़ेशन को प्रभावी ढंग से प्रतिस्थापित करता है।

Ling Xing, Rui Yan, Alex Jinpeng Wang, Zechao Li, Jinhui Tang2026-03-27
💬 NLP

Which Way Does Time Flow? A Psychophysics-Grounded Evaluation for Vision-Language Models

यह शोध पत्र AoT-PsyPhyBENCH प्रस्तुत करता है, जो एक मनोवैज्ञानिक रूप से प्रमाणित बेंचमार्क है जो यह दर्शाता है कि वर्तमान विजन-लैंग्वेज मॉडल प्राकृतिक वीडियो में समय की दिशा (arrow of time) निर्धारित करने में संघर्ष करते हैं, जो मनुष्यों की तुलना में उनकी टेम्पोरल और कॉज़ल रीजनिंग क्षमताओं में एक मौलिक अंतर को प्रकट करता है।

Shiho Matta, Lis Kanashiro Pereira, Peitao Han, Fei Cheng, Shigeru Kitazawa2026-03-27
💬 NLP

EQ-Negotiator: Dynamic Emotional Personas Empower Small Language Models for Edge-Deployable Credit Negotiation

यह शोध पत्र EQ-Negotiator को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो गेम थ्योरी और हिडन मार्कोव मॉडल्स (Hidden Markov Models) को एकीकृत करके भावनात्मक अवस्थाओं को गतिशील रूप से ट्रैक करने में सक्षम बनाता है, जिससे छोटे भाषा मॉडल गोपनीयता-संवेदनशील क्रेडिट वार्ताओं में काफी बड़े LLMs से बेहतर प्रदर्शन कर पाते हैं, और इस प्रकार यह प्रदर्शित करता है कि प्रभावी स्वचालित वार्ता के लिए मॉडल का पैमाना (scale) नहीं, बल्कि रणनीतिक भावनात्मक बुद्धिमत्ता अधिक महत्वपूर्ण है।

Yunbo Long, Yuhan Liu, Alexandra Brintrup2026-03-27