💬 NLP

DND: Boosting Large Language Models with Dynamic Nested Depth

यह शोध पत्र डायनेमिक नेस्टेड डेप्थ (DND) को प्रस्तुत करता है, जो एक नवीन पोस्ट-ट्रेनिंग विधि है जो एक नेस्टेड डेप्थ तंत्र के माध्यम से महत्वपूर्ण टोकन की गतिशील रूप से पहचान करने और उन्हें पुन: संसाधित करने द्वारा ऑफ-द-शेल्फ LLMs को उन्नत करती है, जिससे न्यूनतम कम्प्यूटेशनल ओवरहेड के साथ विविध बेंचमार्क पर महत्वपूर्ण प्रदर्शन लाभ प्राप्त होता है।

Tieyuan Chen, Xiaodong Chen, Haoxing Chen, Zhenzhong Lan, Weiyao Lin, Jianguo Li2026-01-28
💬 NLP

Do Psychometric Tests Work for Large Language Models? Evaluation of Tests on Sexism, Racism, and Morality

यह अध्ययन 17 लार्ज लैंग्वेज मॉडल्स पर लिंगभेद, नस्लवाद और नैतिकता के लिए मानव मनोमितीय (साइकोमेट्रिक) परीक्षणों का व्यवस्थित रूप से मूल्यांकन करता है, जिसमें यह पाया गया कि हालांकि ये परीक्षण मध्यम विश्वसनीयता प्रदर्शित करते हैं, लेकिन इनमें पारिस्थितिक वैधता (इकोलॉजिकल वैलिडिटी) का अभाव है क्योंकि उनके स्कोर वास्तविक दुनिया के कार्यों में मॉडल्स के वास्तविक व्यवहार के साथ संरेखित होने में विफल रहते हैं या उससे नकारात्मक रूप से सह-संबंधित होते हैं।

Jana Jung, Marlene Lutz, Indira Sen, Markus Strohmaier2026-01-28
💬 NLP

Rethinking Schema Linking: A Context-Aware Bidirectional Retrieval Approach for Text-to-SQL

यह शोध पत्र एक संदर्भ-जागरूक द्वि-दिश पुनर्प्राप्ति ढांचे (context-aware bidirectional retrieval framework) का प्रस्ताव करता है जो पूरक टेबल-प्रथम और कॉलम-प्रथम रणनीतियों के माध्यम से स्कीमा लिंकिंग को एक स्वतंत्र समस्या के रूप में मानता है, जो भ्रम (hallucinations) को कम करके और पूर्ण एवं पूर्ण स्कीमा सेटिंग्स के बीच प्रदर्शन के अंतर को कम करके Text-to-SQL सटीकता और दक्षता में महत्वपूर्ण सुधार करता है।

Md Mahadi Hasan Nahid, Davood Rafiei, Weiwei Zhang, Yong Zhang2026-01-28
💬 NLP

Unleashing Scientific Reasoning for Bio-experimental Protocol Generation via Structured Component-based Reward Mechanism

यह शोध पत्र थॉथ (Thoth) को प्रस्तुत करता है, जिसे एक "स्केच-एंड-फिल" (Sketch-and-Fill) प्रतिमान और एक संरचित घटक-आधारित पुरस्कार तंत्र का उपयोग करके नए SciRecipe डेटासेट पर प्रशिक्षित किया गया है, ताकि सटीक, तार्किक रूप से क्रमबद्ध और निष्पादन योग्य जैविक प्रयोगात्मक प्रोटोकॉल उत्पन्न किए जा सकें जो मौजूदा लार्ज लैंग्वेज मॉडल्स से बेहतर प्रदर्शन करते हैं।

Haoran Sun, Yankai Jiang, Zhenyu Tang, Yaning Pan, Shuang Gu, Zekai Lin, Lilong Wang, Wenjie Lou, Lei Liu, Lei Bai, Xiao (…)2026-01-28
💬 NLP

SemCoT: Accelerating Chain-of-Thought Reasoning through Semantically-Aligned Implicit Tokens

SemCoT एक नवीन ढांचा है जो एक सिमेंटिकली-अलाइन्ड इम्प्लिसिट टोकन दृष्टिकोण पेश करके चेन-ऑफ-थॉट रीजनिंग को त्वरित करता है, जो तर्क की गुणवत्ता को बनाए रखने के लिए एक कंट्रास्टिवली प्रशिक्षित सेंटेंस ट्रांसफार्मर को एक हल्के, नॉलेज-डिस्टिल्ड जनरेटर के साथ जोड़ता है ताकि टोकन-स्तरीय पीढ़ी की गति को अनुकूलित किया जा सके।

Yinhan He, Wendy Zheng, Yaochen Zhu, Zaiyi Zheng, Lin Su, Sriram Vasudevan, Qi Guo, Liangjie Hong, Jundong Li2026-01-28
💬 NLP

Accepted with Minor Revisions: Value of AI-Assisted Scientific Writing

यह अध्ययन प्रकट करता है कि जबकि एआई-जनित सार (एब्स्ट्रैक्ट) न्यूनतम संशोधन के साथ मानव-लिखित सार के तुलनीय स्वीकृति दर प्राप्त कर सकते हैं, लेखकत्व के कथित स्रोत का संपादन व्यवहार पर महत्वपूर्ण प्रभाव पड़ता है, जो सहयोगात्मक वैज्ञानिक लेखन में स्रोत प्रकटीकरण के अत्यंत महत्व को रेखांकित करता है।

Sanchaita Hazra, Doeun Lee, Bodhisattwa Prasad Majumder, Sachin Kumar2026-01-28
💬 NLP

Prompt-Counterfactual Explanations for Generative AI System Behavior

यह शोध पत्र प्रॉम्प्ट-काउंटरफैक्चुअल स्पष्टीकरण (PCEs) उत्पन्न करने के लिए एक नवीन ढांचे और एल्गोरिदम का प्रस्ताव करता है ताकि यह व्याख्या की जा सके कि विशिष्ट इनपुट प्रॉम्प्ट जेनरेटिव एआई आउटपुट की विशेषताओं को कैसे प्रभावित करते हैं, जिससे अधिक प्रभावी प्रॉम्प्ट इंजीनियरिंग, रेड-टीमिंग और नियामक अनुपालन सक्षम हो सके।

Sofie Goethals, Foster Provost, João Sedoc2026-01-28
💬 NLP

Improving Implicit Hate Speech Detection via a Community-Driven Multi-Agent Framework

यह शोध पत्र एक समुदाय-संचालित मल्टी-एजेंट फ्रेमवर्क पेश करता है जो एक केंद्रीय मॉडरेटर एजेंट और गतिशील रूप से निर्मित कम्युनिटी एजेंटों का लाभ उठाता है ताकि सामाजिक-सांस्कृतिक संदर्भ को एकीकृत किया जा सके, जिससे टॉक्सीजेन (ToxiGen) डेटासेट पर मौजूदा प्रॉम्प्टिंग विधियों की तुलना में निहित घृणास्पद भाषण (implicit hate speech) का पता लगाने की सटीकता और निष्पक्षता दोनों में महत्वपूर्ण सुधार होता है।

Ewelina Gajewska, Katarzyna Budzynska, Jarosław A Chudziak2026-01-28
💬 NLP

coTherapist: A Behavior-Aligned Small Language Model to Support Mental Healthcare Experts

यह शोध पत्र coTherapist को प्रस्तुत करता है, जो एक व्यवहार-संरेखित (behavior-aligned) लघु भाषा मॉडल ढांचा है जो सहानुभूतिपूर्ण, नैदानिक रूप से सटीक और विश्वसनीय प्रतिक्रियाएं उत्पन्न करने के लिए डोमेन-विशिष्ट फाइन-ट्यूनिंग, रिट्रीवल ऑग्मेंटेशन और एजेंटिक रीजनिंग का लाभ उठाता है, जिससे कार्यबल की कमी के बीच मानसिक स्वास्थ्य देखभाल विशेषज्ञों को सहायता प्रदान करने के लिए एक स्केलेबल समाधान मिलता है।

Prottay Kumar Adhikary, Reena Rawat, Tanmoy Chakraborty2026-01-28
💬 NLP

Can We Trust LLM Detectors?

यह शोध पत्र वितरण बदलावों (distribution shifts) और शैलीगत विचलनों (stylistic perturbations) के तहत मौजूदा प्रशिक्षण-मुक्त (training-free) और पर्यवेक्षित (supervised) LLM डिटेक्टरों की भंगुरता का व्यवस्थित रूप से मूल्यांकन करता है, एक पर्यवेक्षित कंट्रास्टिव लर्निंग फ्रेमवर्क प्रस्तावित करता है, और साथ ही मजबूत, डोमेन-अज्ञेय (domain-agnostic) AI टेक्स्ट डिटेक्टर बनाने में मौलिक चुनौतियों पर प्रकाश डालता है।

Jivnesh Sandhan, Harshit Jaiswal, Fei Cheng, Yugo Murawaki2026-01-28