💬 NLP

Word-Centered Semantic Graphs for Interpretable Diachronic Sense Tracking

यह शोधपत्र एक व्याख्यात्मक, ग्राफ-आधारित ढांचे को प्रस्तुत करता है जो पूर्व-निर्धारित अर्थ सूचियों (sense inventories) पर निर्भर रहे बिना, शब्द-केंद्रित अर्थ नेटवर्क के निर्माण के लिए वितरण संबंधी समानता (distributional similarity) और शाब्दिक प्रतिस्थापन योग्यता (lexical substitutability) को संयोजित करता है ताकि कालक्रमिक अर्थ विकास (diachronic sense evolution) को ट्रैक किया जा सके, और 1980 से 2017 तक 'न्यूयॉर्क टाइम्स मैगजीन' के लेखों में "trump", "god", और "post" जैसे शब्दों के अर्थ प्रक्षेपवक्र (semantic trajectories) पर केस स्टडीज के माध्यम से अपनी प्रभावशीलता प्रदर्शित करता है।

Imene Kolli, Kai-Robin Lange, Jonas Rieger, Carsten Jentsch2026-02-02
💬 NLP

Towards Resiliency in Large Language Model Serving with KevlarFlow

KevlarFlow एक फॉल्ट-टॉलरेंट LLM सर्विंग आर्किटेक्चर है जो डिकपल्ड मॉडल पैरेललिज्म इनिशियलाइजेशन, डायनेमिक ट्रैफिक रिरोटिंग और बैकग्राउंड KV कैश रेप्लिकेशन का लाभ उठाता है ताकि स्टेट-ऑफ-द-आर्ट सिस्टम्स की तुलना में हार्डवेयर विफलताओं के दौरान रिकवरी समय और लेटेंसी को नाटकीय रूप से कम किया जा सके।

Shangshu Qian, Kipling Liu, P. C. Sruthi, Lin Tan, Yongle Zhang2026-02-02
💬 NLP

FraudShield: Knowledge Graph Empowered Defense for LLMs against Fraud Attacks

FraudShield एक नवीन ढांचा है जो एक फ्रॉड टैक्टिक-कीवर्ड नॉलेज ग्राफ का निर्माण और उपयोग करके इनपुट को संरचित साक्ष्य के साथ संवर्धित करता है, जिससे बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) को धोखाधड़ी वाले हमलों से सुरक्षा प्रदान करता है, और इस प्रकार विभिन्न मॉडलों और धोखाधड़ी के प्रकारों में रक्षा प्रभावशीलता, व्याख्यात्मकता और सामान्यीकरण क्षमता में महत्वपूर्ण सुधार करता है।

Naen Xu, Jinghuai Zhang, Ping He, Chunyi Zhou, Jun Wang, Zhihui Fu, Tianyu Du, Zhaoxiang Wang, Shouling Ji2026-02-02
💬 NLP

TTCS: Test-Time Curriculum Synthesis for Self-Evolving

यह शोध पत्र TTCS का प्रस्ताव करता है, जो एक स्व-विकसित (self-evolving) टेस्ट-टाइम ट्रेनिंग फ्रेमवर्क है जो एक प्रश्न सिंथेसाइज़र और एक रीजनिंग सॉल्वर को पुनरावृत्ति (iteratively) के माध्यम से अनुकूलित करता है ताकि प्रगतिशील रूप से चुनौतीपूर्ण सिंथेटिक प्रश्नों का एक अनुकूलित पाठ्यक्रम तैयार किया जा सके, जिससे ऑनलाइन अपडेट स्थिर होते हैं और कठिन बेंचमार्क पर LLM की रीजनिंग क्षमताओं में महत्वपूर्ण वृद्धि होती है।

Chengyi Yang, Zhishang Xiang, Yunbo Tang, Zongpei Teng, Chengsong Huang, Fei Long, Yuhan Liu, Jinsong Su2026-02-02
💬 NLP

TSLM: Tree-Structured Language Modeling for Divergent Thinking

यह शोध पत्र ट्री-स्ट्रक्चर्ड लैंग्वेज मॉडलिंग (TSLM) प्रस्तुत करता है, जो एक नवीन दृष्टिकोण है जो विशेष टोकन का उपयोग करके और पूर्ण खोज वृक्षों (search trees) पर प्रशिक्षण देकर शाखाबद्ध खोज पथों को एक एकल पीढ़ी प्रक्रिया (generation process) में समाहित करता है, ताकि बाहरी खोज विधियों की अनावश्यक गणना के बिना कुशल, व्यवस्थित विचलित सोच (divergent thinking) को सक्षम बनाया जा सके।

Doyoung Kim, Jaehyeok Doo, Minjoon Seo2026-02-02
💬 NLP

FNF: Functional Network Fingerprint for Large Language Models

यह शोध पत्र फंक्शनल नेटवर्क फिंगरप्रिंट (FNF) का प्रस्ताव करता है, जो एक प्रशिक्षण-मुक्त और नमूना-कुशल विधि है जो विविध आर्किटेक्चर और संशोधनों में बौद्धिक संपदा संरक्षण के लिए एक सुदृढ़ समाधान प्रदान करते हुए, उनके कार्यात्मक नेटवर्क गतिविधि की निरंतरता का विश्लेषण करके लार्ज लैंग्वेज मॉडल्स के अनधिकृत व्युत्पन्नों का पता लगाता है।

Yiheng Liu, Junhao Ning, Sichen Xia, Haiyang Sun, Yang Yang, Hanyang Chi, Xiaohui Gao, Ning Qiang, Bao Ge, Junwei Han, X (…)2026-02-02
💬 NLP

Models Know Models Best: Evaluation via Model-Preferred Formats

यह शोध पत्र एक गतिशील फॉर्मेट-अलाइनमेंट रणनीति प्रस्तावित करता है जो मॉडल-पसंदीदा संकेतों पर प्रशिक्षित एक हल्के क्लासिफायर का लाभ उठाकर सिंबल-आधारित और क्लोज़-स्टाइल मूल्यांकन स्वरूपों के बीच स्वचालित रूप से चयन करता है, जिससे प्रदर्शन संबंधी विसंगतियों को हल किया जा सके और विभिन्न LLM बेंचमार्क में ज़ीरो-शॉट सटीकता में महत्वपूर्ण सुधार किया जा सके।

Joonhak Lee, Sungmok Jung, Jongyeon Park, Jaejin Lee2026-02-02
💬 NLP

A Unified Study of LoRA Variants: Taxonomy, Review, Codebase, and Empirical Evaluation

यह शोध पत्र एक व्यवस्थित वर्गीकरण स्थापित करके, एक सैद्धांतिक समीक्षा प्रदान करके, मॉड्यूलर LoRAFactory कोडबेस को पेश करके, और एक बड़े पैमाने पर अनुभवजन्य मूल्यांकन आयोजित करके LoRA वेरिएंट्स का पहला एकीकृत अध्ययन प्रस्तुत करता है जो लर्निंग रेट के प्रति विधि की संवेदनशीलता और उचित हाइपरपैरामीटर ट्यूनिंग के साथ अधिकांश वेरिएंट्स के बराबर या उनसे बेहतर होने की इसकी क्षमता को प्रकट करता है।

Haonan He, Jingqi Ye, Minglei Li, Zhengbo Wang, Tao Chen, Lei Bai, Peng Ye2026-02-02
💬 NLP

MM-THEBench: Do Reasoning MLLMs Think Reasonably?

यह शोध पत्र MM-THEBench को प्रस्तुत करता है, जो मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स के मध्यवर्ती तर्क चरणों (intermediate reasoning steps) में मतिभ्रम (hallucinations) का मूल्यांकन करने के लिए डिज़ाइन किया गया एक व्यापक बेंचमार्क है, जो मौजूदा मूल्यांकनों के उस अंतराल को संबोधित करता है जो पोस्ट-ट्रेन्ड रीजनिंग मॉडल्स की आंतरिक विचार प्रक्रियाओं की अनदेखी करते हैं।

Zhidian Huang, Zijun Yao, Ji Qi, Shangqing Tu, Junxian Ma, Jinxin Liu, Weichuan Liu, Xiaoyin Che, Lei Hou, Juanzi Li2026-02-02
💬 NLP

AR-BENCH: Benchmarking Legal Reasoning with Judgment Error Detection, Classification and Correction

यह शोध पत्र AR-BENCH, एक नवीन बेंचमार्क डेटासेट और "अपीलीय समीक्षा" (Appellate Review) कार्य प्रस्तुत करता है, जिसे कानूनी निर्णयों में त्रुटियों का पता लगाने, वर्गीकृत करने और उन्हें सुधारने की बड़े भाषा मॉडलों (large language models) की क्षमता का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो वर्तमान मॉडलों की नैदानिक तर्क क्षमताओं में महत्वपूर्ण सीमाओं को प्रकट करता है।

Yifei Li, Richong Zhang, Wanyu Tu, Zhijie Nie, Haokun Luo, Chuantao Yin, Pengchong Li2026-02-02