💬 NLP

Neuromem: A Granular Decomposition of the Streaming Lifecycle in External Memory for LLMs

यह शोधपत्र Neuromem प्रस्तुत करता है, जो एक स्केलेबल टेस्टबेड है जो मेमोरी लाइफसाइकिल को पांच प्रमुख आयामों में विभाजित करके यथार्थवादी, इंटरलीव्ड स्ट्रीमिंग स्थितियों के तहत LLMs के लिए बाहरी मेमोरी मॉड्यूल का बेंचमार्किंग करता है, जिससे यह प्रकट होता है कि जबकि डेटा संरचनाएं मुख्य रूप से प्रदर्शन की गुणवत्ता को निर्धारित करती हैं, आक्रामक संपीड़न (compression) और जेनेरेटिव एकीकरण सीमित सटीकता लाभ प्रदान करते हैं, बावजूद इसके कि वे इंसर्शन और रिट्रीवल के बीच लागतों को स्थानांतरित कर देते हैं।

Ruicheng Zhang, Xinyi Li, Tianyi Xu, Shuhao Zhang, Xiaofei Liao, Hai Jin2026-02-17
💬 NLP

LogitsCoder: Towards Efficient Chain-of-Thought Path Search via Logits Preference Decoding for Code Generation

LogitsCoder एक नवीन फ्रेमवर्क है जो लॉजिट-लेवल कंट्रोल मैकेनिज्म, विशेष रूप से लॉजिट प्रेफरेंस डिकोडिंग और पाथ सिलेक्शन रणनीतियों के माध्यम से, संतुलित और सुसंगत रीजनिंग चेन्स उत्पन्न करने के लिए अंडरथिंकिंग और ओवरथिंकिंग की समस्याओं को संबोधित करके कोड जनरेशन की दक्षता और गुणवत्ता में सुधार करता है।

Jizheng Chen, Weiming Zhang, Xinyi Dai, Weiwen Liu, Kounianhua Du, Yasheng Wang, Ruiming Tang, Yong Yu, Weinan Zhang2026-02-17
💬 NLP

From Scarcity to Scale: A Release-Level Analysis of the Pashto Common Voice Dataset

यह शोध पत्र तेजी से बढ़ते पाश्तो कॉमन वॉयस डेटासेट (v2.4.0) का एक मात्रात्मक विश्लेषण प्रस्तुत करता है, जो इसके लगभग 2,800 घंटों तक बढ़ने पर प्रकाश डालता है और अत्यधिक योगदानकर्ता एकाग्रता, विषम आयु जनसांख्यिकी, और लिंग मेटाडेटा में महत्वपूर्ण अंतराल जैसे महत्वपूर्ण चुनौतियों की पहचान करता है जिन्हें ऑटोमैटिक स्पीच रिकग्निशन के लिए कॉर्पस की उपयोगिता में सुधार करने हेतु संबोधित किया जाना चाहिए।

Jandad Jahani, Mursal Dawodi, Jawid Ahmad Baktash2026-02-17
💬 NLP

Knowing When Not to Answer: Abstention-Aware Scientific Reasoning

यह शोध पत्र एक अपवर्जन-जागरूक (abstention-aware) सत्यापन ढांचे का प्रस्ताव करता है जो वैज्ञानिक दावों को विभाजित करता है और साक्ष्य अपर्याप्त होने पर उत्तर देने से चुनिंदा रूप से बचता है, यह प्रदर्शित करते हुए कि वैज्ञानिक विश्वसनीयता के लिए किसी विशिष्ट मॉडल आर्किटेक्चर को चुनने की तुलना में यह निर्धारित करना अधिक महत्वपूर्ण है कि कब उत्तर देना है।

Samir Abdaljalil, Erchin Serpedin, Hasan Kurban2026-02-17
💬 NLP

We can still parse using syntactic rules

यह शोध एक पारदर्शी और व्याख्यात्मक पार्सिंग प्रणाली प्रस्तुत करता है जो पारंपरिक सीमाओं को दूर करने के लिए कॉन्टेक्स्ट-फ्री और जनरलाइज्ड फ्रेज स्ट्रक्चर ग्रामर नियमों को एकीकृत करती है, जो शोर के प्रति सहनशीलता (noise tolerance) के साथ डिपेंडेंसी और कंस्टिट्यूएंसी दोनों ट्री उत्पन्न करती है और यूनिवर्सल डिपेंडेंसी बेंचमार्क पर मध्यम सटीकता प्राप्त करती है।

Ghaly Hussein2026-02-17
💬 NLP

Detecting LLM Hallucinations via Embedding Cluster Geometry: A Three-Type Taxonomy with Measurable Signatures

यह शोध पत्र टोकन एम्बेडिंग क्लस्टर संरचनाओं के आधार पर LLM मतिभ्रम (hallucinations) को तीन विशिष्ट प्रकारों में विभाजित करने के लिए एक ज्यामितीय वर्गीकरण (geometric taxonomy) प्रस्तावित करता है और आर्किटेक्चर-निर्भर भेद्यता प्रोफाइल (vulnerability profiles) स्थापित करने हेतु तीन मापने योग्य सांख्यिकियों (ध्रुवीयता युग्मन, क्लस्टर सामंजस्य और रेडियल सूचना प्रवणता) का उपयोग करके 11 ट्रांसफॉर्मर मॉडलों में इस ढांचे को मान्य करता है।

Matic Korun2026-02-17
💬 NLP

Beyond Token-Level Policy Gradients for Complex Reasoning with Large Language Models

यह शोध पत्र मल्टी-टोकन पॉलिसी ग्रेडिएंट ऑप्टिमाइज़ेशन (MPO) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो K क्रमिक टोकन के अनुक्रमों को एकीकृत अर्थपूर्ण क्रियाओं (unified semantic actions) के रूप में मानता है ताकि जटिल तर्क संबंधी कार्यों के ब्लॉक-स्तरीय संरचना के साथ पॉलिसी ग्रेडिएंट अनुकूलन को बेहतर ढंग से संरेखित किया जा सके, जो गणितीय और कोडिंग बेंचमार्क पर मानक टोकन-स्तरीय विधियों की तुलना में बेहतर प्रदर्शन प्रदर्शित करता है।

Mufan Xu, Kehai Chen, Xuefeng Bai, Zhengyu Niu, Muyun Yang, Tiejun Zhao, Min Zhang2026-02-17
💬 NLP

TruthStance: An Annotated Dataset of Conversations on Truth Social

यह शोध पत्र TruthStance को प्रस्तुत करता है, जो 2023-2025 तक फैली Truth Social की बातचीत का एक बड़े पैमाने पर, मानव-एनोटेटेड डेटासेट है, जो व्यापक पैटर्न विश्लेषण के लिए LLM-जनित लेबल के साथ-साथ तर्क खनन (argument mining) और रुख पहचान (stance detection) के लिए बेंचमार्क प्रदान करके ऑल्ट-टेक विमर्श अनुसंधान में मौजूद अंतराल को संबोधित करता है।

Fathima Ameen, Danielle Brown, Manusha Malgareddy, Amanul Haque2026-02-17
💬 NLP

LLM-Guided Knowledge Distillation for Temporal Knowledge Graph Reasoning

यह शोधपत्र एक LLM-सहायता प्राप्त ज्ञान आसवन (knowledge distillation) ढांचे का प्रस्ताव करता है जो हल्के छात्र मॉडलों की टेम्पोरल रीजनिंग क्षमताओं को बढ़ाने के लिए एक सहायक प्रशिक्षक के रूप में एक बड़े भाषा मॉडल का लाभ उठाता है, जिससे कम्प्यूटेशनल दक्षता बनाए रखते हुए टेम्पोरल नॉलेज ग्राफ पर बेहतर लिंक प्रेडिक्शन प्रदर्शन प्राप्त होता है।

Wang Xing, Wei Song, Siyu Lin, Chen Wu, Man Wang2026-02-17
💬 NLP

Selective Synchronization Attention

यह शोध पत्र सेलेक्टिव सिंक्रोनाइज़ेशन अटेंशन (SSA) प्रस्तुत करता है, जो कपल्ड ऑसिलेटर्स के कुरामोतो मॉडल से व्युत्पन्न एक नवीन अटेंशन मैकेनिज्म है, जो प्राकृतिक स्पर्सिटी (sparsity), एकीकृत पोजीशनल-सिमेंटिक एनकोडिंग और ऑसिलेटरी सिंक्रोनाइज़ेशन नेटवर्क (OSN) के भीतर कुशल सिंगल-पास कंप्यूटेशन प्राप्त करने के लिए मानक सेल्फ-अटेंशन को एक क्लोज्ड-फॉर्म ऑपरेटर से प्रतिस्थापित करता है।

Hasi Hays2026-02-17