💬 NLP

S3^3-Attention:Attention-Aligned Endogenous Retrieval for Memory-Bounded Long-Context Inference

S3^3-Attention एक मेमोरी-कुशल इन्फरेंस फ्रेमवर्क है जो रैखिक रूप से स्केल होने वाले KV कैश को स्पार्स फीचर आइडेंटिफायर्स का उपयोग करने वाले एक CPU-आधारित, अटेंशन-अलाइन्ड एंडोजेनस रिट्रीवल सिस्टम से बदल देता है ताकि बाउंडेड GPU मेमोरी के भीतर प्रतिस्पर्धी प्रदर्शन बनाए रखते हुए लॉन्ग-कॉन्टेक्स्ट प्रोसेसिंग को सक्षम किया जा सके।

Qingsen Ma, Dianyun Wang, Yaoye Wang, Lechen Ning, Sujie Zhu, Xiaohang Zhang, Jiaming Lyu, Linhao Ren, Zhenbo Xu, Zhaofe (…)2026-01-29
💬 NLP

AdaReasoner: Dynamic Tool Orchestration for Iterative Visual Reasoning

AdaReasoner मल्टीमॉडल मॉडल्स का एक परिवार है जो एक स्केलेबल डेटा पाइपलाइन, Tool-GRPO सुदृढीकरण लर्निंग (reinforcement learning), और गतिशील टूल विनियमन (dynamic tool regulation) के लिए एक अनुकूली तंत्र के माध्यम से टूल ऑर्केस्ट्रेशन को एक सामान्य कौशल के रूप में सीखकर, अत्याधुनिक विजुअल रीजनिंग और अनदेखे टूल्स के प्रति सामान्यीकरण प्राप्त करता है।

Mingyang Song, Haoyu Sun, Jiawei Gu, Linjie Li, Luxin Xu, Ranjay Krishna, Yu Cheng2026-01-29
💬 NLP

DABench-LLM: Standardized and In-Depth Benchmarking of Post-Moore Dataflow AI Accelerators for LLMs

यह शोध पत्र DABench-LLM को प्रस्तुत करता है, जो पोस्ट-मूर युग में गहन प्रदर्शन विश्लेषण की कमी को दूर करते हुए, विविध डेटाफ्लो-आधारित AI एक्सेलेरेटर्स पर लार्ज लैंग्वेज मॉडल वर्कलोड का व्यापक रूप से मूल्यांकन और अनुकूलित करने के लिए डिज़ाइन किया गया पहला मानकीकृत बेंचमार्किंग फ्रेमवर्क है।

Ziyu Hu, Zhiqing Zhong, Weijian Zheng, Zhijing Ye, Xuwei Tan, Xueru Zhang, Zheng Xie, Rajkumar Kettimuthu, Xiaodong Yu2026-01-29
💬 NLP

Modeling Next-Token Prediction as Left-Nested Intuitionistic Implication

यह शोध पत्र ऐरो लैंग्वेज मॉडल (Arrow Language Model) को प्रस्तुत करता है, जो एक ऐसा न्यूरल आर्किटेक्चर है जो लेफ्ट-नेस्टेड इंट्यूशनिस्टिक इम्प्लिकेशंस (left-nested intuitionistic implications) के माध्यम से नेक्स्ट-टोकन प्रेडिक्शन को कंस्ट्रक्टिव प्रूफ एक्सटेंशन के रूप में पुनर्व्याख्या करता है, जिससे एक मल्टीप्लिकेटिव आरएनएन (multiplicative RNN) संरचना व्युत्पन्न होती है जहाँ अनुक्रम प्रसंस्करण मोडस पोन्स (modus ponens) के अनुरूप होता है और क्रम को नॉन-कम्यूटेटिव कंपोज़िशन (non-commutative composition) के माध्यम से संरक्षित किया जाता है।

Paul Tarau2026-01-29
💬 NLP

Quantifying non deterministic drift in large language models

यह शोध पत्र यह प्रदर्शित करके कि विभिन्न मॉडलों और प्रॉम्प्ट प्रकारों में शून्य तापमान (zero temperature) पर भी आउटपुट परिवर्तनशीलता बनी रहती है, लार्ज लैंग्वेज मॉडल्स में आधारभूत व्यवहारिक विचलन (baseline behavioral drift) को अनुभवजन्य रूप से परिमाणित करता है, जो भविष्य की न्यूनीकरण रणनीतियों के मूल्यांकन के लिए एक व्यवस्थित संदर्भ बिंदु स्थापित करता है।

Claire Nicholson2026-01-29
💬 NLP

Mem2ActBench: A Benchmark for Evaluating Long-Term Memory Utilization in Task-Oriented Autonomous Agents

यह शोध पत्र Mem2ActBench प्रस्तुत करता है, जो एक नया बेंचमार्क है जिसे टूल-आधारित कार्यों को निष्पादित करने के लिए दीर्घकालिक स्मृति (long-term memory) का सक्रिय रूप से लाभ उठाने की LLM-आधारित एजेंटों की क्षमता का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो यह प्रकट करता है कि वर्तमान प्रणालियाँ संग्रहीत जानकारी को टास्क पैरामीटर्स को आधार देने (grounding) के लिए सक्रिय रूप से लागू करने में संघर्ष करती हैं।

Yiting Shen, Kun Li, Wei Zhou, Songlin Hu2026-01-29
💬 NLP

Latent Object Permanence: Topological Phase Transitions, Free-Energy Principles, and Renormalization Group Flows in Deep Transformer Manifolds

यह शोध पत्र प्रस्तावित करता है कि डीप ट्रांसफॉर्मर्स में मल्टी-स्टेप रीजनिंग (बहु-चरणीय तर्क) एक क्रिटिकल नॉर्मलाइज्ड डेप्थ (क्रांतिक सामान्यीकृत गहराई) पर टोपोलॉजिकल फेज ट्रांज़िशन (स्थलाकृतिक अवस्था संक्रमण) के माध्यम से उभरती है, जहाँ लेयरवाइज रेनोर्मलाइजेशन डायनेमिक्स (परतवार पुनर्सामान्यीकरण गतिकी) प्रतिनिधित्व स्पेक्ट्रम को निम्न-एन्ट्रॉपी वाले "कॉन्सेप्ट बेसिन" (अवधारणा बेसिन) में सिकोड़ देता है जो क्षणिक, पुन: प्रयोज्य ऑब्जेक्ट-जैसे संरचनाओं का निर्माण करते हैं।

Faruk Alpay, Bugra Kilictas2026-01-29
⚡ electrical engineering

RIR-Mega-Speech: A Reverberant Speech Corpus with Comprehensive Acoustic Metadata and Reproducible Evaluation

यह शोध पत्र RIR-Mega-Speech प्रस्तुत करता है, जो एक पुनरुत्पादक 117.5-घंटे का गूँजने वाला (reverberant) स्पीच कॉर्पस है, जिसमें प्रति-फ़ाइल व्यापक ध्वनिक मेटाडेटा और मानकीकृत मूल्यांकन स्क्रिप्ट शामिल हैं ताकि स्पीच रिकग्निशन प्रदर्शन पर रूम एकॉस्टिक्स के प्रभाव पर पारदर्शी अनुसंधान को सुगम बनाया जा सके।

Mandip Goswami2026-01-29
💬 NLP

Counterfactual Cultural Cues Reduce Medical QA Accuracy in LLMs: Identifier vs Context Effects

यह शोध पत्र एक काउंटरफैक्चुअल बेंचमार्क प्रस्तुत करता है जो यह प्रदर्शित करता है कि चिकित्सा संबंधी प्रश्नों में गैर-निर्णायक सांस्कृतिक पहचानकर्ताओं और संदर्भ को सम्मिलित करने से विभिन्न लार्ज लैंग्वेज मॉडल्स की नैदानिक सटीकता में महत्वपूर्ण गिरावट आती है, जिससे अक्सर सांस्कृतिक संकेतों की उपस्थिति में चिकित्सकीय रूप से सही तर्क विफल हो जाते हैं।

Amirhossein Haji Mohammad Rezaei, Zahra Shakeri2026-01-29
💬 NLP

FFE-Hallu:Hallucinations in Fixed Figurative Expressions:Benchmark of Idioms and Proverbs in the Persian Language

यह शोध पत्र FFE-Hallu प्रस्तुत करता है, जो फारसी भाषा के भीतर निश्चित लाक्षणिक अभिव्यक्तियों में मतिभ्रम (hallucinations) का मूल्यांकन करने के लिए पहला बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान बड़े भाषा मॉडल सांस्कृतिक आधार (cultural grounding) के साथ संघर्ष करते हैं और अक्सर निर्मित मुहावरों और लोकोक्तियों को उत्पन्न करते हैं या उन्हें पहचानने में विफल रहते हैं।

Faezeh Hosseini, Mohammadali Yousefzadeh, Yadollah Yaghoobzadeh2026-01-29