💬 NLP

Batch Speculative Decoding Done Right

यह शोध पत्र पहचान करता है कि मौजूदा बैच स्पेक्युलेटिव डिकोडिंग कार्यान्वयन रैग्ड टेंसर (ragged tensor) की समस्या के कारण आउटपुट समानता बनाए रखने में विफल रहते हैं, और पहला सही ढांचा, EQSPEC, इसके अनुकूलित संस्करण EXSPEC के साथ प्रस्तावित करता है, जो विभिन्न मॉडल युग्मों में एल्गोरिदम की शुद्धता सुनिश्चित करते हुए 3 गुना तक थ्रूपुट सुधार प्राप्त करता है।

Ranran Haoran Zhang, Soumik Dey, Ashirbad Mishra, Hansi Wu, Binbin Li, Rui Zhang2026-02-17
💬 NLP

ArtistMus: A Globally Diverse, Artist-Centric Benchmark for Retrieval-Augmented Music Question Answering

यह शोध पत्र ArtistMus, जो एक वैश्विक रूप से विविध बेंचमार्क है, और MusWikiDB वेक्टर डेटाबेस प्रस्तुत करता है, जो यह प्रदर्शित करते हैं कि रिट्रीवल-ऑगमेंटेड जनरेशन संगीत-संबंधी प्रश्नोत्तर में तथ्यात्मक सटीकता और प्रासंगिक तर्क को महत्वपूर्ण रूप से बढ़ाता है, जिससे ओपन-सोर्स मॉडल प्रोप्रायटरी प्रदर्शन का मुकाबला करने में सक्षम होते हैं।

Daeyong Kwon, SeungHeon Doh, Juhan Nam2026-02-17
💬 NLP

Writing in Symbiosis: Mapping Human Creative Agency in the AI Era

यह शोधपत्र एक "दोहरी-ट्रैक विकास" (Dual-Track Evolution) मॉडल प्रस्तावित करने के लिए अनुदैर्ध्य लेखन डेटा का विश्लेषण करता है, जो यह प्रदर्शित करता है कि मानवीय रचनात्मक अभिकर्तृत्व (human creative agency), मानवीय अभिव्यक्ति के भयावह एकरूपता में विलीन होने के बजाय, विविध अनुकूलन पैटर्न—जिसमें शैलीगत अभिसरण, विचलन और स्थिरता शामिल हैं—के माध्यम से एआई (AI) के साथ सह-विकसित हो रहा है।

Vivan Doshi, Mengyuan Li2026-02-17
💬 NLP

Multi-LLM Thematic Analysis with Dual Reliability Metrics: Combining Cohen's Kappa and Semantic Similarity for Qualitative Research Validation

यह शोध पत्र एक मल्टी-एलएलएम (multi-LLM) विषयगत विश्लेषण ढांचे को प्रस्तुत करता है जो कोहेन के कप्पा (Cohen's Kappa) और सिमेंटिक समानता मेट्रिक्स को जोड़कर गुणात्मक अनुसंधान विश्वसनीयता को प्रमाणित करता है, और एक साइकेडेलिक आर्ट थेरेपी केस स्टडी के माध्यम से यह प्रदर्शित करता है कि जेमिनी (Gemini), जीपीटी-4ओ (GPT-4o) और क्लॉड (Claude) का उपयोग करने वाला एक एन्सेम्बल दृष्टिकोण उच्च इंटर-रेटर सहमति और सुदृढ़ सर्वसम्मति विषय निष्कर्षण प्राप्त करता है।

Nilesh Jain, Hyungil Suh, Seyi Adeyinka, Leor Roseman, Aza Allsop2026-02-17
💬 NLP

FormationEval, an open multiple-choice benchmark for petroleum geoscience

यह शोध पत्र FormationEval को प्रस्तुत करता है, जो पेट्रोलियम भूविज्ञान के सात डोमेन में 505 प्रश्नों वाला एक खुला बहुविकल्पीय बेंचमार्क है, जो 72 भाषा मॉडलों का मूल्यांकन करता है और यह प्रकट करता है कि शीर्ष प्रदर्शन करने वाले मॉडल लगभग पूर्ण सटीकता प्राप्त करते हैं, जबकि साथ ही निरंतर डोमेन-विशिष्ट चुनौतियों और ओपन-वेट एवं क्लोज्ड मॉडलों के बीच प्रदर्शन के अंतर के कम होने को भी उजागर करता है।

Almaz Ermilov2026-02-17
💬 NLP

SYNAPSE: Empowering LLM Agents with Episodic-Semantic Memory via Spreading Activation

सिनैप्स (Synapse) एक नवीन मेमोरी आर्किटेक्चर है जो मेमोरी को स्प्रेडिंग एक्टिवेशन (spreading activation), लेटरल इनहिबिशन (lateral inhibition) और टेम्पोरल डिके (temporal decay) के साथ एक डायनेमिक ग्राफ के रूप में मॉडल करके LLM एजेंटों की दीर्घकालिक तर्क क्षमता को बढ़ाता है, जिससे यह जटिल टेम्पोरल और मल्टी-हॉप कार्यों में मौजूदा तरीकों से बेहतर प्रदर्शन करता है।

Hanqi Jiang, Junhao Chen, Yi Pan, Ling Chen, Weihang You, Yifan Zhou, Ruidong Zhang, Andrea Sikora, Lin Zhao, Yohannes A (…)2026-02-17
💬 NLP

RAGExplorer: A Visual Analytics System for the Comparative Diagnosis of RAG Systems

RAGExplorer एक विज़ुअल एनालिटिक्स सिस्टम है जिसे डेवलपर्स को विभिन्न डिज़ाइनों के प्रदर्शन के माध्यम से व्यवस्थित मैक्रो-टू-माइक्रो तुलना करने और विफलता के मामलों के इंटरैक्टिव निदान को सक्षम करके रिट्रीवल-ऑगमेंटेड जनरेशन (RAG) सिस्टम के जटिल कॉन्फ़िगरेशन स्पेस को नेविगेट करने में मदद करने के लिए डिज़ाइन किया गया है।

Haoyu Tian, Yingchaojie Feng, Zhen Wen, Haoxuan Li, Minfeng Zhu, Wei Chen2026-02-17
💬 NLP

Human Values in a Single Sentence: Moral Presence, Hierarchies, and Transformer Ensembles on the Schwartz Continuum

यह शोध पत्र एकल अंग्रेजी वाक्यों में 19 परिष्कृत श्वार्ट्ज मानवीय मूल्यों का पता लगाने के लिए एक कंप्यूट-कुशल ढांचे को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि एक हल्का, फीचर-ऑगमेंटेड सुपरवाइज्ड एनसेम्बल, सख्त GPU मेमोरी बाधाओं के तहत पदानुक्रमित गेटिंग दृष्टिकोणों और इंस्ट्रक्शन-ट्यून्ड LLMs दोनों से बेहतर प्रदर्शन करता है।

Víctor Yeste, Paolo Rosso2026-02-17
💬 NLP

DS@GT at TREC TOT 2025: Bridging Vague Recollection with Fusion Retrieval and Learned Reranking

DS@GT सिस्टम हाइब्रिड और टॉपिक-अवेयर डेंस रिट्रीवल को जेमिनी-2.5-फ्लैश रीरैंकर के साथ फ्यूज करने वाले एक दो-चरणीय रिट्रीवल फ्रेमवर्क का उपयोग करके TREC टिप-ऑफ-द-टंग टास्क को संबोधित करता है, जिससे टेस्ट सेट पर 0.66 का रिकॉल प्राप्त होता है।

Wenxin Zhou, Ritesh Mehta, Anthony Miyaguchi2026-02-17
💬 NLP

Endless Terminals: Scaling RL Environments for Terminal Agents

यह शोध पत्र 'एंडलेस टर्मिनल्स' (Endless Terminals) को प्रस्तुत करता है, जो एक पूर्णतः स्वायत्त पाइपलाइन है जो सुदृढीकरण सीखने (reinforcement learning) वाले एजेंटों को प्रशिक्षित करने के लिए हजारों स्केलेबल टर्मिनल-उपयोग कार्यों को प्रक्रियात्मक रूप से उत्पन्न करती है, और यह प्रदर्शित करती है कि इस डेटासेट पर सरल आरएल (RL) दृष्टिकोण जटिल एजेंटिक स्कैफोल्ड्स की आवश्यकता के बिना, सिंथेटिक और मानव-क्यूरेटेड दोनों बेंचमार्क पर पर्याप्त प्रदर्शन लाभ प्रदान करते हैं।

Kanishk Gandhi, Shivam Garg, Noah D. Goodman, Dimitris Papailiopoulos2026-02-17