💬 NLP

Graph Your Way to Inspiration: Integrating Co-Author Graphs with Retrieval-Augmented Generation for Large Language Model Based Scientific Idea Generation

यह शोध पत्र GYWI प्रस्तुत करता है, जो एक ऐसी प्रणाली है जो बड़े भाषा मॉडलों (Large Language Models) की नियंत्रणीय, पता लगाने योग्य और नवीन वैज्ञानिक विचार उत्पन्न करने की क्षमता को बढ़ाने के लिए सह-लेखक ज्ञान ग्राफ (co-author knowledge graphs) को हाइब्रिड रिट्रीवल-ऑगमेंटेड जनरेशन और सुदृढीकरण शिक्षण-आधारित प्रॉम्प्ट अनुकूलन (reinforcement learning-based prompt optimization) के साथ एकीकृत करती है, जो मुख्यधारा के मॉडलों की तुलना में कई मूल्यांकन मेट्रिक्स में बेहतर प्रदर्शन प्रदर्शित करती है।

Pengzhen Xie, Huizhi Liang2026-02-27
💬 NLP

Comparative Analysis of Neural Retriever-Reranker Pipelines for Retrieval-Augmented Generation over Knowledge Graphs in E-commerce Applications

यह शोध पत्र ई-कॉमर्स नॉलेज ग्राफ पर रिट्रीवल-ऑगमेंटेड जनरेशन (RAG) के लिए न्यूरल रिट्रीवर-रीरैंकर पाइपलाइनों का एक तुलनात्मक विश्लेषण प्रस्तुत करता है, जो यह प्रदर्शित करता है कि STaK डेटासेट पर अनुकूलित कॉन्फ़िगरेशन रिट्रीवल सटीकता में मौजूदा बेंचमार्क से काफी बेहतर प्रदर्शन करते हैं और उत्पादन-तैयार डोमेन-विशिष्ट RAG सिस्टम के लिए एक व्यावहारिक ढांचा स्थापित करते हैं।

Teri Rumble, Zbyněk Gazdík, Javad Zarrin, Jagdeep Ahluwalia2026-02-27
💬 NLP

Misinformation Exposure in the Chinese Web: A Cross-System Evaluation of Search Engines, LLMs, and AI Overviews

यह शोध एक वास्तविक दुनिया के क्वेरी डेटासेट को पेश करते हुए चीनी वेब में पारंपरिक खोज इंजनों, स्टैंडअलोन एलएलएम (LLMs) और एआई ओवरव्यू की तथ्यात्मक विश्वसनीयता का मूल्यांकन करता है, जो महत्वपूर्ण सटीकता असमानताओं को प्रकट करता है और चीनी उपयोगकर्ताओं के गलत सूचनाओं के क्षेत्रीय जोखिम का अनुमान लगाता है।

Geng Liu, Junjie Mu, Li Feng, Mengxiao Zhu, Francesco Pierri2026-02-27
💬 NLP

Scaling In, Not Up? Testing Thick Citation Context Analysis with GPT-5 and Fragile Prompts

यह शोध पत्र यह प्रदर्शित करता है कि जहाँ GPT-5 विविध व्याख्यात्मक परिकल्पनाओं को उत्पन्न करके सघन उद्धरण संदर्भ विश्लेषण (thick citation context analysis) के लिए एक स्थिर सह-विश्लेषक के रूप में कार्य कर सकता है, वहीं इसके विशिष्ट पठन और शब्दावली व्यवस्थित रूप से प्रॉम्प्ट स्कैफोल्डिंग द्वारा आकार लेती हैं, जो अक्सर मानव विशेषज्ञ पुनर्निर्माणों की तुलना में निषेध (admonishment) से वंशावली (lineage) की ओर ध्यान केंद्रित करती हैं।

Arno Simons2026-02-27
💬 NLP

SAFARI: A Community-Engaged Approach and Dataset of Stereotype Resources in the Sub-Saharan African Context

यह शोध पत्र SAFARI को प्रस्तुत करता है, जो एक समुदाय-संलग्न बहुभाषी डेटासेट है जिसमें घाना, केन्या, नाइजीरिया और दक्षिण अफ्रीका की 16 भाषाओं में 6,700 से अधिक रूढ़ियाँ (stereotypes) शामिल हैं, जिसे सांस्कृतिक रूप से संवेदनशील, मूल-भाषा सर्वेक्षण विधियों के माध्यम से जनरेटिव एआई सुरक्षा आकलन में उप-सहारा अफ्रीकी संदर्भों के कम प्रतिनिधित्व को संबोधित करने के लिए डिज़ाइन किया गया है।

Aishwarya Verma, Laud Ammah, Olivia Nercy Ndlovu Lucas, Andrew Zaldivar, Vinodkumar Prabhakaran, Sunipa Dev2026-02-27
💬 NLP

Causality \neq Invariance: Function and Concept Vectors in LLMs

यह शोधपत्र यह प्रदर्शित करता है कि जबकि बड़े भाषा मॉडल (Large Language Models) में अमूर्त अवधारणा प्रतिनिधित्व (Concept Vectors) होते हैं जो इनपुट प्रारूपों और भाषाओं में सामान्यीकृत होते हैं, इन-कॉन्टेक्स्ट लर्निंग प्रदर्शन को संचालित करने के लिए आमतौर पर उपयोग किए जाने वाले फंक्शन वेक्टर्स (Function Vectors) प्रारूप-विशिष्ट होते हैं और उनमें इस प्रकार की अपरिवर्तनीयता का अभाव होता है।

Gustaw Opiełka, Hannes Rosenbusch, Claire E. Stevenson2026-02-27
💬 NLP

How Do Latent Reasoning Methods Perform Under Weak and Strong Supervision?

यह शोध पत्र विभिन्न पर्यवेक्षण स्तरों के तहत गुप्त तर्क विधियों (latent reasoning methods) का विश्लेषण करता है, जो यह प्रकट करता है कि जहाँ मजबूत पर्यवेक्षण शॉर्टकट व्यवहार को कम करता है, वहीं यह परिकल्पना विविधता को सीमित करता है, जबकि कमजोर पर्यवेक्षण शॉर्टकट में वृद्धि की कीमत पर समृद्ध प्रतिनिधित्व को बढ़ावा देता है, और यह कि तर्क प्रक्रिया संरचित खोज के बजाय अंतर्निहित छंटनी (implicit pruning) पर निर्भर करती है।

Yingqian Cui, Zhenwei Dai, Bing He, Zhan Shi, Hui Liu, Rui Sun, Zhiji Liu, Yue Xing, Jiliang Tang, Benoit Dumoulin2026-02-27
💬 NLP

A Fusion of context-aware based BanglaBERT and Two-Layer Stacked LSTM Framework for Multi-Label Cyberbullying Detection

यह शोध पत्र एक नवीन फ्यूजन आर्किटेक्चर प्रस्तावित करता है जो संदर्भ-जागरूक बांग्लाBERT-Large को दो-परत वाले स्टैक्ड LSTM के साथ जोड़ता है ताकि सिमेंटिक संदर्भ और अनुक्रमिक निर्भरताओं को संयुक्त रूप से मॉडल करके कम-संसाधन वाली बांग्ला भाषा में मल्टी-लेबल साइबरबुलिंग डिटेक्शन की चुनौतियों को प्रभावी ढंग से संबोधित किया जा सके।

Mirza Raquib, Asif Pervez Polok, Kedar Nath Biswas, Rahat Uddin Azad, Saydul Akbar Murad, Nick Rahimi2026-02-27
💬 NLP

Mind the Gap in Cultural Alignment: Task-Aware Culture Management for Large Language Models

यह शोधपत्र कल्चरमैनेजर (CultureManager) को प्रस्तुत करता है, जो एक नवीन पाइपलाइन है जो कार्य-जागरूक सांस्कृतिक डेटा को संश्लेषित करके और उपयुक्त सांस्कृतिक एडेप्टर चुनने के लिए एक मॉड्यूल आधारित राउटर का उपयोग करके लार्ज लैंग्वेज मॉडल्स में प्रभावी सांस्कृतिक संरेखण प्राप्त करता है, जिससे विशिष्ट कार्य लक्ष्यों और क्रॉस-कल्चरल हस्तक्षेप को संभालने में मौजूदा विधियों की सीमाओं को दूर किया जा सके।

Binchi Zhang, Xujiang Zhao, Jundong Li, Haifeng Chen, Zhengzhang Chen2026-02-27
💬 NLP

VeRO: An Evaluation Harness for Agents to Optimize Agents

यह शोधपत्र VeRO को प्रस्तुत करता है, जो एक व्यापक मूल्यांकन हारनेस और बेंचमार्क सुइट है जिसे पुनरावृत्ति एजेंट अनुकूलन चक्रों के माध्यम से कोडिंग एजेंटों का व्यवस्थित रूप से आकलन करने और सुधारने के लिए डिज़ाइन किया गया है, जो उन प्रणालियों के मूल्यांकन की अनूठी चुनौतियों का समाधान करता है जो नियत (deterministic) कोड को स्टोकेस्टिक (stochastic) LLM पूर्णताओं के साथ जोड़ती हैं।

Varun Ursekar, Apaar Shanker, Veronica Chatrath, Yuan, Xue, Sam Denton2026-02-27