💬 NLP

Graph-based Approaches and Functionalities in Retrieval-Augmented Generation: A Comprehensive Survey

यह सर्वेक्षण रिट्रीवल-ऑगमेंटेड जनरेशन (RAG) में ग्राफ-आधारित दृष्टिकोणों की एक व्यापक समीक्षा प्रदान करता है, जो LLM मतिभ्रम (hallucinations) को संबोधित करने के लिए डेटाबेस निर्माण, एल्गोरिदम, पाइपलाइन और कार्यों में उनकी भूमिकाओं का व्यवस्थित रूप से विश्लेषण करता है और वर्तमान चुनौतियों तथा भविष्य के अनुसंधान दिशाओं को रेखांकित करता है।

Zulun Zhu, Tiancheng Huang, Kai Wang, Junda Ye, Xinghe Chen, Siqiang Luo2026-01-22
💬 NLP

StrucSum: Graph-Structured Reasoning for Long Document Extractive Summarization with LLMs

StrucSum एक प्रशिक्षण-मुक्त प्रॉम्प्टिंग फ्रेमवर्क है जो ग्राफ-संरचित तर्क रणनीतियों के माध्यम से लार्ज लैंग्वेज मॉडल्स द्वारा ज़ीरो-शॉट लॉन्ग डॉक्यूमेंट एक्सट्रैक्टिव समराइजेशन को बढ़ाता है, जिससे कई डेटासेट्स में सारांश की गुणवत्ता और तथ्यात्मक निरंतरता में महत्वपूर्ण सुधार होता है।

Haohan Yuan, Sukhwa Hong, Haopeng Zhang2026-01-22
💬 NLP

Large Language Models Encode Semantics and Alignment in Linearly Separable Representations

यह शोध पत्र प्रदर्शित करता है कि बड़े भाषा मॉडल (लार्ज लैंग्वेज मॉडल्स) उच्च-स्तरीय अर्थ संबंधी और संरेखण संबंधी जानकारी को अपने लेटेंट रिप्रजेंटेशन के भीतर निम्न-आयामी, रैखिक रूप से विभाज्य उप-स्थानों (लो-डायमेंशनल, लीनियरली सेपरेबल सबस्पेस) में व्यवस्थित करते हैं, जिससे प्रभावी ज्यामिति-जागरूक गार्डरेल्स का विकास सक्षम होता है जो दुर्भावनापूर्ण सामग्री का पता लगाने और उसे कम करने में पारंपरिक सुरक्षा तंत्रों से बेहतर प्रदर्शन करते हैं।

Baturay Saglam, Paul Kassianik, Blaine Nelson, Sajana Weerawardhena, Yaron Singer, Amin Karbasi2026-01-22
💬 NLP

Do Political Opinions Transfer Between Western Languages? An Analysis of Unaligned and Aligned Multilingual LLMs

यह शोध पत्र प्रदर्शित करता है कि पश्चिमी भाषाई संदर्भों में, बहुभाषी लार्ज लैंग्वेज मॉडल्स (LLMs) में राजनीतिक विचार भाषाओं के बीच अलग रहने के बजाय एक भाषा से दूसरी भाषा में स्थानांतरित हो जाते हैं, और संरेखण (alignment) इन विचारों को लक्षित भाषा की परवाह किए बिना समान रूप से परिवर्तित कर देता है।

Franziska Weeber, Tanise Ceron, Sebastian Padó2026-01-22
💬 NLP

LoSemB: Logic-Guided Semantic Bridging for Inductive Tool Retrieval

यह शोध पत्र LoSemB का प्रस्ताव करता है, जो एक नवीन ढांचा (framework) है जो लॉजिक-गाइडेड सिमेंटिक ब्रिजिंग का लाभ उठाकर बड़े भाषा मॉडलों (LLMs) को इंडक्टिव सेटिंग्स में अनदेखे टूल्स को प्रभावी ढंग से खोजने में सक्षम बनाता है, जिससे बिना किसी महंगी रिट्रेनिंग के वितरण बदलावों (distribution shifts) को कम किया जा सके और समानता-आधारित रिट्रीवल पर निर्भरता को घटाया जा सके।

Luyao Zhuang, Qinggang Zhang, Huachi Zhou, Yujing Zhang, Xiao Huang2026-01-22
💬 NLP

A2H-MAS: An Algorithm-to-HLS Multi-Agent System for Automated and Reliable FPGA Implementation

यह शोध पत्र A2H-MAS प्रस्तुत करता है, जो एक मॉड्यूलर मल्टी-एजेंट सिस्टम है जो हाई-लेवल सिंथेसिस (High-Level Synthesis) के माध्यम से MATLAB एल्गोरिदम को कुशल, सटीक और लेटेंसी-अनुकूलित FPGA कार्यान्वयन में स्वचालित रूप से अनुवादित करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जो विशिष्ट एजेंट भूमिकाओं, निष्पादन-आधारित सत्यापन और एल्गोरिदम-हार्डवेयर सह-डिज़ाइन के माध्यम से मौजूदा दृष्टिकोणों की सीमाओं को दूर करता है।

Jie Lei, Ruofan Jia, J. Andrew Zhang, Hao Zhang2026-01-22
💬 NLP

Pathways of Thoughts: Multi-Directional Thinking for Long-form Personalized Question Answering

यह शोध पत्र पाथवेज़ ऑफ़ थॉट्स (PoT) को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त इन्फरेंस-चरण की विधि है जो अनुमानित उपयोगकर्ता प्राथमिकताओं के आधार पर विविध तर्क प्रक्षेप पथों (reasoning trajectories) को उत्पन्न करने, एकत्रित करने और पुन: भारित करने के लिए विचार प्रक्रिया को एक पुनरावृत्ति निर्णय प्रक्रिया के रूप में मॉडल करके दीर्घ-रूप व्यक्तिगत प्रश्नोत्तर को बेहतर बनाता है, जिससे मौजूदा बेसलाइन की तुलना में महत्वपूर्ण प्रदर्शन लाभ प्राप्त होता है।

Alireza Salemi, Cheng Li, Mingyang Zhang, Qiaozhu Mei, Zhuowan Li, Spurthi Amba Hombaiah, Weize Kong, Tao Chen, Hamed Za (…)2026-01-22
💬 NLP

Reading Between the Lines: Towards Reliable Black-box LLM Fingerprinting via Zeroth-order Gradient Estimation

यह शोध पत्र ZeroPrint को प्रस्तुत करता है, जो एक नवीन ब्लैक-बॉक्स LLM फिंगरप्रिंटिंग विधि है जो मौजूदा आउटपुट-आधारित तकनीकों की तुलना में अधिक सूचनात्मक और सुदृढ़ मॉडल सिग्नेचर निकालने के लिए अर्थ-संरक्षण वाले शब्द प्रतिस्थापन (semantic-preserving word substitutions) के माध्यम से ज़ीरो-ऑर्डर ग्रेडिएंट एस्टीमेशन का लाभ उठाता है।

Shuo Shao, Yiming Li, Hongwei Yao, Yifei Chen, Yuchen Yang, Zhan Qin2026-01-22
⚡ electrical engineering

Hierarchical Self-Supervised Representation Learning for Depression Detection from Speech

यह शोधपत्र HAREN-CTC का प्रस्ताव करता है, जो एक पदानुक्रमित स्व-पर्यवेक्षित शिक्षण ढांचा (hierarchical self-supervised learning framework) है जो गैर-आक्रामक अवसाद पहचान (non-invasive depression detection) में अत्याधुनिक प्रदर्शन प्राप्त करने के लिए एसिमेट्रिक क्रॉस-अटेंशन और CTC सहायक पर्यवेक्षण के माध्यम से निम्न-स्तरीय ध्वनिक और उच्च-स्तरीय अर्थ संबंधी भाषण विशेषताओं को एकीकृत करता है।

Yuxin Li, Eng Siong Chng, Cuntai Guan2026-01-22
⚡ electrical engineering

Extending Audio Context for Long-Form Understanding in Large Audio-Language Models

यह शोध पत्र 'पार्शियल यार्न' (Partial YaRN) का प्रस्ताव देकर लार्ज ऑडियो-लैंग्वेज मॉडल्स में लघु ऑडियो कॉन्टेक्स्ट विंडोज़ की सीमा को संबोधित करता है, जो एक ट्रेनिंग-फ्री विधि है जो ऑडियो और टेक्स्ट पोजीशनल एक्सटेंशन को अलग करती है, और 'वर्चुअल लॉन्गफॉर्म ऑडियो ट्रेनिंग' (VLAT) का उपयोग करता है, जो एक ऐसी रणनीति है जो विविध ऑडियो लंबाई का अनुकरण करती है ताकि लंबे इनपुट्स की सुदृढ़ समझ सक्षम हो सके।

Yuatyong Chaichana, Pittawat Taveekitworachai, Warit Sirichotedumrong, Potsawee Manakul, Kunat Pipatanakul2026-01-22