💬 NLP

IRPAPERS: A Visual Document Benchmark for Scientific Retrieval and Question Answering

यह शोध पत्र IRPAPERS को प्रस्तुत करता है, जो 166 वैज्ञानिक शोध पत्रों के 3,230 पृष्ठों से बना एक विजुअल डॉक्यूमेंट बेंचमार्क है, जो यह प्रदर्शित करता है कि जबकि टेक्स्ट-आधारित रिट्रीवल आम तौर पर इमेज-आधारित विधियों से बेहतर प्रदर्शन करता है, उनकी पूरक शक्तियों का लाभ उठाने वाला एक मल्टीमॉडल हाइब्रिड दृष्टिकोण बेहतर रिट्रीवल और प्रश्न-उत्तर प्रदर्शन प्राप्त करता है।

Connor Shorten, Augustas Skaburskas, Daniel M. Jones, Charles Pierse, Roberto Esposito, John Trengrove, Etienne Dilocker (…)2026-02-23
💬 NLP

Tethered Reasoning: Decoupling Entropy from Hallucination in Quantized LLMs via Manifold Steering

यह शोध पत्र HELIX को प्रस्तुत करता है, जो एक ज्यामितीय ढांचा (geometric framework) है जो क्वांटाइज्ड LLMs में हिडन-स्टेट प्रक्षेपवक्रों (hidden-state trajectories) को एक सत्यता मैनिफोल्ड (truthfulness manifold) से बांधकर एंट्रॉपी को मतिभ्रम (hallucination) से अलग करता है, जिससे उच्च-तापमान अनुमान (high-temperature inference) सक्षम होता है जो तार्किक सुसंगतता और सटीकता बनाए रखते हुए रचनात्मक विविधता को महत्वपूर्ण रूप से बढ़ाता है।

Craig Atkinson2026-02-23
💬 NLP

Mind the Style: Impact of Communication Style on Human-Chatbot Interaction

यह अध्ययन प्रदर्शित करता है कि एक नेविगेशन चैटबॉट में मैत्रीपूर्ण संचार शैली विशेष रूप से महिला उपयोगकर्ताओं के लिए कार्य पूर्णता दरों और संतुष्टि में महत्वपूर्ण सुधार करती है, जो मानव-चैटबॉट इंटरैक्शन में लिंग-संवेदनशील वैयक्तिकरण के महत्व को रेखांकित करती है।

Erik Derner, Dalibor Kučera, Aditya Gulati, Ayoub Bagheri, Nuria Oliver2026-02-23
💬 NLP

ADAPT: Hybrid Prompt Optimization for LLM Feature Visualization

यह शोध पत्र ADAPT को प्रस्तुत करता है, जो एक हाइब्रिड प्रॉम्प्ट ऑप्टिमाइज़ेशन विधि है जो बीम सर्च इनिशियलाइज़ेशन को एडेप्टिव ग्रेडिएंट-गाइडेड म्यूटेशन के साथ जोड़ती है ताकि Gemma 2 2B स्पार्स ऑटोएन्कोडर लेटेंट्स पर मौजूदा तकनीकों की तुलना में उत्कृष्ट प्रदर्शन प्रदर्शित करते हुए LLM एक्टिवेशन स्पेस में एनकोडेड फीचर्स को प्रभावी ढंग से विज़ुअलाइज़ किया जा सके।

João N. Cardoso, Arlindo L. Oliveira, Bruno Martins2026-02-23
💬 NLP

Understanding Unreliability of Steering Vectors in Language Models: Geometric Predictors and the Limits of Linear Approximations

यह शोध प्रबंध भाषा मॉडलों में स्टीयरिंग वेक्टर्स (steering vectors) की अविश्वसनीयता की जांच करता है, यह प्रदर्शित करते हुए कि स्टीयरिंग प्रभावकारिता प्रशिक्षण डेटा और लक्षित व्यवहार के बीच ज्यामितीय संरेखण (geometric alignment) पर निर्भर करती है, और यह निष्कर्ष निकालते हुए कि जब लेटेंट रिप्रजेंटेशन (latent representations) गैर-रैखिक होते हैं तो रैखिक सन्निकटन (linear approximations) विफल हो जाते हैं।

Joschka Braun2026-02-23
💬 NLP

Analyzing LLM Instruction Optimization for Tabular Fact Verification

यह शोध पत्र सारणीबद्ध तथ्य सत्यापन (tabular fact verification) के लिए DSPy-आधारित निर्देश अनुकूलन (instruction optimization) का पहला व्यवस्थित मूल्यांकन प्रस्तुत करता है, जो यह प्रदर्शित करता है कि MiPROv2 और SIMBA जैसे ऑप्टिमाइज़र विभिन्न मॉडल पैमानों में विभिन्न प्रॉम्प्टिंग रणनीतियों (CoT और ReAct सहित) के प्रदर्शन को महत्वपूर्ण रूप से बढ़ाते हैं, जिसमें SIMBA विशेष रूप से संख्यात्मक तर्क (numerical reasoning) और टूल उपयोग दक्षता में सुधार करता है।

Xiaotang Du, Giwon Hong, Wai-Chung Kwan, Rohit Saxena, Ivan Titov, Pasquale Minervini, Emily Allaway2026-02-23
💬 NLP

Decomposing Retrieval Failures in RAG for Long-Document Financial Question Answering

यह शोध पत्र वित्तीय RAG प्रणालियों में उस महत्वपूर्ण विफलता मोड की पहचान करता है और उसे संबोधित करता है जहाँ सही दस्तावेज़ तो प्राप्त हो जाता है लेकिन उत्तर वाला विशिष्ट पृष्ठ छूट जाता है, और एक डोमेन फाइन-ट्यून्ड पेज स्कोरर का प्रस्ताव करता है जो लंबे नियामक फाइलिंग पर पेज और चंक-स्तरीय रिट्रीवल प्रदर्शन में महत्वपूर्ण सुधार करता है।

Amine Kobeissi, Philippe Langlais2026-02-23
💬 NLP

Towards More Standardized AI Evaluation: From Models to Agents

यह शोध पत्र तर्क देता है कि जैसे-जैसे एआई (AI) प्रणालियाँ स्थिर मॉडलों से गतिशील एजेंटों में विकसित हो रही हैं, मूल्यांकन को पुराने स्थिर बेंचमार्क और समग्र स्कोर पर निर्भर रहने के बजाय एक निरंतर, विश्वास-निर्माण करने वाले मापन अनुशासन में बदलना चाहिए जो बड़े पैमाने पर गैर-नियत व्यवहारों (non-deterministic behaviors) को नियंत्रित करने में सक्षम हो।

Ali El Filali, Inès Bedar2026-02-23
💬 NLP

The Statistical Signature of LLMs

यह शोध पत्र यह प्रदर्शित करता है कि लॉसलेस कम्प्रेशन (lossless compression), उच्च संरचनात्मक नियमितता और संपीड़नीयता (compressibility) को उजागर करके, एलएलएम (LLM) द्वारा जनरेट किए गए टेक्स्ट को मानव लेखन से अलग करने के लिए एक सरल, मॉडल-अज्ञेय (model-agnostic) मीट्रिक के रूप में कार्य करता है, हालांकि खंडित, छोटे पैमाने के इंटरेक्शन वातावरण में यह विशिष्टता कम हो जाती है।

Ortal Hadad, Edoardo Loru, Jacopo Nudo, Niccolò Di Marco, Matteo Cinelli, Walter Quattrociocchi2026-02-23
💬 NLP

Click it or Leave it: Detecting and Spoiling Clickbait with Informativeness Measures and Large Language Models

यह शोधपत्र एक हाइब्रिड क्लिकबेट डिटेक्शन मॉडल प्रस्तुत करता है जो ट्रांसफॉर्मर-आधारित एम्बेडिंग्स को 15 भाषाई रूप से प्रेरित सूचनात्मक विशेषताओं के साथ जोड़ता है, जिससे XGBoost के साथ 91% F1-स्कोर प्राप्त होता है और महत्वपूर्ण भाषाई संकेतों के माध्यम से भविष्यवाणी की व्याख्यात्मकता में वृद्धि होती है।

Wojciech Michaluk, Tymoteusz Urban, Mateusz Kubita, Soveatin Kuntur, Anna Wroblewska2026-02-23