💬 NLP

Exploring the Reversal Curse and Other Deductive Logical Reasoning in BERT and GPT-Based Large Language Models

यह अध्ययन प्रकट करता है कि जहाँ द्विदिश (bidirectional) BERT मॉडल उस "रिवर्सल कर्से" (Reversal Curse) से मुक्त हैं जो सममित तार्किक अनुमान (symmetric logical deduction) में ऑटो-रिग्रेसिव GPT मॉडलों को बाधित करता है, वहीं दोनों आर्किटेक्चर जटिल मल्टी-सेट निगमनात्मक तर्क (complex multi-set deductive reasoning) के साथ संघर्ष करते हैं, जो यह सुझाव देता है कि मॉडल का चयन बायोमेडिकल नॉलेज ग्राफ निर्माण जैसे कार्यों की विशिष्ट तार्किक मांगों के अनुरूप तैयार किया जाना चाहिए।

Da Wu, Jingye Yang, Kai Wang2026-07-15
💬 NLP

Stars, Stripes, and Silicon: Unravelling the ChatGPT's All-American, Monochrome, Cis-centric Bias

यह शोध पत्र तर्क देता है कि चैटजीपीटी (ChatGPT) जैसे बड़े भाषा मॉडलों का पूर्वाग्रह, विषाक्तता और अविश्वसनीयता मुख्य रूप से मॉडल आर्किटेक्चर के बजाय गैर-विविध प्रशिक्षण डेटा से उत्पन्न होती है, जिसके लिए सामाजिक नुकसान को कम करने और न्यायसंगत एआई (AI) तैनाती सुनिश्चित करने हेतु अंतर-विषयक सहयोग और सुदृढ़ शासन ढांचे की आवश्यकता है।

Federico Torrielli2026-07-15
💰 quantitative finance

Modeling Story Expectations: A Generative Framework using LLMs

यह शोध पत्र काल्पनिक कहानी के निरंतरता (कंटिन्यूएशन) से व्याख्यात्मक विशेषताओं को निकालने के लिए लार्ज लैंग्वेज मॉडल्स का उपयोग करने वाला एक जनरेटिव फ्रेमवर्क प्रस्तुत करता है, जो यह प्रदर्शित करता है कि ये LLM-व्युत्पन्न अपेक्षाएं मानव विश्वासों और वास्तविक कथा परिणामों दोनों की प्रभावी ढंग से भविष्यवाणी करती हैं और साथ ही पाठक की सहभागिता (एंगेजमेंट) के साथ महत्वपूर्ण रूप से सह-संबंधित हैं।

Hortense Fong, George Gui, Bo Yang2026-07-15
💬 NLP

Toward Metaphor-Fluid Conversation Design for Voice User Interfaces

यह शोध पत्र वॉइस यूजर इंटरफेस के लिए एक "मेटाफर-फ्लुइड डिज़ाइन" (रूपक-प्रवाहपूर्ण डिज़ाइन) दृष्टिकोण का प्रस्ताव करता है और उसे प्रमाणित करता है जो विशिष्ट संवादात्मक संदर्भों के अनुसार रूपक संबंधी प्रस्तुतियों को गतिशील रूप से अनुकूलित करता है, और यह प्रदर्शित करता है कि इस प्रकार की तरलता स्थिर, एक-समान डिज़ाइनों की तुलना में उपयोगकर्ता द्वारा अपनाए जाने, आनंद और पसंद के स्तर को महत्वपूर्ण रूप से बढ़ाती है।

Smit Desai, Jessie Chin, Dakuo Wang, Benjamin Cowan, Michael Twidale2026-07-15
💬 NLP

Systematicity between Forms and Meanings across Languages Supports Efficient Communication

यह शोधपत्र यह प्रदर्शित करता है कि विविध भाषाओं में क्रिया और सर्वनाम रूपों के बीच व्यवस्थित संबंध सरलता और सटीकता के लिए प्रतिस्पर्धी दबावों से उत्पन्न होते हैं, जो भाषाई व्यवस्थितता के साथ कुशल संचार सिद्धांत को जोड़ने के लिए एक नवीन शिक्षणीयता-आधारित जटिलता माप का उपयोग करता है।

Doreen Osmelak, Yang Xu, Michael Hahn, Kate McCurdy2026-07-15
💬 NLP

CANDI: Contextual Alignment for Niche Domains Question Answering

यह शोध पत्र CANDI-QA प्रस्तुत करता है, जो एक नवीन बेंचमार्क डेटासेट है जिसे विशेषज्ञ-क्यूरेटेड तथ्यात्मक और तर्क संबंधी कार्यों के माध्यम से विशिष्ट डोमेन में सटीक, संदर्भ-संवेदनशील और उपयोगकर्ता-अनुरूप उत्तर देने में लार्ज लैंग्वेज मॉडल्स का मूल्यांकन करने के लिए डिज़ाइन किया गया है, साथ ही यह वर्तमान मॉडल्स की मजबूत प्रासंगिक संरेखण प्राप्त करने की सीमाओं को संबोधित करने के लिए MTSS-Net फ्रेमवर्क का प्रस्ताव भी देता है।

Megha Chakraborty, Darssan L. Eswaramoorthi, Het Riteshkumar Shah, Madhur Thareja, Michelle A Ihetu, Harshul Raj Surana (…)2026-07-15
💬 NLP

TAKE: Trajectory-Aware Knowledge Estimation for Text Dataset Distillation

यह शोध पत्र TAKE का प्रस्ताव करता है, जो एक प्रक्षेपवक्र-जागरूक (trajectory-aware) ज्ञान अनुमान ढांचा है जो टेक्स्ट कॉर्पोरा को उनके मूल आकार के 0.1% तक कम करने के लिए इन्फ्लुएंस फंक्शन्स और ऑप्टिमल ट्रांसपोर्ट का उपयोग करता है, जबकि डाउनस्ट्रीम टास्क प्रदर्शन को सुरक्षित रखता है।

Tri-Nhan Vo, Dang Nguyen, Sunil Gupta2026-07-15
💬 NLP

Transforming LLMs into Efficient Cross-Encoders via Knowledge Distillation for RAG Reranking

यह शोध पत्र प्रदर्शित करता है कि LoRA और 4-bit क्वांटाइजेशन के साथ LLaMA 3 (8B) को फाइन-ट्यून करना RAG पाइपलाइनों के लिए एक कुशल, उच्च-सटीक क्रॉस-एनकोडर रीरैंकर बनाता है जो प्रासंगिकता और शुद्धता मेट्रिक्स में पारंपरिक बेसलाइन से काफी बेहतर प्रदर्शन करता है और द्विघातीय (quadratic) इन्फरेंस लागतों को समाप्त करता है।

Shreeya Dasa Lakshminath, Shubhan S2026-07-15
💬 NLP

MAGE: Understanding Stability-Performance Trade-offs in Multi-component Prompt Optimization

यह शोध पत्र MAGE प्रस्तुत करता है, जो एक नियंत्रित विश्लेषण ढांचा है जो प्रॉम्प्ट ऑप्टिमाइज़ेशन कपलिंग इफेक्ट (POCE) को प्रकट करता है, यह प्रदर्शित करते हुए कि एक रिफ्लेक्टिव लूप में कई स्टोकेस्टिक ऑप्टिमाइज़ेशन सिग्नल्स को संयोजित करना प्रदर्शन को बढ़ाता है और साथ ही भिन्नता (variance) को भी बढ़ाता है, जिससे प्रॉम्प्ट ऑप्टिमाइज़ेशन सिस्टम के लिए स्थिरता और पीक एक्यूरेसी दोनों का दोहरा मूल्यांकन आवश्यक हो जाता है।

Prateek Singh2026-07-15
💬 NLP

Belief-reality separation lives in routing over a shared value slot in language models

यह शोध पत्र यह पहचानता है कि भाषा मॉडल दो विशिष्ट तंत्रों के माध्यम से विश्वास (belief) को वास्तविकता (reality) से अलग करते हैं: एक साझा मूल्य स्लॉट (shared value slot) जो आरोपित जानकारी को संग्रहीत करता है और एक क्वेरी-पोजीशन राउटर (query-position router) जो यह चयन करता है कि पात्र के विश्वास से पढ़ना है या वस्तुनिष्ठ वास्तविकता से, एक ऐसी क्षमता जो कई आर्किटेक्चरों में 3B से 7B पैरामीटर्स के बीच उभरती है।

Oliver Steele, Jiangtao Wen, Yuxing Han2026-07-15