💬 NLP

Overton Pluralistic Reinforcement Learning for Large Language Models

यह शोध पत्र OP-GRPO को प्रस्तुत करता है, जो एक सुदृढीकरण अधिगम (रीइन्फोर्समेंट लर्निंग) ढांचा है जो एक समानता अनुमानक (सिमिलैरिटी एस्टिमेटर) को प्रशिक्षित करके और एक दोहरी-पुरस्कार प्रणाली का उपयोग करके एक एकल बड़े भाषा मॉडल को विविध, बहुलवादी प्रतिक्रियाएं उत्पन्न करने में सक्षम बनाता है, जो बड़े बेसलाइन और मॉड्यूलर आर्किटेक्चर की तुलना में बेहतर परिप्रेक्ष्य कवरेज और सटीकता प्राप्त करता है।

Yu Fu, Seongho Son, Ilija Bogunovic2026-02-25
💬 NLP

FinAnchor: Aligned Multi-Model Representations for Financial Prediction

FinAnchor एक हल्का ढांचा (lightweight framework) है जो बिना फाइन-ट्यूनिंग के कई LLMs से विषम एम्बेडिंग्स (heterogeneous embeddings) को संरेखित और एकत्रित करके एक एकीकृत प्रतिनिधित्व में बदलकर लंबे दस्तावेजों से वित्तीय भविष्यवाणी को बेहतर बनाता है, जिससे यह सिंगल-मॉडल और मानक एन्सेम्बल बेसलाइन्स से बेहतर प्रदर्शन करता है।

Zirui He, Huopu Zhang, Yanguang Liu, Sirui Wu, Mengnan Du2026-02-25
💬 NLP

Blackbird Language Matrices: A Framework to Investigate the Linguistic Competence of Language Models

यह शोध पत्र ब्लैकबर्ड लैंग्वेज मैट्रिसेस (BLM) को प्रस्तुत करता है, जो इंटेलिजेंस टेस्ट से प्रेरित एक नवीन, संरचित बहुविकल्पीय ढांचा है, जो क्यूरेटेड, व्याख्या योग्य डेटासेट के माध्यम से लार्ज लैंग्वेज मॉडल्स की भाषाई सक्षमता, व्यवस्थितता और तर्क क्षमताओं की विस्तृत जांच को सक्षम बनाता है।

Paola Merlo, Chunyang Jiang, Giuseppe Samo, Vivi Nastase2026-02-25
⚡ electrical engineering

Multimodal MRI Report Findings Supervised Brain Lesion Segmentation with Substructures

यह शोध पत्र MS-RSuper को प्रस्तुत करता है, जो एक एकीकृत, अनिश्चितता-जागरूक (uncertainty-aware) पर्यवेक्षित शिक्षण ढांचा है जो गुणात्मक मोडैलिटी संकेतों को उप-संरचनाओं के साथ संरेखित करने, एकतरफा मात्रात्मक बाधाओं को लागू करने और शारीरिक पूर्ववृत्तों (anatomical priors) को शामिल करने के माध्यम से मस्तिष्क के घाव विभाजन (brain lesion segmentation) को निर्देशित करने के लिए पार्स किए गए मल्टीमॉडल एमआरआई (MRI) रिपोर्टों का लाभ उठाता है, जिससे यह विरल रिपोर्ट-लेबल वाली निगरानी वाले डेटासेट पर मौजूदा विधियों से बेहतर प्रदर्शन करता है।

Yubin Ge, Yongsong Huang, Xiaofeng Liu2026-02-25
💬 NLP

PaperTrail: A Claim-Evidence Interface for Grounding Provenance in LLM-based Scholarly Q&A

पेपरट्रेल (PaperTrail) इंटरफ़ेस एलएलएम-आधारित (LLM-based) विद्वत्तापूर्ण प्रश्नोत्तर में उत्पत्ति (provenance) में सुधार के लिए एक सूक्ष्म दावा-साक्ष्य मानचित्रण तंत्र पेश करता है, लेकिन एक उपयोगकर्ता अध्ययन से पता चलता है कि जबकि यह असमर्थित दावों को उजागर करके शोधकर्ताओं के विश्वास को सफलतापूर्वक कम करता है, यह सत्यापन की उच्च संज्ञानात्मक लागत के कारण सिस्टम पर उनकी निर्भरता को बदलने में विफल रहता है।

Anna Martin-Boyle, Cara A. C. Leckey, Martha C. Brown, Harmanpreet Kaur2026-02-25
💬 NLP

An Expert Schema for Evaluating Large Language Model Errors in Scholarly Question-Answering Systems

यह शोध पत्र विद्वत प्रश्न-उत्तर प्रणालियों (scholarly question-answering systems) में लार्ज लैंग्वेज मॉडल (LLM) की त्रुटियों के मूल्यांकन के लिए एक नवीन, विशेषज्ञ-संचालित स्कीमा प्रस्तुत और मान्य करता है, जिसे 68 प्रश्न-उत्तर युग्मों के विषयगत विश्लेषण (thematic analysis) के माध्यम से विकसित किया गया था और डोमेन वैज्ञानिकों के साथ परिष्कृत किया गया था ताकि उन सूक्ष्म मूल्यांकन रणनीतियों को पकड़ा जा सके जिन्हें वर्तमान स्वचालित मेट्रिक्स अनदेखा कर देते हैं।

Anna Martin-Boyle, William Humphreys, Martha Brown, Cara Leckey, Harmanpreet Kaur2026-02-25
💬 NLP

Beyond the Star Rating: A Scalable Framework for Aspect-Based Sentiment Analysis Using LLMs and Text Classification

यह अध्ययन एक स्केलेबल हाइब्रिड फ्रेमवर्क का प्रस्ताव करता है जो लाखों ग्राहक समीक्षाओं का प्रभावी ढंग से विश्लेषण करने के लिए पहलू पहचान (aspect identification) हेतु लार्ज लैंग्वेज मॉडल्स और सेंटीमेंट वर्गीकरण हेतु पारंपरिक मशीन लर्निंग का लाभ उठाता है, यह प्रदर्शित करते हुए कि यह दृष्टिकोण विविध संदर्भों में रेस्टोरेंट की समग्र रेटिंग के विचरण (variance) को महत्वपूर्ण रूप से स्पष्ट कर सकता है।

Vishal Patil, Shree Vaishnavi Bacha, Revanth Yamani, Yidan Sun, Mayank Kejriwal2026-02-25
💬 NLP

A Benchmark for Deep Information Synthesis

यह शोध पत्र DEEPSYNTH को प्रस्तुत करता है, जो 7 डोमेन में 120 वास्तविक दुनिया के कार्यों वाला एक चुनौतीपूर्ण नया बेंचमार्क है, जो सूचना को संश्लेषित करने और अंतर्दृष्टि निकालने की LLM-आधारित एजेंटों की क्षमता का मूल्यांकन करता है, जो तर्क और मतिभ्रम (hallucination) नियंत्रण में महत्वपूर्ण वर्तमान सीमाओं को प्रकट करता है।

Debjit Paul, Daniel Murphy, Milan Gritta, Ronald Cardenas, Victor Prokhorov, Lena Sophia Bolliger, Aysim Toker, Roy Mile (…)2026-02-25
💬 NLP

PVminer: A Domain-Specific Tool to Detect the Patient Voice in Patient Generated Data

PVminer एक डोमेन-विशिष्ट एनएलपी (NLP) फ्रेमवर्क है जो सुरक्षित रोगी-प्रदाता संचार के भीतर सामाजिक निर्धारकों (social determinants of health) सहित रोगी की आवाज़ का कुशलतापूर्वक पता लगाने और उसे संरचित करने के लिए रोगी-अनुकूलित बर्ट (BERT) मॉडल और अनसुपरवाइज्ड टॉपिक मॉडलिंग का लाभ उठाता है, जो मौजूदा क्लिनिकल बेसलाइनों की तुलना में बेहतर प्रदर्शन प्राप्त करता है।

Samah Fodeh, Linhai Ma, Yan Wang, Srivani Talakokkul, Ganesh Puthiaraju, Afshan Khan, Ashley Hagaman, Sarah Lowe, Aimee (…)2026-02-25
💬 NLP

Learning from Trials and Errors: Reflective Test-Time Planning for Embodied LLMs

यह शोध पत्र रिफ्लेक्टिव टेस्ट-टाइम प्लानिंग (Reflective Test-Time Planning) प्रस्तुत करता है, जो एक ऐसा ढांचा है जो एम्बोडीड एलएलएम (embodied LLMs) को रिफ्लेक्शन-इन-एक्शन (reflection-in-action), रिफ्लेक्शन-ऑन-एक्शन (reflection-on-action), और रेट्रोस्पेक्टिव रिफ्लेक्शन (retrospective reflection) को एकीकृत करके उन्नत बनाता है ताकि बार-बार होने वाले प्रयास-और-त्रुटि (trial-and-error) को संचयी अनुभव में बदला जा सके, जिससे लॉन्ग-होरिज़ॉन टास्क परफॉर्मेंस (long-horizon task performance) और व्यवहार संबंधी सुधार में महत्वपूर्ण रूप से सुधार होता है।

Yining Hong, Huang Huang, Manling Li, Li Fei-Fei, Jiajun Wu, Yejin Choi2026-02-25