💬 NLP

RLHF in an SFT Way: From Optimal Solution to Reward-Weighted Alignment

यह शोध पत्र वेरिएशनल अलाइनमेंट विद री-वेटिंग (VAR) का प्रस्ताव करता है, जो एक नवीन ऑफलाइन विधि है जो बेहतर अलाइनमेंट प्रदर्शन और स्थिरता प्राप्त करने के लिए मानव फीडबैक से सुदृढीकरण लर्निंग (RLHF) को एक रिवॉर्ड-वेटेड सुपरवाइज्ड फाइन-ट्यूनिंग कार्य के रूप में पुनर्गठित करती है, जबकि पारंपरिक ऑनलाइन विधियों और DPO जैसे मौजूदा ऑफलाइन दृष्टिकोणों की तुलना में कम्प्यूटेशनल लागत को काफी कम करती है।

Yuhao Du, Zhuo Li, Pengyu Cheng, Zhihong Chen, Yuejiao Xie, Xiang Wan, Anningzhe Gao2026-03-24
💰 quantitative finance

Advanced Deep Learning Techniques for Analyzing Earnings Call Transcripts: Methodologies and Applications

यह अध्ययन अर्निंग कॉल ट्रांसक्रिप्ट के सेंटीमेंट एनालिसिस के लिए BERT, FinBERT और ULMFiT सहित डीप लर्निंग मॉडल्स का एक तुलनात्मक विश्लेषण प्रस्तुत करता है ताकि उनके प्रदर्शन, दक्षता और वित्तीय निर्णय लेने तथा जोखिम प्रबंधन को बढ़ाने की क्षमता का मूल्यांकन किया जा सके।

Umair Zakir, Evan Daykin, Amssatou Diagne, Jacob Faile2026-03-24
💬 NLP

Levels of Analysis for Large Language Models

यह शोध पत्र डेविड मार के विश्लेषण के स्तरों और स्थापित संज्ञानात्मक विज्ञान तकनीकों को अनुकूलित करके बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) के व्यवहार और उनकी आंतरिक संरचना को डिकोड करने के लिए एक ढांचा प्रस्तावित करता है।

Alexander Y. Ku, Declan Campbell, Xuechunzi Bai, Jiayi Geng, Ryan Liu, Raja Marjieh, R. Thomas McCoy, Andrew Nam, Ilia S (…)2026-03-24
💬 NLP

An evolutionary perspective on modes of learning in Transformers

यह शोध पत्र विकासवादी जीव विज्ञान और ट्रांसफॉर्मर लर्निंग के बीच एक सादृश्यता प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि पर्यावरणीय स्थिरता 'इन-वेट लर्निंग' (IWL) के पक्ष में होती है, जबकि पर्यावरणीय अस्थिरता विश्वसनीय संकेतों के साथ 'इन-कॉन्टेक्स्ट लर्निंग' (ICL) के पक्ष में होती है, और इन रणनीतियों के बीच संक्रमण 'एसिम्प्टोटिक ऑप्टिमैलिटी' (asymptotic optimality) और अनुकूलन लागतों द्वारा नियंत्रित होते हैं।

Alexander Y. Ku, Thomas L. Griffiths, Stephanie C. Y. Chan2026-03-24
🧬 biology

MolLangBench: A Comprehensive Benchmark for Language-Prompted Molecular Structure Recognition, Editing, and Generation

यह शोध पत्र MolLangBench प्रस्तुत करता है, जो भाषा-प्रेरित आणविक संरचना पहचान, संपादन और निर्माण के मूल्यांकन के लिए एक व्यापक बेंचमार्क है, जो यह प्रकट करता है कि मनुष्यों के लिए अपनी सहज सरलता के बावजूद, GPT-5 जैसे अत्याधुनिक मॉडल भी इन मौलिक रासायनिक कार्यों के साथ महत्वपूर्ण रूप से संघर्ष करते हैं।

Feiyang Cai, Jiahui Bai, Tao Tang, Guijuan He, Joshua Luo, Tianyu Zhu, Srikanth Pilla, Gang Li, Ling Liu, Feng Luo2026-03-24
💬 NLP

Comparative Analysis of AI Agent Architectures for Entity Relationship Classification

यह शोध पत्र एंटिटी रिलेशनशिप वर्गीकरण के लिए तीन एआई एजेंट आर्किटेक्चर का एक तुलनात्मक विश्लेषण प्रस्तुत करता है, जो यह प्रदर्शित करता है कि सहकारी और प्रतिकूल प्रॉम्प्टिंग के साथ एक नवीन मल्टी-एजेंट डायनेमिक उदाहरण जनरेशन दृष्टिकोण लगातार मानक फ्यू-शॉट प्रॉम्प्टिंग से बेहतर प्रदर्शन करता है और कई डोमेन में फाइन-ट्यून्ड मॉडलों को टक्कर देता है।

Maryam Berijanian, Kuldeep Singh, Amin Sehati2026-03-24
💬 NLP

Theory-Grounded Evaluation of Human-Like Fallacy Patterns in LLM Reasoning

यह शोध पत्र तर्क के एरोटेटिक सिद्धांत (Erotetic Theory of Reasoning) का उपयोग करते हुए 38 भाषा मॉडलों का मूल्यांकन करता है ताकि यह प्रदर्शित किया जा सके कि जैसे-जैसे मॉडल की क्षमता बढ़ती है, उनकी त्रुटियां यादृच्छिक गलतियों के बजाय विशिष्ट मानव-समान तर्कदोषों (fallacy patterns) के अधिक अनुरूप हो जाती हैं, और आधारवाक्यों (premise) का क्रम तर्कदोष उत्पादन को महत्वपूर्ण रूप से प्रभावित करता है।

Andrew Keenan Richardson, Ryan Othniel Kearns, Sean Moss, Vincent Wang-Mascianica, Philipp Koralus2026-03-24
💬 NLP

Knowledge Fusion via Bidirectional Information Aggregation

यह शोध पत्र KGA को प्रस्तुत करता है, जो एक नवीन इन्फरेंस-टाइम फ्रेमवर्क है जो स्थिर मॉडलों और कैटास्ट्रोफिक फॉरगेटिंग की सीमाओं को दूर करने के लिए सिनर्जिस्टिक बॉटम-अप नॉलेज फ्यूजन और टॉप-डाउन अटेंशन गाइडेंस पाथवे का उपयोग करते हुए, बिना किसी पैरामीटर संशोधन के बड़े भाषा मॉडलों में बाहरी नॉलेज ग्राफ को गतिशील रूप से एकीकृत करता है।

Songlin Zhai, Guilin Qi, Yue Wang, Yuan Meng2026-03-24
💬 NLP

DMFI: A Dual-Modality Log Analysis Framework for Insider Threat Detection with LoRA-Tuned Language Models

यह शोध पत्र DMFI का प्रस्ताव करता है, जो एक द्वैत-मोडैलिटी (dual-modality) ढांचा है जो स्वतंत्र रूप से LoRA-ट्यून किए गए भाषा मॉडलों और एक विभेदक अनुकूलन रणनीति के माध्यम से सिमेंटिक और व्यवहार संबंधी लॉग विश्लेषणों को संलयित करके इनसाइडर थ्रेट डिटेक्शन को बढ़ाता है, और CERT डेटासेट्स पर अत्याधुनिक तरीकों की तुलना में बेहतर सटीकता प्राप्त करता है।

Kaichuan Kong, Dongjie Liu, Xiaobo Jin, Guanggang Geng, Zhiying Li, Jian Weng2026-03-24
💬 NLP

SafeConstellations: Mitigating Over-Refusals in LLMs Through Task-Aware Representation Steering

यह शोध पत्र SafeConstellations को प्रस्तुत करता है, जो एक इन्फरेंस-टाइम विधि है जो टास्क-विशिष्ट एम्बेडिंग ट्रैजेक्टरीज को रिफ्यूज़ल पैटर्न से दूर पहचानकर और निर्देशित करके LLM के ओवर-रिफ्यूज़ल को कम करती है, जिससे उपयोगिता को बनाए रखते हुए रिजेक्शन रेट में 73% तक की कमी आती है।

Utsav Maskey, Sumit Yadav, Mark Dras, Usman Naseem2026-03-24