💬 NLP

The Heterogeneous Safety Impacts of Benign Multilingual Fine-Tuning

यह शोध पत्र पहला व्यापक अध्ययन प्रस्तुत करता है जो यह प्रदर्शित करता है कि विभिन्न भाषाओं में गैर-प्रतिकूल (non-adversarial) डेटा के साथ बड़े भाषा मॉडलों का सौम्य फाइन-ट्यूनिंग (benign fine-tuning), विषम और विच्छेदित (decoupled) सुरक्षा विचलन का कारण बनता है, जो अक्सर काफी बढ़ी हुई प्रतिकूल अनुपालन दरों की ओर ले जाता है जिन्हें केवल अंग्रेजी-केंद्रित मूल्यांकनों द्वारा नहीं पकड़ा जा सकता है।

Will Hawkins, Kaivalya Rawal, Jonathan Rystrøm, Stratis Tsirtsis, Zihao Fu, Greta Warren, Ryan Brown, Eoin Delaney, Sand (…)2026-06-30
💬 NLP

Memory-Managed Long-Context Attention: A Preliminary Study of Editable Request-Local Memory

यह प्रारंभिक अध्ययन एक हाइब्रिड "मेमोरी-मैनेज्ड लॉन्ग-कॉन्टेक्स्ट अटेंशन" आर्किटेक्चर का प्रस्ताव करता है जो एक तेज़ रिकरेंट बैकबोन को स्पष्ट, संपादन योग्य मेमोरी स्लॉट्स से अलग करता है, और विभिन्न सिंथेटिक एवं प्राकृतिक भाषा बेंचमार्क के माध्यम से यह प्रदर्शित करता है कि यह दृष्टिकोण ओवरराइट, वर्जनिंग और एंटी-पॉल्यूशन हैंडलिंग की सीमाओं को प्रभावी ढंग से संबोधित करता है, साथ ही यह भी पहचानता है कि लर्नड ओपन-डोमेन सिलेक्शन ही शेष प्रमुख बाधा (बॉटलनेक) है।

Junyi Zou, Avrova Donz2026-06-30
💬 NLP

Latent Bridges for Multi-Table Question Answering

यह शोध पत्र GRAB को प्रस्तुत करता है, जो एक कुशल पाइपलाइन है जो विषम ग्राफों (heterogeneous graphs) को क्वेरी-सशर्त लेटेंट टोकन में एनकोड करके फ्रोजन लार्ज लैंग्वेज मॉडल्स को रिलेशनल डेटा से जोड़ता है, जिससे केवल एक हल्के 91M पैरामीटर वाले मॉड्यूल को प्रशिक्षित करके मल्टी-टेबल प्रश्न उत्तर प्रदर्शन में महत्वपूर्ण सुधार होता है।

Simone Varriale, Tamara Cucumides, Floris Geerts, Paolo Papotti2026-06-30
💬 NLP

FinInvest-GTCN: Explainable Graph-Temporal-Causal Modeling for Risk-Aware Investment Decision Optimization

यह शोध पत्र FinInvest-GTCN को प्रस्तुत करता है, जो एक मेटा-कॉज़ल अडैप्टेशन रणनीति द्वारा संवर्धित एक व्याख्यात्मक ग्राफ-टेम्पोरल-कॉज़ल नेटवर्क है, जो अत्याधुनिक जोखिम-समायोजित निवेश प्रदर्शन और व्याख्यात्मकता प्राप्त करने के लिए विषम, गैर-स्थिर और कम-डेटा वाले वेंचर कैपिटल परिवेश की चुनौतियों को प्रभावी ढंग से संबोधित करता है।

Junyan Tan, Yifan Li, Minghao Wang, Zihan Chen, Haoyu Zhang2026-06-30
💬 NLP

EVLA: An Electro-Aware Multimodal Assistant for Physically-Grounded Driving Reasoning and Control

यह शोध पत्र EVLA प्रस्तुत करता है, जो एक इलेक्ट्रो-अवेयर मल्टीमॉडल असिस्टेंट है जो एक एकीकृत एनकोडर और संरचित रीजनिंग चेन के माध्यम से वास्तविक समय के विद्युतीकृत पावरट्रेन अवस्थाओं को विजुअल और टेक्स्टुअल डेटा के साथ एकीकृत करता है ताकि भौतिक रूप से-आधारित, ऊर्जा-इष्टतम ड्राइविंग निर्णय उत्पन्न किए जा सकें जो मौजूदा विजन-लैंग्वेज बेसलाइन्स से बेहतर प्रदर्शन करते हैं।

Yuxin Liu, Zihan Chen, Haoyu Wang, Mingxuan Zhang, Ruijie Lin, Siyuan Zhao2026-06-30
💬 NLP

A3M: Adaptive, Adversarial and Multi-Objective Learning for Strategic Bidding in Repeated Auctions

यह शोध पत्र A3M को पेश करता है, जो एक नवीन ढांचा है जो एडेप्टिव डीप रीइन्फोर्समेंट लर्निंग, एडवरसैरियल रीजनिंग और मल्टी-ऑब्जेक्टिव रिवॉर्ड डिज़ाइन को एकीकृत करता है ताकि मौजूदा विधियों की तुलना में बार-बार होने वाली मल्टी-यूनिट नीलामियों में रणनीतिक बोली लगाने के प्रदर्शन, मजबूती और निष्पक्षता में महत्वपूर्ण सुधार किया जा सके।

Junhan Li, Yuxin Zhang, Haoran Wang, Minghao Chen2026-06-30
💬 NLP

Beyond the Mean: Three-Axis Fidelity for Aligning LLM-Based Survey Simulators from Small Pilot Data

यह शोध पत्र LLM-आधारित सर्वेक्षण सिम्युलेटरों का मूल्यांकन करने के लिए एक त्रि-अक्षीय निष्ठा ढांचे (संरचनात्मक, सीमांत और व्यक्तिगत) का प्रस्ताव करता है और यह प्रदर्शित करता है कि छोटे पायलट नमूनों पर फाइन-ट्यूनिंग करना जनसंख्या-स्तरीय सांख्यिकीय विशेषताओं को पुनः प्राप्त करने के लिए एक संतुलित दृष्टिकोण प्रदान करता है, हालांकि निष्ठा उप-नमूनों में भिन्न हो सकती है।

Eun Cheol Choi, Youngrae Kim, Prabhu Pugalenthi, Hong-En Chen, Bo-Ruei Huang2026-06-30
💬 NLP

Can LLMs Hire Fairly? Racial Bias in Resume Screening

यह शोध पत्र चौदह बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) का ऑडिट करता है और पाता है कि जहाँ एक 2023 के मॉडल ने मानव भेदभाव के समान श्वेत-पक्षपाती भर्ती पूर्वाग्रह प्रदर्शित किया, वहीं 2024 या उसके बाद जारी किए गए सभी मॉडलों ने या तो कोई पूर्वाग्रह नहीं दिखाया या एक महत्वपूर्ण प्रो-ब्लैक रिवर्सल (अश्वेत-पक्षपाती उलटफेर) प्रदर्शित किया, जो एल्गोरिद्मिक भर्ती निष्पक्षता में एक पीढ़ीगत बदलाव को चिह्नित करता है।

Zhenyu Gao, Wenxi Jiang, Yutong Yan2026-06-30
💬 NLP

BERTomelo: Your Portuguese Encoder Best Friend

यह शोध पत्र BERTomelo को प्रस्तुत करता है, जो ModernBERT आर्किटेक्चर पर निर्मित और 106-मिलियन दस्तावेज़ों के विशाल संग्रह पर प्रशिक्षित एक अगली पीढ़ी का एकलभाषी पुर्तगाली एनकोडर है, जो मौजूदा पुर्तगाली मॉडलों से बेहतर प्रदर्शन करता है और विभिन्न एनएलपी कार्यों के लिए बहुभाषी विकल्पों के मुकाबले एक अधिक कुशल विकल्प प्रदान करता है।

Rennê Ruan Alves Oliveira, Gustavo Cordeiro Galvão Van Erven, Luís Paulo Faina Garcia2026-06-30
💬 NLP

Conversational Domain Adaptation of IndicTrans2 across 21 Indic Languages via Experience Replay and Model Soups

यह शोध पत्र एक ईमानदार, एंड-टू-एंड अध्ययन प्रस्तुत करता है जो यह प्रदर्शित करता है कि एक्सपीरियंस रिप्ले और मॉडल सूपिंग को संयोजित करने से IndicTrans2 को 21 भारतीय भाषाओं में संवादात्मक रजिस्टरों के अनुकूल होने में मदद मिलती है, जिससे सामान्य-डोमेन प्रदर्शन में गिरावट लाए बिना संदर्भ-मिलान मेट्रिक्स में महत्वपूर्ण सुधार होता है, जबकि यह स्वीकार किया गया है कि ये लाभ बेहतर रजिस्टर संरेखण को दर्शाते हैं न कि पुष्ट मानव-अनुभूत गुणवत्ता सुधारों को।

Aditya Pratap Singh2026-06-30