💬 NLP

To See is Not to Learn: Protecting Multimodal Data from Unauthorized Fine-Tuning of Large Vision-Language Model

यह शोध पत्र MMGuard का प्रस्ताव करता है, जो एक सक्रिय रक्षा तंत्र है जो बड़े विजन-लैंग्वेज मॉडल्स (Large Vision-Language Models) के अनधिकृत फाइन-ट्यूनिंग को रोकने के लिए मानव-अदृश्य विक्षोभों (human-imperceptible perturbations) को इंजेक्ट करके और क्रॉस-मोडल बाइंडिंग्स को बाधित करके अनलर्नेबल मल्टीमॉडल उदाहरण उत्पन्न करता है, जिससे डेटा मालिकों के कॉपीराइट और गोपनीयता की रक्षा होती है।

Chengshuai Zhao, Zhen Tan, Dawei Li, Zhiyuan Yu, Huan Liu2026-05-15
🤖 machine learning

Minimal-Intervention KV Retention: A Design-Space Study and a Diversity-Penalty Survivor

यह शोधपत्र प्रदर्शित करता है कि एक न्यूनतम, विविधता-दंड (diversity-penalty) संशोधन, टाइट मेमोरी बजट के तहत दीर्घ-रूप गणितीय तर्क (long-form mathematical reasoning) में सात भारी संरचनात्मक पुनर्रचनाओं से बेहतर प्रदर्शन करता है, जो एक कठोर, पूर्व-पंजीकृत मूल्यांकन प्रोटोकॉल स्थापित करता है जो इस प्रदर्शन विषमता को प्रकट करता है।

Libo Sun, Po-wei Harn, Peixiong He, Xiao Qin2026-05-15
💬 NLP

Ideology Prediction of German Political Texts

यह शोध पत्र जर्मन ग्रंथों की राजनीतिक दिशा को निरंतर बाएं-से-दाएं स्पेक्ट्रम पर अनुमानित करने के लिए एक ट्रांसफार्मर-आधारित दृष्टिकोण प्रस्तावित करता है, जो चार अलग-अलग कॉर्पोरा पर प्रयोगों के माध्यम से यह प्रदर्शित करता है कि पूर्वाग्रह अनुमान में उच्च सटीकता प्राप्त करने के लिए मॉडल आर्किटेक्चर और डोमेन-विशिष्ट प्रशिक्षण डेटा, मॉडल के आकार जितने ही महत्वपूर्ण हैं।

Sinclair Schneider, Florian Steuber, Joao A. G. Schneider, Gabi Dreo Rodosek2026-05-15
💬 NLP

LLM-based Detection of Manipulative Political Narratives

यह शोध पत्र एक ऐसा कम्प्यूटेशनल फ्रेमवर्क प्रस्तुत करता है जो 1.2 मिलियन से अधिक सोशल मीडिया पोस्ट्स से पूर्व-निर्धारित श्रेणियों पर निर्भर रहे बिना, विशिष्ट हेरफेर वाली राजनीतिक विमर्शों (नैरेटिव्स) को प्रभावी ढंग से पहचानने और उन्हें संरचित करने के लिए फ़िल्टरिंग और अनसुपरवाइज्ड क्लस्टरिंग हेतु फ्यू-शॉट प्रॉम्प्टिंग को रीजनिंग मॉडल्स के साथ जोड़ता है।

Sinclair Schneider, Florian Steuber, Gabi Dreo Rodosek2026-05-15
💬 NLP

Herculean: An Agentic Benchmark for Financial Intelligence

यह शोध पत्र हर्कुलियन (Herculean) को प्रस्तुत करता है, जो वित्तीय बुद्धिमत्ता के लिए पहला एजेंटिक बेंचमार्क है जो मानकीकृत MCP-आधारित वातावरणों का उपयोग करके चार जटिल वर्कफ़्लो (ट्रेडिंग, हेजिंग, मार्केट इनसाइट्स और ऑडिटिंग) में AI एजेंटों का मूल्यांकन करता है, जिससे यह पता चलता है कि जहाँ एजेंट ट्रेडिंग और इनसाइट्स पर अच्छा प्रदर्शन करते हैं, वहीं वे हेजिंग और ऑडिटिंग के लिए आवश्यक दीर्घकालिक समन्वय (long-horizon coordination) और संरचित सत्यापन (structured verification) में काफी संघर्ष करते हैं।

Xueqing Peng, Zhuohan Xie, Yupeng Cao, Haohang Li, Lingfei Qian, Yan Wang, Vincent Jim Zhang, Huan He, Xuguang Ai, Linha (…)2026-05-15
💬 NLP

A Formative Study of Brief Affective Text as a Complement to Wearable Sensing for Longitudinal Student Health Monitoring

458 विश्वविद्यालय के छात्रों का यह एक वर्ष का अध्ययन यह प्रदर्शित करता है कि भावनात्मक चिंताओं को पकड़ने वाले अति-संक्षिप्त, मुक्त-अंत वाले टेक्स्ट प्रॉम्प्ट्स, पैसिव वियरेबल सेंसर डेटा की मनोवैज्ञानिक व्याख्यात्मकता को महत्वपूर्ण रूप से बढ़ाते हैं, जिससे यह पता चलता है कि विशिष्ट विषयों के बजाय भावात्मक भाषाई आयाम, नींद और शारीरिक गतिविधि के परिणामों के प्रमुख भविष्यवक्ता हैं।

Tamunotonye Harry, Johanna Hidalgo, Matthew Price, Yuanyuan Feng, Kathryn Stanton, Connie Tompkins, Peter Sheridan Dodds (…)2026-05-15
💬 NLP

Reinforcement Learning with Semantic Rewards Enables Low-Resource Language Expansion without Alignment Tax

यह शोध पत्र कम संसाधन वाली भाषाओं में बड़े भाषा मॉडलों (LLMs) के विस्तार के लिए सिमेंटिक रिवॉर्ड्स के साथ ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइजेशन (GRPO) का उपयोग करते हुए एक सुदृढीकरण शिक्षण (reinforcement learning) दृष्टिकोण प्रस्तावित करता है, जो सामान्य क्षमताओं और सिमेंटिक गुणवत्ता को बनाए रखते हुए सुपरवाइज्ड फाइन-ट्यूनिंग के कारण होने वाले "अलाइनमेंट टैक्स" और कैटास्ट्रोफिक फॉरगेटिंग को प्रभावी ढंग से कम करता है।

Zeli Su, Ziyin Zhang, Zhou Liu, Xuexian Song, Zhankai Xu, Longfei Zheng, Xiaolu Zhang, Rong Fu, Guixian Xu, Wentao Zhang2026-05-15
💬 NLP

Where Should Diffusion Enter a Language Model? Geometry-Guided Hidden-State Replacement

यह शोध पत्र DiHAL को प्रस्तुत करता है, जो एक ज्यामिति-निर्देशित हाइब्रिड मॉडल है जो निरंतर डिफ्यूजन लैंग्वेज मॉडल्स (continuous diffusion language models) में सुधार करता है, जिसमें हिडन-स्टेट पुनर्निर्माण (hidden-state reconstruction) के लिए डिफ्यूजन ब्रिज से बदलने हेतु प्रीट्रेन ट्रांसफॉर्मर्स के भीतर इष्टतम परतों की पहचान की जाती है, जिससे प्रत्यक्ष निरंतर-से-डिस्क्रीट टोकन रिकवरी से बचा जा सके और बेहतर प्रदर्शन प्राप्त किया जा सके।

Injin Kong, Hyoungjoon Lee, Yohan Jo2026-05-15
💬 NLP

Mitigating Data Scarcity in Psychological Defense Classification with Context-Aware Synthetic Augmentation

मनोवैज्ञानिक रक्षा तंत्र (psychological defense mechanism) वर्गीकरण में डेटा की कमी और वर्ग असंतुलन को संबोधित करने के लिए, यह शोध पत्र एक हाइब्रिड वर्गीकरण मॉडल के साथ संयुक्त एक संदर्भ-जागरूक सिंथेटिक संवर्धन ढांचा प्रस्तावित करता है जो साइडेफडिटेक्ट (PsyDefDetect) साझा कार्य में मौजूदा बेसलाइन से काफी बेहतर प्रदर्शन करने के लिए परिभाषा-निर्देशित पीढ़ी (definition-guided generation) का लाभ उठाता है।

Hoang-Thuy-Duong Vu, Quoc-Cuong Pham, Huy-Hieu Pham2026-05-15
💬 NLP

Nexus : An Agentic Framework for Time Series Forecasting

यह शोध पत्र नेक्सस (Nexus) का परिचय देता है, जो एक मल्टी-एजेंट फ्रेमवर्क है जो समय श्रृंखला पूर्वानुमान (time series forecasting) को विशिष्ट चरणों में विभाजित करता है ताकि असंरचित प्रासंगिक डेटा (unstructured contextual data) को संख्यात्मक पैटर्न के साथ प्रभावी ढंग से एकीकृत किया जा सके, जिससे वर्तमान एलएलएम (LLMs) पारदर्शी तर्क संबंधी निशान (reasoning traces) प्रदान करते हुए अत्याधुनिक मॉडलों के बराबर या उनसे बेहतर प्रदर्शन करने में सक्षम होते हैं।

Sarkar Snigdha Sarathi Das, Palash Goyal, Mihir Parmar, Nanyun Peng, Vishy Tirumalashetty, Chun-Liang Li, Rui Zhang, Jin (…)2026-05-15