🤖 machine learning

Bias Is a Subspace, Not a Coordinate: A Geometric Rethinking of Post-hoc Debiasing in Vision-Language Models

यह शोध पत्र सबस्पेस प्रोजेक्शन डिबायसिंग (SPD) को प्रस्तुत करता है, जो एक ज्यामितीय ढांचा है जो मौजूदा कोऑर्डिनेट-वाइज पोस्ट-हॉक विधियों में सुधार करता है, क्योंकि यह पूर्वाग्रह को अलग-थलग निर्देशांकों के बजाय एक वितरित रैखिक उप-स्थान (डिस्ट्रिब्यूटेड लीनियर सबस्पेस) के रूप में पहचानता है और उसे हटाता है, जिससे विजन-लैंग्वेज मॉडल्स में न्यूनतम प्रदर्शन हानि के साथ काफी बेहतर निष्पक्षता प्राप्त होती है।

Dachuan Zhao, Weiyue Li, Zhenda Shen, Yushu Qiu, Bowen Xu, Haoyu Chen, Yongchao Chen2026-04-03
🤖 machine learning

Semantic Refinement with LLMs for Graph Representations

यह शोध पत्र ग्राफ-एक्सेम्पलर-गाइडेड सिमेंटिक रिफाइनमेंट (GES) फ्रेमवर्क का प्रस्ताव करता है, जो एक डेटा-केंद्रित दृष्टिकोण है जो विभिन्न ग्राफ डोमेन में संरचना-अर्थ विषमता (structure-semantics heterogeneity) की चुनौती को संबोधित करने के लिए, बड़े भाषा मॉडलों (Large Language Models) को नोड विवरणों को अनुकूल रूप से परिष्कृत करने में मार्गदर्शन करने हेतु संरचनात्मक और अर्थपूर्ण रूप से समान इन-ग्राफ नोड्स का लाभ उठाता है।

Safal Thapaliya, Zehong Wang, Jiazheng Li, Ziming Li, Yanfang Ye, Chuxu Zhang2026-04-03
💬 NLP

Language Steering for Multilingual In-Context Learning

यह शोध पत्र प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल्स में कंप्यूटेड "लैंग्वेज वेक्टर्स" को एक्टिवेशन ऑफसेट्स के रूप में जोड़ने से उनके आंतरिक निरूपण (इंटरनल रिप्रेजेंटेशन्स) को मल्टीलिंगुअल इन-कॉन्टेक्स्ट लर्निंग के लिए लक्षित भाषाओं की ओर प्रभावी ढंग से पुनर्निर्देशित किया जा सकता है, जिससे कार्यों और भाषाओं में सुसंगत प्रदर्शन सुधार प्राप्त होता है और यह भी प्रकट होता है कि भाषा की पहचान मॉडल के एक्टिवेशन स्पेस में पृथक, संरचित दिशाओं में स्थित होती है।

Neeraja Kirtane, Kuan-Hao Huang2026-04-03
💻 computer science

Towards Distillation-Resistant Large Language Models: An Information-Theoretic Perspective

यह शोध पत्र शिक्षक लॉजिट्स (teacher logits) और इनपुट क्वेरीज़ के बीच कंडीशनल म्यूचुअल इंफॉर्मेशन (conditional mutual information) को न्यूनतम करके, लॉजिट-आधारित मॉडल डिस्टिलेशन (logit-based model distillation) के विरुद्ध एक सूचना-सैद्धांतिक रक्षा प्रस्तावित करता है, जो उनकी कार्य उपयोगिता (task utility) को बनाए रखते हुए प्रोप्रायटरी एलएलएम (proprietary LLMs) को ज्ञान निष्कर्षण (knowledge extraction) से प्रभावी रूप से सुरक्षित करता है।

Hao Fang, Tianyi Zhang, Tianqu Zhuang, Jiawei Kong, Kuofeng Gao, Bin Chen, Leqi Liang, Shu-Tao Xia, Ke Xu2026-04-03
💬 NLP

Semantic Shifts of Psychological Concepts in Scientific and Popular Media Discourse: A Distributional Semantics Analysis of Russian-Language Corpora

यह अध्ययन रूसी भाषा के कॉर्पोरा (corpus) का विश्लेषण करने के लिए वितरण संबंधी अर्थविज्ञान (distributional semantics) का उपयोग करता है, जो यह प्रकट करता है कि बर्नआउट और अवसाद जैसी मनोवैज्ञानिक अवधारणाओं में लोकप्रिय मीडिया में महत्वपूर्ण अर्थ संबंधी परिवर्तन होते हैं, जहाँ उन्हें वैज्ञानिक विमर्श में पाए जाने वाले सटीक पद्धतिगत और नैदानिक शब्दावली के बजाय व्यक्तिगत आख्यानों और रोजमर्रा के अनुभवों के माध्यम से प्रस्तुत किया जाता है।

Orlova Anastasia2026-04-03
💬 NLP

Phonological Fossils: Machine Learning Detection of Non-Mainstream Vocabulary in Sulawesi Basic Lexicon

यह अध्ययन सुलावेसी भाषाओं में गैर-मुख्यधारा की शब्दावली को संभावित प्री-ऑस्ट्रोनेशियन सबस्ट्रेट्स के रूप में पहचानने के लिए मशीन लर्निंग का उपयोग करता है, जो विशिष्ट ध्वन्यात्मक पैटर्न को प्रकट करता है लेकिन सुसंगत शब्द परिवारों की कमी के कारण एक एकल साझा सबस्ट्रेट भाषा के साक्ष्य नहीं पाता है।

Mukhlis Amien, Go Frendi Gunawan2026-04-03
💬 NLP

Hierarchical Chain-of-Thought Prompting: Enhancing LLM Reasoning Performance and Efficiency

यह शोध पत्र पदानुक्रमित चेन-ऑफ-थॉट (Hi-CoT) को प्रस्तुत करता है, जो एक संरचित प्रॉम्प्टिंग प्रतिमान है जो तर्क को वैकल्पिक नियोजन और निष्पादन उप-चरणों में विभाजित करता है, जिससे विभिन्न बड़े भाषा मॉडलों और गणितीय बेंचमार्क पर पारंपरिक चेन-ऑफ-थॉट विधियों की तुलना में सटीकता और दक्षता दोनों में महत्वपूर्ण सुधार प्राप्त होता है।

Xingshuai Huang, Derek Li, Bahareh Nikpour, Parsa Omidi2026-04-03
💬 NLP

Polish phonology and morphology through the lens of distributional semantics

यह अध्ययन प्रदर्शित करता है कि पोलिश शब्दों के वितरण संबंधी अर्थगत सदिश (distributional semantic vectors) स्वाभाविक रूप से उप-शब्दकोशीय ध्वन्यात्मक और रूपात्मक जानकारी को समाहित करते हैं, जो रूप-आधारित भाषाई विशेषताओं की सटीक भविष्यवाणी करने में सक्षम हैं और इस दृष्टिकोण का समर्थन करते हैं कि अर्थगत स्थान संरचनात्मक रूप स्थान के साथ समरूपी (isomorphic) है।

Paula Orzechowska, R. Harald Baayen2026-04-03
💬 NLP

Do LLMs Know What Is Private Internally? Probing and Steering Contextual Privacy Norms in Large Language Model Representations

यह शोध पत्र प्रदर्शित करता है कि बड़े भाषा मॉडल (large language models) आंतरिक रूप से प्रासंगिक गोपनीयता मानदंडों को विशिष्ट, रैखिक रूप से विभाज्य निरूपणों (linearly separable representations) के रूप में कूटबद्ध करते हैं, फिर भी इन अंतर्निहित अवधारणाओं और व्यवहार के बीच एक मिसअलाइनमेंट (misalignment) के कारण उन पर कार्य करने में विफल रहते हैं, एक ऐसा अंतराल जिसे संरचित CI-पैरामीट्रिक स्टीयरिंग (CI-parametric steering) के माध्यम से प्रभावी ढंग से पाटा जा सकता है।

Haoran Wang, Li Xiong, Kai Shu2026-04-03
💬 NLP

Do Language Models Know When They'll Refuse? Probing Introspective Awareness of Safety Boundaries

यह अध्ययन चार फ्रंटियर भाषा मॉडलों की उनकी सुरक्षा अस्वीकृति सीमाओं (safety refusal boundaries) के संबंध में आत्मनिरीक्षण जागरूकता का मूल्यांकन करता है, जिसमें यह पाया गया है कि हालांकि वे सामान्य रूप से अस्वीकृतियों का पूर्वानुमान लगाने के लिए उच्च संवेदनशीलता रखते हैं, लेकिन प्रदर्शन मॉडल और विषय के अनुसार भिन्न होता है, जिसमें कॉन्फिडेंस स्कोर (confidence scores) सुरक्षा-महत्वपूर्ण प्रश्नों को रूट करने के लिए एक व्यावहारिक तंत्र प्रदान करते हैं।

Tanay Gondil2026-04-03