💬 NLP

Prism-Δ\Delta: Differential Subspace Steering for Prompt Highlighting in Large Language Models

PRISM-Δ\Delta एक नवीन प्रॉम्प्ट हाइलाइटिंग विधि है जो विभेदक संकेतों को अलग करने और साझा पैटर्न को समाप्त करने के लिए क्रॉस-कोवेरिएंस मैट्रिसेस (cross-covariance matrices) को विघटित करके लार्ज लैंग्वेज मॉडल्स को निर्देशित करती है, जिससे कम कम्प्यूटेशनल ओवरहेड बनाए रखते हुए कई बेंचमार्क और लॉन्ग-कॉन्टेक्स्ट कार्यों में उत्कृष्ट प्रदर्शन प्राप्त होता है।

Yuyao Ge, Shenghua Liu, Yiwei Wang, Tianyu Liu, Baolong Bi, Lingrui Mei, Jiayu Yao, Jiafeng Guo, Xueqi Cheng2026-03-12
💬 NLP

Word Recovery in Large Language Models Enables Character-Level Tokenization Robustness

यह शोध पत्र यह प्रकट करता है कि बड़े भाषा मॉडल (large language models) एक "शब्द पुनर्प्राप्ति" (word recovery) तंत्र के माध्यम से कैरेक्टर-स्तरीय टोकनाइज़ेशन (character-level tokenization) के प्रति मजबूती बनाए रखते हैं, जहाँ हिडन स्टेट्स (hidden states) एक ही टोकन से संबंधित कैरेक्टर्स के बीच महत्वपूर्ण इन-ग्रुप अटेंशन (in-group attention) के माध्यम से मानक शब्द पहचान (canonical word identities) को पुनर्गठित करते हैं।

Zhipeng Yang, Shu Yang, Lijie Hu, Di Wang2026-03-12
💬 NLP

Large Language Models as Annotators for Machine Translation Quality Estimation

यह शोध पत्र एक विशेष प्रॉम्प्ट (PPbMQM) के माध्यम से सरलीकृत MQM-शैली के एनोटेशन उत्पन्न करने के लिए GPT-4o का उपयोग करने का प्रस्ताव करता है ताकि एक COMET मॉडल को प्रशिक्षित किया जा सके, जिससे बड़े भाषा मॉडलों (LLMs) को सीधे लागू करने की उच्च अनुमान लागतों को कम करते हुए प्रतिस्पर्धी मशीन अनुवाद गुणवत्ता अनुमान प्रदर्शन प्राप्त किया जा सके।

Sidi Wang, Sophie Arnoult, Amir Kamran2026-03-12
💬 NLP

LuxBorrow: From Pompier to Pompjee, Tracing Borrowing in Luxembourgish

यह शोध पत्र LuxBorrow प्रस्तुत करता है, जो 1999 से 2025 तक के लक्ज़मबर्गिश समाचारों का एक व्यापक कॉर्पस-आधारित विश्लेषण है जो फ्रांसीसी ऋणशब्दों और रूपात्मक अनुकूलनों द्वारा प्रधान बहुभाषी मिश्रण को प्रकट करता है, और दस्तावेज़-स्तर के कोड-मिक्सिंग मेट्रिक्स से टोकन-स्तर के उधार लेने वाले मूल्यांकन की ओर बदलाव की वकालत करता है।

Nina Hosseini-Kivanani, Fred Philippy2026-03-12
💬 NLP

PivotAttack: Rethinking the Search Trajectory in Hard-Label Text Attacks via Pivot Words

PivotAttack एक क्वेरी-कुशल, "इनसाइड-आउट" फ्रेमवर्क पेश करता है जो हार्ड-लेबल टेक्स्ट हमलों के लिए मल्टी-आर्म्ड बैंडिट एल्गोरिदम का लाभ उठाकर परस्पर निर्भर टोकन के रणनीतिक "पिवट सेट्स" की पहचान करता है, जिससे यह विभिन्न मॉडलों में अटैक सक्सेस रेट और क्वेरी दक्षता दोनों में मौजूदा स्टेट-ऑफ-द-आर्ट विधियों से बेहतर प्रदर्शन करता है।

Yuzhi Liang, Shiliang Xiao, Jingsong Wei, Qiliang Lin, Xia Li2026-03-12
💬 NLP

From Images to Words: Efficient Cross-Modal Knowledge Distillation to Language Models from Black-box Teachers

यह शोध पत्र ARMADA को प्रस्तुत करता है, जो एक कुशल क्रॉस-मोडल नॉलेज डिस्टिलेशन फ्रेमवर्क है जो बड़े, संभावित रूप से ब्लैक-बॉक्स विजन-लैंग्वेज मॉडल्स से ज्ञान को बिना टीचर प्री-ट्रेनिंग या आंतरिक एक्सेस की आवश्यकता के केवल भाषा-आधारित मॉडल्स में स्थानांतरित करता है, जिससे विविध प्राकृतिक भाषा कार्यों में प्रदर्शन में महत्वपूर्ण सुधार होता है।

Ayan Sengupta, Shantanu Dixit, Md Shad Akhtar, Tanmoy Chakraborty2026-03-12
💬 NLP

GLM-OCR Technical Report

GLM-OCR एक संक्षिप्त 0.9B-पैरामीटर वाला मल्टीमॉडल मॉडल है जो वास्तविक दुनिया के दस्तावेज़ समझ संबंधी कार्यों में अत्याधुनिक दक्षता और प्रदर्शन प्राप्त करने के लिए मल्टी-टोकन प्रेडिक्शन मैकेनिज्म और एक टू-स्टेज पाइपलाइन का लाभ उठाता है, जो इसे एज और बड़े पैमाने पर परिनियोजन दोनों के लिए उपयुक्त बनाता है।

Shuaiqi Duan, Yadong Xue, Weihan Wang, Zhe Su, Huan Liu, Sheng Yang, Guobing Gan, Guo Wang, Zihan Wang, Shengdong Yan, D (…)2026-03-12
💬 NLP

LLM2Vec-Gen: Generative Embeddings from Large Language Models

LLM2Vec-Gen एक नवीन स्व-पर्यवेक्षित (self-supervised) ढांचे को पेश करता है जो विशेष टोकन को एक LLM की संभावित प्रतिक्रियाओं का प्रतिनिधित्व करने के लिए प्रशिक्षित करके उच्च-गुणवत्ता वाले, व्याख्या योग्य टेक्स्ट एम्बेडिंग उत्पन्न करता है, जिससे बिना किसी लेबल वाले डेटा या फ्रोजन बैकबोन की आवश्यकता के सुरक्षा और तर्क क्षमताओं को स्थानांतरित करते हुए MTEB पर अत्याधुनिक प्रदर्शन प्राप्त किया जाता है।

Parishad BehnamGhader, Vaibhav Adlakha, Fabian David Schmidt, Nicolas Chapados, Marius Mosbach, Siva Reddy2026-03-12
💬 NLP

COMIC: Agentic Sketch Comedy Generation

यह शोध पत्र COMIC प्रस्तुत करता है, जो एक पूर्णतः स्वचालित AI प्रणाली है जो विशेष भूमिकाओं वाले मल्टी-एजेंट फ्रेमवर्क और पेशेवर मानकों की ओर सामग्री को बार-बार परिष्कृत करने के लिए YouTube डेटा पर प्रशिक्षित LLM-आधारित आलोचकों का उपयोग करके उच्च-गुणवत्ता वाले, विविध हास्य स्केच वीडियो उत्पन्न करती है।

Susung Hong, Brian Curless, Ira Kemelmacher-Shlizerman, Steve Seitz2026-03-12
💬 NLP

Markovian Transformers for Informative Language Modeling

यह शोध पत्र मार्कोवियन ट्रांसफॉर्मर्स (Markovian Transformers) प्रस्तुत करता है, जो एक ऐसा ढांचा है जो सीमित-लंबाई वाले चेन-ऑफ-थॉट (Chain-of-Thought) तर्क के माध्यम से एक सख्त सूचना बाधा (information bottleneck) लागू करता है, जो भाषा मॉडलों को केवल स्पष्ट प्राकृतिक-भाषा चरणों से उत्तर प्राप्त करने के लिए बाध्य करता है और साथ ही गैर-मार्कोवियन वेरिएंट के समान प्रदर्शन प्राप्त करते हुए उनकी तर्क प्रक्रियाओं में मजबूत कारण निर्भरता (causal reliance) और सामान्यीकरण प्रदर्शित करता है।

Scott Viteri, Max Lamparth, Peter Chatain, Clark Barrett2026-03-11