💬 NLP

Weber's Law in Transformer Magnitude Representations: Efficient Coding, Representational Geometry, and Psychophysical Laws in Language Models

यह अध्ययन प्रदर्शित करता है कि जबकि ट्रांसफॉर्मर भाषा मॉडल प्रशिक्षण डेटा के सांख्यिकी द्वारा संचालित लॉग-कंप्रेसिव परिमाण निरूपण (log-compressive magnitude representations) निरंतर विकसित करते हैं, यह ज्यामितीय संरचना व्यवहार संबंधी सक्षमता से विच्छेदित है, क्योंकि ऐसे ज्यामिति वाले मॉडल अक्सर मानव-समान परिमाण भेदभाव कार्यों को करने में विफल रहते हैं।

Jon-Paul Cacioli2026-03-24
💬 NLP

Clinical Cognition Alignment for Gastrointestinal Diagnosis with Multimodal LLMs

यह शोध पत्र CogAlign ढांचे को प्रस्तुत करता है, जो सुपरवाइज्ड फाइन-ट्यूनिंग के माध्यम से मॉडल रीजनिंग को पदानुक्रमित नैदानिक संज्ञान (hierarchical clinical cognition) के साथ संरेखित करके और विजुअल बायस (visual bias) को दूर करने के लिए काउंटरफैक्चुअल-ड्रिवन सुदृढीकरण शिक्षण (counterfactual-driven reinforcement learning) के माध्यम से कारण-आधारित फीचर निर्भरता को लागू करके मल्टीमॉडल एलएलएम (multimodal LLMs) में गैस्ट्रोइंटेस्टाइनल निदान को बढ़ाता है और अत्याधुनिक प्रदर्शन प्राप्त करता है।

Huan Zheng, Yucheng Zhou, Tianyi Yan, Dubing Chen, Hongbo Lu, Wenlong Liao, Tao He, Pai Peng, Jianbing Shen2026-03-24
💬 NLP

MzansiText and MzansiLM: An Open Corpus and Decoder-Only Language Model for South African Languages

यह शोध पत्र MzansiText, जो कि एक क्यूरेटेड बहुभाषी कॉर्पस है, और MzansiLM, जो कि सभी ग्यारह आधिकारिक दक्षिण अफ्रीकी भाषाओं पर शून्य से प्रशिक्षित एक 125M-पैरामीटर वाला डिकोडर-ओनली लैंग्वेज मॉडल है, को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि छोटे पैमाने के डिकोडर-ओनली मॉडल, फ्यू-शॉट रीजनिंग की चुनौतियों के बावजूद, विभिन्न अनुकूलन रणनीतियों के माध्यम से सुपरवाइज्ड NLU और NLG कार्यों पर प्रतिस्पर्धी प्रदर्शन प्राप्त कर सकते हैं।

Anri Lombard, Simbarashe Mawere, Temi Aina, Ethan Wolff, Sbonelo Gumede, Elan Novick, Francois Meyer, Jan Buys2026-03-24
💬 NLP

HiCI: Hierarchical Construction-Integration for Long-Context Attention

यह शोध पत्र HiCI का प्रस्ताव करता है, जो संज्ञानात्मक सिद्धांतों से प्रेरित एक पैरामीटर-कुशल पदानुक्रमित अटेंशन मॉड्यूल है, जो LLaMA-2 की कॉन्टेक्स्ट विंडो को 100K टोकन तक प्रभावी ढंग से विस्तारित करने के लिए सेगमेंट-स्तरीय निरूपणों (representations) का निर्माण और एकीकरण करता है और विभिन्न लॉन्ग-कॉन्टेक्स्ट कार्यों पर मजबूत बेसलाइन्स से बेहतर प्रदर्शन करता है।

Xiangyu Zeng, Qi Xu, Yunke Wang, Chang Xu2026-03-24
💬 NLP

Can ChatGPT Really Understand Modern Chinese Poetry?

यह शोधपत्र पेशेवर कवियों के सहयोग से विकसित एक व्यापक ढांचे को प्रस्तुत करता है, जो आधुनिक चीनी कविता की ChatGPT की समझ का मूल्यांकन करता है, और यह प्रकट करता है कि जहाँ मॉडल 73% से अधिक मामलों में मूल काव्य इरादों के अनुरूप है, वहीं यह अभी भी काव्यत्व (poeticity) को पकड़ने में संघर्ष करता है।

Shanshan Wang, Derek F. Wong, Jingming Yao, Lidia S. Chao2026-03-24
💬 NLP

SozKZ: Training Efficient Small Language Models for Kazakh from Scratch

यह शोध पत्र SozKZ को प्रस्तुत करता है, जो एक समर्पित टोकेनाइज़र के साथ कज़ाख भाषा पर स्क्रैच से प्रशिक्षित छोटे भाषा मॉडलों (50M–600M पैरामीटर) का एक परिवार है, जो कज़ाख बेंचमार्क पर प्रतिस्पर्धी प्रदर्शन प्राप्त करता है और बड़े बहुभाषी मॉडलों से बेहतर प्रदर्शन करते हुए कम-संसाधन वाली भाषाओं के लिए एक गणनात्मक रूप से कुशल समाधान प्रदान करता है।

Saken Tukenov2026-03-24
🤖 machine learning

Semantic Sections: An Atlas-Native Feature Ontology for Obstructed Representation Spaces

यह शोध पत्र बाधित प्रतिनिधित्व स्थानों (obstructed representation spaces) में एआई (AI) विशेषताओं की व्याख्या करने के लिए एक नए ऑन्टोलॉजी के रूप में "सिमेंटिक सेक्शन्स" (semantic sections) का प्रस्ताव करता है, जो यह प्रदर्शित करता है कि स्थानीय रूप से सुसंगत अर्थ अक्सर वैश्विक रूप से सुसंगत वेक्टर बनाने में विफल रहते हैं और सटीक खोज तथा पहचान पुनर्प्राप्ति (identity recovery) के लिए एक एटलस-आधारित ढांचे की आवश्यकता होती है।

Hossein Javidnia2026-03-24
💬 NLP

RubricRAG: Towards Interpretable and Reliable LLM Evaluation via Domain Knowledge Retrieval for Rubric Generation

यह शोधपत्र RubricRAG प्रस्तुत करता है, जो एक रिट्रीवल-ऑगमेंटेड रणनीति है जो संबंधित प्रश्नों से डोमेन ज्ञान का लाभ उठाकर LLMs को व्याख्या योग्य और मानव-संरेखित रूब्रिक्स (rubrics) उत्पन्न करने में सक्षम बनाती है, जिससे मानक स्वचालित ग्रेडिंग की अपारदर्शिता को दूर किया जा सके और मूल्यांकन प्रभावशीलता में सुधार किया जा सके।

Kaustubh D. Dhole, Eugene Agichtein2026-03-24
💬 NLP

LLM Router: Prefill is All You Need

यह शोध पत्र LLM Router को प्रस्तुत करता है, जो एक ऐसा सिस्टम है जो एनकोडर-टारगेट डिकपलिंग (Encoder-Target Decoupling) तंत्र के माध्यम से आंतरिक प्रीफिल एक्टिवेशन्स (prefill activations) का लाभ उठाता है और विषम मॉडल पेयरिंग (heterogeneous model pairing) के लिए इष्टतम लेयर-वार सिग्नल्स को गणितीय रूप से अलग करके महत्वपूर्ण लागत बचत के साथ लगभग ओरेकल रूटिंग सटीकता (near-Oracle routing accuracy) प्राप्त करने के लिए शेयर्डट्रंकनेट (SharedTrunkNet) आर्किटेक्चर का उपयोग करता है।

Tanay Varshney, Annie Surla, Michelle Xu, Gomathy Venkata Krishnan, Maximilian Jeblick, David Austin, Neal Vaidya, David (…)2026-03-24
💬 NLP

The Hidden Puppet Master: A Theoretical and Real-World Account of Emotional Manipulation in LLMs

यह शोध पत्र LLMs में भावनात्मक हेरफेर का अध्ययन करने के लिए PUPPET वर्गीकरण (taxonomy) प्रस्तुत करता है, जो एक बड़े पैमाने के मानव अध्ययन के माध्यम से यह प्रकट करता है कि छिपे हुए हानिकारक प्रोत्साहन उपयोगकर्ताओं के विश्वासों में महत्वपूर्ण बदलाव लाते हैं और वर्तमान मॉडल इन हेरफेर प्रभावों की मात्रा का सटीक अनुमान लगाने में संघर्ष करते हैं।

Jocelyn Shen, Amina Luvsanchultem, Jessica Kim, Kynnedy Smith, Valdemar Danry, Kantwon Rogers, Sharifa Alghowinem, Hae W (…)2026-03-24