💬 NLP

Sparse Feature Coactivation Reveals Causal Semantic Modules in Large Language Models

यह शोध पत्र यह प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल्स में स्पार्स ऑटोएन्कोडर फीचर्स के सह-सक्रियण (coactivation) का विश्लेषण करने से अवधारणाओं और संबंधों के लिए अर्थपूर्ण रूप से सुसंगत, संदर्भ-संगत कारण मॉड्यूल (causal modules) प्रकट होते हैं, जो घटक एब्लेशन (ablation) और प्रवर्धन (amplification) के माध्यम से मॉडल आउटपुट के पूर्वानुमानित और लक्षित हेरफेर को सक्षम करते हैं।

Ruixuan Deng, Xiaoyang Hu, Miles Gilberti, Shane Storks, Aman Taxali, Mike Angstadt, Chandra Sripada, Joyce Chai2026-04-21
💬 NLP

On the Predictive Power of Representation Dispersion in Language Models

यह शोध पत्र यह प्रदर्शित करता है कि रिप्रेजेंटेशन डिस्पर्सन (representation dispersion)—जो हिडन वेक्टर्स के बीच औसत पेयरवाइज कोसाइन डिस्टेंस है—विविध लैंग्वेज मॉडल्स और डोमेन में परप्लेक्सिटी (perplexity) के साथ दृढ़ता से और नकारात्मक रूप से सह-संबंधित है, जो अनलेबल डेटा डिफिकल्टी रैंकिंग, रिट्रीवल-आधारित विधियों के लिए इष्टतम लेयर चयन, और एक "पुश-अवे" (push-away) ट्रेनिंग ऑब्जेक्टिव के माध्यम से प्रत्यक्ष परप्लेक्सिटी सुधार जैसे व्यावहारिक अनुप्रयोगों को सक्षम बनाता है।

Yanhong Li, Ming Li, Karen Livescu, Jiawei Zhou2026-04-21
💬 NLP

Lizard: An Efficient Linearization Framework for Large Language Models

Lizard एक नवीन लिनियराइजेशन फ्रेमवर्क है जो प्रीडोन्ड ट्रांसफॉर्मर-आधारित LLMs को एडेप्टिव, लर्नबल मॉड्यूल्स और एक हार्डवेयर-अवेयर एल्गोरिदम का उपयोग करके सबक्वाड्रेटिक आर्किटेक्चर में बदल देता है ताकि क्वाड्रेटिक कॉम्प्लेक्सिटी बॉटलनैक्स को दूर करते हुए पूर्ववर्ती विधियों की तुलना में नियर-लॉसलेस परफॉरमेंस रिकवरी और बेहतर लेंथ जनरलाइजेशन प्राप्त किया जा सके।

Chien Van Nguyen, Huy Nguyen, Ruiyi Zhang, Hanieh Deilamsalehy, Puneet Mathur, Viet Dac Lai, Haoliang Wang, Jayakumar Su (…)2026-04-21
💬 NLP

MetaLint: Easy-to-Hard Generalization for Code Linting

MetaLint एक मेटा-लर्निंग फ्रेमवर्क है जो कोड लिन्टिंग को एक निर्देश-अनुसरण (instruction-following) कार्य के रूप में पुनर्गठित करता है, जिससे सिंथेटिक डेटा पर प्रशिक्षित मॉडल बिना पुनरप्रशिक्षण के, सरल, नियम-आधारित उल्लंघनों से जटिल, संदर्भ-निर्भर सर्वोत्तम प्रथाओं तक सामान्यीकरण करने में सक्षम होते हैं, जैसा कि एक नए मानव-क्यूरेटेड बेंचमार्क पर महत्वपूर्ण प्रदर्शन लाभ द्वारा प्रदर्शित किया गया है।

Atharva Naik, Lawanya Baghel, Dhakshin Govindarajan, Darsh Agrawal, Yiqing Xie, Daniel Fried, Carolyn Rose2026-04-21
💬 NLP

Synthia: Scalable Grounded Persona Generation from Social Media Data

यह शोध पत्र सिंथिया (Synthia) को प्रस्तुत करता है, जो एक स्केलेबल फ्रेमवर्क है जो वास्तविक ब्लूस्काई (Bluesky) सोशल मीडिया डेटा और इंटरेक्शन ग्राफ्स पर आधारित उच्च-गुणवत्ता वाले, न्यायसंगत आभासी व्यक्तित्व (virtual personas) उत्पन्न करता है, जो छोटे भाषा मॉडलों का उपयोग करते हुए भी पूर्ववर्ती अत्याधुनिक विधियों की तुलना में मानवीय राय वितरण और निष्पक्षता के साथ बेहतर संरेखण प्रदर्शित करता है।

Vahid Rahimzadeh, Erfan Moosavi Monazzah, Mohammad Taher Pilehvar, Yadollah Yaghoobzadeh2026-04-21
💬 NLP

Cognitive Chain-of-Thought (CoCoT): Structured Multimodal Reasoning about Social Situations

यह शोधपत्र कॉग्निटिव चेन-ऑफ-थॉट (CoCoT) को प्रस्तुत करता है, जो एक संरचित तर्क ढांचा है जो मल्टीमॉडल सामाजिक कार्यों को धारणा (perception), स्थिति (situation) और मानदंड (norm) चरणों में विभाजित करता है, और निरंतर प्रदर्शन सुधार तथा सुपरवाइज्ड फाइन-ट्यूनिंग के माध्यम से संरचित तर्क पैटर्न को आत्मसात करने की क्षमता प्रदर्शित करता है।

Eunkyu Park, Wesley Hanwen Deng, Gunhee Kim, Motahhare Eslami, Maarten Sap2026-04-21
💬 NLP

Culinary Crossroads: A RAG Framework for Enhancing Diversity in Cross-Cultural Recipe Adaptation

यह शोध पत्र CARRIAGE को प्रस्तुत करता है, जो एक नवीन रिट्रीवल ऑगमेंटेड जनरेशन (Retrieval Augmented Generation) फ्रेमवर्क है जो क्रॉस-कल्चरल रेसिपी अनुकूलन में मानक RAG सिस्टम की एकरूप आउटपुट उत्पन्न करने की प्रवृत्ति को संबोधित करता है, और यह गुणवत्ता बनाए रखते हुए विविध उपयोगकर्ता प्राथमिकताओं को बेहतर ढंग से समायोजित करने के लिए रिट्रीवल और संदर्भ संगठन दोनों में स्पष्ट रूप से विविधता को बढ़ाता है।

Tianyi Hu, Andrea Morales-Garzón, Jingyi Zheng, Maria Maistro, Daniel Hershcovich2026-04-21
💬 NLP

PrinciplismQA: A Philosophy-Grounded Approach to Assessing LLM-Human Clinical Medical Ethics Alignment

यह शोध पत्र 'प्रिंसिपलिज्मक्यूए' (PrinciplismQA) का परिचय देता है, जो कि 3,648 विशेषज्ञ-सत्यापित प्रश्नों वाला एक दर्शन-आधारित बेंचमार्क है, जो चिकित्सा एलएलएम (LLMs) की उच्च ज्ञान सटीकता के बावजूद उनकी नैतिक तर्क क्षमताओं में महत्वपूर्ण अंतराल को प्रकट करता है, जिससे नैदानिक एआई (clinical AI) तैनाती की तत्परता का आकलन करने के लिए एक व्यवस्थित उपकरण प्राप्त होता है।

Chang Hong, Minghao Wu, Qingying Xiao, Yuchi Wang, Xiang Wan, Guangjun Yu, Benyou Wang, Yan Hu2026-04-21
💬 NLP

ToxiFrench: Benchmarking and Enhancing Language Models via CoT Fine-Tuning for French Toxicity Detection

यह शोध पत्र ToxiFrench का परिचय देता है, जो एक अर्ध-स्वचालित पाइपलाइन के माध्यम से निर्मित एक बड़े पैमाने का फ्रांसीसी विषाक्तता (toxicity) डेटासेट है, और यह प्रदर्शित करता है कि एक नवीन चेन-ऑफ-थॉट (Chain-of-Thought) रणनीति और डायनेमिक वेटेड लॉस (Dynamic Weighted Loss) के साथ फाइन-ट्यून किया गया 4B पैरामीटर वाला मॉडल, फ्रांसीसी विषाक्त सामग्री का पता लगाने में बड़े मॉडलों और अत्याधुनिक प्रणालियों से बेहतर प्रदर्शन करता है।

Axel Delaval, Shujian Yang, Haicheng Wang, Han Qiu, Jialiang Lu2026-04-21
💬 NLP

Bridging the Culture Gap: A Framework for LLM-Driven Socio-Cultural Localization of Math Word Problems in Low-Resource Languages

यह शोध पत्र एक LLM-संचालित ढांचे को प्रस्तुत करता है जो अंग्रेजी-केंद्रित संस्थाओं को सांस्कृतिक रूप से प्रासंगिक स्थानीय नामों, संगठनों और मुद्राओं से बदलकर कम-संसाधन वाली भाषाओं में गणितीय शब्द समस्याओं को स्वचालित रूप से स्थानीयकृत करता है, जिससे डेटासेट की कमी को दूर किया जा सके और बहुभाषी गणितीय तर्क की मजबूती में सुधार किया जा सके।

Israel Abebe Azime, Tadesse Destaw Belay, Dietrich Klakow, Philipp Slusallek, Anshuman Chhabra2026-04-21