💬 NLP

A Gauge Theory of Superposition: Toward a Sheaf-Theoretic Atlas of Neural Representations

यह शोध पत्र वैश्विक शब्दकोशों (global dictionaries) के स्थान पर स्थानीय अर्थ संबंधी चार्टों (local semantic charts) का उपयोग करके, बड़े भाषा मॉडलों (large language models) में सुपरपोजिशन की व्याख्या करने के लिए एक शीफ-सैद्धांतिक गेज फ्रेमवर्क (sheaf-theoretic gauge framework) प्रस्तावित करता है, जिससे व्याख्यात्मकता (interpretability) की तीन विशिष्ट बाधाओं—लोकल जैमिंग (local jamming), प्रॉक्सी शीयरिंग (proxy shearing), और नॉनट्रिवियल होलोनोमी (nontrivial holonomy)—को परिमाणित किया जाता है और Llama-3.2-3B पर अनुभवजन्य प्रयोगों के माध्यम से इन सैद्धांतिक सीमाओं को मान्य किया जाता है।

Hossein Javidnia2026-03-17
🤖 machine learning

Translational Gaps in Graph Transformers for Longitudinal EHR Prediction: A Critical Appraisal of GT-BEHRT

यह शोध पत्र अनुदैर्ध्य (लॉन्गीटुडिनल) EHR भविष्यवाणी के लिए GT-BEHRT ग्राफ-ट्रांसफॉर्मर मॉडल का आलोचनात्मक मूल्यांकन करता है, जो इसके मजबूत विभेदक प्रदर्शन और वास्तुशिल्प संबंधी प्रगति को स्वीकार करते हुए उन महत्वपूर्ण रूपात्मक अंतराल (ट्रांसलेशनल गैप्स) को रेखांकित करता है जिन्हें नैदानिक ​​अपनाने से पहले अंशांकन (कैलिब्रेशन), निष्पक्षता और परिनियोजन व्यवहार्यता के संदर्भ में संबोधित किया जाना चाहिए।

Krish Tadigotla2026-03-17
💬 NLP

KazakhOCR: A Synthetic Benchmark for Evaluating Multimodal Models in Low-Resource Kazakh Script OCR

यह शोध पत्र KazakhOCR को प्रस्तुत करता है, जो अरबी, सिरिलिक और लैटिन रूपों में कम-संसाधन वाले कज़ाख लिपियों पर मल्टीमॉडल मॉडलों के मूल्यांकन के लिए एक सिंथेटिक बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स पारंपरिक OCR विधियों की तुलना में काफी खराब प्रदर्शन करते हैं, विशेष रूप से अरबी और लैटिन लिपियों को पहचानने और भाषा की सही पहचान करने में।

Henry Gagnier, Sophie Gagnier, Ashwin Kirubakaran2026-03-17
💬 NLP

Explain in Your Own Words: Improving Reasoning via Token-Selective Dual Knowledge Distillation

यह शोध पत्र टोकन-सिलेक्टिव ड्यूल नॉलेज डिस्टिलेशन (TSD-KD) प्रस्तुत करता है, जो एक छात्र-केंद्रित ढांचा है जो अप्रत्यक्ष प्राथमिकता-आधारित फीडबैक और चयनात्मक टोकन-स्तरीय वितरण मिलान को जोड़ता है ताकि छोटे मॉडलों को क्षमता संबंधी सीमाओं को पार करने और अत्याधुनिक रीजनिंग प्रदर्शन प्राप्त करने में मदद मिल सके, जो अक्सर उनके शिक्षक मॉडलों से भी बेहतर होता है।

Minsang Kim, Seung Jun Baek2026-03-17
💬 NLP

Tracing the Evolution of Word Embedding Techniques in Natural Language Processing

यह शोध पत्र 1954 से 2025 तक के 149 शोध लेखों का एक व्यापक पद्धतिगत समीक्षा और डेटा-संचालित बिब्लियोमेट्रिक विश्लेषण प्रस्तुत करता है, जो वर्ड एम्बेडिंग तकनीकों के विकास को रेखांकित करता है और संदर्भ-आधारित विधियों, बड़े सहयोग समूहों और नई उद्योग-संचालित अनुसंधान प्राथमिकताओं की ओर एक नाटकीय पोस्ट-जीपीटी-3 (post-GPT-3) प्रतिमान परिवर्तन (paradigm shift) को परिमाणित करता है।

Minh Anh Nguyen, Kuheli Sai, Minh Nguyen2026-03-17
🤖 machine learning

From Gradients to Riccati Geometry: Kalman World Models for Single-Pass Learning

यह शोधपत्र कलमन वर्ल्ड मॉडल्स (Kalman World Models) को प्रस्तुत करता है, जो एक ग्रेडिएंट-मुक्त ढांचा है जो स्टेट-स्पेस मॉडल्स और ट्रांसफॉर्मर्स के ऑनलाइन, सुदृढ़ प्रशिक्षण को सक्षम करने के लिए बैकप्रोपैगेशन को रिकर्सिव बायेसियन फ़िल्टरिंग और कलमन गेन एडाप्टेशन से बदल देता है, जो कंट्रोल थ्योरी पर आधारित है।

Andrew Kiruluta2026-03-17
🤖 machine learning

Resolving Interference (RI): Disentangling Models for Improved Model Merging

यह शोध पत्र रिज़ॉल्विंग इंटरफेरेंस (RI) का प्रस्ताव करता है, जो एक हल्का ढांचा (लाइटवेट फ्रेमवर्क) है जो अनलेबल सहायक डेटा का उपयोग करके विशेषज्ञ मॉडलों को कार्यात्मक रूप से ऑर्थोगोनल स्पेस में अलग करता है, जिससे क्रॉस-टास्क इंटरफेरेंस कम होता है और बिना किसी कार्य-विशिष्ट डेटा की आवश्यकता के मॉडल मर्जिंग के प्रदर्शन और सामान्यीकरण में महत्वपूर्ण सुधार होता है।

Pratik Ramesh, George Stoica, Arun Iyer, Leshem Choshen, Judy Hoffman2026-03-17
🤖 AI

The AI Fiction Paradox

यह शोध पत्र "AI-फिक्शन विरोधाभास" प्रस्तुत करता है, जिसमें यह तर्क दिया गया है कि वर्तमान AI मॉडल इस पर प्रशिक्षित होने के बावजूद प्रभावशाली कथा साहित्य उत्पन्न करने में संघर्ष करते हैं क्योंकि उनमें नैरेटिव कॉजेशन (कथात्मक कारणता), सूचना के पूर्वव्यापी पुनर्मूल्यांकन और बहु-स्तरीय भावनात्मक संरचना को संभालने की क्षमता का अभाव है, जो इस बात की चिंता पैदा करता है कि इन पैटर्नों में महारत हासिल करना बड़े पैमाने पर मानव हेरफेर को सक्षम कर सकता है।

Katherine Elkins2026-03-17
📊 statistics

Holographic Invariant Storage: Design-Time Safety Contracts via Vector Symbolic Architectures

यह शोध पत्र होलोग्राफिक इनवेरिएंट स्टोरेज (HIS) को प्रस्तुत करता है, जो वेक्टर सिम्बोलिक आर्किटेक्चर का लाभ उठाते हुए LLM कॉन्टेक्स्ट-ड्रिफ्ट न्यूनीकरण के लिए क्लोज्ड-फॉर्म, डिज़ाइन-टाइम सुरक्षा गारंटी प्रदान करने के लिए एक प्रोटोकॉल है, जिसमें रिकवरी फिडेलिटी, नॉइज़ रोबस्टनेस और क्षमता पर विशिष्ट सीमाएं शामिल हैं, जिन्हें सिमुलेशन और व्यवहार संबंधी प्रयोगों के माध्यम से मान्य किया गया है।

Arsenios Scrivens2026-03-17
🤖 machine learning

BERTology of Molecular Property Prediction

यह शोध पत्र सैकड़ों नियंत्रित प्रयोगों के माध्यम से डेटासेट के आकार, मॉडल के आकार और मानकीकरण के प्रभावों का विश्लेषण करके आणविक गुण भविष्यवाणी में केमिकल लैंग्वेज मॉडल्स (CLMs) के असंगत प्रदर्शन की व्यवस्थित रूप से जांच करता है, जिसका उद्देश्य व्यापक संख्यात्मक साक्ष्य प्रदान करना और उन अंतर्निहित तंत्रों को स्पष्ट करना है जिन्हें मौजूदा साहित्य में अक्सर अनदेखा कर दिया जाता है।

Mohammad Mostafanejad, Paul Saxe, T. Daniel Crawford2026-03-17