🤖 machine learning

Polymorphism Is Rotation: Operational Mechanistic Interpretability from a Two-Layer Transformer to Pythia-70m

यह शोध पत्र यह प्रदर्शित करता है कि स्वतंत्र रूप से प्रशिक्षित ट्रांसफॉर्मर एक समान यादृच्छिक घूर्णन (uniform random rotation) द्वारा संबंधित परस्पर अविबोध्य आंतरिक निर्देशांकों का उपयोग करके समान फलनों की गणना करते हैं, जिसे "पॉलीमॉर्फिज्म" (polymorphism) नामक एक घटना कहा जाता है जिसे बिना पुनप्रशिक्षण के फीचर डिक्शनरी और स्टीयरिंग वेक्टर्स के प्रत्यक्ष हस्तांतरण को सक्षम करने के लिए एक एकल ऑर्थोगोनल प्रोक्रस्टेस फिट (orthogonal Procrustes fit) के माध्यम से हल किया जा सकता है।

Jordan F. McCann2026-05-26
🤖 machine learning

LAPLEX: The FFT of Learnable Laplace Kernels

LAPLEX सटीक, प्रशिक्षित लाप्लास-कर्नेल ऑपरेटरों की एक श्रेणी पेश करता है जो डेटा-अनुकूली वैश्विक इंटरैक्शन और उच्च-आयामी सहप्रसरण मॉडलिंग को सक्षम करने के लिए FFT-समान स्केलिंग प्राप्त करते हैं, जो घने मैट्रिक्स (dense matrices) की भंडारण लागत के बिना, प्रभावी रूप से अभिव्यंजना (expressivity) को मेमोरी आवश्यकताओं से अलग करता है।

Łukasz Struski, Hanna Blazhko, Piotr Kubaty, Jacek Tabor2026-05-26
🤖 AI

Hera: Learning Long-Horizon Coordination for Device-Cloud Collaborative LLM Agents

Hera एक नवीन स्टेप-लेवल डिवाइस-क्लाउड समन्वयक है जो लॉन्ग-होरिज़न LLM एजेंटों के लिए है, जो कार्य सफलता और कम्प्यूटेशनल लागत के बीच संतुलन को अनुकूलित करने के लिए इमिटेशन लर्निंग और कॉस्ट-अवेयर रीइन्फोर्समेंट लर्निंग के दो-चरणीय प्रशिक्षण प्रतिमान का उपयोग करता है, जिससे क्लाउड के उपयोग में उल्लेखनीय कमी के साथ क्लाउड-ओनली प्रदर्शन के करीब प्रदर्शन प्राप्त होता है।

Yuxin Zhang, Mengxue Hu, Zheng Lin, Xiaoyi Fan, Fan Xie, Zihan Fang, Jing Yang, Wenjun Zhu, Zhiwen Chen, Chengfei Lv, Zh (…)2026-05-26
💻 computer science

Correcting Visual Blur Induced by Attention Distraction to Reduce Hallucinations: Algorithm and Theory

यह शोध पत्र AFIP पद्धति का प्रस्ताव करता है, जो मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स में ऑब्जेक्ट हैलुसिनेशन (वस्तु संबंधी भ्रम) को कम करने के लिए उन्हें सैद्धांतिक रूप से अटेंशन डिस्ट्रैक्शन (ध्यान भटकाव) से जोड़ता है और बिना किसी अतिरिक्त प्रशिक्षण की आवश्यकता के क्रॉस-हेड अटेंशन एनरिचमेंट और डायनेमिक हिस्टोरिकल अटेंशन एनहांसमेंट के माध्यम से इस समस्या का समाधान करता है।

Quanjiang Li, Zhiming Liu, Wei Luo, Tingjin Luo, Chenping Hou2026-05-26
🤖 AI

Lattice theory and algebraic models for deep convolutional learning based on mathematical morphology

यह शोध पत्र डीप कनवल्शनल नेटवर्क का विश्लेषण करने के लिए लैटिस थ्योरी और मैथमेटिकल मॉर्फोलॉजी पर आधारित एक कठोर बीजगणितीय ढांचे को स्थापित करता है, जो यह प्रकट करता है कि मानक सीएनएन (CNN) परतें गैर-इडम्पोटेंट क्रॉस-लैटिस ऑपरेटर बनाती हैं जो गहराई की प्रतिनिधित्व शक्ति की व्याख्या करती हैं, और साथ ही तीन वास्तविक इडम्पोटेंट मॉर्फोलॉजिकल लेयर डिज़ाइनों का प्रस्ताव और लक्षण वर्णन करता है तथा विभिन्न पूलिंग और पिरामिड तकनीकों को एक एकीकृत एडजॉइंट थ्योरी के तहत एकीकृत करता है।

Gustavo (Jesus), Angulo2026-05-26
💻 computer science

Phase-Aware Wavelet-Based-Scattering Encoder-Decoder for Dense Predictions

यह शोध पत्र एक फेज़-अवेयर स्कैटरिंग एनकोडर-डिकोडर का प्रस्ताव करता है जो स्किप कनेक्शन्स में फेज़ जानकारी को स्पष्ट रूप से संरक्षित करके इमेज डिनोइजिंग और स्किन लीजन सेगमेंटेशन जैसे डेंस प्रेडिक्शन कार्यों को बढ़ाता है, जिससे पारंपरिक स्कैटरिंग ट्रांसफॉर्म्स में खोई हुई स्थानिक संरचना को पुनर्स्थापित किया जाता है और प्रदर्शन मेट्रिक्स में महत्वपूर्ण सुधार होता है।

Ghassen Marrakchi, Basarab Matei2026-05-26
🤖 machine learning

Beyond Generative Priors: Minority Sampling with JEPA-Guided Diffusion

यह शोध पत्र JEPA मार्गदर्शन प्रस्तुत करता है, जो एक डिफ्यूजन सैंपलिंग फ्रेमवर्क है जो जॉइंट-एम्बेडिंग प्रेडिक्टिव आर्किटेक्चर (JEPA) वर्ल्ड मॉडल्स का लाभ उठाकर मॉडल-विशिष्ट घनत्वों के बजाय वास्तविक दुनिया की सिमेंटिक दुर्लभता के आधार पर अल्पसंख्यक नमूनों को परिभाषित और उत्पन्न करता है, जिससे विभिन्न जनरेशन कार्यों में उत्पन्न कम-घनत्व वाले उदाहरणों की निष्ठा और वैधता में सुधार होता है।

Sol Park, Soobin Um2026-05-26
💻 computer science

Demystifying the Mythos or Disrupting Bugonomics? From Zero-Day Asymmetry to Defender Remediation Throughput

यह शोध पत्र तर्क देता है कि साइबर सुरक्षा पर एलएलएम (LLM) का प्राथमिक प्रभाव केवल ज़ीरो-डे खोजों में वृद्धि नहीं है, बल्कि "बगोनॉमिक्स" (bugonomics) में एक मौलिक बदलाव है जहाँ बाधा कम लागत वाली, उच्च-मात्रा वाली रिपोर्टों की निगरानी करने के बजाय, उनके परिणामस्वरूप होने वाली प्रचुरता को मान्य करने, छँटनी करने और सुधारने की रक्षक की क्षमता की ओर स्थानांतरित हो जाती है।

Alfredo Pesoli, Herman Errico, Lorenzo Cavallaro2026-05-26
🤖 AI

GlobalDentBench: A Multinational Benchmark for Evaluating LLM Clinical Reasoning in Dentistry with Expert Calibration

यह शोधपत्र GlobalDentBench प्रस्तुत करता है, जो 14 विशेषज्ञताओं और तीन तर्क स्तरों में 8,978 विशेषज्ञ-सत्यापित प्रश्नों वाला पहला बहुराष्ट्रीय दंत चिकित्सा बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान बड़े भाषा मॉडल (large language models) जटिल नैदानिक तर्क में महत्वपूर्ण प्रदर्शन गिरावट प्रदर्शित करते हैं और 31.01% असुरक्षित सिफारिशों की दर सहित पर्याप्त सुरक्षा जोखिम उत्पन्न करते हैं।

Junjie Zhao, Jingyi Liang, Zhenyang Cai, Jiaming Zhang, Zhenwei Wen, Shuzhi Deng, Wenjing Yi, Chunfeng Luo, Hexian Zhang (…)2026-05-26
🤖 machine learning

On the Stability and Realizability of Recurrent Polynomial Surrogate Ternary Logic Gate Networks

यह शोध पत्र रिकरेंट डिफरेंशिएबल टर्नरी लॉजिक गेट नेटवर्क (R-DTLGN) प्रस्तुत करता है, जो एक नवीन आर्किटेक्चर है जो क्लीन के थ्री-वैल्यूड लॉजिक (Kleene's three-valued logic) पर कार्य करते हुए सिग्नल टेम्पोरल लॉजिक के वर्डिक्ट्स (verdicts) की भविष्यवाणी करना सीखता है और सेंसर डिग्रेडेशन के तहत स्थिर डायनेमिक्स और सिद्धांतपूर्ण अपवर्जन (abstention) के औपचारिक आश्वासन प्रदान करता है, साथ ही अपने नेटवर्क के आकार को टेम्पोरल फॉर्मूला की संरचना से सीधे व्युत्पन्न करता है।

Sai Sandeep Damera, Ryan Matheu, Aniruddh G. Puranic, John S. Baras, Calin Belta2026-05-26