🤖 machine learning

Mirror Horizon: Viable Path Entropy as a Measure of Bounded Reflection

यह शोध पत्र मिरर थ्योरी (Mirror Theory) और इसके परिचालन माप, वायबल पाथ एंट्रॉपी (Viable Path Entropy - VPE) को पेश करता है ताकि बुद्धिमान क्षमता को सीमित प्रतिबिंब (bounded reflection) के तहत सुलभ, विविध निरंतरताओं की संरचना के रूप में परिभाषित किया जा सके, और भाषा मॉडल प्रयोगों के माध्यम से यह प्रदर्शित किया जा सके कि यह मीट्रिक पैरामीटर संख्या या वन-शॉट सटीकता की तुलना में सुलभ तर्क क्षमता को अधिक प्रभावी ढंग से पकड़ता है।

Tiantian Zhang (Crystal)2026-07-15
🤖 machine learning

How Query Visibility Changes KV-Cache Compression Rankings: A Matched-Budget Audit

यह शोध पत्र प्रकट करता है कि एक यथार्थवादी, क्वेरी-अज्ञेय (query-agnostic) प्रोटोकॉल के तहत—जहाँ संपीड़न (compression) प्रश्न देखने से पहले होता है—KV-कैश संपीड़न विधियों का मूल्यांकन करना, मानक क्वेरी-जागरूक (query-aware) मूल्यांकनों की तुलना में प्रदर्शन रैंकिंग को महत्वपूर्ण रूप से बदल देता है, जो अक्सर SnapKV जैसी उन्नत विधियों को सरल बेसलाइन से कम प्रदर्शन करने पर मजबूर करता है और KeyDiff को सबसे सुदृढ़ समाधान के रूप में उजागर करता है।

Daming Luo, Christy Liang, Junyu Xuan2026-07-15
💬 NLP

MAGE: Understanding Stability-Performance Trade-offs in Multi-component Prompt Optimization

यह शोध पत्र MAGE प्रस्तुत करता है, जो एक नियंत्रित विश्लेषण ढांचा है जो प्रॉम्प्ट ऑप्टिमाइज़ेशन कपलिंग इफेक्ट (POCE) को प्रकट करता है, यह प्रदर्शित करते हुए कि एक रिफ्लेक्टिव लूप में कई स्टोकेस्टिक ऑप्टिमाइज़ेशन सिग्नल्स को संयोजित करना प्रदर्शन को बढ़ाता है और साथ ही भिन्नता (variance) को भी बढ़ाता है, जिससे प्रॉम्प्ट ऑप्टिमाइज़ेशन सिस्टम के लिए स्थिरता और पीक एक्यूरेसी दोनों का दोहरा मूल्यांकन आवश्यक हो जाता है।

Prateek Singh2026-07-15
💬 NLP

Belief-reality separation lives in routing over a shared value slot in language models

यह शोध पत्र यह पहचानता है कि भाषा मॉडल दो विशिष्ट तंत्रों के माध्यम से विश्वास (belief) को वास्तविकता (reality) से अलग करते हैं: एक साझा मूल्य स्लॉट (shared value slot) जो आरोपित जानकारी को संग्रहीत करता है और एक क्वेरी-पोजीशन राउटर (query-position router) जो यह चयन करता है कि पात्र के विश्वास से पढ़ना है या वस्तुनिष्ठ वास्तविकता से, एक ऐसी क्षमता जो कई आर्किटेक्चरों में 3B से 7B पैरामीटर्स के बीच उभरती है।

Oliver Steele, Jiangtao Wen, Yuxing Han2026-07-15
💻 computer science

Ontology-Amplified Distillation and Contextuality Auditing for Sovereign Enterprise Language Models: A Combined Proof-of-Mechanism and Negative-Results Method Study

यह शोध पत्र एक संयुक्त अध्ययन प्रस्तुत करता है जो यह प्रदर्शित करता है कि एक एकल Apple M5 Max पर Qwen3.6-27B मॉडल के ऑन्टोलॉजी-एम्प्लीफाइड डिस्टिलेशन से प्राप्त वियतनामी वित्तीय कार्य ग्राउंडिंग, GPT-5 बेसलाइन के तुलनीय है लेकिन श्रेष्ठता सिद्ध करने के लिए इसमें सांख्यिकीय शक्ति का अभाव है, जबकि एक समवर्ती कॉन्टेक्सचुअलिटी-ऑडिट पायलट नकारात्मक परिणाम देता है जो शून्य अवशिष्ट कॉन्टेक्सचुअलिटी को इंगित करता है, जो सामूहिक रूप से संप्रभु उद्यम भाषा मॉडलों के लिए तैनात करने योग्यता, सुरक्षा या सांख्यिकीय समानता स्थापित करने में विफल रहता है।

Thanh Luong Tuan2026-07-15
🤖 machine learning

Scalable Optimal Transport Algorithm for Network Alignment

यह शोध पत्र FastAlign को प्रस्तुत करता है, जो एक स्केलेबल, स्पैरसिटी-अवेयर (sparsity-aware) फ्रेमवर्क है जो कस्टम कर्नेल फ्यूजन और स्पार्स-डेंस ऑपरेशन्स का लाभ उठाकर ऑप्टिमल ट्रांसपोर्ट-आधारित नेटवर्क अलाइनमेंट को त्वरित करता है, ताकि CPU और GPU दोनों पर काफी कम रनटाइम के साथ अत्याधुनिक सटीकता प्राप्त की जा सके।

Elaheh Hassani, Durga Mandarapu, Qi Yu, Hanghang Tong, Ariful Azad2026-07-15
🤖 machine learning

When Does Reward Teach State? A Hidden-Automaton Instrument and the Group-Language Boundary

यह शोध पत्र सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) में पुरस्कार अधिकतमकरण और वास्तविक गुप्त-अवस्था शिक्षण के बीच कड़ाई से अंतर करने के लिए एक व्हाइट-बॉक्स हिडन-ऑटोमेटन ढांचे को प्रस्तुत करता है, जो यह प्रकट करता है कि उच्च पुरस्कार कार्य की समझ की गारंटी नहीं देता है और अवस्था रिकवरी अंतराल कार्य संरचना, ऑप्टिमाइज़र की शक्ति और अवलोकन सूचनात्मकता के आधार पर पूर्वानुमेय होते हैं।

Jim Allchin2026-07-15
🤖 machine learning

Graph-Constrained Policy Learning for Extreme Clinical Code Prediction

यह शोध पत्र एक ग्राफ-प्रतिबंधित नीति शिक्षण (graph-constrained policy learning) दृष्टिकोण का प्रस्ताव करता है जो नैदानिक कोड भविष्यवाणी को एक पदानुक्रमित निर्णय प्रक्रिया के रूप में रूपायित करता है, और यह प्रदर्शित करता है कि ICD-10-CM संरचना के माध्यम से यात्रा करने वाला एक एकल भाषा मॉडल, दुर्लभ-कोड बाधा (rare-code bottleneck) को प्रभावी ढंग से कम करके, MIMIC-IV डेटा पर फ्लैट बेसलाइन और जटिल कैस्केड या सुदृढीकरण शिक्षण विकल्पों से बेहतर प्रदर्शन करता है।

Amritpal Singh, Sebastian Torres, Khawar Shakeel, Syed Ahmad Chan Bukhari2026-07-15
🧬 biology

Constructed Reality, Contested Priors: Decoupling and the Architecture of Cognitive Relapse Under the Free Energy Principle

यह शोध पत्र एक वेरिएशनल ऑटोएन्कोडर (variational autoencoder) को एक कम्प्यूटेशनल प्रॉक्सी के रूप में उपयोग करता है यह प्रदर्शित करने के लिए कि फ्री एनर्जी प्रिंसिपल (Free Energy Principle) के अंतर्गत, एक प्रेडिक्टिव सिस्टम की रिप्रजेंटेशनल सटीकता उच्च बनी रह सकती है जबकि उसका डिफ़ॉल्ट जेनेरेटिव व्यवहार एक नॉन-मोनोटोनिक "कॉग्निटिव रिलैप्स" (cognitive relapse) से गुजरता है, जो यह प्रकट करता है कि एक नई वास्तविकता को अपनाने का प्रतिरोध सीखने की गति से भिन्न एक संरचनात्मक गुण है।

MD Ibrahim Hossain Ridoy2026-07-15
💻 computer science

Contrastive Joint-Embedding Prediction for Representation Learning in Structural MRI

यह शोध पत्र COJEPA को प्रस्तुत करता है, जो एक स्व-पर्यवेक्षित (self-supervised) ढांचा है जो लेबल किए गए डेटा की आवश्यकता के बिना, जुड़वां पहचान (twin retrieval), आयु प्रतिगमन (age regression) और ट्यूमर विभाजन (tumor segmentation) में अत्याधुनिक प्रदर्शन प्राप्त करते हुए, मजबूत 3D मस्तिष्क MRI निरूपणों (representations) को सीखने के लिए कंट्रास्टिव लॉस (contrastive loss) को जॉइंट-एम्बेडिंग प्रेडिक्टिव आर्किटेक्चर (joint-embedding predictive architecture) के साथ जोड़ता है।

Fabian Mager, Lars Kai Hansen2026-07-15