⚡ electrical engineering

A Generalized Formalism of Auto-Regressive Decoding for Speech Processing

यह शोध पत्र स्पष्ट समावेशन मानदंडों को स्थापित करके और इन खोज रणनीतियों के बेंचमार्किंग को वर्गीकृत, तुलना और सरल बनाने के लिए एक सामान्यीकृत सैद्धांतिक ढांचा व्युत्पन्न करके स्पीच प्रोसेसिंग में ऑटो-रिग्रेसिव डिकोडिंग रणनीतियों के लिए एक एकीकृत अवलोकन की कमी को संबोधित करता है।

Julia Gachot, Philipp Allgeuer, Marie S. Bauer, Stefan Wermter2026-06-23
💬 NLP

Multimodal Image Colorization: Quantifying the Impact of Text-Conditioned Guidance on Grayscale-to-Color Translation

यह शोध पत्र यू-नेट (U-Net) और स्टेबल डिफ्यूजन 1.5 (Stable Diffusion 1.5) दोनों आर्किटेक्चर में CLIP मार्गदर्शन को एकीकृत करके यह प्रदर्शित करते हुए ग्रेस्केल-से-रंग अनुवाद (grayscale-to-color translation) पर टेक्स्ट कंडीशनिंग के प्रभाव को परिमाणित करता है कि यह बिना टेक्स्ट इनपुट वाले मॉडलों की तुलना में पिक्सेल-स्तरीय सटीकता, संवेदी समानता और रंगत में निरंतर सुधार करता है।

Colten Reissmann, Hugo Garrido-Lestache Belinchon2026-06-23
🤖 AI

When Web Agents Finish but Still Fail: Reproducible Triggers and Trace Diagnostics for Parallel Web Exploration

यह शोध पत्र 'पैरेलल वेबबेंच' (Parallel WebBench) का परिचय देता है, जो 1,679 सत्यापित रिकॉर्डों वाला एक बेंचमार्क है, ताकि लॉन्ग-होराइजन वेब एजेंटों में छिपी हुई विफलताओं का विश्लेषण और निदान किया जा सके, जो यह दर्शाता है कि हालांकि GRPO प्रशिक्षण कार्य पूरा करने की दरों में महत्वपूर्ण सुधार करता है, लेकिन यह संदर्भ-बद्ध लूप (context-bound loops), समयपूर्व समाप्ति (premature termination) और संश्लेषण पतन (synthesis collapse) जैसी निरंतर समस्याओं के कारण अंतिम शुद्धता में एक महत्वपूर्ण अंतर छोड़ देता है।

Aagam Sogani, Botao Rui, Swetha Vaidyanathan, Rishi Agarwal, Minghao Yan, Shivaram Venkataraman2026-06-23
🤖 AI

Repeated Shared Access Enables Grokking, but Edit Propagation Depends on a Fine-Grained Addressable Memory

यह शोध पत्र यह प्रदर्शित करता है कि जहाँ बार-बार साझा पहुंच (shared access) मॉडलों को आउट-ऑफ-डिस्ट्रीब्यूशन सामान्यीकरण बाधाओं ("ग्रोकिंग") को पार करने में सक्षम बनाती है, वहीं प्रभावी तथ्यात्मक संपादन प्रसार (factual edit propagation) के लिए विशेष रूप से एक सूक्ष्म, पता योग्य स्मृति आधार (addressable memory substrate) की आवश्यकता होती है जो फॉरवर्ड कंप्यूटेशन को संपादित तथ्यों को लिखने और तत्पश्चात पुनः पढ़ने की अनुमति दे सके, एक ऐसी क्षमता जिसे लूप पुनरावृत्ति (loop recurrence) अकेले केवल आंशिक रूप से ही प्रदान करती है।

Yanan Niu2026-06-23
🤖 machine learning

Massive Activations Are Architecturally Robust: A Controlled Scratch/Commitment Residual Stream Test

यह शोध पत्र एक "लेजर रेसिडुअल्स" (Ledger Residuals) वास्तुशिल्प हस्तक्षेप के माध्यम से यह प्रदर्शित करता है कि ट्रांसफॉर्मर्स में विशाल सक्रियण (activations) केवल ओवरलोडेड रेसिडुअल स्ट्रीम्स के कृत्रिम प्रभाव मात्र नहीं हैं, बल्कि वे कार्यात्मक रूप से सुदृढ़ विशेषताएं हैं जो तब भी पुन: प्रकट होती हैं जब मॉडल को अपने अंतिम प्रतिनिधित्व के लिए एक संरक्षित, डिकोड-ओनली चैनल का उपयोग करने के लिए मजबूर किया जाता है।

Maruthi Vemula (University of North Carolina at Chapel Hill)2026-06-23
🤖 machine learning

Evidential Fusion Network for Multimodal Survival Prediction under Missing Modalities

यह शोध पत्र एविडेंशियल मिसिंग मोडैलिटी सर्वाइवल फ्यूजन (EMMS) मॉडल का प्रस्ताव करता है, जो अनुपस्थित मोडैलिटीज को जनरेटिव इम्प्यूटेशन की आवश्यकता के बिना शून्य साक्ष्य (vacuous evidence) के रूप में मानकर, डेटा की कमी की स्थितियों में स्टेट-ऑफ-द-आर्ट, कैलिब्रेटेड मल्टीमॉडल सर्वाइवल भविष्यवाणियों को प्राप्त करने के लिए डेम्पस्टर-शेफर थ्योरी और गॉसियन रैंडम फजी नंबर्स का लाभ उठाता है।

Yucheng Xing, Hailan Mo, Zi Wang, Ling Huang, Mengling Feng2026-06-23
💬 NLP

FirstPass: Grounding AI Scientific Judgment in Multi-Round Editorial Outcomes

यह शोध पत्र FirstPass प्रस्तुत करता है, जो Nature Communications के 3,668 बहु-चरणीय सहकर्मी-समीक्षा (पीयर-रिव्यू) संवादों पर निर्मित एक डेटासेट और फाइन-ट्यून किया गया मॉडल है, जो रिस्पॉन्स-ओनली लॉस मास्किंग और पांच वैज्ञानिक डोमेनों में पारदर्शी, पुनरावृत्ति संवाद डेटा का लाभ उठाकर संपादकीय परिणामों की भविष्यवाणी करने और वैज्ञानिक समीक्षाएं उत्पन्न करने में मौजूदा एआई प्रणालियों से काफी बेहतर प्रदर्शन करता है।

Prabhjot Singh, Somnath Luitel, Manmeet Singh, Josh Durkee2026-06-23
💬 NLP

Beyond 'One Language, One Script': Quantifying Orthographic Bias in Multilingual VLMs with PuMVR

यह शोध पत्र PuMVR प्रस्तुत करता है, जो बहुभाषी विजन-लैंग्वेज मॉडल्स में महत्वपूर्ण ऑर्थोग्राफिक पूर्वाग्रह को मापने वाला पहला बेंचमार्क है, यह प्रदर्शित करते हुए कि ये सिस्टम पंजाबी की तीन सक्रिय लिपियों (गुरमुखी, शाहमुखी और रोमन) के बीच प्रदर्शन में भारी अंतर और असंगत तर्क प्रदर्शित करते हैं, जिससे इस धारणा को चुनौती मिलती है कि एक भाषा का अर्थ एक एकल लेखन प्रणाली है।

Prabhjot Singh, Bhushan Pawar, Madhu Reddiboina2026-06-23
🤖 machine learning

Provably Sub-Linear Two-Timescale NeuroEvolution with Online Plasticity

यह शोध पत्र एक न्यूरोइवोल्यूशनरी ऑनलाइन लर्निंग (NEOL) फ्रेमवर्क प्रस्तुत करता है जो एक बाहरी आर्किटेक्चर सर्च लूप को एक आंतरिक ऑनलाइन वेट अडैप्टेशन लूप के साथ जोड़ता है, जो सब-लीनियर रिग्रेट का पहला सैद्धांतिक प्रमाण प्रदान करता है और अनुभवजन्य रूप से यह प्रदर्शित करता है कि यह टू-टाइमस्केल दृष्टिकोण निरंतर नियंत्रण कार्यों पर मानक NEAT की तुलना में सैंपल दक्षता और मजबूती में बेहतर प्रदर्शन करता है।

Shishen Lin, Yixin Chen2026-06-23
🤖 machine learning

CELEUS: Certifiable and Efficient LLM Evaluation via E-Processes

यह शोध पत्र CELEUS को प्रस्तुत करता है, जो एक ऐसा फ्रेमवर्क है जो अनिश्चितता-निर्देशित नमूनाकरण (uncertainty-guided sampling) और सरोगेट-सहायता प्राप्त सन्निकटन (surrogate-assisted approximations) के माध्यम से आवश्यक नमूनों की संख्या को काफी कम करते हुए, LLM मूल्यांकन के लिए प्रमाणित, एनीटाइम-वैलिड (anytime-valid) विश्वास अंतराल प्रदान करने के लिए E-प्रक्रियाओं का लाभ उठाता है।

Zhijian Zhou, Zesheng Ye, Zhaorun Chen, Bo Li, Feng Liu2026-06-23