🤖 machine learning

Minimal Filling Architectures of Polynomial Neural Networks: Counterexamples, Frontier Search, and Defects

यह शोधपत्र फ्रंटियर सर्च के माध्यम से खोजे गए और रिकर्सिव डायमेंशन बाउंड्स द्वारा प्रमाणित किए गए एक प्रति-उदाहरण को प्रस्तुत करके, जिसमें पूर्व अवलोकनों के विपरीत बड़े डिफेक्ट्स वाले सब-आर्किटेक्चर शामिल हैं, पॉलीनोमियल न्यूरल नेटवर्क के लिए मिनिमल यूनिमोडल कंजेक्चर का खंडन करता है।

Kevin Dao, Jose Israel Rodriguez2026-05-12
🤖 AI

SmartEval: A Benchmark for Evaluating LLM-Generated Smart Contracts from Natural Language Specifications

यह शोध पत्र SmartEval को प्रस्तुत करता है, जो 9,000 LLM-जनित सॉलिडिटी (Solidity) अनुबंधों के एक संग्रह, एक पांच-आयामी मूल्यांकन मानदंड और एक प्रमाणित पाइपलाइन से युक्त एक व्यापक बेंचमार्क है, जो विशिष्ट विफलता मोड को प्रकट करता है और यह प्रदर्शित करता है कि LLM-जनित अनुबंध कार्यात्मक अनुपालन में ग्राउंड-ट्रुथ कार्यान्वयन से बेहतर प्रदर्शन कर सकते हैं।

Abhinav Goel, Agostino Capponi, Alfio Gliozzo, Chaitya Shah2026-05-12
🤖 AI

Adaptive DNN Partitioning and Offloading in Heterogeneous Edge-Cloud Continuum

यह शोध पत्र एक विषम एज-क्लाउड निरंतरता (edge-cloud continuum) में अनुकूली DNN विभाजन और ऑफलोडिंग के लिए एक ढांचे का प्रस्ताव और सत्यापन करता है जो रनटाइम स्थितियों के अनुसार गतिशील रूप से समायोजित होता है, जो एक भौतिक टेस्टबेड पर स्थिर बेसलाइन की तुलना में ऊर्जा खपत और विलंबता में महत्वपूर्ण कमी प्रदर्शित करता है।

Akuen Akoi Deng, Eimantas Butkus, Alfreds Lapkovskis, Praveen Kumar Donta2026-05-12
🤖 machine learning

Scratchpad Patching: Decoupling Compute from Patch Size in Byte-Level Language Models

यह शोधपत्र स्क्रैचपैड पैचिंग (SP) प्रस्तुत करता है, जो बाइट-लेवल लैंग्वेज मॉडल्स में पैच साइज़ से कंप्यूट को अलग करने वाली एक तकनीक है, जो पैच लैग को कम करने के लिए गतिशील रूप से क्षणिक (transient) स्क्रैचपैड्स को सम्मिलित करती है, जिससे मॉडलिंग गुणवत्ता से समझौता किए बिना कम KV-कैशे और कंप्यूट लागत के लिए बड़े पैच सक्षम होते हैं।

Lin Zheng, Vasilisa Bashlovkina, Timothy Dozat, Dan Garrette, Laura Rimell, Joshua Maynez2026-05-12
🤖 machine learning

Overcoming Catastrophic Forgetting in Visual Continual Learning with Reinforcement Fine-Tuning

यह शोध पत्र रिटेंशन-अवेयर पॉलिसी ऑप्टिमाइज़ेशन (RaPO) को प्रस्तुत करता है, जो एक नवीन रीइन्फोर्समेंट फाइन-ट्यूनिंग विधि है जो रिटेंशन रिवॉर्ड शेपिंग और क्रॉस-टास्क एडवांटेज नॉर्मलाइज़ेशन के माध्यम से ट्राजेक्टरी-लेवल ड्रिफ्ट एग्नोस्टिसिज्म को संबोधित करके विजुअल कॉन्टिनुअल लर्निंग में कैटास्ट्रोफिक फॉरगेटिंग को कम करती है, जिससे मौजूदा दृष्टिकोणों की तुलना में बेहतर प्रदर्शन प्राप्त होता है।

Meng Lou, Hanzhong Guo, Linwei Chen, Yizhou Yu2026-05-12
🤖 machine learning

Make Each Token Count: Towards Improving Long-Context Performance with KV Cache Eviction

यह शोधपत्र एक वैश्विक रिटेंशन-आधारित (retention-based) KV कैश इविक्शन विधि प्रस्तुत करता है जो मेमोरी उपयोग को कम करने के लिए अप्रासंगिक टोकन को चुनिंदा रूप से हटाने के लिए सीखता है और अटेंशन डाइल्यूशन (attention dilution) को कम करके लॉन्ग-कॉन्टेक्स्ट रीजनिंग प्रदर्शन में सुधार करता है, जिससे यह विविध बेंचमार्क पर फुल-कैश इन्फरेंस से भी बेहतर प्रदर्शन करता है।

Ngoc Bui, Hieu Trung Nguyen, Arman Cohan, Rex Ying2026-05-12
🤖 AI

Workspace Optimization: How to Train Your Agent

यह शोध पत्र "वर्कस्पेस ऑप्टिमाइज़ेशन" (workspace optimization) को पेश करता है, जो एजेंट के वेट्स (weights) के बजाय उसके स्ट्रक्चर्ड एक्सटर्नल सबस्ट्रेट (structured external substrate) को विकसित करने वाला एक ट्रेनिंग प्रतिमान (training paradigm) है, और ड्रीमटीम (DreamTeam) के माध्यम से इसकी प्रभावशीलता को प्रदर्शित करता है, जो एक मल्टी-एजेंट सिस्टम है जिसने कम एक्शन का उपयोग करते हुए ARC-AGI-3 बेंचमार्क पर 38.4% का नया स्टेट-ऑफ-द-आर्ट स्कोर हासिल किया है।

Elad Sarafian, Gal Kaplun, Ron Banner, Daniel Soudry, Boris Ginsburg2026-05-12
📊 statistics

Metropolis-Adjusted Diffusion Models

यह शोध पत्र डिफ्यूजन मॉडल्स के लिए मेट्रोपोलिस-एडजस्टेड लैंग्विन करेक्टर्स पेश करता है जो स्कोर-आधारित स्वीकृति प्रायिकताओं और सैंपलिंग बायस को समाप्त करने के लिए एक नवीन बर्नौली फैक्ट्री एल्गोरिदम का उपयोग करते हैं, जिससे नमूना गुणवत्ता में उल्लेखनीय सुधार होता है और फ्रेशेट इनसेप्शन डिस्टेंस स्कोर कम होता है।

Kevin H. Lam, Tyler Farghly, Christopher Williams, Jun Yang, Yee Whye Teh, Arnaud Doucet2026-05-12
🤖 machine learning

FreeMOCA: Memory-Free Continual Learning for Malicious Code Analysis

FreeMOCA दुर्भावनापूर्ण कोड विश्लेषण के लिए एक मेमोरी- और कंप्यूट-कुशल निरंतर शिक्षण (continual learning) ढांचा है जो क्रमिक कार्य इष्टतमों (consecutive task optima) के बीच अनुकूली परत-वार इंटरपोलेशन (adaptive layer-wise interpolation) का लाभ उठाकर विनाशकारी विस्मृति (catastrophic forgetting) को कम करता है, जिससे बिना किसी रिप्ले बफर की आवश्यकता के बड़े पैमाने के विंडोज और एंड्रॉइड मैलवेयर बेंचमार्क पर बेहतर सटीकता और प्रतिधारण (retention) प्राप्त होता है।

Zahra Asadi, Haeseung Jeon, Sohyun Han, Md Mahmuduzzaman Kamol, Se Eun Oh, Mohammad Saidur Rahman2026-05-12
🤖 machine learning

Quantum Circuit Simulation of Compartmental Drug Dynamics: Leveraging Variational Algorithms for Nonlinear Mixed-Effects Population Pharmacokinetics

यह शोध पत्र एक हाइब्रिड क्वांटम-क्लासिकल फ्रेमवर्क प्रस्तुत करता है जो PennyLane का उपयोग करके कम्पार्टमेंटल पॉपुलेशन फार्माकोकाइनेटिक्स को एक ओपन क्वांटम सिस्टम के रूप में पुनर्गठित करता है, यह प्रदर्शित करते हुए कि एक क्वांटम-एन्हांस्ड SAEM एल्गोरिदम शास्त्रीय विधियों की तुलना में फेज 1 क्लिनिकल डेटा पर तेज़ अभिसरण (convergence) और बेहतर सांख्यिकीय फिट प्राप्त करता है।

Isshaan Singh, Nandan Patel2026-05-12