🤖 AI

When and How Human Curation Backfires: Preference Alignment under Multi-Model Self-Consuming Loop

यह शोध पत्र प्रकट करता है कि जहाँ मानव क्यूरेशन (human curation) पृथक स्व-उपभोज्य मॉडलों (self-consuming models) में संरेखण (alignment) में सुधार करता है, वहीं इस प्रतिमान को बहु-मॉडल प्रणालियों तक विस्तारित करने से क्रॉस-मॉडल इंटरैक्शन के माध्यम से क्यूरेशन प्रभाव मंद या विपरीत हो सकते हैं, जो अंततः दीर्घकालिक संरेखण को खराब कर देते हैं।

Yang Zhang, Xiukun Wei, Xueru Zhang2026-05-29
💻 computer science

Compute Allocation in Evolutionary Search: From Depth-Breadth to Multi-Armed Bandits

यह शोध पत्र BaSE का प्रस्ताव देने के लिए LLM-निर्देशित विकासवादी खोज (evolutionary search) की अनुभवजन्य नियमितताओं का विश्लेषण करता है, जो एक मल्टी-आर्म्ड बैंडिट एल्गोरिदम है जो समानांतर प्रक्षेप पथों (parallel trajectories) के बीच कंप्यूट को गतिशील रूप से आवंटित करता है, जिससे अंतर्निहित मॉडल या प्रॉम्प्ट्स को संशोधित किए बिना पारंपरिक डेप्थ-ब्रेड्थ रणनीतियों की तुलना में औसत फिटनेस में 12.3% सुधार और उन्नत विश्वसनीयता प्राप्त होती है।

Sixue Xing, Haoyu He, Kerui Wu, Zhuo Yang, Haozheng Luo, Tianfan Fu, Aarthy Nagarajan2026-05-29
🤖 machine learning

A Theoretical and Experimental Study of a Novel Adaptive Learning Algorithm

यह शोध पत्र Adam और AMSGrad जैसे लोकप्रिय एडेप्टिव ऑप्टिमाइज़र की आलोचनात्मक समीक्षा करता है, लाइन-ऑफ-साइट दृष्टिकोण पर आधारित C-Adam नामक एक नया अभिसरण-गारंटीकृत (convergence-guaranteed) संस्करण प्रस्तावित करता है, और संख्यात्मक प्रयोगों के माध्यम से इसके सैद्धांतिक और प्रयोगात्मक प्रदर्शन को मान्य करता है।

Sakshi Kumari, Shyam Kumar M, Sushmitha P2026-05-29
🤖 AI

GrepSeek: Training Search Agents for Direct Corpus Interaction

GrepSeek एक दो-चरणीय प्रशिक्षण पाइपलाइन पेश करता है जो एक ऐसे खोज एजेंट के लिए है जो निष्पादन योग्य शेल कमांड के माध्यम से सीधे टेक्स्ट कॉर्पोरा के साथ इंटरैक्ट करता है, जो ओपन-डोमेन प्रश्नोत्तर बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त करता है और पारंपरिक पुनर्प्राप्ति-आधारित प्रणालियों के लिए एक व्यावहारिक, स्केलेबल विकल्प प्रदान करता है।

Alireza Salemi, Chang Zeng, Atharva Nijasure, Jui-Hui Chung, Razieh Rahimi, Fernando Diaz, Hamed Zamani2026-05-29
🤖 machine learning

NeuroEdge: Real-Time Hand Gesture Recognition with High-Density EMG Using Deep Learning at the Edge

यह शोध पत्र NeuroEdge प्रस्तुत करता है, जो एक वास्तविक समय, माइक्रोकंट्रोलर-आधारित प्रणाली है जो संसाधन-सीमित एज उपकरणों पर 90% जेस्चर रिकग्निशन सटीकता और 83 मिलीसेकंड विलंबता प्राप्त करने के लिए एक कस्टम वायरलेस HD-EMG स्ट्रीमिंग इंटरफ़ेस को एक हल्के 1D CNN इन्फरेंस इंजन के साथ एकीकृत करता है।

Peter Chudinov, Zhenyu Lin, Jay Motamarry, Srihita Panati, Xiaorong Zhang, Zhuwei Qin2026-05-29
🧬 biology

Mixing Vector Model for Copolymer Inference via Mixed Integer Linear Programming

यह शोध पत्र एक मिक्सिंग वेक्टर मॉडल पेश करके मौजूदा mol-infer फ्रेमवर्क को कोपोलिमर (copolymers) तक विस्तारित करता है जो कोपोलिमर विशेषताओं को मोनोमर डिस्क्रिप्टर्स के उत्तरोत्तर संयोजन (convex combinations) के रूप में प्रस्तुत करता है, जिससे निर्धारित गुणों और मिश्रण अनुपातों वाले कोपोलिमर के सटीक व्युत्क्रम डिजाइन (exact inverse design) के लिए एक सुलभ मिश्रित पूर्णांक रैखिक प्रोग्रामिंग (MILP) समस्या को तैयार करना संभव हो जाता है।

Jianshen Zhu, Raveena Rai, Taiyo Sohkawa, Naveed Ahmed Azam, Kazuya Haraguchi, Liang Zhao, Tatsuya Akutsu2026-05-29
🤖 machine learning

Solving Integer Linear Programming with Parallel Tempering

यह शोधपत्र एक सॉल्वर-मुक्त, सैंपलिंग-आधारित फ्रेमवर्क पेश करता है जो इंटिजर लीनियर प्रोग्रामिंग के लिए पैरेलल टेम्परिंग को लोकली-बैलेंस्ड प्रपोजल और पेनल्टी टेम्परिंग के साथ जोड़ता है ताकि मल्टीमॉडल एनर्जी लैंडस्केप्स को प्रभावी ढंग से नेविगेट किया जा सके, जो SCIP और Guropi जैसे क्लासिकल सॉल्वर्स के मुकाबले प्रतिस्पर्धी प्रदर्शन प्राप्त करने के साथ-साथ लर्निंग-आधारित विधियों की तुलना में डिस्ट्रीब्यूशन शिफ्ट्स के प्रति बेहतर मजबूती प्रदर्शित करता है।

Kyuil Sim, Sanghyeok Choi, Jinkyoo Park2026-05-29
🤖 machine learning

Deep Adaptive Dimension Reduction for Bayesian Inference in Inverse Problems

यह शोध पत्र एक गहरा अनुकूलनशील आयाम-न्यूनीकरण ढांचा प्रस्तावित करता है जो वेरिएशनल फ्लोज़ (Variational Flows), पुनरावृत्ति पूर्ववर्ती अद्यतन (iterative prior updating) और एक अनुकूलित रूप से फाइन-ट्यून किए गए फूरियर न्यूरल ऑपरेटर सरोगेट को जोड़ता है ताकि मौजूदा बेसलाइनों की तुलना में बेहतर सटीकता के साथ उच्च-आयामी, गैर-गाऊसी PDE-शासित व्युत्क्रम समस्याओं को कुशलतापूर्वक हल किया जा सके।

Yueyang Wang, Xili Wang, Kejun Tang, Xiaoliang Wan, Tao Zhou, Chao Yang2026-05-29
🤖 machine learning

BrahmicTokenizer-131K: An Indic-Capable Drop-In Replacement for o200k_base

यह शोध पत्र BrahmicTokenizer-131K को प्रस्तुत करता है, जो OpenAI के o200k_base का एक ड्रॉप-इन रिप्लेसमेंट है, जो अंग्रेजी, कोड और गणित संबंधी कार्यों पर प्रतिस्पर्धी प्रदर्शन बनाए रखते हुए एक सर्जिकल वोकैबुलरी रेट्रोफिट के माध्यम से भारतीय भाषाओं के लिए बेहतर संपीड़न (compression) प्राप्त करता है।

Rohan Shravan2026-05-29
🤖 machine learning

TRACER: Persistent Regularization for Robust Multimodal Finetuning

यह शोध पत्र TRACER को प्रस्तुत करता है, जो एक सुदृढ़ मल्टीमॉडल फाइनट्यूनिंग विधि है जो निरंतर नियमितीकरण (persistent regularization) के लिए एक वेटेड मूविंग एवरेज (WMA) शिक्षक का उपयोग करके कैटास्ट्रोफिक फॉरगेटिंग और टीचर कोलैप्स को संबोधित करती है, जिससे आउट-ऑफ-डिस्ट्रीब्यूशन सटीकता और अंशांकन (calibration) में महत्वपूर्ण सुधार होता है।

Hesam Asadollahzadeh, Feng Liu, Christopher Leckie, Sarah M. Erfani2026-05-29