💬 NLP

Structural Rationale Distillation via Reasoning Space Compression

यह शोध पत्र डिस्टिलेशन थ्रू रीजनिंग पाथ कम्प्रेशन (D-RPC) का प्रस्ताव करता है, जो एक ऐसी विधि है जो शिक्षक (teacher) के तर्क (rationales) को पुन: प्रयोज्य उच्च-स्तरीय रीजनिंग पथों के एक गतिशील रूप से बनाए रखे गए बैंक तक सीमित करके बड़े से छोटे भाषा मॉडलों में ज्ञान हस्तांतरण में सुधार करती है, जिससे पर्यवेक्षण शोर (supervision noise) कम होता है और मौजूदा डिस्टिलेशन तकनीकों की तुलना में कई रीजनिंग बेंचमार्क पर बेहतर प्रदर्शन प्राप्त होता है।

Jialin Yang, Jiankun Wang, Jiajun Wu, Henry Leung, Jiayu Zhou, Steve Drew2026-05-11
🤖 AI

MathlibPR: Pull Request Merge-Readiness Benchmark for Formal Mathematical Libraries

यह शोध पत्र MathlibPR को प्रस्तुत करता है, जो वास्तविक Lean/Mathlib4 पुल रिक्वेस्ट इतिहास से प्राप्त एक बेंचमार्क है, जिसका उद्देश्य LLMs और एजेंटों की मर्ज-तैयार योगदानों से गैर-मर्ज किए गए योगदानों के बीच अंतर करने की क्षमता का मूल्यांकन करना है, जो उनकी वर्तमान संघर्षों को प्रकट करता है और रिव्यूअर असिस्टेंट और रिवॉर्ड मॉडल विकसित करने के लिए इस बेंचमार्क की क्षमता को उजागर करता है।

Zixuan Xie, Xinyu Liu, Shangtong Zhang2026-05-11
🤖 machine learning

Learned Lagrangian Models of PDEs via Euler-Lagrange Residual Minimization

यह शोध पत्र एक ऐसी नवीन विधि प्रस्तुत करता है जो एक मेश-मुक्त अनुकूलन-आधारित इंटीग्रेटर के माध्यम से यूलर-लैग्रेंज अवशेषों (Euler-Lagrange residuals) को न्यूनतम करके आंशिक अंतर समीकरणों (partial differential equations) के लिए सीधे निरंतर लैग्रेंजियन मॉडल सीखती है, जो रैखिक स्केलेबिलिटी और बिना पुनरप्रशिक्षण के मनमाने सीमा स्थितियों (boundary conditions) में सामान्यीकरण के साथ स्थिर, दीर्घकालिक भविष्यवाणियों को सक्षम बनाती है।

Lyra Zhornyak, Eric Forgoston, M. Ani Hsieh2026-05-11
💬 NLP

Topic Is Not Agenda: A Citation-Community Audit of Text Embeddings

यह शोध पत्र यह प्रदर्शित करता है कि वर्तमान अत्याधुनिक टेक्स्ट एम्बेडिंग (text embeddings) व्यापक उप-क्षेत्र स्तरों पर पर्याप्त प्रदर्शन करने के बावजूद सूक्ष्म शोध एजेंडों को पकड़ने में विफल रहती हैं, जो वैज्ञानिक रिट्रीवल-ऑगमेंटेड जनरेशन (retrieval-augmented generation) के लिए एक महत्वपूर्ण सीमा को उजागर करता है जिसे साइटेशन-आधारित संकेतों (citation-based signals) का लाभ उठाकर आंशिक रूप से संबोधित किया जा सकता है।

Junseon Yoo2026-05-11
🤖 machine learning

Neurosymbolic Imitation Learning with Human Guidance: A Privileged Information Approach

यह शोध पत्र एक न्यूरोसिम्बोलिक इमिटेशन लर्निंग फ्रेमवर्क प्रस्तावित करता है जो उच्च-आयामी डेटा को संसाधित करने की तंत्रिका नेटवर्क (न्यूरल नेटवर्क) की क्षमता को प्रतीकात्मक विधियों की सामान्यीकरण क्षमताओं के साथ जोड़ता है, जो दक्षता में सुधार करने और ओवरफिटिंग को कम करने के लिए गेज़ (दृष्टि) डेटा जैसे विशेषाधिकार प्राप्त प्रशिक्षण जानकारी का लाभ उठाता है।

Nikhilesh Prabhakar, Varun Balaji, Athresh Karanam, Kristian Kersting, Sriraam Natarajan2026-05-11
⚡ electrical engineering

Cost-Ordered Feasibility for Multi-Armed Bandits with Cost Subsidy

यह शोध पत्र लागत सब्सिडी वाले मल्टी-आर्म्ड बैंडिट्स के लिए कॉस्ट-ऑर्डर्ड फिजिबिलिटी (COF) एल्गोरिदम प्रस्तुत करता है, जो अधिक सटीक इंस्टेंस-डिपेंडेंट सैद्धांतिक सीमाएं स्थापित करता है और मौजूदा बेसलाइन की तुलना में रिवॉर्ड बाधाओं को पूरा करते हुए लागतों को कम करने में बेहतर अनुभवजन्य प्रदर्शन प्रदर्शित करता है।

Ishank Juneja, Carlee Joe-Wong, Osman Yağan2026-05-11
🤖 machine learning

Learning Multi-Relational Graph Representations for DNA Methylation-Based Biological Age Estimation

यह शोध पत्र RelAge-GNN को प्रस्तुत करता है, जो एक मल्टी-रिलेशनल ग्राफ न्यूरल नेटवर्क फ्रेमवर्क है जो मौजूदा विधियों की तुलना में डीएनए मिथाइलेशन-आधारित आयु अनुमान की सटीकता और जैविक व्याख्यात्मकता में सुधार करने के लिए को-मिथाइलेशन पैटर्न, जीनोमिक को-लोकलाइजेशन और जीन-स्तरीय जुड़ावों को एकीकृत करता है।

Qing Qing, Xikun Zhang, Zhongyuan Zhang, Jiarui Liu, Xingtong Yu, Xiaotao Shen, Ziqi Xu, Qixin Zhang, Zhe Wang, Renqiang (…)2026-05-11
🤖 machine learning

HyperEyes: Dual-Grained Efficiency-Aware Reinforcement Learning for Parallel Multimodal Search Agents

HyperEyes एक समानांतर मल्टीमॉडल सर्च एजेंट है जिसे एक ड्यूल-ग्रेन्ड एफिशिएंसी-अवेयर रीइन्फोर्समेंट लर्निंग फ्रेमवर्क के माध्यम से प्रशिक्षित किया गया है जो विजुअल ग्राउंडिंग और रिट्रीवल को समवर्ती कार्यों में संलयित करता है, जिससे मौजूदा अनुक्रमिक एजेंटों की तुलना में बेहतर सटीकता और काफी कम इन्फरेंस लागत प्राप्त होती है।

Guankai Li, Jiabin Chen, Yi Xu, Xichen Zhang, Yuan Lu2026-05-11
🤖 machine learning

Star Elastic: Many-in-One Reasoning LLMs with Efficient Budget Control

स्टार इलास्टिक (Star Elastic) एक नवीन पोस्ट-ट्रेनिंग विधि है जो एकल पैरेंट मॉडल से एक ही ट्रेनिंग रन के माध्यम से कुशलतापूर्वक कई नेस्टेड रीजनिंग सब-मॉडल्स उत्पन्न करती है, जो डायनेमिक, चरण-विशिष्ट बजट नियंत्रण को सक्षम बनाती है जो स्वतंत्र प्रशिक्षण या कंप्रेशन बेसलाइन की तुलना में प्रशिक्षण लागत को काफी कम करते हुए सटीकता-विलंबता (accuracy-latency) ट्रेड-ऑफ में सुधार करती है।

Ali Taghibakhshi, Ruisi Cai, Saurav Muralidharan, Sharath Turuvekere Sreenivas, Aditya Vavre, Ameya Sunil Mahabaleshwark (…)2026-05-11
🤖 machine learning

Coupling Models for One-Step Discrete Generation

यह शोध पत्र कपलिंग मॉडल्स (Coupling Models) को प्रस्तुत करता है, जो एक वन-स्टेप डिस्क्रीट जनरेटिव फ्रेमवर्क है जो सिंगल-स्टेप जनरेशन को सक्षम करने के लिए डिस्क्रीट सीक्वेंस और गॉसियन लेटेंट्स के बीच एक डायरेक्ट कपलिंग सीखता है, जिससे टेक्स्ट जनरेशन, बायोलॉजिकल सीक्वेंस डिजाइन और इमेज सिंथेसिस में मौजूदा बेसलाइन्स की तुलना में महत्वपूर्ण प्रदर्शन सुधार प्राप्त होता है।

Fred Zhangzhi Peng, Avishek Joey Bose, Anru R. Zhang, Alexander Tong2026-05-11