🤖 machine learning

Field-Aware RankMixer with Dual-Stream Bilinear Fusion for the Tencent UNI-REC Challenge

यह शोध पत्र KDD कप 2026 टेनसेंट UNI-REC चुनौती के लिए एक नौवें स्थान के समाधान को प्रस्तुत करता है, जो एक फील्ड-अवेयर रैंकमिक्सर (Field-Aware RankMixer) को ड्यूल-स्ट्रीम द्विपक्षीय संलयन (dual-stream bilinear fusion) के साथ पेश करता है जो मल्टी-डोमेन टार्गेट-एड cPVR भविष्यवाणी के लिए टार्गेट-अवेयर इंटरेस्ट एक्सट्रैक्शन, सिमेंटिक टोकन मॉडलिंग और पूरक शैलो-डीप स्ट्रीम आर्किटेक्चर को प्रभावी ढंग से एकीकृत करता है।

Yufeng Zhang, Zhengqi Xu, Jiajun Cui2026-07-20
💬 NLP

Process Reward Informed Tree Rollout for Effective Multi-Turn RL

यह शोध पत्र PATR को प्रस्तुत करता है, जो एक प्रोसेस-रिवॉर्ड-गाइडेड एडेप्टिव ट्री रोलआउट फ्रेमवर्क है जो आशाजनक मध्यवर्ती अवस्थाओं (intermediate states) से चुनिंदा रूप से शाखा बनाने और साझा प्रीफिक्स के पुन: उपयोग द्वारा LLM एजेंटों के लिए मल्टी-टर्न सुदृढीकरण शिक्षण (reinforcement learning) को अनुकूलित करता है, जिससे पारंपरिक यूनिफॉर्म ट्राजेक्टरी सैंपलिंग विधियों की तुलना में SWE-Bench और FrozenLake जैसे बेंचमार्क पर प्रदर्शन में महत्वपूर्ण सुधार होता है।

Xintong Li, Sha Li, Yuwei Zhang, Changlong Yu, Rongmei Lin, Hongye Jin, Shuyi Guan, Xin Liu, Linwei Li, Qingyu Yin, Jing (…)2026-07-20
🤖 AI

Think at 5 Hz, Act at 20 Hz: Asynchronous Fast-Slow Vision-Language-Action Inference for Closed-Loop Driving

यह शोधपत्र क्लोज्ड-लूप ड्राइविंग के लिए एक एसिंक्रोनस फास्ट-स्लो आर्किटेक्चर पेश करता है जो एक कैश रिप्रजेंटेशन (cached representation) के माध्यम से एक फ्रोजन विजन-लैंग्वेज बैकबोन (जो 5 Hz पर चल रहा है) को एक लाइटवेट एक्शन एक्सपर्ट (जो 20 Hz पर चल रहा है) से अलग करता है, जिससे कंट्रोल लेटेंसी के समझौतों को समाप्त किया जाता है और फ्रेम-स्किपिंग बेसलाइन की तुलना में रूट कंप्लीशन और सुरक्षा मेट्रिक्स में महत्वपूर्ण सुधार होता है।

Yun Li, Jiachen Gong, Simon Thompson, Ehsan Javanmardi, Qunli Zhang, Zifan Zeng, Shiming Liu, Peng Wang, Zixuan Guo, Man (…)2026-07-20
🤖 AI

A cubical formalisation of topos causal models: intervention, sheaf gluing, and the intuitionistic do-calculus

यह शोध पत्र टोपोस कॉज़ल मॉडल्स (topos causal models) का क्यूबिकल एगडा (Cubical Agda) में पहला मशीन-चेक्ड फॉर्मलाइजेशन प्रस्तुत करता है, जो विशेषतात्मक मानचित्रों (characteristic maps) के रूप में हस्तक्षेप और शीफ ग्लूइंग (sheaf gluing) जैसी मुख्य अवधारणाओं को सत्यापित करता है, साथ ही पर्ल के नियमों की स्थिरता स्थापित करने के लिए लॉवरे-टायनी (Lawvere-Tierney) अभिगृहीतों में एक अंतराल की पहचान और मरम्मत करता है, और एक सुरक्षित, अक्षोमित (axiom-free) ढांचे के भीतर एक संदर्भता बाधा (contextuality obstruction) को प्रदर्शित करता है।

Karen Sargsyan2026-07-20
🤖 AI

IMBench: A Benchmark for Intuitive Robotic Manipulation

यह शोध पत्र IMBench को प्रस्तुत करता है, जो 35 कार्यों और 14K प्रक्षेपपथों (trajectories) से युक्त एक व्यापक बेंचमार्क है जिसे "सहज हेरफेर" (intuitive manipulation)—जिसमें भौतिक तर्क, धारणा और क्रिया निर्माण का संयोजन शामिल है—की एकीकृत क्षमता का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो वर्तमान विजन-लैंग्वेज और विजन-लैंग्वेज-एक्शन मॉडलों की जटिल, बाधा-युक्त रोबोटिक कार्यों की योजना बनाने और उन्हें निष्पादित करने की क्षमता में महत्वपूर्ण अंतराल को प्रकट करता है।

Anurag Maurya, Sukhvansh Jain, Prajwal Avhad, Gautham Balachandran, Ziyi Zhou, Atharva Kshirsagar, Satyam Singh, Bowen L (…)2026-07-20
💬 NLP

On the Structure of Address in Multi-Party Dialogue: From Discrete Labels to Continuous Levels

यह शोधपत्र एड्रेसर डिटेक्शन (संबोधन पहचान) को एक विविक्त वर्गीकरण कार्य के रूप में देखने के पारंपरिक दृष्टिकोण को चुनौती देते हुए एक निरंतर ढांचे का प्रस्ताव करता है जो संबोधन की क्रमिक प्रकृति को बेहतर ढंग से पकड़ता है और टर्न-टेकिंग तथा श्रोता के व्यवहार जैसे कि दृष्टि (गेज़) और बैकचैनल के लिए इसकी श्रेष्ठ भविष्य कहने वाली शक्ति को प्रदर्शित करता है।

Taiga Mori, Koji Inoue, Divesh Lala, Tatsuya Kawahara2026-07-20
🤖 AI

ToolVerse: Unlocking Massive Environments and Long-Horizon Tasks for Agentic Reinforcement Learning

यह शोध पत्र ToolVerse को प्रस्तुत करता है, जो एक व्यापक ढांचा है जो लगभग 400 वास्तविक-दुनिया के प्रोटोकॉल से विशाल प्रशिक्षण वातावरणों का स्वचालित रूप से निर्माण करके, टूल डिपेंडेंसी ग्राफ के माध्यम से लॉन्ग-होरिजन कार्यों को उत्पन्न करके, और जटिल, गतिशील टूल-एकीकृत परिदृश्यों में LLMs की मजबूती और तर्क क्षमता को महत्वपूर्ण रूप से बढ़ाने के लिए एक टर्न-अवेयर रिलेटिव एडवांटेज एल्गोरिदम का उपयोग करके एजेंटिक सुदृढीकरण लर्निंग (reinforcement learning) को स्केल करता है।

Shuaiyu Zhou, Fengpeng Yue, Zengjie Hu, Yuanzhe Shen, Chenyang Zhang, feng hong, Cao Liu, Ke Zeng2026-07-20
🧬 biology

Toward a mechanistic understanding of inference in visual cortex and diffusion models

यह शोध पत्र पेयरवाइज इंटरैक्शन (pairwise interactions) के साथ स्पार्स कोडिंग पर आधारित एक न्यूनतम, व्याख्या योग्य डिफ्यूजन मॉडल प्रस्तुत करता है जो उच्च-प्रदर्शन इमेज डिनोइज़िंग प्राप्त करने के लिए V1 हॉरिजॉन्टल कनेक्शन की नकल करता है और जैविक संवेदी अनुमान (biological perceptual inference) तथा ब्लैक-बॉक्स डिफ्यूजन आर्किटेक्चर की आंतरिक कार्यप्रणाली, दोनों में यांत्रिक अंतर्दृष्टि प्रदान करता है।

Zeyu Yun, Alexander Belsten, Dasheng Bi, Zahra Kadkhodaie, Yubei Chen, Bruno A. Olshausen2026-07-20
🤖 AI

Efficient Difficulty-Aware Dynamic Routing for Diffusion-Based Real-World Image Super-Resolution

यह शोध पत्र डिफ्यूजन-आधारित वास्तविक दुनिया के इमेज सुपर-रिज़ॉल्यूशन के लिए एक डिफिकल्टी-अवेयर डायनेमिक रूटिंग (DDR) रणनीति प्रस्तावित करता है जो अनुमानित बहाली कठिनाई (रेस्टोरेशन डिफिकल्टी) के आधार पर इनपुट्स को विभिन्न VAE डाउनसैंपलिंग अनुपातों वाले नेटवर्क में अनुकूल रूप से असाइन करता है, जिससे कठोर प्रसंस्करण प्रतिमानों और अपरिवर्तनीय विवरण हानि की सीमाओं को पार करते हुए दक्षता में सुधार होता है।

Xue Wu, Kang Zhao, Kafeng Wang, Jianfei Chen, Jingwei Xin, Nannan Wang, Xinbo Gao2026-07-20
🤖 AI

Debiasing Text-to-Image Evaluation via Implicit Cultural Alignment Reward Modeling

यह शोध पत्र एक कुशल, हल्का इम्पलिसिट कल्चरल एलाइनमेंट रिवॉर्ड मॉडल पेश करता है जो मौजूदा टेक्स्ट-टू-इमेज इवैल्यूएटर्स के सांस्कृतिक पूर्वाग्रह और विलंबता सीमाओं को दूर करने के लिए स्किप-कनेक्शन क्रॉस-अटेंशन मैकेनिज्म का लाभ उठाता है, जिससे कल्चरलफ्रेम्स बेंचमार्क पर बेहतर सटीकता और 10 गुना तेज़ इन्फरेंस गति प्राप्त होती है।

Bo-An Chang, Yu-Chih Chen2026-07-20