🤖 AI

VidPrism: Heterogeneous Mixture of Experts for Image-to-Video Transfer

VidPrism एक नवीन हेट्रोजेनियस मिक्सचर-ऑफ-एक्सपर्ट्स फ्रेमवर्क है जो कार्यात्मक रूप से विशिष्ट विशेषज्ञों को गतिशील रूप से जनरेट किए गए, कंटेंट-अवेयर मल्टी-रेट स्ट्रीम्स के माध्यम से फीड करके और उन्हें स्टेट-ऑफ-द-आर्ट वीडियो रिकग्निशन प्रदर्शन प्राप्त करने के लिए एक द्विदिश तंत्र के माध्यम से फ्यूज करके इमेज-टू-वीडियो ट्रांसफर लर्निंग में एक्सपर्ट होमोजेनाइजेशन की समस्या को दूर करता है।

Rui Lin, Chuanming Wang, Huadong Ma2026-05-28
🤖 machine learning

IRDS: Interpretable RLVR Data Selection via Verifier-Coupled Sparse Autoencoder Coverage

यह शोध पत्र IRDS को प्रस्तुत करता है, जो 'वेरिफिएबल रिवार्ड्स' (verifiable rewards) के साथ सुदृढीकरण शिक्षण (Reinforcement Learning) के लिए एक व्याख्या योग्य डेटा चयन पद्धति है, जो उच्च गुणवत्ता वाले प्रशिक्षण उदाहरणों को कुशलतापूर्वक चुनने के लिए एक 'वेरिफायर-कपल्ड स्पार्स ऑटोएन्कोडर कवरेज' (verifier-coupled sparse autoencoder coverage) उद्देश्य का उपयोग करता है, जिससे गणितीय बेंचमार्क पर तर्क क्षमता (reasoning performance) में उल्लेखनीय सुधार होता है और साथ ही गणनात्मक लागत भी कम होती है।

Yuhan Li, Mingxu Zhang, Dazhong Shen, Ying Sun2026-05-28
🤖 AI

AI, Take the Wheel: What Drives Delegation and Trust in Human-Computer Cooperative Question Answering?

यह शोध पत्र मानव-एआई प्रश्न-उत्तर टीमों में प्रतिनिधिमंडल (delegation) और अंगीकरण (adoption) की विशिष्ट गतिशीलता की जांच करता है, जो यह प्रकट करता है कि जहाँ सहयोग व्यक्तिगत एजेंटों से बेहतर प्रदर्शन करता है, वहीं मनुष्य पुष्टिकरण पूर्वाग्रह (confirmation bias) और गलत संरेखित आत्मविश्वास के कारण उप-इष्टतम विश्वास निर्णय लेते हैं, जिससे बेहतर अंशांकन (calibration) और स्पष्टीकरण तंत्र की आवश्यकता होती है।

Maharshi Gor, Yoo Yeon Sung, Yu Hou, Eve Fleisig, Irene Ying, Tianyi Zhou, Jordan Boyd-Graber2026-05-28
🤖 AI

Entropy Distribution as a Fingerprint for Hallucinations in Generative Models

यह शोध पत्र कैलिब्रेटेड एंट्रॉपी स्कोर (CES) को प्रस्तुत करता है, जो एक हल्का, सिंगल-पास ब्लैक-बॉक्स तरीका है जो औपचारिक त्रुटि गारंटी और कम्प्यूटेशनल रूप से महंगे मल्टी-सैंपल दृष्टिकोणों के तुलनीय प्रदर्शन के साथ LLM मतिभ्रम (hallucinations) का पता लगाने के लिए टोकन-स्तरीय एंट्रॉपी वितरणों का लाभ उठाता है।

Mattia J. Villani, Pranav Deshpande, Akshay Seshadri, Romina Yalovetzky, Niraj Kumar2026-05-28
🤖 AI

Global Policy-Space Response Oracles for Two-Player Zero-Sum Games

यह शोधपत्र ग्लोबल PSRO को प्रस्तुत करता है, जो दो-खिलाड़ी शून्य-योग खेलों (two-player zero-sum games) के लिए एक नवीन एल्गोरिदम है, जो जनसंख्या शोषणशीलता (Population Exploitability) को सीधे कम करने के लिए एक दो-चरणीय अन्वेषण-चयन ढांचे का उपयोग करके मौजूदा पॉलिसी-स्पेस रिस्पांस ओरेकल (PSRO) विधियों में सुधार करता है, जिससे कम पॉलिसी पुनरावृत्तियों (policy iterations) के साथ नैश इक्विलिब्रियम (Nash equilibria) की ओर कम शोषणशीलता और तेज़ अभिसरण (faster convergence) प्राप्त होता है।

Junyu Zhang, Feihong Yang, Jian Wang, Chao Wang, Xudong Zhang2026-05-28
🤖 AI

Where Rollouts Begin: Low-Load, High-Leverage First-Token Diversification for RLVR

यह शोध पत्र REFT को प्रस्तुत करता है, जो एक हल्का RLVR तरीका है जो रीजनिंग मार्कर के बाद पहले टोकन के लिए पॉलिसी के शीर्ष-NN उम्मीदवारों से समान रूप से नमूना लेकर रोलआउट विविधता को बढ़ाता है और रीजनिंग प्रदर्शन में सुधार करता है, जिससे शुद्धता संकेत (correctness signal) को बदले बिना अन्वेषण का विस्तार होता है।

Soeun Kim, Albert No2026-05-28
🤖 AI

Better Accuracies, Worse Reasoning: A Step-Level Audit of Medical Chain-of-Thought Distillation

यह शोध पत्र यह प्रकट करता है कि जहाँ चेन-ऑफ-थॉट डिस्टिलेशन चिकित्सा संबंधी प्रश्नोत्तर (medical QA) में उत्तर की सटीकता और अंशांकन (calibration) में महत्वपूर्ण सुधार करता है, वहीं यह विरोधाभासी रूप से मध्यवर्ती तर्क चरणों की तथ्यात्मकता को कम कर देता है, जो एक गंभीर दोष है जिसे मानक उत्तर-स्तरीय मेट्रिक्स पहचानने में विफल रहते हैं।

Zhaoyang Jiang, Xuanqi Peng, Fei Teng, Zhizhong Fu, Yunsoo Kim, Jiacong Mi, Zicheng Li, Honghan Wu2026-05-28
💬 NLP

Routing-Aligned Fine-Tuning for Multilingual Downstream Tasks in Mixture-of-Experts Models

यह शोध पत्र RA-MoE का प्रस्ताव करता है, जो एक तीन-चरणीय फाइन-ट्यूनिंग फ्रेमवर्क है जो मिक्सचर-ऑफ-एक्सपर्ट्स मॉडल्स के मध्य परतों में भाषा-सार्वभौमिक संरेखण क्षेत्र (language-universal alignment zone) का लाभ उठाकर लक्ष्य-भाषा के रूटिंग पैटर्न को अंग्रेजी कार्य-विशेषज्ञ सक्रियणों (English task-expert activations) के साथ संरेखित करता है, जिससे बहुभाषी डाउनस्ट्रीम प्रदर्शन में महत्वपूर्ण सुधार होता है।

Guanzhi Deng, Kuan Wu, Haibo Wang, Shing Yin Wong, Sichun Luo, Linqi Song2026-05-28
🔬 physics

Hybrid Neural World Models

यह शोधपत्र हाइब्रिड न्यूरल वर्ल्ड मॉडल्स (hybrid neural world models) को प्रस्तुत करता है, जो एक एकल-नेटवर्क फ्रेमवर्क है जो शास्त्रीय सॉल्वर की तुलना में महत्वपूर्ण गति के साथ भौतिक गतिकी (physical dynamics) की भविष्यवाणी करता है और साथ ही झटकों (shocks) और संपर्कों (contacts) जैसे तीव्र विच्छेदन (discontinuities) का पता लगाने के लिए आंतरिक रूप से एक त्रुटि मानचित्र (error map) उत्पन्न करता है, जिससे एक फॉलबैक तंत्र सक्षम होता है जो बिना किसी अतिरिक्त अंशांकन (calibration) या शासी-समीकरण ज्ञान की आवश्यकता के भविष्यवाणियों की त्रुटियों को काफी कम कर देता है।

Pranav Lakshmanan, Paras Chopra2026-05-28✓ Author reviewed
🤖 AI

Identifying Explicit Parsimonious Piece-wise Polynomial Relationships in Industrial time-series: Application to manipulator robots

यह शोध पत्र औद्योगिक समय-श्रृंखला डेटा से स्पष्ट, संक्षिप्त खंडवार बहुपद (piece-wise polynomial) संबंधों की पहचान करने के लिए एक एल्गोरिदम प्रस्तावित करता है, जो निहित निरूपणों (implicit representations) का लाभ उठाकर मैनिपुलेटर रोबोटों के लिए व्युत्क्रम गति विज्ञान (inverse kinematics) को मॉडल करने में इसकी प्रभावशीलता को प्रदर्शित करता है और अनदेखे संदर्भों में डीप न्यूरल नेटवर्क की तुलना में बेहतर सामान्यीकरण दिखाता है।

Mazen Alamir, Sacha Clavel2026-05-28