💬 NLP

OpenCompass: A Universal Evaluation Platform for Large Language Models

यह शोध पत्र OpenCompass को प्रस्तुत करता है, जो एक ओपन-सोर्स, स्केलेबल और उच्च-समानांतरता (high-concurrency) वाला मूल्यांकन मंच है, जिसे विविध डोमेन में बड़े भाषा मॉडलों के व्यापक और कुशल मूल्यांकन के लिए एक मॉड्यूलर, एकीकृत ढांचे के माध्यम से पारंपरिक स्थिर बेंचमार्क की सीमाओं को दूर करने के लिए डिज़ाइन किया गया है।

Maosong Cao, Kai Chen, Haodong Duan, Yixiao Fang, Tong Gao, Ge Jiaye, Mo Li, Hongwei Liu, Junnan Liu, Yuan Liu, Chengqi (…)2026-05-20
🤖 machine learning

Rethinking Muon Beyond Pretraining: Spectral Failures and High-Pass Remedies for VLA and RLVR

यह शोध पत्र Pion को प्रस्तुत करता है, जो एक हाई-पास स्पेक्ट्रल ऑप्टिमाइज़र है जो शोर वाले ग्रेडिएंट घटकों को दबाकर और प्रति-हेड विशेषज्ञता को संरक्षित करके Muon में सुधार करता है, जिससे विज़न-लैंग्वेज-एक्शन प्रशिक्षण और सत्यापन योग्य पुरस्कारों के साथ सुदृढीकरण शिक्षण (reinforcement learning) में बेहतर प्रदर्शन और स्थिरता प्राप्त होती है जहाँ Muon और AdamW संघर्ष करते हैं।

Chongyu Fan, Gaowen Liu, Mingyi Hong, Ramana Rao Kompella, Sijia Liu2026-05-20
💬 NLP

Language models struggle with compartmentalization

यह शोध पत्र प्रदर्शित करता है कि बड़े भाषा मॉडल अक्सर एक ही अंतर्निहित अवधारणा (जैसे कि विभिन्न भाषाएँ या प्रोग्रामिंग प्रतिमान) की अलग-अलग प्रस्तुतियों को साझा आंतरिक निरूपणों में एकीकृत करने में विफल रहते हैं, जिससे अनावश्यक शिक्षण, कम नमूना दक्षता और अवधारणा प्रस्तुतियों की संख्या के आधार पर हस्तक्षेप प्रभावशीलता में एक चरण संक्रमण (फेज ट्रांजिशन) होता है।

Thomas Vincent Howe, David Wingate2026-05-20
📊 statistics

Factor Augmented High-Dimensional SGD

यह शोध पत्र फैक्टर-ऑगमेंटेड SGD (FSGD) प्रस्तुत करता है, जो उच्च-आयामी शिक्षण (high-dimensional learning) के लिए एक स्केलेबल अनुकूलन विधि है जो लेटेंट फैक्टर रिप्रजेंटेशन को एकीकृत करके स्ट्रीमिंग डेटा पर कार्य करती है और फैक्टर अनुमान त्रुटियों (factor estimation errors) को ध्यान में रखते हुए पहला सैद्धांतिक अभिसरण विश्लेषण (theoretical convergence analysis) प्रदान करती है।

Shubo Li, Yuefeng Han, Xiufan Yu2026-05-20
🔢 mathematics

Domain-Adaptive Communication-Rate Optimization for Sim-to-Real Humanoid-Robot Wireless XR Teleoperation

यह शोध पत्र मानव रूपी रोबोटों (ह्यूमनॉइड रोबोट्स) के वायरलेस एक्सआर (XR) टेलीऑपरेशन के लिए एक डोमेन-अनुकूली संचार-दर अनुकूलन ढांचे का प्रस्ताव करता है जो सिम-टू-रियल वितरण बदलावों (डिस्ट्रीब्यूशन शिफ्ट्स) के तहत मोशन रिकंस्ट्रक्शन सटीकता को बनाए रखते हुए ऊर्जा खपत को कम करने के लिए एक सिम्युलेटर-प्रशिक्षित, डेंसिटी-रेशियो-वेटेड पीपीओ (PPO) एल्गोरिदम का उपयोग करता है।

Caolu Xu, Zhiyong Chen, Meixia Tao, Li Song, Feng Yang, Wenjun Zhang2026-05-20
🤖 machine learning

BrainDyn: A Sheaf Neural ODE for Generative Brain Dynamics

डिब्रेन (DiebDyn) एक नवीन शीफ न्यूरल ऑर्डिनरी डिफरेंशियल इक्वेशन मॉडल है जो fMRI, EEG और सिम्युलेटेड डेटा में यथार्थवादी मस्तिष्क गतिविधि उत्पन्न करने के लिए शारीरिक मस्तिष्क संरचना को निरंतर-समय गतिकी (continuous-time dynamics) के साथ एकीकृत करता है, जिससे सटीक पूर्वानुमान और इन सिलिको (in silico) व्यवधान विश्लेषण सक्षम होता है।

Siddharth Viswanath, Panayiotis Ketonis, Chen Liu, Michael Perlmutter, Dhananjay Bhaskar, Smita Krishnaswamy2026-05-20
💬 NLP

HalluWorld: A Controlled Benchmark for Hallucination via Reference World Models

यह शोध पत्र HalluWorld को प्रस्तुत करता है, जो भाषा मॉडलों में मतिभ्रम (hallucinations) का व्यवस्थित रूप से मूल्यांकन और वर्गीकरण करने के लिए स्पष्ट संदर्भ विश्व मॉडलों (reference world models) का उपयोग करने वाला एक नियंत्रित बेंचमार्क है, जो यह प्रकट करता है कि जबकि संवेदी त्रुटियाँ (perceptual errors) काफी हद तक हल हो गई हैं, बहु-चरणीय अवस्था ट्रैकिंग (multi-step state tracking), कारण सिमुलेशन (causal simulation) और परहेज (abstention) में चुनौतियाँ बनी हुई हैं।

Emmy Liu, Varun Gangal, Michael Yu, Zhuofu Tao, Karan Singh, Sachin Kumar, Steven Y. Feng2026-05-20
🤖 machine learning

What Makes a Representation Good for Single-Cell Perturbation Prediction?

यह शोधपत्र PerturbedVAE को प्रस्तुत करता है, जो एक नया ढांचा है जो सिंगल-सेल डेटा में विरल परटर्बेशन संकेतों (sparse perturbation signals) की चुनौती का समाधान करता है, जिससे वह प्रमुख अपरिवर्तनीय संरचनाओं (dominant invariant structures) से स्पष्ट रूप से परटर्बेशन-विशिष्ट जानकारी को अलग करता है, और इस प्रकार आनुवंशिक परटर्बेशन के प्रति कोशिकीय प्रतिक्रियाओं की भविष्यवाणी करने में अत्याधुनिक प्रदर्शन प्राप्त करता है।

Wenkang Jiang, Yuhang Liu, Yichao Cai, Erdun Gao, Jiayi Dong, Ehsan Abbasnejad, Lina Yao, Javen Qinfeng Shi2026-05-20
💬 NLP

IMLJD: A Computational Dataset for Indian Matrimonial Litigation Analysis

यह शोध पत्र IMLJD को प्रस्तुत करता है, जो सुप्रीम कोर्ट और कर्नाटक हाई कोर्ट (2000-2024) के 3,613 भारतीय वैवाहिक मुकदमेबाजी संबंधी निर्णयों से बना एक खुला कम्प्यूटेशनल डेटासेट है, जो दोनों न्यायालयों के बीच क्वैशिंग याचिका (quashing petition) की सफलता दर में एक महत्वपूर्ण असमानता के साथ-साथ कानूनी विश्लेषण के लिए संरचित मेटाडेटा और एक नॉलेज ग्राफ को प्रकट करता है।

Joy Bose2026-05-20
🤖 machine learning

CompoSE: Compositional Synthesis and Editing of 3D Shapes via Part-Aware Control

CompoSE एक नवीन डिफ्यूजन ट्रांसफार्मर-आधारित विधि है जो पार्ट-लेवल टेक्स्ट प्रॉम्प्ट्स की आवश्यकता के बिना, मोटे ज्यामितीय पार्ट लेआउट को विस्तृत, पार्ट-पृथक वस्तुओं में परिवर्तित करके उच्च-गुणवत्ता वाले 3D आकारों को संश्लेषित और संपादित करती है, जिसमें सूक्ष्म संपादन क्षमताएं भी शामिल हैं।

Habib Slim, Shariq Farooq Bhat, Mohamed Elhoseiny, Yifan Wang, Mike Roberts2026-05-20