🧬 biology

Scaling Laws for Masked-Reconstruction Transformers on Single-Cell Transcriptomics

यह अध्ययन व्यवस्थित प्रमाण स्थापित करता है कि सिंगल-सेल आरएनए सीक्वेंसिंग डेटा पर प्रशिक्षित मास्कड-रिकंस्ट्रक्शन ट्रांसफॉर्मर, नेचुरल लैंग्वेज प्रोसेसिंग के समान न्यूरल स्केलिंग लॉ का पालन करते हैं, लेकिन केवल तभी जब डेटा की कमी की सीमाओं को पार करने के लिए पर्याप्त डेटा उपलब्ध हो।

Ihor Kendiukhov2026-06-09
🤖 machine learning

Geometry-Aware Uncertainty Quantification via Conformal Prediction on Manifolds

यह शोध पत्र एडेप्टिव जियोडेसिक कॉन्फॉर्मल प्रेडिक्शन (adaptive geodesic conformal prediction) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो रिमानियन मैनिफोल्ड्स (Riemannian manifolds) पर रिग्रेशन के लिए परिमित-नमूना कवरेज गारंटी प्रदान करने के लिए जियोडेसिक दूरियों और स्थानीय भविष्यवाणी कठिनाई का लाभ उठाता है, जिससे यह सिंथेटिक और वास्तविक दुनिया के भू-चुंबकीय पूर्वानुमान कार्यों में यूक्लिडियन-आधारित बेसलाइन की तुलना में बेहतर प्रदर्शन करता है।

Marzieh Amiri Shahbazi, Ali Baheri2026-06-09
📈 economics

Partial Identification under Missing Data Using Weak Shadow Variables from Pretrained Models

यह शोध पत्र एक आंशिक पहचान ढांचे (partial identification framework) का प्रस्ताव करता है जो 'मिसिंग नॉट एट रैंडम' (MNAR) डेटा के तहत जनसंख्या मात्राओं पर तीक्ष्ण सीमाएँ (sharp bounds) प्राप्त करने के लिए प्रीट्रेंड मॉडल्स से प्राप्त परिणाम भविष्यवाणियों को "कमजोर छाया चर" (weak shadow variables) के रूप में उपयोग करता है, जिससे शास्त्रीय विधियों की मजबूत धारणाओं या पूर्णता स्थितियों की आवश्यकता के बिना महत्वपूर्ण अंतराल न्यूनीकरण और वैध कवरेज प्राप्त होता है।

Hongyu Chen, David Simchi-Levi, Ruoxuan Xiong2026-06-09
🤖 machine learning

Insertion Based Sequence Generation with Learnable Order Dynamics

यह शोध पत्र LoFlexMDM को प्रस्तुत करता है, जो एक इंसर्शन-आधारित (insertion-based) मास्कड डिफ्यूजन मॉडल है जो अणु डिजाइन (molecule design) जैसे संरचित अनुक्रम पीढ़ी कार्यों में नमूना गुणवत्ता में सुधार करने के लिए डेटा-निर्भर पीढ़ी क्रमों (data-dependent generation orders) को सीखता है और साथ ही सुलभ प्रशिक्षण बनाए रखता है।

Dhruvesh Patel, Benjamin Rozonoyer, Gaurav Pandey, Tahira Naseem, Ramón Fernandez Astudillo, Andrew McCallum2026-06-09
🤖 AI

2-Step Agent: A Framework for the Interaction of a Decision Maker with AI Decision Support

यह शोध पत्र "2-स्टेप एजेंट" फ्रेमवर्क पेश करता है जो यह मॉडल करता है कि कैसे तर्कसंगत निर्णय लेने वाले एमएल (ML) भविष्यवाणियों से सूचना का अनुमान लगाते हैं, और यह प्रदर्शित करता है कि आदर्श परिस्थितियों में भी, मिसअलाइन्ड (misaligned) पूर्व धारणाएं एमएल-आधारित निर्णय सहायता को डाउनस्ट्रीम परिणामों को खराब कर सकती हैं।

Otto Nyberg, Fausto Carcassi, Davide Tugnoli, Giovanni CinÃ2026-06-09
💬 NLP

SPHERICAL KV: Angle-Domain Attention and Rate-Distortion Retention for Efficient Long-Context Inference

स्फेरिकल KV (Spherical KV) एक कुशल लॉन्ग-कॉन्टेक्स्ट इन्फरेंस विधि है जो एंगल-डोमेन अटेंशन (Angle-Domain Attention), जो सघन पुनर्निर्माण के बिना कॉम्पैक्ट स्फेरिकल की (spherical key) रिप्रजेंटेशन से सीधे अटेंशन लॉजिट्स की गणना करता है, और रेट-डिस्टॉर्शन रिटेंशन (Rate-Distortion Retention), जो एक निश्चित मेमोरी बजट के तहत टोकन रिटेंशन और प्रिसिजन को इष्टतम रूप से आवंटित करता है, को जोड़कर HBM बैंडविड्थ बाधाओं को संबोधित करता है।

Anay Chauhan, Gurucharan Marthi Krishna Kumar, Arion Das, Amit Dhanda, Vinija Jain, Aman Chadha, Amitava Das2026-06-09
💬 NLP

CAPruner: Conceptual-Adjacent Scene Graph Pruner for Enhancing 3D Spatial Reasoning of Large Language Models

यह शोध पत्र CAPruner प्रस्तुत करता है, जो एक नवीन सीन ग्राफ प्रनर (scene graph pruner) है जो 3D विजन-लैंग्वेज कार्यों के लिए कार्य-महत्वपूर्ण संबंधों को कुशलतापूर्वक चुनने के लिए फजी सिमेंटिक प्रासंगिकता (fuzzy semantic relevance) को स्थानिक निकटता (spatial proximity) के साथ जोड़ता है, जिससे बड़े भाषा मॉडलों की स्थानिक तर्क क्षमताओं को बढ़ाते हुए कम्प्यूटेशनल लागत को कम किया जा सके।

Shengli Zhou, Xiangchen Wang, Guanhua Chen, Feng Zheng2026-06-09
🤖 AI

Beyond Item IDs: Scaling Short-Form-Video Recommendation via Semantic-Native Long Sequence Modeling

यह शोध पत्र अरबों उपयोगकर्ताओं के पैमाने पर शॉर्ट-फॉर्म वीडियो अनुशंसा (recommendation) के लिए एक उत्पादन-तैनात (production-deployed) ढांचे को प्रस्तुत करता है जो विरल (sparse) वीडियो आईडी को संक्षिप्त सिमेंटिक (Semantic) आईडी से बदलकर और अल्ट्रा-लॉन्ग उपयोगकर्ता व्यवहार अनुक्रमों को कुशलतापूर्वक मॉडल करने के लिए एक ग्लोबल-अवेयर कम्प्रेशन ट्रांसफार्मर पेश करके पारंपरिक अनुक्रम मॉडलिंग की सीमाओं को दूर करता है, जिसके परिणामस्वरूप कंप्यूटिंग लागत में महत्वपूर्ण कमी और उपयोगकर्ता जुड़ाव में पर्याप्त सुधार होता है।

Ruixiao Sun, Diego Uribe Mora, Zhimeng Jiang, Yuanzhen Lin, Jiarui Wang, Yuening Li, Danfeng Guo, Zhizhong Chen, Chuan H (…)2026-06-09
🤖 machine learning

Offline Reinforcement Learning for Plasma Control in Nuclear Fusion: Codebase and Benchmark

यह शोध पत्र RL4F को प्रस्तुत करता है, जो वास्तविक DIII-D टोकामक डेटा पर आधारित परमाणु संलयन प्लाज्मा नियंत्रण के लिए एक मानकीकृत ऑफलाइन सुदृढीकरण शिक्षण (RL) बेंचमार्क है, जो चार पूर्ण-प्रोफ़ाइल ट्रैकिंग कार्यों में विभिन्न एल्गोरिदम का मूल्यांकन करता है और यह प्रदर्शित करता है कि ऑफलाइन मॉडल-आधारित विधियाँ इन जटिल, दीर्घ-क्षितिज समस्याओं में आम तौर पर बेहतर प्रदर्शन करती हैं।

Yang Fu, Haomin Bao, Rohit Sonker, Xiaoyan Hu, Aravind Venugopal, Jeff Schneider, Jiayu Chen2026-06-09
🤖 AI

Symbolic Reasoning Frameworks Modulate LLM Risk Aversion in Multi-Agent Strategic Settings

यह अध्ययन प्रदर्शित करता है कि एक बहु-एजेंट रणनीतिक खेल के भीतर एक एकल एजेंट में रिफ्लेक्टिव प्रॉम्प्ट्स के रूप में प्रतीकात्मक तर्क ढांचों (symbolic reasoning frameworks) को इंजेक्ट करना, स्वाभाविक जोखिम-विमुख पूर्वाग्रहों (risk-aversion biases) को नियंत्रित करता है और विशिष्ट ढांचों की सामग्री का पालन करने के बजाय स्वयं रिफ्लेक्टिव प्रक्रिया के माध्यम से पारिस्थितिकी तंत्र-व्यापी विजेता वितरणों को नया आकार देता है।

Augustin Chan2026-06-09