🤖 AI

Exploring and Developing a Pre-Model Safeguard with Draft Models

यह शोध पत्र एक प्री-मॉडल सेफगार्ड का प्रस्ताव करता है जो ड्राफ्ट रिस्पॉन्स जनरेट करने के लिए बड़े लैंग्वेज मॉडल्स से छोटे ड्राफ्ट मॉडल्स में जेलब्रेक हमलों की ट्रांसफरेबिलिटी का लाभ उठाता है, जिससे मौजूदा गार्ड्स को पोस्ट-मॉडल ऑडिटिंग की उच्च कम्प्यूटेशनल लागतों से बचते हुए, टारगेट मॉडल इन्फरेंस से पहले असुरक्षित प्रॉम्प्ट्स को अधिक सटीकता से पहचानने में सक्षम बनाया जा सके।

Hongyu Cai, Arjun Arunasalam, Yiming Liang, Antonio Bianchi, Z. Berkay Celik2026-05-20
💬 NLP

STAR-PólyaMath: Multi-Agent Reasoning under Persistent Meta-Strategic Supervision

यह शोधपत्र STAR-PólyaMath को प्रस्तुत करता है, जो एक निरंतर मेटा-स्ट्रैटेजिस्ट (Meta-Strategist) और संरचित रीज़नर-वेरिफायर (Reasoner-Verifier) लूप्स वाला एक मल्टी-एजेंट फ्रेमवर्क है, जो मेटा-स्तरीय पर्यवेक्षण के माध्यम से मतिभ्रम (hallucination), मेमोरी विखंडन (memory fragmentation) और टूल के दुरुपयोग को प्रभावी ढंग से कम करके आठ शीर्ष-स्तरीय गणितीय बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त करता है।

Jiaao Wu, Xian Zhang, Hanzhang Liu, Sophia Zhang, Fan Yang, Yinpeng Dong2026-05-20
💬 NLP

HalluWorld: A Controlled Benchmark for Hallucination via Reference World Models

यह शोध पत्र HalluWorld को प्रस्तुत करता है, जो भाषा मॉडलों में मतिभ्रम (hallucinations) का व्यवस्थित रूप से मूल्यांकन और वर्गीकरण करने के लिए स्पष्ट संदर्भ विश्व मॉडलों (reference world models) का उपयोग करने वाला एक नियंत्रित बेंचमार्क है, जो यह प्रकट करता है कि जबकि संवेदी त्रुटियाँ (perceptual errors) काफी हद तक हल हो गई हैं, बहु-चरणीय अवस्था ट्रैकिंग (multi-step state tracking), कारण सिमुलेशन (causal simulation) और परहेज (abstention) में चुनौतियाँ बनी हुई हैं।

Emmy Liu, Varun Gangal, Michael Yu, Zhuofu Tao, Karan Singh, Sachin Kumar, Steven Y. Feng2026-05-20
💬 NLP

IMLJD: A Computational Dataset for Indian Matrimonial Litigation Analysis

यह शोध पत्र IMLJD को प्रस्तुत करता है, जो सुप्रीम कोर्ट और कर्नाटक हाई कोर्ट (2000-2024) के 3,613 भारतीय वैवाहिक मुकदमेबाजी संबंधी निर्णयों से बना एक खुला कम्प्यूटेशनल डेटासेट है, जो दोनों न्यायालयों के बीच क्वैशिंग याचिका (quashing petition) की सफलता दर में एक महत्वपूर्ण असमानता के साथ-साथ कानूनी विश्लेषण के लिए संरचित मेटाडेटा और एक नॉलेज ग्राफ को प्रकट करता है।

Joy Bose2026-05-20
💬 NLP

PAVE: A Cognitive Architecture for Legitimate Violation in Generative Agent Societies

यह शोध पत्र PAVE को प्रस्तुत करता है, जो एक नवीन चार-मॉड्यूल वाला संज्ञानात्मक आर्किटेक्चर है जो जनरेटिव एजेंटों को संरचित, व्याख्या योग्य और तर्कसंगत निर्णय लेने में सक्षम बनाता है ताकि वे केवल आपातकालीन ट्रिगर्स द्वारा सख्ती से न्यायसंगत होने पर ही नियमों का वैध रूप से उल्लंघन कर सकें, जबकि अधिकार के प्रति सम्मान और सीमित दायरे को बनाए रखें।

Ahmad Yehia, Abduallah Mohamed, Kun Qian, Tianyi Wang, Jiseop Byeon, Omar Hassanin, Christian Claudel2026-05-20
🧬 biology

Brain alignment of reasoning and action representations from vision-language and action models during naturalistic gameplay

यह अध्ययन प्रदर्शित करता है कि प्राकृतिक गेमप्ले के दौरान क्रिया (LAMs) बनाम तर्क (VLMs) के लिए फाउंडेशन मॉडल्स को फाइन-ट्यून करने से मस्तिष्क संरेखण के विशिष्ट पैटर्न सामने आते हैं, जहाँ LAMs फ्रंटल-मोटर क्षेत्रों में असममित, क्रिया-विशिष्ट प्रतिनिधित्व दिखाते हैं जबकि दोनों मॉडल सुदृढीकरण शिक्षण (reinforcement learning) बेसलाइन्स की तुलना में बेहतर प्रदर्शन करते हैं, जिसमें लाभ कॉर्टिकल प्रोसेसिंग पदानुक्रम के साथ बढ़ते हैं।

Subba Reddy Oota, Anant Khandelwal, Khushbu Pahwa, Satya Sai Srinath Namburi, Tanmoy Chakraborty, Bapi S. Raju, Manish G (…)2026-05-20
🤖 AI

Generative Recursive Reasoning

यह शोध पत्र जेनेरेटिव रिकर्सिव रीजनिंग मॉडल्स (GRAM) को प्रस्तुत करता है, जो एक संभाव्य ढांचा (प्रोबेबिलिस्टिक फ्रेमवर्क) है जो स्टोकेस्टिक, मल्टी-ट्रैजेक्टरी लेटेंट स्टेट रिफाइनमेंट को सक्षम करके रिकर्सिव रीजनिंग को बढ़ाता है, जिससे इन्फरेंस-टाइम स्केलिंग, विविध परिकल्पना सृजन, और कंडीशनल रीजनिंग एवं अनकंडीशनल जनरेशन दोनों को समर्थन मिलता है।

Junyeob Baek, Mingyu Jo, Minsu Kim, Mengye Ren, Yoshua Bengio, Sungjin Ahn2026-05-20
🤖 AI

PRISM: A Benchmark for Programmatic Spatial-Temporal Reasoning

यह शोध पत्र PRISM को प्रस्तुत करता है, जो एक बड़े पैमाने का, बहुभाषी बेंचमार्क और एक व्यापक मूल्यांकन ढांचा है जिसे प्रोग्रामेटिक वीडियो जनरेशन में भाषा मॉडलों की स्थानिक-कालिक (spatial-temporal) तर्क क्षमताओं का कड़ाई से आकलन करने के लिए डिज़ाइन किया गया है, जो कोड की निष्पादन क्षमता (executability) और दृश्य स्थानिक सुसंगतता (visual spatial coherence) के बीच एक महत्वपूर्ण अंतर को प्रकट करता है।

Qiran Zhang, Yuheng Wang, Runde Yang, Lin Wu, Jingru Fan, Shu Yao, Jie Zhang, Tianle Zhou, Huatao Li, Ruijie Shi, Yihan (…)2026-05-20
🤖 AI

Rebalancing Reference Frame Dominance to Improve Motion in Image-to-Video Models

यह शोध पत्र DyMoS को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त और मॉडल-अज्ञेय (model-agnostic) विधि है जो अटेंशन मैकेनिज्म में संदर्भ-फ्रेम के प्रभुत्व को पुनर्संतुलित करके इमेज-टू-वीडियो जनरेशन में मोशन डायनेमिक्स को बढ़ाती है, जिससे विजुअल फिडेलिटी से समझौता किए बिना या अतिरिक्त प्रशिक्षण की आवश्यकता के बिना मोशन सप्रेशन (motion suppression) पर विजय प्राप्त की जाती है।

Wooseok Jeon, Seungho Park, Seunghyun Shin, Sangeyl Lee, Hyeonho Jeong, Hae-Gon Jeon2026-05-20
🤖 machine learning

A Bitter Lesson for Data Filtering

यह शोध पत्र इस पारंपरिक धारणा को चुनौती देता है कि बड़े मॉडल के प्रीट्रेनिंग के लिए डेटा फ़िल्टरिंग आवश्यक है, यह उच्च-कंप्यूट, डेटा-दुर्लभ व्यवस्थाओं में स्केलिंग अध्ययनों के माध्यम से प्रदर्शित करता है कि पर्याप्त रूप से प्रशिक्षित बड़े मॉडल वास्तव में कम गुणवत्ता वाले और विचलित करने वाले डेटा को हटाने के बजाय उन्हें शामिल करने से लाभान्वित होते हैं।

Christopher Mohri, John Duchi, Tatsunori Hashimoto2026-05-20