💬 NLP

Zero-Shot Detection of LLM-Generated Text via Implicit Reward Model

यह शोध पत्र IRM को प्रस्तुत करता है, जो LLM-जनित टेक्स्ट का पता लगाने के लिए एक नवीन ज़ीरो-शॉट दृष्टिकोण है, जो बिना किसी प्राथमिकता संग्रह या अतिरिक्त प्रशिक्षण के बेहतर प्रदर्शन प्राप्त करने के लिए मौजूदा मॉडलों से प्राप्त निहित रिवॉर्ड मॉडल्स का लाभ उठाता है।

Runheng Liu, Heyan Huang, Xingchen Xiao, Zhijing Wu2026-04-24
💬 NLP

EngramaBench: Evaluating Long-Term Conversational Memory with Structured Graph Retrieval

यह शोध पत्र दीर्घकालिक संवादात्मक स्मृति के मूल्यांकन के लिए एक बेंचमार्क, EngramaBench प्रस्तुत करता है, और यह प्रदर्शित करता है कि जबकि फुल-कॉन्टेक्स्ट प्रॉम्प्टिंग उच्चतम समग्र प्रदर्शन प्राप्त करती है, प्रस्तावित ग्राफ-स्ट्रक्चर्ड मेमोरी सिस्टम (Engrama) क्रॉस-स्पेस रीजनिंग में विशिष्ट रूप से इससे बेहतर प्रदर्शन करता है, जो विशेष संरचनात्मक लाभों और समग्र अनुकूलन के बीच एक मौलिक ट्रेड-ऑफ को प्रकट करता है।

Julian Acuna2026-04-24
💻 computer science

ReCAPA: Hierarchical Predictive Correction to Mitigate Cascading Failures

ReCAPA एक पदानुक्रमित ढांचा (hierarchical framework) है जो कार्यों, उप-लक्ष्यों (subgoals) और प्रक्षेप पथों (trajectories) के बीच भविष्य कहनेवाला संरेखण (predictive alignment) और सुधार का उपयोग करके विजन-लैंग्वेज-एक्शन सिस्टम में कैस्केडिंग विफलताओं को कम करता है ताकि लंबी अवधि के कार्यों के दौरान स्थानीय त्रुटियों को फैलने से रोका जा सके।

Xiyin Zeng, Yuyu Sun, Haoyang Li, Shouqiang Liu, Hao Wang2026-04-24
💬 NLP

Planning Beyond Text: Graph-based Reasoning for Complex Narrative Generation

यह शोध पत्र PLOTTER का परिचय देता है, जो एक ऐसा ढांचा है जो सीधे टेक्स्ट के बजाय संरचनात्मक घटना और चरित्र ग्राफ पर 'इवैल्यूएट-प्लान-रिवाइज' (मूल्यांकन-योजना-संशोधन) चक्र को निष्पादित करके जटिल कथा निर्माण को उन्नत करता है, जिससे वैश्विक सुसंगतता, तार्किक निरंतरता और चरित्र विकास में महत्वपूर्ण सुधार होता है।

Hanwen Gu, Chao Guo, Junle Wang, Wenda Xie, Yisheng Lv2026-04-24
📈 economics

Calibeating Prediction-Powered Inference

यह शोध पत्र कैलिब्रेटेड प्रेडिक्शन-पावर्ड इन्फरेंस (Calibrated Prediction-Powered Inference) को प्रस्तुत करता है, जो एक अर्ध-पर्यवेक्षित (semisupervised) माध्य अनुमान पद्धति है जो पुनरप्रशिक्षण के बिना एस्टिमेटर की दक्षता और भविष्य कहने वाली सटीकता में सुधार करने के लिए एक छोटे लेबल वाले नमूने पर ब्लैक-बॉक्स प्रेडिक्शन स्कोर को पोस्ट-हॉक कैलिब्रेट करती है, जो आइसोटोनिक कैलिब्रेशन (isotonic calibration) के लिए प्रथम-क्रम अनुकूलता गारंटी और AIPW एवं PPI++ जैसे मौजूदा दृष्टिकोणों के विरुद्ध प्रतिस्पर्धी प्रदर्शन प्रदान करती है।

Lars van der Laan, Mark Van Der Laan2026-04-24
🧬 biology

Trustworthy Clinical Decision Support Using Meta-Predicates and Domain-Specific Languages

यह शोधपत्र नैदानिक निर्णय नियमों पर ज्ञानमीमांसीय बाधाओं को लागू करने के लिए मेटा-प्रिडिकेट्स और एक डोमेन-विशिष्ट भाषा का उपयोग करने वाले एक ढांचे का प्रस्ताव करता है, जिससे यह सुनिश्चित होता है कि एआई-संचालित स्वास्थ्य सेवा निर्णय न केवल सटीक हों, बल्कि तैनाती से पहले ऑडिट योग्य और उपयुक्त साक्ष्यों पर आधारित भी हों।

Michael Bouzinier, Sergey Trifonov, Michael Chumack, Eugenia Lvova, Dmitry Etin2026-04-24
💬 NLP

Do LLM Decoders Listen Fairly? Benchmarking How Language Model Priors Shape Bias in Speech Recognition

यह शोध पत्र पांच जनसांख्यिकीय अक्षों और विभिन्न ध्वनिक स्थितियों में नौ स्पीच रिकग्निशन मॉडलों का बेंचमार्किंग करता है, जिससे यह पता चलता है कि ऑडियो एनकोडर डिज़ाइन और संपीड़न स्तर—न कि एलएलएम (LLM) का पैमाना—निष्पक्षता और मजबूती के प्राथमिक निर्धारक हैं, जिसमें विशिष्ट निष्कर्ष यह हैं कि एलएलएम डिकोडर स्वाभाविक रूप से नस्लीय पूर्वाग्रह को नहीं बढ़ाते हैं, लेकिन सन्नाटा इंजेक्शन या मास्किंग के तहत गंभीर, जनसांख्यिकीय-चयनात्मक मतिभ्रम (hallucinations) प्रदर्शित कर सकते हैं।

Srishti Ginjala, Eric Fosler-Lussier, Christopher W. Myers, Srinivasan Parthasarathy2026-04-24
💻 computer science

Can MLLMs "Read" What is Missing?

यह शोध पत्र MMTR-Bench प्रस्तुत करता है, जो एक नवीन बेंचमार्क है जो स्पष्ट प्रॉम्प्ट के बिना सीधे दृश्य संदर्भ से मास्क किए गए टेक्स्ट को पुनर्गठित करने की मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स की अंतर्निहित क्षमता का मूल्यांकन करता है, जिससे उनके लेआउट समझ, विजुअल ग्राउंडिंग और ज्ञान एकीकरण क्षमताओं को अलग करके और उनका आकलन करके देखा जा सकता है।

Jindi Guo, Xi Fang, Chaozheng Huang2026-04-24
💬 NLP

Spatial Metaphors for LLM Memory: A Critical Analysis of the MemPalace Architecture

यह शोध पत्र मेमपैलेस (MemPalace) आर्किटेक्चर का आलोचनात्मक विश्लेषण करता है, और इस निष्कर्ष पर पहुँचता है कि जहाँ इसका उत्कृष्ट रिट्रीवल प्रदर्शन मुख्य रूप से इसके नवीन स्थानिक रूपक (spatial metaphor) के बजाय वर्बेटिम स्टोरेज और मानक वेक्टर फ़िल्टरिंग से उपजा है, वहीं यह प्रणाली अपने कम लागत वाले, नियतात्मक राइट पाथ (deterministic write path) और एआई में स्थानिक स्मृति सिद्धांतों के पहले व्यवस्थित अनुप्रयोग के माध्यम से वास्तविक वास्तुशिल्प मूल्य प्रदान करती है, भले ही इसे उन दावों के साथ विपणन किया गया हो जो इसकी वैज्ञानिक कठोरता से अधिक हैं।

Robin Dey, Panyanon Viradecha2026-04-24
💬 NLP

Cross-Entropy Is Load-Bearing: A Pre-Registered Scope Test of the K-Way Energy Probe on Bidirectional Predictive Coding

यह पूर्व-पंजीकृत अध्ययन प्रदर्शित करता है कि सॉफ्टमैक्स के सापेक्ष K-वे एनर्जी प्रोब का प्रदर्शन क्रॉस-एन्ट्रॉपी प्रशिक्षण पर अत्यधिक निर्भर है, जो द्विदिशीय अनुमान गतिशीलता (bidirectional inference dynamics) या लेटेंट मूवमेंट मैग्नीट्यूड के बजाय काफी बड़े लॉजिट नॉर्म्स और एक स्केल-इनवेरिएंट रैंकिंग लाभ को प्रेरित करता है।

Jon-Paul Cacioli2026-04-24