💬 NLP

Zero-Shot Detection of LLM-Generated Text via Implicit Reward Model

यह शोध पत्र IRM को प्रस्तुत करता है, जो LLM-जनित टेक्स्ट का पता लगाने के लिए एक नवीन ज़ीरो-शॉट दृष्टिकोण है, जो बिना किसी प्राथमिकता संग्रह या अतिरिक्त प्रशिक्षण के बेहतर प्रदर्शन प्राप्त करने के लिए मौजूदा मॉडलों से प्राप्त निहित रिवॉर्ड मॉडल्स का लाभ उठाता है।

Runheng Liu, Heyan Huang, Xingchen Xiao, Zhijing Wu2026-04-24
💬 NLP

EngramaBench: Evaluating Long-Term Conversational Memory with Structured Graph Retrieval

यह शोध पत्र दीर्घकालिक संवादात्मक स्मृति के मूल्यांकन के लिए एक बेंचमार्क, EngramaBench प्रस्तुत करता है, और यह प्रदर्शित करता है कि जबकि फुल-कॉन्टेक्स्ट प्रॉम्प्टिंग उच्चतम समग्र प्रदर्शन प्राप्त करती है, प्रस्तावित ग्राफ-स्ट्रक्चर्ड मेमोरी सिस्टम (Engrama) क्रॉस-स्पेस रीजनिंग में विशिष्ट रूप से इससे बेहतर प्रदर्शन करता है, जो विशेष संरचनात्मक लाभों और समग्र अनुकूलन के बीच एक मौलिक ट्रेड-ऑफ को प्रकट करता है।

Julian Acuna2026-04-24
🤖 machine learning

Learning Dynamic Representations and Policies from Multimodal Clinical Time-Series with Informative Missingness

यह शोध पत्र मल्टीमॉडल क्लिनिकल टाइम सीरीज़ से डायनेमिक पेशेंट रिप्रेजेंटेशन सीखने के लिए एक नवीन फ्रेमवर्क प्रस्तावित करता है जो एक मल्टीमॉडल एनकोडर और बेयसियन फ़िल्टरिंग के माध्यम से सूचनात्मक अनुपलब्धता (informative missingness) का स्पष्ट रूप से लाभ उठाता है, जो बड़े पैमाने के ICU डेटासेट्स पर ऑफलाइन ट्रीटमेंट पॉलिसी लर्निंग और मृत्यु दर भविष्यवाणी में बेहतर प्रदर्शन प्रदर्शित करता है।

Zihan Liang, Ziwen Pan, Ruoxuan Xiong2026-04-24
💬 NLP

Planning Beyond Text: Graph-based Reasoning for Complex Narrative Generation

यह शोध पत्र PLOTTER का परिचय देता है, जो एक ऐसा ढांचा है जो सीधे टेक्स्ट के बजाय संरचनात्मक घटना और चरित्र ग्राफ पर 'इवैल्यूएट-प्लान-रिवाइज' (मूल्यांकन-योजना-संशोधन) चक्र को निष्पादित करके जटिल कथा निर्माण को उन्नत करता है, जिससे वैश्विक सुसंगतता, तार्किक निरंतरता और चरित्र विकास में महत्वपूर्ण सुधार होता है।

Hanwen Gu, Chao Guo, Junle Wang, Wenda Xie, Yisheng Lv2026-04-24
🤖 machine learning

Hyperloop Transformers

यह शोध पत्र हाइपरलूप ट्रांसफॉर्मर (Hyperloop Transformer) को प्रस्तुत करता है, जो एक पैरामीटर-कुशल आर्किटेक्चर है जो गहराई-समान बेसलाइन की तुलना में बेहतर प्रदर्शन प्राप्त करने के लिए लूप वाले परतों (looped layers) को हाइपर-कनेक्शन के साथ जोड़ता है और लगभग 50% कम पैरामीटर्स का उपयोग करता है, जो इसे मेमोरी-सीमित एज और ऑन-डिवाइस अनुप्रयोगों के लिए आदर्श बनाता है।

Abbas Zeitoun, Lucas Torroba-Hennigen, Yoon Kim2026-04-24
💬 NLP

When Agents Look the Same: Quantifying Distillation-Induced Similarity in Tool-Use Behaviors

यह शोध पत्र मॉडल डिस्टिलेशन के कारण एलएलएम एजेंटों में होने वाले गैर-अनिवार्य व्यवहारिक समरूपीकरण को मापने और अंतर स्पष्ट करने के लिए पूरक मेट्रिक्स के रूप में रिस्पॉन्स पैटर्न सिमिलैरिटी (RPS) और एक्शन ग्राफ सिमिलैरिटी (AGS) को प्रस्तुत करता है, जो 18 मॉडलों में महत्वपूर्ण इन-फैमिली अभिसरण और टीचर-विशिष्ट पैटर्न को प्रकट करता है।

Chenghao Yang, Yuning Zhang, Zhoufutu Wen, Tao Gong, Jiaheng Liu, Qi Chu, Nenghai Yu2026-04-24
💬 NLP

Listen and Chant Before You Read: The Ladder of Beauty in LM Pre-Training

यह शोध पत्र यह प्रदर्शित करता है कि संगीत, कविता और गद्य के विकासात्मक पाइपलाइन पर भाषा मॉडलों को प्री-ट्रेन करना, रैंडम इनिशियलाइजेशन की तुलना में भाषा अधिग्रहण को महत्वपूर्ण रूप से त्वरित और बेहतर बनाता है, जो यह प्रकट करता है कि संरचित मानवीय रचनात्मक आउटपुट छोटे भाषा मॉडलों के लिए एक कुशल, क्षमता-निर्भर आधार (सब्सट्रेट) के रूप में कार्य करते हैं।

Yoshinori Nomura2026-04-24
💬 NLP

Do LLM Decoders Listen Fairly? Benchmarking How Language Model Priors Shape Bias in Speech Recognition

यह शोध पत्र पांच जनसांख्यिकीय अक्षों और विभिन्न ध्वनिक स्थितियों में नौ स्पीच रिकग्निशन मॉडलों का बेंचमार्किंग करता है, जिससे यह पता चलता है कि ऑडियो एनकोडर डिज़ाइन और संपीड़न स्तर—न कि एलएलएम (LLM) का पैमाना—निष्पक्षता और मजबूती के प्राथमिक निर्धारक हैं, जिसमें विशिष्ट निष्कर्ष यह हैं कि एलएलएम डिकोडर स्वाभाविक रूप से नस्लीय पूर्वाग्रह को नहीं बढ़ाते हैं, लेकिन सन्नाटा इंजेक्शन या मास्किंग के तहत गंभीर, जनसांख्यिकीय-चयनात्मक मतिभ्रम (hallucinations) प्रदर्शित कर सकते हैं।

Srishti Ginjala, Eric Fosler-Lussier, Christopher W. Myers, Srinivasan Parthasarathy2026-04-24
💬 NLP

Spatial Metaphors for LLM Memory: A Critical Analysis of the MemPalace Architecture

यह शोध पत्र मेमपैलेस (MemPalace) आर्किटेक्चर का आलोचनात्मक विश्लेषण करता है, और इस निष्कर्ष पर पहुँचता है कि जहाँ इसका उत्कृष्ट रिट्रीवल प्रदर्शन मुख्य रूप से इसके नवीन स्थानिक रूपक (spatial metaphor) के बजाय वर्बेटिम स्टोरेज और मानक वेक्टर फ़िल्टरिंग से उपजा है, वहीं यह प्रणाली अपने कम लागत वाले, नियतात्मक राइट पाथ (deterministic write path) और एआई में स्थानिक स्मृति सिद्धांतों के पहले व्यवस्थित अनुप्रयोग के माध्यम से वास्तविक वास्तुशिल्प मूल्य प्रदान करती है, भले ही इसे उन दावों के साथ विपणन किया गया हो जो इसकी वैज्ञानिक कठोरता से अधिक हैं।

Robin Dey, Panyanon Viradecha2026-04-24
💬 NLP

Cross-Entropy Is Load-Bearing: A Pre-Registered Scope Test of the K-Way Energy Probe on Bidirectional Predictive Coding

यह पूर्व-पंजीकृत अध्ययन प्रदर्शित करता है कि सॉफ्टमैक्स के सापेक्ष K-वे एनर्जी प्रोब का प्रदर्शन क्रॉस-एन्ट्रॉपी प्रशिक्षण पर अत्यधिक निर्भर है, जो द्विदिशीय अनुमान गतिशीलता (bidirectional inference dynamics) या लेटेंट मूवमेंट मैग्नीट्यूड के बजाय काफी बड़े लॉजिट नॉर्म्स और एक स्केल-इनवेरिएंट रैंकिंग लाभ को प्रेरित करता है।

Jon-Paul Cacioli2026-04-24