💬 NLP

EduCoder: An Open-Source Annotation System for Education Transcript Data

यह शोध पत्र एडुकोडर (EduCoder) को प्रस्तुत करता है, जो एक ओपन-सोर्स प्लेटफॉर्म है जिसे सहयोगी कोडबुक परिभाषा को सक्षम करके, विविध एनोटेशन प्रकारों का समर्थन करके और डेटा विश्वसनीयता में सुधार के लिए इंटर-एनोटेटर अंशांकन (inter-annotator calibration) को सुगम बनाकर शैक्षिक संवाद ट्रांसक्रिप्ट्स को एनोटेट करने की अनूठी जटिलताओं को संबोधित करने के लिए डिज़ाइन किया गया है।

Guanzhong Pan, Mei Tan, Hyunji Nam, Lucía Langlois, James Malamut, Liliana Deonizio, Dorottya Demszky2026-04-24
💬 NLP

Unveiling Unicode's Unseen Underpinnings in Undermining Authorship Attribution

यह शोध पत्र स्टाइलोमेट्रिक लेखकत्व निर्धारण (stylometric authorship attribution) के विरुद्ध पारंपरिक अनामीकरण विधियों की सीमाओं का विश्लेषण करता है और सार्वजनिक संचार में उपयोगकर्ता की पहचान की सुरक्षा के लिए एक प्रतिरोधी प्रति-रणनीति के रूप में यूनिकोड स्टेग्नोग्राफी (Unicode steganography) का प्रस्ताव करता है।

Robert Dilworth2026-04-24
🤖 machine learning

CE-GPPO: Coordinating Entropy via Gradient-Preserving Clipping Policy Optimization in Reinforcement Learning

यह शोध पत्र CE-GPPO को प्रस्तुत करता है, जो एक नवीन सुदृढीकरण शिक्षण (reinforcement learning) एल्गोरिदम है जो उन क्लिप्ड टोकन से सीमित ग्रेडिएंट्स को पुन: पेश करके पॉलिसी एंट्रॉपी को स्थिर करता है जिन्हें मानक PPO में आमतौर पर त्याग दिया जाता है, जिससे बड़े भाषा मॉडलों में तर्क प्रदर्शन में सुधार होता है।

Zhenpeng Su, Leiyu Pan, Minxuan Lv, Yuntao Li, Wenping Hu, Fuzheng Zhang, Kun Gai, Guorui Zhou2026-04-24
💬 NLP

ReFACT: A Benchmark for Scientific Confabulation Detection with Positional Error Annotations

यह शोध पत्र ReFACT को प्रस्तुत करता है, जो Reddit के r/AskScience से प्राप्त एक बेंचमार्क है जो यह प्रकट करता है कि लार्ज लैंग्वेज मॉडल्स (LLMs) एक मौलिक सिमेंटिक ग्राउंडिंग घाटे (semantic grounding deficit) से ग्रस्त हैं जिसके कारण "सैलियंट डिस्ट्रैक्टर" (salient distractor) त्रुटियां होती हैं और वे तुलनात्मक निर्णय लेने में संघर्ष करते हैं, जिससे वैज्ञानिक तथ्यात्मकता के लिए LLM-as-Judge प्रतिमानों की विश्वसनीयता को चुनौती मिलती है।

Yindong Wang, Martin Preiß, Margarita Bugueño, Jan Vincent Hoffbauer, Abdullatif Ghajar, Tolga Buz, Gerard de Melo2026-04-24
💬 NLP

Optimal Aggregation of LLM and PRM Signals for Efficient Test-Time Scaling

यह शोध पत्र एक सैद्धांतिक रूप से आधारित, कुशल अंशांकन (कैलिब्रेशन) पद्धति प्रस्तावित करता है जो सीखे गए भारों—ऋणात्मक भारों सहित—के साथ LLM और PRM संकेतों को इष्टतम रूप से संयोजित करने के लिए है, ताकि मानक दृष्टिकोणों द्वारा आवश्यक गणना के केवल एक अंश का उपयोग करते हुए टेस्ट-टाइम स्केलिंग दक्षता और प्रदर्शन को महत्वपूर्ण रूप से बढ़ाया जा सके।

Peng Kuang, Yanli Wang, Xiaoyu Han, Yaowenqi Liu, Kaidi Xu, Haohan Wang2026-04-24
💬 NLP

SlideAgent: Hierarchical Agentic Framework for Multi-Page Visual Document Understanding

प्रदत्त पाठ में शीर्षक ("SlideAgent") और सार (जो हाइब्रिड RAG के लिए "SARA" नामक एक फ्रेमवर्क का वर्णन करता है) के बीच एक विसंगति है, लेकिन सार की सामग्री के आधार पर, यह शोध पत्र SARA का प्रस्ताव करता है, जो एक हाइब्रिड रिट्रीवल-ऑगमेंटेड जनरेशन फ्रेमवर्क है जो निश्चित टोकन बजट के तहत कई डेटासेट और ओपन-सोर्स LLMs में उत्तर की प्रासंगिकता, शुद्धता और सिमेंटिक समानता में उल्लेखनीय सुधार करने के लिए प्राकृतिक भाषा के स्निपेट्स को सिमेंटिक कम्प्रेशन वेक्टर्स के साथ जोड़ता है।

Yiqiao Jin, Rachneet Kaur, Zhen Zeng, Sumitra Ganesh, Srijan Kumar2026-04-24
💬 NLP

Back to the Future: The Role of Past and Future Context Predictability in Incremental Language Production

प्राकृतिक भाषण के दो अध्ययनों के माध्यम से, यह शोध पत्र यह प्रदर्शित करता है कि एक सूचना-सैद्धांतिक माप, जो एक शब्द और उसके भविष्य के संदर्भ (जो अतीत द्वारा बाधित है) के बीच साझा की गई सूचना को परिमाणित करता है, न केवल ध्वन्यात्मक न्यूनीकरण (phonetic reduction) में अद्वितीय विचरण की व्याख्या करता है बल्कि प्रतिस्थापन त्रुटियों (substitution errors) के सबसे मजबूत भविष्यवक्ता के रूप में भी कार्य करता है, जिससे यह स्पष्ट होता है कि वक्ता क्रमिक शाब्दिक नियोजन (incremental lexical planning) के दौरान अतीत और भविष्य के संदर्भ को गतिशील रूप से कैसे एकीकृत करते हैं।

Shiva Upadhye, Richard Futrell2026-04-24
💬 NLP

Tuning for TraceTarnish: Techniques, Trends, and Testing Tangible Traits

यह शोध पत्र प्रमुख भाषाई विशेषताओं—विशेष रूप से फंक्शन और कंटेंट वर्ड फ्रीक्वेंसी और टाइप-टोकन रेश्यो—की पहचान करके एडवर्सरियल स्टाइलोमेट्री अटैक "TraceTarnished" का मूल्यांकन करता है, जो लेखक के छद्म रूप (authorship obfuscation) का पता लगाने के लिए समझौते के संकेतक (indicators of compromise) और हमले की प्रभावशीलता को बढ़ाने के लिए आधारभूत तत्वों के रूप में कार्य करते हैं।

Robert Dilworth2026-04-24
💬 NLP

Entropy Ratio Clipping as a Soft Global Constraint for Stable Reinforcement Learning

यह शोध पत्र एंट्रॉपी रेश्यो क्लिपिंग (ERC) का प्रस्ताव करता है, जो एक सॉफ्ट ग्लोबल कंस्ट्रेंट है जो वर्तमान और पिछले पॉलिसियों के बीच एंट्रॉपी रेश्यो पर द्विदिश सीमाएं लगाकर लार्ज लैंग्वेज मॉडल्स के लिए सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) को स्थिर करता है ताकि वितरण बदलाव (डिस्ट्रीब्यूशन शिफ्ट) और प्रशिक्षण अस्थिरता को कम किया जा सके।

Zhenpeng Su, Leiyu Pan, Minxuan Lv, Tiehua Mei, Zijia Lin, Yuntao Li, Wenping Hu, Ruiming Tang, Kun Gai, Guorui Zhou2026-04-24
💬 NLP

StegoStylo: Squelching Stylometric Scrutiny through Steganographic Stitching

यह शोध पत्र उन्नत प्रतिकूल हमलों (adversarial attacks) और स्टेग्नोग्राफिक तकनीकों, विशेष रूप से TraceTarnish\textit{TraceTarnish} और ज़ीरो-विड्थ कैरेक्टर एम्बेडिंग को प्रस्तुत करता है, ताकि लेखक के शैलीगत फिंगरप्रिंट्स को प्रभावी ढंग से अस्पष्ट किया जा सके और दुर्भावनापूर्ण स्टाइलोमेट्रिक विश्लेषण के विरुद्ध गोपनीयता की रक्षा की जा सके।

Robert Dilworth2026-04-24