💬 NLP

Inject or Navigate? Token-Efficient Retrieval for LLM Analysis of Transactional Legal Documents

यह शोध पत्र प्रदर्शित करता है कि फुल-कॉर्पस इंजेक्शन को स्ट्रक्चर्ड रिट्रीवल विधियों, विशेष रूप से एक कॉम्पैक्ट इंडेक्स (NAVINDEX) पर LLM नेविगेशन के साथ बदलने से, ट्रांसेक्शनल लीगल डॉक्यूमेंट बेंचमार्क पर बेसलाइन इंजेक्शन के समान सटीकता प्राप्त होती है, जबकि टोकन खपत, कॉन्टेक्स्ट साइज और परिचालन लागत में उल्लेखनीय कमी आती है।

Mahmoud Hany, Mourad ElSheraey, Mahmoud Said, Peter Naoum2026-07-08
🤖 AI

TurnOPD: Making On-Policy Distillation Turn-Aware for Efficient Long-Horizon Agent Training

TurnOPD एक नवीन ऑन-पॉलिसी डिस्टिलेशन फ्रेमवर्क है जो एडेप्टिव रोलआउट-डेप्थ बजटिंग और प्रोग्रेसिव टर्न-नॉर्मलाइज्ड लॉस वेटिंग को पेश करके लॉन्ग-होरइजन लैंग्वेज एजेंट्स के प्रशिक्षण की दक्षता को बढ़ाता है, ताकि वे वैनिला OPD में निहित संसाधन अपव्यय और प्रशिक्षण असंतुलन को दूर कर सकें।

Yuhang Zhou, Kai Zheng, Haoling Li, Dengyun Peng, Can Xu, Jingjing Chen2026-07-08
💬 NLP

CoPiT: Cognitive Pivot Translation for Digraphic Low-Resource Mongolian in the Traditional Script

यह शोध पत्र CoPiT को प्रस्तुत करता है, जो एक संज्ञानात्मक पिवट अनुवाद ढांचा (cognitive pivot translation framework) है जो वर्तनी संबंधी अस्पष्टता को दूर करने के लिए कम संसाधन वाले पारंपरिक मंगोलियाई को उसके बेहतर संसाधन वाले सिरिलिक लिपि के माध्यम से रूट करता है, जिससे अनुवाद की गुणवत्ता में महत्वपूर्ण सुधार होता है और कम प्रतिनिधित्व वाले भाषा युग्मों के लिए सिंथेटिक डेटा जनरेशन सक्षम होता है।

Burte Bayarsaikhan, Serynn Kim, Buru Chang2026-07-08
🤖 machine learning

K-ABENA: K-Adaptive Backpropagation with Error-based N-exclusion Algorithm : (Compensated Loss-Based Sample Exclusion with Unbiased Gradient Estimation)

K-ABENA एक चयनात्मक ग्रेडिएंट कंप्यूटेशन फ्रेमवर्क है जो कम-लॉस (low-loss) वाले नमूनों को बाहर करके प्रशिक्षण लागत को कम करता है और एक निष्पक्ष ग्रेडिएंट एस्टिमेटर प्रदान करने के लिए हॉरविट्ज़-थॉम्पसन रीवेटिंग (Horvitz-Thompson reweighting) का उपयोग करता है, जिससे यह अनकम्पेंसेटेड सिलेक्शन विधियों के गंभीर विफलता मोड के बिना पूर्ण-बैच SGD के तुलनीय प्रदर्शन और अभिसरण गारंटी (convergence guarantees) प्राप्त करता है।

Jean-Francois Bonbhel2026-07-08
💬 NLP

PolicyShiftGuard: Benchmarking and Improving Policy-Adaptive Image Guardrails

यह शोध पत्र पॉलिसी-एडेप्टिव इमेज गार्डरेल्स के मूल्यांकन के लिए पॉलिसीशिफ्टबेंच (PolicyShiftBench) का परिचय देता है, और पॉलिसीशिफ्टगार्ड (PolicyShiftGuard) का प्रस्ताव करता है, जो दो-चरणीय रेसिपी के साथ प्रशिक्षित एक नवीन मॉडल है जो विभिन्न सुरक्षा नीतियों के अनुकूल गतिशील रूप से ढलने में मौजूदा विधियों की तुलना में काफी बेहतर प्रदर्शन करता है।

Mingyang Song, Luxin Xu, Haoyu Sun, Minzhou Pan, Yu Cheng, Bo Li2026-07-08
💬 NLP

CMDR: Contextual Multimodal Document Retrieval

यह शोध पत्र CMDR पेश करता है, जो एक नया मल्टीमॉडल दस्तावेज़ पुनर्प्राप्ति कार्य और बेंचमार्क (CMDR-Bench) है जिसके लिए दस्तावेज़ संदर्भ को मॉडल करने की आवश्यकता होती है, साथ ही इसमें CMDR-Embed फ्रेमवर्क और CMCL लर्निंग ऑब्जेक्टिव है जो कई पृष्ठों को संयुक्त रूप से एनकोड करता है ताकि मौजूदा गैर-संदर्भात्मक विधियों से काफी बेहतर प्रदर्शन किया जा सके।

Ryota Tanaka, Taku Hasegawa, Kyosuke Nishida2026-07-08
💬 NLP

Is Domain Adaptation Always Helpful? A Frozen-Backbone Study of Cross-Domain Sentiment Transfer

यह अध्ययन प्रदर्शित करता है कि फ्रोजन प्री-ट्रेन्ड लैंग्वेज मॉडल बैकबोन के साथ स्पष्ट डोमेन अनुकूलन (explicit domain adaptation) की प्रभावकारिता बैकबोन के मौजूदा लक्षित-डोमेन ज्ञान पर अत्यधिक निर्भर है, क्योंकि अनुकूलन विशिष्ट मॉडलों या बड़े पैमाने के एम्बेडिंग्स के लिए नगण्य लाभ प्रदान करता है जबकि डोमेन-विशिष्ट कार्यों पर छोटे सामान्य-उद्देश्य वाले मॉडलों को महत्वपूर्ण रूप से लाभान्वित करता है।

Phat Tran, Artin Lahni, Pranav Kulkarni, Yaolun Zhang2026-07-08
🤖 AI

Integrating knowledge graphs and multilingual scholarly corpora for domain-adaptive LLMs in SSH

यह शोध पत्र LLMs4EU परियोजना और ALT-EDIC बुनियादी ढांचे के भीतर एक चल रही पहल को रेखांकित करता है, जिसका उद्देश्य ज्ञान ग्राफ (knowledge graphs) और बहुभाषी कॉर्पोरा को एकीकृत करके सामाजिक विज्ञान और मानविकी अनुसंधान के लिए फाउंडेशन मॉडल्स को अनुकूलित करना है, ताकि विद्वत्तापूर्ण कार्यों के लिए विश्वसनीय, नैतिक रूप से अनुपालन करने वाले और डोमेन-संवेदनशील एआई (AI) समर्थन को सुनिश्चित करने के लिए एक कठोर मात्रात्मक और गुणात्मक मूल्यांकन ढांचे का उपयोग किया जा सके।

Adam Faci, Alessio Miaschi, Anne Combe, Pascal Cuxac, Francesca Frontini, Nicolas Larrousse, Stéphane Pouyllau2026-07-08
💬 NLP

Umm... With Transformers? Insights from Filled Pause Use across Four Slavic Parliaments

यह अध्ययन चार स्लाव भाषाओं में लगभग 4,000 घंटों के संसदीय भाषणों पर ट्रांसफॉर्मर-आधारित डिटेक्शन और जनरलाइज्ड एस्टिमेटिंग इक्वेशन्स का उपयोग करता है ताकि यह प्रकट किया जा सके कि जबकि आयु और भाषण दर का फिलड पॉज़ दरों के साथ नकारात्मक सहसंबंध है, लिंग प्रभाव भाषा-विशिष्ट और पूर्व निष्कर्षों के विपरीत हैं, जबकि सेंटिमेंट (भावना) फिलड पॉज़ के साथ एक सुसंगत सकारात्मक जुड़ाव दिखाता है जो राजनीतिक अभिविन्यास और शक्ति स्थिति द्वारा नियंत्रित होता है।

Ivan Porupski, Branimir Dropuljić, Nikola Ljubešić2026-07-08
💬 NLP

Nested Episodic State Topology (NEST): A Graph-Theoretic Architecture of Cognitive States

यह शोध पत्र NEST (नेस्टेड एपिसोडिक स्टेट टोपोलॉजी) का परिचय देता है, जो एक मौलिक ग्राफ-सैद्धांतिक ढांचा है जो विविध संज्ञानात्मक सिद्धांतों को एकीकृत करने, विश्वास और वर्किंग मेमोरी (कार्यकारी स्मृति) का प्रतिनिधित्व करने और भविष्य के अनुभवजन्य एवं गणनात्मक अनुसंधान के लिए एक पारदर्शी प्रतिनिधित्व आधार प्रदान करने के लिए टाइप किए गए, भारित ग्राफों का उपयोग करके संज्ञानात्मक प्रक्रिया को संरचित अवस्था निर्माण और रूपांतरण के रूप में मॉडल करता है।

Ishant2026-07-08