💻 computer science

Efficient Multilingual Reasoning Transfer via Progressive Code-Switching

यह शोध पत्र PCS (प्रोग्रेसिव कोड-स्विचिंग) प्रस्तुत करता है, जो एक कुशल ढांचा है जो हल्के अनुवाद और सुदृढीकरण शिक्षण (रीइन्फोर्समेंट लर्निंग) के माध्यम से कोड-स्विच्ड से पूर्ण लक्ष्य-भाषा तर्क की ओर प्रगतिशील रूप से संक्रमण करके अंग्रेजी तर्क क्षमताओं को अन्य भाषाओं में स्थानांतरित करता है, जिससे मौजूदा डिस्टिलेशन-आधारित विधियों की लागत और स्केलेबिलिटी सीमाओं को दूर किया जा सके।

Zhijun Wang, Junxiao Liu, Hao Zhou, Hao-Ran Wei, Baosong Yang, Shujian Huang2026-07-02
🤖 AI

BaseRT: Best-in-Class LLM Inference on Apple Silicon via Native Metal

यह शोध पत्र BaseRT को पेश करता है, जो Apple Silicon के लिए एक नेटिव Metal इन्फरेंस रनटाइम है जो बड़े भाषा मॉडलों (LLMs) के लिए रिकॉर्ड-तोड़ थ्रूपुट प्राप्त करने के लिए चिप-विशिष्ट अनुकूलनों का लाभ उठाता है, जो llama.cpp और MLX जैसे मौजूदा फ्रेमवर्कों से 1.56x तक बेहतर प्रदर्शन करता है।

Prabod Rathnayaka, Fabian Waschkowski, Lukas Wesemann2026-07-02
💻 computer science

Dual-Confidence Contrastive Decoding for Retrieval-Augmented Generation

यह शोध पत्र ड्यूल-कॉन्फिडेंस कॉन्ट्रास्टिव डीकोडिंग (DCCD) प्रस्तुत करता है, जो एक ट्रेनिंग-फ्री विधि है जो डॉक्यूमेंट-लेवल और टोकन-लेवल कॉन्फिडेंस सिग्नल्स का लाभ उठाकर मल्टी-डॉक्यूमेंट रिट्रीवल-ऑगमेंटेड जनरेशन में इंट्रा-कॉन्टेक्स्ट संघर्षों को हल करती है, और नए DRQA बेंचमार्क एवं मानक QA डेटासेट्स पर इसकी प्रभावशीलता को प्रमाणित करती है।

Raymond Li, Md Tawkat Islam Khondaker, Amirhossein Abaskohi, Gabriel Murray, Giuseppe Carenini, Issam H. Laradji2026-07-02
💻 computer science

Multi-Turn Agentic Scientific Literature Search via Workflow Induction

PaperPilot एक मल्टी-टर्न वैज्ञानिक साहित्य खोज एजेंट है जो खोज को निष्पादन योग्य ऑपरेटरों के एक इंड्यूसिबल (inducible), संपादन योग्य वर्कफ़्लो के रूप में फ्रेम करता है, और प्रयोगों के माध्यम से यह प्रदर्शित करता है कि यह दृष्टिकोण मानक टूल-आधारित एजेंटों की तुलना में पुनर्प्राप्ति प्रदर्शन (retrieval performance) में महत्वपूर्ण सुधार करता है और निष्पादन त्रुटियों को समाप्त करता है।

Jisen Li (University of Illinois Urbana-Champaign, Together AI), Bingxuan Li (University of Illinois Urbana-Champaign) (…)2026-07-02
💻 computer science

"Don't Say It!": Constraints, Compliance, and Communication when Language Models Play Taboo

यह शोध पत्र इस बात का मूल्यांकन करता है कि ओपन-वेट लैंग्वेज मॉडल्स 'टैबू' (Taboo) के खेल में शाब्दिक बाधाओं और संचार प्रभावशीलता की प्रतिस्पर्धी मांगों के बीच कैसे सामंजस्य बिठाते हैं, जो यह प्रकट करता है कि हालांकि हस्तक्षेप रणनीतियां नियम अनुपालन और विवरण की गुणवत्ता को प्रभावित करती हैं, फिर भी मॉडल मनुष्यों की तुलना में बाधित शाब्दिक ग्राउंडिंग (lexical grounding) के साथ काफी संघर्ष करते हैं।

Sara Candussio, Francesca Padovani, Daniel Scalena, Malvina Nissim2026-07-02
🤖 machine learning

Auditing Forgetting in Limited Memory Language Models

यह शोध पत्र एक कारण संबंधी ऑडिटिंग फ्रेमवर्क (causal auditing framework) प्रस्तुत करता है जो यह प्रदर्शित करता है कि लिमिटेड मेमोरी लैंग्वेज मॉडल्स में, अनलर्निंग की प्रभावशीलता मुख्य रूप से मॉडल के बजाय डेटाबेस प्रबंधन द्वारा निर्धारित होती है, क्योंकि हटाए गए तथ्य शायद ही कभी पैरामीट्रिक मेमोरी में बने रहते हैं लेकिन वे रिट्रीवल आर्टिफैक्ट्स (retrieval artifacts) और निकटवर्ती संबंधों के माध्यम से पुन: प्रकट हो सकते हैं।

Arya Raeesi, Hanna Roed2026-07-02
🤖 AI

Self-conditioned Flow Map Language Models via Fixed-point Flows

यह शोध पत्र फिक्स्ड-पॉइंट फ्लोज़ (Fixed-point Flows) प्रस्तुत करता है, जो एक सैद्धांतिक ढांचा है जो फ्लो-आधारित भाषा मॉडलों में सेल्फ-कंडीशनिंग की व्याख्या एक फिक्स्ड-पॉइंट इटरेशन के रूप में करता है, जिससे FMLM^\star का विकास होता है, जो एक डिस्टिल्ड मॉडल है और OpenWebText पर एक और कुछ-चरणों (few-step) के टेक्स्ट जनरेशन में अत्याधुनिक प्रदर्शन प्राप्त करता है।

Jaehoon Yoo, Wonjung Kim, Floor Eijkelboom, Chanhyuk Lee, Nicholas M. Boffi, Seunghoon Hong, Jinwoo Kim2026-07-02
💻 computer science

MSQA: A Natively Sourced Multilingual and Multicultural SimpleQA Benchmark

यह शोध पत्र MSQA को प्रस्तुत करता है, जो एक मूल रूप से स्रोतित बहुभाषी बेंचमार्क है जो यह प्रकट करता है कि बड़े भाषा मॉडल (LLMs) की सांस्कृतिक सक्षमता सामान्य तर्क या इन्फरेंस-टाइम उपचारों के बजाय प्री-ट्रेनिंग एक्सपोज़र पर अधिक निर्भर करती है, जिससे "सांस्कृतिक संरेखण का भ्रम" (Illusion of Cultural Alignment) सिद्ध होता है और यह प्रमाणित होता है कि बहुभाषी प्रवाह सांस्कृतिक समझ की गारंटी नहीं देता है।

Xianru Chen, Yukai Huang, Mingxiang Chen, Xinping Lei, Fangbing Deng, Jin Chen, Ge Zhang, Wenhao Huang, Jiaheng Liu2026-07-02
💻 computer science

What Survives Into Context: A Diagnostic for Budget-Constrained Multi-Hop RAG and When Submodular Evidence Packing Improves It

यह शोध पत्र बजट-सीमित मल्टी-हॉप RAG के लिए "आंसर-इन-कॉन्टेक्स्ट" को एक बेहतर डायग्नोस्टिक के रूप में प्रस्तुत करता है और एक सबमॉड्यूलर ऑप्टिमाइज़ेशन-आधारित पैकिंग रणनीति का प्रस्ताव करता है जो साक्ष्य घनत्व (एविडेंस डेंसिटी) को अधिकतम करके छोटे रीडर्स के प्रदर्शन में महत्वपूर्ण सुधार करती है, हालांकि जैसे-जैसे रीडर की क्षमता बढ़ती है इसके लाभ कम होते जाते हैं।

Ananto Nayan Bala2026-07-02✓ Author reviewed
💻 computer science

The Course of News Events: A Comparison of Bottom-Up and Top-Down Approaches for Collecting Text-Based Data about Disasters

यह शोध पत्र भूस्खलन पर जर्मन समाचार लेखों का उपयोग करके टेक्स्ट-आधारित आपदा डेटा एकत्र करने के लिए टॉप-डाउन और बॉटम-अप दृष्टिकोणों की तुलना करता है, जो यह प्रदर्शित करता है कि कार्यप्रणाली का चयन घटना कवरेज और सामाजिक-पर्यावरणीय अध्ययनों में आगामी अनुसंधान परिणामों को महत्वपूर्ण रूप से प्रभावित करता है।

Brielen Madureira, Andreas Niekler, Mariana Madruga de Brito2026-07-02