💬 NLP

Dissecting Agentic RAG: A Component Ablation for Multi-Hop QA with a Local 7B Model

यह शोध पत्र HotpotQA पर एक स्थानीय 7B मॉडल का उपयोग करते हुए एक एजेंटिक RAG सिस्टम के घटक एब्लेशन अध्ययन को प्रस्तुत करता है, जो यह प्रकट करता है कि फिक्स्ड हाइब्रिड रिट्रीवल और सीमित रिट्रीवल इटरेशन, जटिल एडेप्टिव रूटिंग और गहरे लूप्स से बेहतर प्रदर्शन करते हैं, जो यह दर्शाता है कि संसाधन संबंधी बाधाओं के तहत मल्टी-हॉप QA के लिए सरल, गैर-अनुकूलनशील डिज़ाइन अधिक प्रभावी होते हैं।

Sheroz Shaikh2026-06-23✓ Author reviewed
💬 NLP

PeerMathDial: A Middle School Dialogue Dataset for Student Collaborative Math Problem Solving

यह शोध पत्र PeerMathDial प्रस्तुत करता है, जो वास्तविक मिडिल स्कूल सहकर्मी गणित समस्या-समाधान संवादों का पहला डेटासेट है, जिसके साथ एक LLM-सहायता प्राप्त संवाद कृत्य वर्गीकरण (dialogue act taxonomy) और इंटरेक्शन डायनेमिक्स को ट्रैक करने, व्यवहारों को छात्र गुणों से जोड़ने, और शैक्षिक सिमुलेशन के लिए LLMs का मूल्यांकन करने में इसकी उपयोगिता के प्रदर्शन शामिल हैं।

Murong Yue, Desmond Alexander Mcglone, Emily Slutz, Wenhan Lyu, Yixuan Zhang, Jennifer Suh, Ziyu Yao2026-06-23
💬 NLP

Per-Entity Bias Mapping for AI Visibility: Why Brand Mentions Require Entity-Specific Calibration

यह शोध पत्र 'पर-एंटिटी बायस मैपिंग' (Per-Entity Bias Mapping) प्रस्तुत करता है, जो एक ऐसा ढांचा है जो यह प्रकट करता है कि एआई दृश्यता त्रुटियां इकाई-विशिष्ट हैं न कि समान, जो अनुभवजन्य अध्ययन के माध्यम से यह प्रदर्शित करता है कि बड़े ब्रांड विरोधाभासी रूप से मॉडल की परिचितता के कारण निर्मित उद्धरणों (fabricated citations) की उच्च दर से ग्रस्त होते हैं, जबकि कम प्रतिनिधित्व वाली संस्थाएं संरचनात्मक अदृश्यता का सामना करती हैं।

Zoltan Varga2026-06-23
💬 NLP

LLM and Human Modes of Representation

यह शोध पत्र भाषाई ज्ञान और वास्तविक दुनिया के तर्क में लार्ज लैंग्वेज मॉडल्स (LLMs) और मनुष्यों द्वारा सूचना के प्रतिनिधित्व और प्रसंस्करण की तुलना करने वाले हालिया शोध का परीक्षण करता है, जो इस बात पर प्रकाश डालता है कि जहाँ LLMs प्रभावशाली प्रवाह प्राप्त करते हैं, वहीं वे अपने प्रसंस्करण तंत्र में मनुष्यों से भिन्न होते हैं और सामान्यतः सीखने और सामान्यीकरण में कम कुशल होते हैं।

Shalom Lappin2026-06-23
💬 NLP

Time-Frequency Weighted Losses for Phoneme Reconstruction in DNN-Based Speech Enhancement

यह शोध पत्र एक डिफरेंशिएबल टाइम-फ्रीक्वेंसी वेटिंग फ्रेमवर्क प्रस्तावित करता है जो डीप लर्निंग-आधारित स्पीच एनहांसमेंट में फोनम इंटेलिजिबिलिटी और कॉन्सोनेंट रिकंस्ट्रक्शन को बढ़ाने के लिए स्पीच प्रेजेंस, सिग्नल-टू-इंटरफेरेंस रेशियो और स्पेक्ट्रल फ्लक्स के आधार पर सिग्नल-टू-डिस्टॉर्शन रेशियो लॉस को मॉड्युलेट करता है।

Nasser-Eddine Monir, Paul Magron, Romain Serizel2026-06-23
🤖 AI

ChainWorld: Composing Long-Horizon Desktop Workloads from Atomic OSWorld Tasks

यह शोध पत्र ChainWorld का परिचय देता है, जो कंप्यूटर उपयोग करने वाले एजेंटों (computer use agents) का मूल्यांकन करने के लिए परमाणु OSWorld कार्यों को दीर्घकालिक डेस्कटॉप वर्कलोड में संयोजित करता है, जिससे यह पता चलता है कि वर्तमान मॉडल बहु-चरणीय पूर्णता (multi-step completion) में संघर्ष करते हैं और इस आधार पर विशिष्ट विफलता प्रोफाइल प्रदर्शित करते हैं कि कार्य सिंगल-टर्न या मल्टी-टर्न प्रारूपों में प्रस्तुत किए गए हैं।

Vincent Siu, Manasi Sharma, Dawn Song, Daniel Yue Zhang, Chenguang Wang2026-06-23
🤖 machine learning

Decodable but Not Faithful: Coupling Natural-Language Rationales to Programmatic Verifiers

यह शोधपत्र वर्िफायर-कपल्ड रीजनिंग (verifier-coupled reasoning) को प्रस्तुत करता है यह प्रदर्शित करने के लिए कि जबकि कंसिस्टेंसी ट्रेनिंग (consistency training) प्रभावी रूप से प्रोग्रामेटिक वर्िफायर जानकारी को लैंग्वेज मॉडल रैशनले रिप्रेजेंटेशन (language model rationale representations) से डिकोडेबल बनाती है, यह डिकोडेबिलिटी इस बात की गारंटी नहीं देती कि उत्पन्न स्पष्टीकरण वास्तव में मॉडल की वास्तविक आंतरिक तर्क प्रक्रिया को निष्ठापूर्वक दर्शाते हैं।

Vatsal Ananthula, Adarsh Kumarappan2026-06-23
💬 NLP

Leveraging LaBSE with Progressive Curriculum Learning for Multicultural Polarization

यह शोध पत्र कम-संसाधन वाली भाषाओं में उन्नत क्रॉस-लिंगुअल लर्निंग के लिए LaBSE एम्बेडिंग्स का लाभ उठाने वाले एक नवीन आर्किटेक्चर का प्रस्ताव करके बहुभाषी और बहुसांस्कृतिक ऑनलाइन ध्रुवीकरण का पता लगाने की चुनौती को संबोधित करता है और एक रिट्रीवल-आधारित प्रॉम्प्टिंग फ्रेमवर्क के भीतर विविध Qwen एनकोडर मॉडलों का मूल्यांकन करता है।

Sachin Sundar, Sandeep Kumar, Mothish M2026-06-23
💬 NLP

When to Plan, When to Polish: Noise Level as a Granularity Axis for Diffusion Language Models

यह शोध पत्र नॉइज़ डिपेंडेंट ग्रैनुलैरिटी कंट्रोल (NDGC) का प्रस्ताव करता है, जो एक सिंगल-लेवल डिफ्यूजन लैंग्वेज मॉडल पद्धति है जो शोर के स्तरों के आधार पर टोकन ग्रुपिंग को गतिशील रूप से समायोजित करती है ताकि बिना किसी स्पष्ट पदानुक्रमित आर्किटेक्चर या अलग प्लानर्स की आवश्यकता के प्रारंभिक मोटे संरचनात्मक नियोजन और उसके बाद सूक्ष्म-स्तरीय परिशोधन को सक्षम बनाया जा सके।

Peihong Li, Yuanjie Shi, Yan Yan2026-06-23
💬 NLP

Is Agent Code Less Maintainable Than Human Code?

यह शोधपत्र CodeThread फ्रेमवर्क को प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि AI एजेंटों द्वारा जनरेट किया गया कोड मानव-निर्मित कोड की तुलना में कम रखरखाव योग्य (maintainable) होता है, क्योंकि बाद के एजेंट पारंपरिक सॉफ्टवेयर मेट्रिक्स के बजाय त्रुटि प्रबंधन (error handling) और इनपुट वैलिडेशन में सूक्ष्म व्यवहार संबंधी अंतरों के कारण इस पर आगे काम करने में संघर्ष करते हैं।

Shaswat Patel, Betty Li Hou, Arun Purohit, Kai Xu, Jane Pan, He He, Valerie Chen2026-06-23