💬 NLP

Verify when Uncertain: Beyond Self-Consistency in Black Box Hallucination Detection

यह शोध पत्र एक बजट-अनुकूल, दो-चरणीय मतिभ्रम (hallucination) पहचान एल्गोरिदम का प्रस्ताव करता है जो उच्च पहचान प्रदर्शन बनाए रखते हुए कम्प्यूटेशनल लागत को महत्वपूर्ण रूप से कम करने के लिए सेल्फ-कंसिस्टेंसी (self-consistency) को क्रॉस-मॉडल कंसिस्टेंसी (cross-model consistency) जांचों के साथ गतिशील रूप से संयोजित करता है, जिसे अनुभवजन्य परिणामों और एक ज्यामितीय सैद्धांतिक व्याख्या दोनों द्वारा समर्थित किया गया है।

Yihao Xue, Kristjan Greenewald, Youssef Mroueh, Baharan Mirzasoleiman2026-07-01
💬 NLP

SAGE: A Search-AuGmented Evaluation of Large Language Models on Free-Form QA

यह शोध पत्र SAGE को प्रस्तुत करता है, जो एक सर्च-ऑगमेंटेड फ्रेमवर्क है जो मुक्त-रूप (free-form) प्रश्नों पर लार्ज लैंग्वेज मॉडल्स की तथ्यात्मकता का मूल्यांकन करने के लिए बाहरी साक्ष्यों को सक्रिय रूप से पुनर्प्राप्त और संश्लेषित करता है, जो स्थिर संदर्भ-आधारित या अविश्वसनीय LLM-एज़-ए-जज मूल्यांकन विधियों के एक स्केलेबल और अनुकूलन योग्य विकल्प के रूप में कार्य करता है।

Sher Badshah, Ali Emami, Hassan Sajjad2026-07-01
💬 NLP

From Multimodal Perception to Strategic Reasoning: A Survey on AI-Generated Game Commentary

यह सर्वेक्षण टिप्पणीकार की क्षमताओं पर आधारित एक एकीकृत ढांचे और नवीन वर्गीकरण को पेश करते हुए, एआई-जनित गेम कमेंट्री अनुसंधान की खंडित स्थिति को संबोधित करता है, साथ ही क्षेत्र में भविष्य की प्रगति का मार्गदर्शन करने के लिए विधियों, डेटासेट और मूल्यांकन मेट्रिक्स की एक व्यापक समीक्षा प्रदान करता है।

Qirui Zheng, Xingbo Wang, Keyuan Cheng, Yunlong Lu, Muhammad Asif Ali, Lingfeng Li, Yongyi Wang, Wenxin Li2026-07-01
💬 NLP

Deductive Logic in Language Models: Horizontal vs Vertical Reasoning

यह शोध पत्र इस बात की जांच करता है कि सिंथेटिक निगमनात्मक कार्यों (synthetic deductive tasks) पर प्रशिक्षित छोटे ट्रांसफार्मर मॉडल किस प्रकार विशिष्ट क्षैतिज (ऑटोरेग्रेसिव) और ऊर्ध्वाधर (निहित) तंत्रों के माध्यम से तर्क को लागू करते हैं, जो यह प्रकट करता है कि चेन-ऑफ-थॉट (Chain-of-Thought) पर्यवेक्षण क्षैतिज परिवेश में वास्तविक नियम-आधारित अनुमान को बढ़ावा देता है, जबकि ऊर्ध्वाधर परिवेश में जटिल तर्क पैटर्न विकसित करने के लिए पाठ्यक्रम शिक्षण (curriculum learning) के रूप में कार्य करता है।

Davide Maltoni, Matteo Ferrara2026-07-01
💬 NLP

What If We Allocate Test-Time Compute Adaptively?

यह शोध पत्र एक सत्यापनकर्ता-निर्देशित अनुकूलन ढांचे (verifier-guided adaptive framework) का प्रस्ताव करता है जो पुनरावृत्ति प्रक्षेपवक्र पीढ़ी (iterative trajectory generation) और चयन के माध्यम से परीक्षण-समय कंप्यूट को गतिशील रूप से आवंटित करता है, जिसमें कम गुणवत्ता वाले पथों को छाँटने के लिए एक प्रक्रिया पुरस्कार मॉडल (process reward model) का उपयोग किया जाता है और यह समान स्केलिंग विधियों की तुलना में जटिल तर्क बेंचमार्क पर महत्वपूर्ण प्रदर्शन लाभ प्राप्त करता है।

Ahsan Bilal, Ahmed Mohsin, Muhammad Umer, Ali Subhan, Hassan Rizwan, Ayesha Mohsin, Dean Hougen2026-07-01
💬 NLP

FairJudge: An Adaptive, Debiased, and Consistent LLM-as-a-Judge

यह शोध पत्र FairJudge को प्रस्तुत करता है, जो एक एडेप्टिव (adaptive) LLM-as-a-Judge फ्रेमवर्क है, जो एडेप्टिविटी, बायस (bias) और कंसिस्टेंसी (consistency) की सीमाओं को दूर करने के लिए एक हाई-इन्फॉर्मेशन-डेंसिटी डेटासेट और एक करिकुलम-स्टाइल SFT-DPO-GRPO ट्रेनिंग प्रतिमान (paradigm) का उपयोग करता है, जिससे यह कई बेंचमार्क पर बड़े इंस्ट्रक्शन-ट्यून्ड मॉडल्स से बेहतर प्रदर्शन करता है।

Bo Yang, Lanfei Feng, Yunkui Chen, Yu Zhang, Xiao Xu, Shijian Li2026-07-01
💻 computer science

ASR-Agnostic Multimodal Spectrotemporal Modeling for Early Dementia Detection

यह शोध पत्र एक ASR-अज्ञेय (ASR-agnostic) मल्टीमॉडल ढांचे का प्रस्ताव करता है जो प्रारंभिक डिमेंशिया का पता लगाने के लिए मेल स्पेक्ट्रोग्राम से स्पेक्ट्रोटेम्पोरल विस्थापन क्षेत्रों (spectrotemporal displacement fields) को निकालता है, और अंग्रेजी, स्लोवाक और स्पेनिश कॉर्पोरा पर क्रॉस-लिंगुअल प्रयोगों के माध्यम से यह प्रदर्शित करता है कि मल्टीमॉडल फ्यूजन की प्रभावकारिता अत्यधिक कॉर्पस-निर्भर है, जो वितरित संकेतों (distributed signals) के लिए आवश्यक, एक एकल मोडैलिटी के प्रभुत्व होने पर प्रतिकूल, या संकेत मौजूद न होने पर अप्रासंगिक होती है।

Chukwuemeka Ugwu, Oluwafemi Richard Oyeleke2026-07-01
🌀 nonlinear sciences

Emergent Culture in Minimal LLM Systems

यह शोधपत्र प्रदर्शित करता है कि तीन न्यूनतम LLM एजेंटों का एक समूह, जो सीमित संदर्भ और विकासवादी दबाव के तहत एक क्षय होते साझा टेक्स्ट स्टोर के साथ संचालित होता है, स्वतः ही सहकारी व्यवहार, भंडारण रणनीतियों और जटिल सांस्कृतिक कलाकृतियों को विकसित करता है जो उभरती संस्कृति के अनुरूप संरचित दीर्घकालिक सुसंगतता प्रदर्शित करते हैं।

Simon Jones, Sabine Hauert2026-07-01
💻 computer science

ViTL: Temporal Logic-Guided Zero-Shot Natural Language Navigation via Vision-Language Models

यह शोध पत्र ViTL प्रस्तुत करता है, जो एक ऐसा फ्रेमवर्क है जो जटिल कमांड्स को मल्टी-टारगेट निष्पादन को समन्वित करने के लिए लीनियर टेम्पोरल लॉजिक फॉर्मूला में बदलकर और विजन-लैंग्वेज मॉडल-निर्देशित अन्वेषण को बढ़ाने के लिए एक दिशात्मक स्कोरिंग तंत्र पेश करके अज्ञात वातावरणों में ज़ीरो-शॉट लॉन्ग-होरिज़ोन नेचुरल लैंग्वेज नेविगेशन को सक्षम बनाता है।

Kaier Liang, Hengde Dai, Cristian-Ioan Vasile2026-07-01
🤖 machine learning

From Search to Synthesis: Training LLMs as Zero-Shot Workflow Generators

यह शोध पत्र MetaFlow को प्रस्तुत करता है, जो एक दो-चरणीय प्रशिक्षण ढांचा है जो सुपरवाइज्ड फाइन-ट्यूनिंग को सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) के साथ जोड़ता है ताकि बड़े भाषा मॉडलों को बिना किसी मैनुअल डिज़ाइन की आवश्यकता के विविध कार्यों के लिए मजबूत, पुन: प्रयोज्य और सामान्यीकरण योग्य ज़ीरो-शॉट वर्कफ़्लो उत्पन्न करने में सक्षम बनाया जा सके।

Gan Luo, Zihan Qin, Bin Dong, Wotao Yin2026-07-01