🤖 AI

VISTA Architect: A graph database-oriented health AI system demonstrated in multidisciplinary tumor boards

VISTA Architect एक ग्राफ डेटाबेस-उन्मुख AI प्रणाली है जो मल्टीडिसिप्लिनरी ट्यूमर बोर्डों के लिए रोगी के इतिहास के पुनर्निर्माण में 96.4% सटीकता प्राप्त करती है और पारंपरिक रिट्रीवल-ऑगमेंटेड जनरेशन विधियों की तुलना में क्वेरी विलंबता (लेटेंसी) और लागत को काफी कम करती है, जो दीर्घकालिक इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड के साथ लार्ज लैंग्वेज मॉडल्स को एकीकृत करके एक निरंतर, प्रोवेनेंस-लिंक्ड नॉलेज ग्राफ बनाती है।

Tuomo Kiiskinen, Jason Fries, Philip Adamson, David Wu, Timothy John Ellis-Caleo, Aaron Fanous, Balasubramanian Narasimh (…)2026-06-23
💬 NLP

Black-Box Forensics for Conversational LLM Agents

यह शोध पत्र संवादात्मक एलएलएम (LLM) एजेंटों के लिए एक ब्लैक-बॉक्स फॉरेंसिक फ्रेमवर्क प्रस्तुत करता है जो केवल कुछ गैर-प्रतिकूल (non-adversarial) संवादों का उपयोग करके बेस मॉडलों का उच्च-सटीक एट्रिब्यूशन और अनदेखे सिस्टम प्रॉम्प्ट्स की सुदृढ़ फिंगरप्रिंटिंग प्राप्त करता है, जिससे एआई-सक्षम घोटालों को उनके प्रदाताओं तक ट्रैक करने और आपराधिक नेटवर्क को जोड़ने में सक्षमता मिलती है।

Isadora White, Yasaman Jafari, Taylor Berg-Kirkpatrick2026-06-23
🤖 AI

Beyond Penalizing Mistakes: Stabilizing Efficiency Training in Large Reasoning Models via Adaptive Correct-Only Rewards

यह शोध पत्र ACOER का प्रस्ताव करता है, जो एक नवीन रिवॉर्ड मैकेनिज्म है जो सही उत्तरों के लिए लेंथ पेनल्टी को अलग करके और डायनेमिक बजट नॉर्मलाइजेशन का उपयोग करके बड़े रीजनिंग मॉडल्स में एफिशिएंसी ट्रेनिंग को स्थिर करता है, जिससे रिवॉर्ड कोलैप्स को रोका जा सकता है और साथ ही सटीकता में उल्लेखनीय सुधार और टोकन जनरेशन में कमी आती है।

Jungseob Lee, Seungyoon Lee, Seongtae Hong, Minhyuk Kim, Chanjun Park, Heuiseok Lim2026-06-23
💬 NLP

moBERTo: A Modern Encoder for Portuguese via Continued Pretraining of ModernBERT

यह शोध पत्र moBERTo को प्रस्तुत करता है, जो एक उच्च-प्रदर्शन वाला पुर्तगाली एनकोडर-ओनली मॉडल है जिसे 60 बिलियन टोकन पर ModernBERT के प्रीट्रेनिंग को जारी रखकर बनाया गया है, जो रिट्रीवल, क्लासिफिकेशन और NER कार्यों में अत्याधुनिक परिणाम प्राप्त करता है और साथ ही लॉन्ग-कॉन्टेक्स्ट क्षमताओं को बनाए रखने के लिए स्क्रैच से प्रशिक्षण के बजाय निरंतर प्रीट्रेनिंग की श्रेष्ठता को प्रदर्शित करता है।

Thiago Laitz, Thales Sales Almeida, João Guilherme Alves Santos, Giovana Kerche Bonás2026-06-23
💬 NLP

BLUEX v2: Benchmarking LLMs on Open-Ended Questions from Brazilian University Entrance Exams

यह शोध पत्र BLUEX v2 प्रस्तुत करता है, जो ब्राजील की प्रमुख विश्वविद्यालय प्रवेश परीक्षाओं (2022-2025) से 395 मुक्त-अंत वाले प्रश्नों वाला एक नया बेंचमार्क है, जो पुर्तगाली विमर्श कार्यों पर 21 अत्याधुनिक LLMs का मूल्यांकन करता है, जो महत्वपूर्ण प्रदर्शन अंतराल को प्रकट करता है और गणितीय तर्क एवं छवि समझ में चुनौतियों को उजागर करता है।

João Guilherme Alves Santos, Giovana Kerche Bonás, Thiago Laitz, Thales Sales Almeida, Helio Pedrini2026-06-23
🤖 AI

GroundEval: A Deterministic Replacement for LLM-as-Judge in Stateful Agent Evaluation

GroundEval एक नियत (deterministic), जज-मुक्त ढांचा है जो स्टेटफुल एजेंटों का मूल्यांकन उनके टूल उपयोग और साक्ष्य पहुंच को विशिष्ट विफलता मोड (साइलेंस, पर्सपेक्टिव, और काउंटरफैक्चुअल) के विरुद्ध सत्यापित करके करता है, जिससे तर्क में उन महत्वपूर्ण अंतरालों को उजागर किया जा जाता है जिन्हें पारंपरिक LLM-as-Judge मेट्रिक्स अक्सर चूक जाते हैं।

Jeffrey Flynt2026-06-23
💬 NLP

Language-Specific Sentiment Polarity Biases in Encoder and Large Language Model Classification of Product Reviews

यह अध्ययन प्रकट करता है कि एआई मॉडल भाषा-विशिष्ट भावना ध्रुवीयता पूर्वाग्रह प्रदर्शित करते हैं, जिसमें बड़े भाषा मॉडल फ्रांसीसी में नकारात्मक पूर्वाग्रह दिखाते हैं और एनकोडर मॉडल जापानी में सकारात्मक पूर्वाग्रह प्रदर्शित करते हैं क्योंकि उन्हें अप्रत्यक्ष आलोचना का पता लगाने में कठिनाई होती है।

Advita Rajiv, Kavitha Kothur, Gautham Reddy2026-06-23
💬 NLP

Learning Moral Diversity: Modelling Individual Perspectives in Moral Classification of Texts

यह शोध पत्र प्रीट्रेन्ड लैंग्वेज मॉडल्स को एनोटेटर-विशिष्ट विशेषताओं के साथ विस्तारित करके नैतिक टेक्स्ट वर्गीकरण में व्यक्तिगत एनोटेटर दृष्टिकोणों को मॉडल करने की एक विधि प्रस्तावित करता है, जो यह प्रदर्शित करता है कि व्यक्तिपरक असहमति को ध्यान में रखने से पारंपरिक दृष्टिकोणों की तुलना में, जो लेबल को एकल ग्राउंड ट्रुथ में एकत्रित करते हैं, अधिक सटीक भविष्यवाणियां और गहन अंतर्दृष्टि प्राप्त होती है।

Yi Ren, Lewis Mitchell, Matthew Roughan2026-06-23
💬 NLP

HAKARI-Bench: A Lightweight Benchmark for Comparing Retrieval Architectures and Efficiency Settings under Unified Conditions

HAKARI-Bench एक हल्का, एकीकृत बेंचमार्क है जो 35 मौजूदा रिट्रीवल डेटासेट्स को संक्षिप्त "नैनो-सेट्स" में पुनर्गठित करता है ताकि 43 भाषाओं में विविध रिट्रीवल आर्किटेक्चर और दक्षता सेटिंग्स की तीव्र, मॉडल-अज्ञेय तुलना सक्षम की जा सके, जो प्रमुख पूर्ण-पैमाने के बेंचमार्क के साथ उच्च सहसंबंध प्राप्त करते हुए त्वरित मॉडल चयन और पारेटो फ्रंटियर विश्लेषण को सुगम बनाता है।

Yuichi Tateno2026-06-23
💬 NLP

Does the Same Token Mean the Same State? MoE Routing as Signal for Reasoning Control

यह शोध पत्र RAD (रूटिंग एग्रीमेंट डिकोडिंग) प्रस्तुत करता है, जो एक नवीन इन्फरेंस रणनीति है जो उच्च गुणवत्ता वाले रीजनिंग ट्रेजेक्टरीज (तर्क पथों) का चयन करने के लिए समान टोकन के विशिष्ट मिक्स्चर-ऑफ-एक्सपर्ट्स रूटिंग पैटर्न का लाभ उठाती है, जो उत्तर स्ट्रिंग पार्सिंग या वोटिंग पर निर्भर किए बिना किया जाता है, जिससे कोड और एजेंटिक कार्यों के लिए प्रभावी pass@1 चयन सक्षम होता है जहाँ पारंपरिक मेजॉरिटी वोटिंग विफल हो जाती है।

Kang Chen, Minshen Yu, Junjie Nian, Yaoning Wang, Yixin Cao, Yugang Jiang2026-06-23