💻 computer science

Multiclass Hate Speech Detection with RoBERTa-OTA: Integrating Transformer Attention and Graph Convolutional Networks

यह शोध पत्र RoBERTa-OTA का प्रस्ताव करता है, जो एक ऑन्टोलॉजी-निर्देशित आर्किटेक्चर है जो संदर्भपूर्ण भाषाई समझ को संरचित डोमेन ज्ञान के साथ जोड़कर मल्टीक्लास हेट स्पीच डिटेक्शन की सटीकता और दक्षता में महत्वपूर्ण सुधार करने के लिए RoBERTa एम्बेडिंग्स को ग्राफ कन्वोल्यूशनल नेटवर्क के साथ एकीकृत करता है।

Mahmoud Abusaqer, Jamil Saquer2026-03-06
💻 computer science

Context-Dependent Affordance Computation in Vision-Language Models

Qwen-VL और LLaVA-1.5 के एक बड़े पैमाने के अध्ययन के माध्यम से, यह शोध पत्र प्रदर्शित करता है कि विजन-लैंग्वेज मॉडल महत्वपूर्ण संदर्भ-निर्भर एफ़ोर्डेंस ड्रिफ्ट (context-dependent affordance drift) प्रदर्शित करते हैं, जहाँ लेक्सिकल और सिमेंटिक दोनों आउटपुट एजेंटिक पर्सोना के आधार पर पर्याप्त रूप से भिन्न होते हैं, जो रोबोटिक्स में स्टैटिक वर्ल्ड मॉडलिंग के बजाय डायनेमिक, क्वेरी-डिपेंडेंट ऑन्टोलॉजिकल प्रोजेक्शन की आवश्यकता का सुझाव देता है।

Murad Farzulla2026-03-06
💻 computer science

Do Mixed-Vendor Multi-Agent LLMs Improve Clinical Diagnosis?

यह शोध पत्र यह प्रदर्शित करता है कि मिश्रित-विक्रेता (mixed-vendor) बड़े भाषा मॉडल का लाभ उठाने वाले मल्टी-एजेंट नैदानिक निदान तंत्र, साझा विफलता मोड (shared failure modes) को दूर करने के लिए पूरक प्रेरणात्मक पूर्वाग्रहों (complementary inductive biases) को एकत्रित करके, एकल-विक्रेता ढाँचों की तुलना में काफी बेहतर प्रदर्शन करते हैं और अत्याधुनिक नैदानिक सटीकता प्राप्त करते हैं।

Grace Chang Yuan, Xiaoman Zhang, Sung Eun Kim, Pranav Rajpurkar2026-03-06
💻 computer science

Dynamic Model Routing and Cascading for Efficient LLM Inference: A Survey

यह सर्वेक्षण क्वेरी की विशेषताओं के आधार पर कई स्वतंत्र लार्ज लैंग्वेज मॉडल्स में से कुशलतापूर्वक चयन करने के लिए अत्याधुनिक डायनेमिक रूटिंग और कैस्केडिंग रणनीतियों का व्यवस्थित रूप से विश्लेषण करता है, जो प्रदर्शन और लागत के बीच संतुलन बनाने के लिए एक वैचारिक ढांचे का प्रस्ताव देता है और सामान्यीकरण (जनरलाइजेशन) में खुले चुनौतियों को उजागर करता है।

Yasmin Moslem, John D. Kelleher2026-03-06
💻 computer science

Induced Numerical Instability: Hidden Costs in Multimodal Large Language Models

यह शोध पत्र एक नवीन हमले की विधि प्रस्तुत करता है जो एक विशिष्ट लॉस फंक्शन को अनुकूलित करके चित्र उत्पन्न करती है, जिससे मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स में संख्यात्मक अस्थिरता (न्यूमेरिकल इंस्टेबिलिटी) उत्पन्न होती है, जिसके परिणामस्वरूप पारंपरिक एडवरसेरियल परटर्बेशन्स से भिन्न, अत्याधुनिक मॉडल्स और डेटासेट्स के प्रदर्शन में महत्वपूर्ण गिरावट आती है।

Wai Tuck Wong, Jun Sun, Arunesh Sinha2026-03-06
💻 computer science

Query Disambiguation via Answer-Free Context: Doubling Performance on Humanity's Last Exam

यह शोध पत्र यह प्रदर्शित करता है कि केवल संदर्भ को पूर्ववर्ती (prepend) करने के बजाय, उत्तर-मुक्त ग्राउंडिंग संदर्भ (answer-free grounding context) का उपयोग करके अस्पष्टता को कम करने के लिए उपयोगकर्ता के प्रश्नों को पुनर्गठित करना, मानवता के अंतिम परीक्षा (Humanity's-Last Exam) जैसे चुनौतीपूर्ण बेंचमार्क पर भाषा मॉडल की सटीकता को महत्वपूर्ण रूप से बढ़ाता है, जिसे केवल इन्फरेंस-टाइम प्रॉम्प्टिंग के माध्यम से पुनरुत्पादित नहीं किया जा सकता है।

Michael Majurski, Cynthia Matuszek2026-03-06
💻 computer science

Adaptive Memory Admission Control for LLM Agents

यह शोध पत्र एडेप्टिव मेमोरी एडमिशन कंट्रोल (A-MAC) का प्रस्ताव करता है, जो एक ऐसा फ्रेमवर्क है जो LLM एजेंटों के लिए पारदर्शी, कुशल और डोमेन-अनुकूली दीर्घकालिक मेमोरी प्रबंधन को सक्षम करने हेतु मेमोरी वैल्यू को पांच व्याख्यात्मक कारकों में विभाजित करता है, जिससे अत्याधुनिक प्रणालियों की तुलना में बेहतर प्रिसिजन-रिकॉल ट्रेडऑफ़ और कम लेटेंसी प्राप्त होती है।

Guilin Zhang, Wei Jiang, Xiejiashan Wang, Aisha Behr, Kai Zhao, Jeffrey Friedman, Xu Chu, Amine Anoun2026-03-06
💻 computer science

From Static Inference to Dynamic Interaction: Navigating the Landscape of Streaming Large Language Models

यह शोध पत्र डेटा प्रवाह और गतिशील अंतःक्रिया के आधार पर एक एकीकृत परिभाषा और व्यवस्थित वर्गीकरण प्रस्तावित करके स्ट्रीमिंग लार्ज लैंग्वेज मॉडल्स की खंडित समझ को संबोधित करता है, साथ ही उनकी कार्यप्रणालियों, वास्तविक दुनिया के अनुप्रयोगों और भविष्य की अनुसंधान दिशाओं का विश्लेषण भी करता है।

Junlong Tong, Zilong Wang, YuJie Ren, Peiran Yin, Hao Wu, Wei Zhang, Xiaoyu Shen2026-03-06
💻 computer science

Vibe Code Bench: Evaluating AI Models on End-to-End Web Application Development

यह शोध पत्र वाइब कोड बेंच (Vibe Code Bench) को प्रस्तुत करता है, जो 100 वेब एप्लिकेशन विनिर्देशों (specifications) वाला एक नया बेंचमार्क है जिसका स्वायत्त ब्राउज़र एजेंटों द्वारा मूल्यांकन किया गया है, जो यह प्रकट करता है कि सर्वश्रेष्ठ फ्रंटियर मॉडल भी एंड-टू-एंड विकास कार्यों पर केवल 58.0% सटीकता प्राप्त करते हैं और स्वयं-परीक्षण (self-testing) एवं इवैल्यूएटर अलाइनमेंट (evaluator alignment) को सफलता के लिए महत्वपूर्ण कारकों के रूप में रेखांकित करता है।

Hung Tran, Langston Nashold, Rayan Krishnan, Antoine Bigeard, Alex Gu2026-03-06
💻 computer science

Coordinated Semantic Alignment and Evidence Constraints for Retrieval-Augmented Generation with Large Language Models

यह शोध पत्र एक रिट्रीवल-ऑगमेंटेड जनरेशन पद्धति का प्रस्ताव करता है जो अर्थ संबंधी विसंगति और अपर्याप्त साक्ष्य उपयोग को हल करने के लिए समन्वित अर्थ संबंधी संरेखण (coordinated semantic alignment) और स्पष्ट साक्ष्य बाधाओं (explicit evidence constraints) को एकीकृत करती है, जिससे बड़े भाषा मॉडल के आउटपुट की तथ्यात्मक विश्वसनीयता और सत्यापन क्षमता में वृद्धि होती है।

Xin Chen, Saili Uday Gadgil, Jiarong Qiu2026-03-06