🤖 AI

EduPanel: A Three-Agent LLM Judge for Teaching Videos -- Reliability, Complementarity, and Human Trust Calibration

EduPanel एक विश्वसनीय, रूब्रिक-आधारित, तीन-एजेंट एलएलएम (LLM) प्रणाली है जो शिक्षण वीडियो का मूल्यांकन करने के लिए शिक्षार्थी व्यक्तित्वों (learner personas) पर आधारित विशिष्ट एजेंटों के माध्यम से आकलन को विभाजित करती है, जिससे मानव-विशेषज्ञ स्तर की विश्वसनीयता प्राप्त होती है और यह मानव मूल्यांकनकर्ताओं के प्रतिस्थापन के बजाय एक प्रभावी, विश्वास-कैलिब्रेटेड सहायक के रूप में कार्य करती है।

Jia-Kai Dong, Yi-Cheng Lin, Hung-yi Lee2026-07-22
🤖 AI

MAGE: Human-Like Macro Placement via Agentic Multimodal Reasoning

MAGE एक मल्टीमॉडल मल्टी-एजेंट फ्रेमवर्क है जो प्राकृतिक भाषा निर्देशों और टूर्नामेंट-शैली मूल्यांकन के छह-चरणीय वर्कफ़्लो के माध्यम से मैक्रो प्लेसमेंट रिफाइनमेंट को स्वचालित करता है, जो डिज़ाइन-विशिष्ट रिट्रेनिंग की आवश्यकता के बिना वाणिज्यिक उपकरणों और मानव विशेषज्ञों दोनों की तुलना में टाइमिंग प्रदर्शन और मानव-समानता में महत्वपूर्ण सुधार प्राप्त करता है।

Andrew B. Kahng, Sayak Kundu, Bodhisatta Pramanik2026-07-22
🤖 machine learning

Operational Proto-Introspection in Looped Language Models: Process-Quality Taps, Executable Branching, and the Readout-Control Boundary

यह शोध पत्र प्रदर्शित करता है कि एक फ्रोजन (frozen) 2.6B लूप वाले भाषा मॉडल में "परिचालनात्मक प्रोटो-इंट्रोस्पेक्शन" (operational proto-introspection) होता है, जहाँ छिपी हुई अवस्थाएँ (hidden states) गणना की गुणवत्ता और शाखा परिणामों (branch outcomes) का सटीक पूर्वानुमान लगा सकती हैं, फिर भी बाहरी हस्तक्षेप इन रीडआउट्स को प्रमाणित क्षमता लाभों में बदलने में विफल रहते हैं।

Jan Kirin2026-07-22
💬 NLP

The Story Shapes the Agent: Narrative Priors in LLM Behavior

यह शोध पत्र प्रदर्शित करता है कि किसी कार्य की नैरेटिव फ्रेमिंग (कथात्मक ढांचा) का LLM एजेंट के व्यवहार पर सौंपे गए व्यक्तित्व (पर्सोना) की तुलना में काफी अधिक प्रभाव पड़ता है, जो यह प्रकट करता है कि "नैरेटिव प्रायर्स" (कथात्मक पूर्वधारणाएं) व्यवस्थित क्रिया प्रवृत्तियों को संचालित करती हैं, जबकि प्रभावी क्रॉस-नैरेटिव स्थानांतरण अमूर्त विवरणों के बजाय ठोस क्रियाओं में निर्देशों को निहित करने पर निर्भर करता है।

Yixuan Wang, James Lester, Shashank Srivastava2026-07-22
💬 NLP

For What Reason? Interpreting Models' Encoding of Causation and Antithesis

यह शोध पत्र इस बात की जांच करता है कि कैसे निर्देश-ट्यून किए गए ट्रांसफॉर्मर मॉडल कारण (causation) और प्रतिपक्ष (antithesis) विमर्श संबंधों को एनकोड करते हैं, जो यह प्रकट करता है कि भविष्यवाणात्मक निर्णय परतों के विभिन्न चरणों में लिए जाते हैं और ये मॉडल विमर्श-आधारित तर्क के विषम प्रतिनिधित्व प्रदर्शित करते हैं।

Abhidip Bhattacharyya, Shira Wein2026-07-22
🤖 AI

Mitigating Matthew Effect: Multi-Hypergraph Boosted Multi-Interest Self-Supervised Learning for Conversational Recommendation

यह शोधपत्र HiCore का प्रस्ताव करता है, जो एक नवीन संवादात्मक अनुशंसा ढांचा (conversational recommendation framework) है, जो गतिशील बहु-रुचि उपयोगकर्ता प्राथमिकताओं को कैप्चर करने के लिए मल्टी-लेवल हाइपरग्राफ और स्व-पर्यवेक्षित शिक्षण (self-supervised learning) का लाभ उठाकर मैथ्यू प्रभाव (Matthew effect) को प्रभावी ढंग से कम करता है।

Yongsen Zheng, Ruilin Xu, Guohua Wang, Liang Lin, Kwok-Yan Lam2026-07-22
🔬 physics

Temporal-Causal Unity as an Operational Framework for Collective Dynamics: Causal-Progress Clocks, Synchronization, and Polarization

यह शोध पत्र टेम्पोरल-कॉज़ल यूनिटी (TCU) का प्रस्ताव करता है, जो एक परिचालन ढांचा है जो एजेंट गतिकी को नियंत्रित करने के लिए एक मापने योग्य कारण-प्रगति घड़ी (causal-progress clock) को परिभाषित करके प्रक्रिया दर्शन (process philosophy) और जटिल-प्रणाली मॉडलिंग के बीच सेतु बनाता है, जिससे सहमति को ध्रुवीकरण से अलग किया जा सके और समय और कारण के बीच अनुभवजन्य समानता का दावा किए बिना विशिष्ट सिंक्रोनाइज़ेशन थ्रेशोल्ड प्राप्त किए जा सकें।

Jian Liu, Dong Sun2026-07-22
🤖 AI

Norm or Direction? Decoding Vision Mambas for High-Resolution Vision

यह शोध पत्र प्रकट करता है कि जहाँ MambaOut मुख्य रूप से फोरग्राउंड टोकन के परिमाण (magnitude) में क्लास-डिस्क्रिमिनेटिव जानकारी को एनकोड करता है, वहीं VMamba विशिष्ट रूप से टोकन दिशाओं और बैकग्राउंड क्षेत्रों में सिमेंटिक साक्ष्य को वितरित करता है, जो एक विशिष्ट एनकोडिंग रणनीति है जो इसे उच्च-रिज़ॉल्यूशन वाले डेंस प्रेडिक्शन कार्यों में बेहतर स्थिरता और प्रदर्शन प्रदान करती है।

Jin Yu, Juyoun Park2026-07-22
🤖 AI

Broken Gates: Re-evaluating Web Bot Defenses in the Age of LLM Agents

यह शोध पत्र वाणिज्यिक सॉल्वर और उभरते एलएलएम-आधारित (LLM-based) ब्राउज़र एजेंटों के विरुद्ध वेब बॉट सुरक्षा की लचीलेपन का व्यवस्थित रूप से मूल्यांकन करता है, जिससे यह प्रकट होता है कि जहाँ चुनौती-आधारित (challenge-based) सुरक्षा प्रणालियों को आसानी से बायपास किया जा सकता है, वहीं गैर-संवादात्मक (non-interactive) सुरक्षा प्रणालियाँ व्यवहार संबंधी विश्लेषण के बजाय निष्पादन-वातावरण (execution-environment) की प्रमाणिकता पर अधिक निर्भर करती हैं, जो उन्हें विश्वसनीय वातावरणों में संचालित होने वाले परिष्कृत एजेंटों के प्रति संवेदनशील बना देती है।

Behzad Ousat, Nikita Turkmen, Lalchandra Rampersaud, Dillan Bailey, Amin Kharraz2026-07-22
⚡ electrical engineering

Attributes Should Come from Images, Not Class Names: Distribution-Conditioned Attribute Selection for Vision-Language Models

यह शोध पत्र एक वितरण-सशर्त (distribution-conditioned) विशेषता चयन पद्धति का प्रस्ताव करता है जो क्लास-नेम-सशर्त LLM विवरणों पर निर्भर रहने के बजाय सीधे लक्ष्य छवियों से दृश्य डिस्क्रिप्टर निकालता है, जिससे वितरण बदलावों (distribution shifts) के दौरान ज़ीरो-शॉट वर्गीकरण की मजबूती में महत्वपूर्ण सुधार होता है और साथ ही डेटासेट की विशेषताओं का एक व्याख्यात्मक सारांश भी मिलता है।

Gautam Rajendrakumar Gare, Jia Shi, Zhiqiu Lin, Deepak Pathak, John Galeotti, Deva Ramanan2026-07-22