🤖 AI

OmniMapBench: Benchmarking Visual-Centric Reasoning on Diverse Map Documents

OmniMapBench एक नया बेंचमार्क है जिसमें विविध मानचित्र दस्तावेजों में से 2,000 से अधिक मैन्युअल रूप से एनोटेट किए गए प्रश्न-उत्तर जोड़े शामिल हैं, जिसे विजुअल डिपेंडेंसी इंडेक्स को पेश करके अपरिहार्य विजुअल ग्राउंडिंग को मापने और लार्ज विजन-लैंग्वेज मॉडल्स में विजुअल-केंद्रित तर्क को विकसित करने और मूल्यांकन करने के लिए डिज़ाइन किया गया है।

Yang Chen, Yunwen Li, Yufan Shen, Minghao Liu, Tianyu Zheng, Bin Fu, Qunshu Lin, Zhi Yu, Botian Shi2026-07-13
🤖 AI

Neuro-Agentic Control: A Deep Learning-based LLM-Powered Agentic AI Framework for Controlling Security Controls

यह शोध पत्र एक न्यूरो-एजेंटिक कंट्रोल फ्रेमवर्क पेश करता है जो एक LLM-आधारित प्लानर को टाइम-सीरीज फाउंडेशन मॉडल और एक काउंटरफैक्चुअल फिजिक्स इंजेक्शन मैकेनिज्म के साथ जोड़ता है ताकि औद्योगिक IoT वातावरण में साइबर हमलों के विरुद्ध सुरक्षित, भौतिकी-आधारित स्वायत्त रक्षा सक्षम की जा सके, जो असुरक्षित मतिभ्रम (hallucinated) कार्यों को समाप्त करते हुए घुसपैठ को प्रभावी ढंग से रोकता है।

Saroj Gopali, Bipin Chhetri, Deepika Giri, Sima Siami-Namini, Akbar Siami Namin2026-07-13
🤖 AI

L-MAD: A Systematic Evaluation of Multi-Agent Debate Structures in Legal Reasoning

यह शोध पत्र कानूनी तर्क में मल्टी-एजेंट डिबेट संरचनाओं का मूल्यांकन करने के लिए L-MAD ढांचे को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि विशेषज्ञ व्यक्तित्व (expert personas) सौंपने से सटीकता में सुधार होता है, जबकि एक महत्वपूर्ण ट्रेड-ऑफ भी प्रकट होता है जहाँ एजेंटों की बढ़ती संख्या विसंगति को कम करती है लेकिन विस्तारित चर्चा दौर हानिकारक अति-विमर्श विचलन (over-deliberation drift) का कारण बनते हैं।

Tan-Minh Nguyen, Hoang-Trung Nguyen, Huu-Dong Nguyen, Dinh-Truong Do, Thi-Hai-Yen Vuong, Le-Minh Nguyen2026-07-13
🤖 AI

IB-Flow: Information Bottleneck-Guided CFG Distillation for Few-Step Text-to-Image Generation

IB-Flow एक नवीन फ्यू-स्टेप टेक्स्ट-टू-इमेज जनरेशन फ्रेमवर्क है जो स्टैटिक, ब्लाइंड क्लासिफायर-फ्री गाइडेंस डिस्टिलेशन को इंस्टेंस-अवेयर टारगेट सिलेक्शन और एंट्रॉपी-अवेयर स्ट्रेंथ शेड्यूलिंग वाले ड्यूल-ट्रैक अडैप्टिव मैकेनिज्म से बदलने के लिए इंफॉर्मेशन बॉटलनेक सिद्धांत का लाभ उठाता है, जिससे ओवर-कंडीशनिंग आर्टिफैक्ट्स समाप्त हो जाते हैं और केवल दो स्टेप्स में स्टेट-ऑफ-द-आर्ट फिडेलिटी प्राप्त होती है।

Yiting Wang, Jingyi Zhang, Wenhu Zhang, Ke Chao, Yves Liang, Kun Cheng, Kang Zhao2026-07-13
🤖 AI

KV-PRM: Efficient Process Reward Modeling via KV-Cache Transfer for Multi-Agent Test-Time Scaling

KV-PRM एक कुशल प्रोसेस रिवॉर्ड मॉडल है जो टेक्स्ट-आधारित री-एनकोडिंग की कम्प्यूटेशनल बाधा को समाप्त करने के लिए सीधे प्री-कंप्यूटेड KV कैश का लाभ उठाता है ताकि स्कोरिंग जटिलता को O(L²) से घटाकर O(L) किया जा सके, जिससे कई रीजनिंग बेंचमार्क में मौजूदा तरीकों के बराबर या उनसे बेहतर प्रदर्शन करते हुए गति और मेमोरी में भारी लाभ प्राप्त होता है।

Peng Kuang, Haibo Jin, Xiaoyu Han, Yanli Wang, Xiaopeng Yuan, Ye Yu, Kaidi Xu, Haohan Wang2026-07-13
🤖 AI

Scoped Verification for Reliable Long-Horizon Agentic Context Evolution under Distribution Shift

यह शोध पत्र ग्राफ-रेगुलराइज्ड एजेंटिक कॉन्टेक्स्ट इवोल्यूशन (GRACE) प्रस्तुत करता है, जो अपडेट के स्थानीय सत्यापन को सक्षम करने के लिए निरंतर सिस्टम निर्देशों को टाइप किए गए सिमेंटिक ग्राफ के रूप में संरचित करता है, जिससे फ्लैट-टेक्स्ट बेसलाइन की तुलना में डिस्ट्रीब्यूशन शिफ्ट के तहत एलएलएम (LLM) एजेंटों की लॉन्ग-होरिज़न विश्वसनीयता में महत्वपूर्ण सुधार होता है।

Dan C. Hsu, Luke Lu2026-07-13
🔢 mathematics

Generative Communications: Overview, Technologies, and Trends

यह शोध पत्र जेनेरेटिव कम्युनिकेशंस (GenCom) को एक नए 6G प्रतिमान (paradigm) के रूप में प्रस्तुत करता है जहाँ बड़े AI मॉडल अर्थ संबंधी समझ और सामग्री निर्माण को संचालित करते हैं, जो संचार को बिट-दर-बिट ट्रांसमिशन के बजाय नियंत्रित संश्लेषण (controlled synthesis) के रूप में पुनर्परिभाषित करते हैं ताकि अत्यंत कुशल, सुदृढ़ और बुद्धिमान नेटवर्किंग प्राप्त की जा सके।

Wenjun Zhang, Zhiyong Chen, Tong Wu, Guo Lu, Li Song, Feng Yang, Meixia Tao2026-07-13
🔬 materials science

Toward Auditable AI Scientists: A Hypothesis Evolution Protocol for LLM Agents

यह शोध पत्र हाइपोथीसिस इवोल्यूशन प्रोटोकॉल (HEP) को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो लार्ज लैंग्वेज मॉडल एजेंटों को परिकल्पना सृजन, परीक्षण और विश्वास संशोधन के लिए स्पष्ट, ऑडिट योग्य संचालन से सुसज्जित करता है, जिससे पारदर्शी और सत्यापन योग्य एआई-संचालित वैज्ञानिक खोज सक्षम होती है।

Izumi Takahara, Teruyasu Mizoguchi2026-07-13
🤖 machine learning

Interference and Retention in Continual Learning

यह शोध पत्र इंटरफेरेंस-गेटेड फंक्शनल एलोकेशन (IGFA) प्रस्तावित करता है, जो एक रिप्ले-फ्री कॉन्टिनुअल लर्निंग पद्धति है जो विस्मरण (forgetting) को टास्क इंटरफेरेंस एनर्जी के रूप में मॉडल करती है ताकि विभाज्य कार्यों के लिए इसे संरचनात्मक रूप से समाप्त किया जा सके और संघर्षरत कार्यों के लिए रिटेंशन और प्लास्टिसिटी के बीच इष्टतम संतुलन बनाया जा सके।

Julius Störk2026-07-13
🤖 AI

LLMs for health: Perceived benefits, risks, intention to use AI chatbots, and willingness to self-disclose across sensitive health topics

1,388 डच प्रतिभागियों के एक अध्ययन के आधार पर, यह शोध पत्र पाता है कि स्वास्थ्य संबंधी पूछताछ के लिए एआई चैटबॉट्स का उपयोग करने का इरादा और संवेदनशील जानकारी को स्वयं प्रकट करने की इच्छा मुख्य रूप से कथित लाभों, कथित जोखिमों और व्यक्तिगत विशेषताओं द्वारा संचालित होती है, न कि चर्चा किए गए स्वास्थ्य विषय के विशिष्ट प्रकार या संवेदनशीलता द्वारा।

Gwenn Beets, Anniek Jansen, Saar Hommes, Ruben D. Vromans, Leonie Westerbeek, Supraja Sankaran, Julia C. M. van Weert, E (…)2026-07-13